調べたい問い
中心となる問いは「日本語利用者が、日常のどの場面で、何を達成するためにAIを使ったか」です。特定サービスの利用率だけではなく、利用目的と生活領域を掛け合わせて観測します。
- 利用目的は、どうすれば/知る・学ぶ/調べる・整理/比較・おすすめ/文章・表現/計画・アイデア/相談・判断/作業・自動化の8分類。
- 領域は、生活・家事/学び・勉強/買い物・選択/仕事・業務/旅行・移動/人間関係・表現/エンタメ・趣味/健康・セルフケアの8分類。
- 質問が外部情報を必要とする度合いは、利用量とは別の補助属性として低・中・高で扱う。
一つの利用が複数目的に当てはまる場合は、利用者が達成したかった主目的を一つ選び、副目的を任意で保存します。分類者の推測だけで決めません。
初回は100人・7日間の探索調査
| 項目 | 初回設計 | 公開時の注意 |
|---|---|---|
| 参加者 | 日本語でAIを利用する18歳以上、目標100人 | 募集経路、年代、職種、利用頻度を併記 |
| 期間 | 連続7日間の利用日記 | 調査日と曜日、季節要因を記載 |
| 記録単位 | 一つの目的を達成するための一連の利用 | 会話の往復数では数えない |
| 回答方法 | 利用直後または当日中の短い自己記録 | 記憶による誤差を限界として記載 |
| 位置づけ | 探索的なパイロット調査 | 全国代表値・市場シェアとは表現しない |
参加者100人は公開設計上の目標で、確保済みの人数ではありません。募集方法や予算によって変更する場合は、収集開始前にこのページを改訂します。
1回の利用で取得する項目
- 利用目的:8分類から主目的を選択。
- 生活領域:8分類から選択。
- 質問の要約:個人名、企業秘密、健康情報などを除き、本人が内容を一文で言い換える。
- 利用サービス:選択式。サービス名を公表したくない回答も許容。
- 結果:解決した/一部役立った/役立たなかった/確認できない。
- 外部確認:公式サイトや他の情報源を追加確認したか。
- 回答への対応:そのまま使った/修正した/参考だけにした/使わなかった。
AIとの会話全文、アップロードしたファイル、アカウント識別子は標準の取得項目に含めません。質問例の公開には、本人が公開用に要約した文章だけを使います。
利用者と利用回数を分けるDB設計
一人の参加者が文章作成を20回使い、別の参加者が比較を1回使った場合、回数だけを集計すると「文章作成が圧倒的に一般的」に見えます。そのため、参加者、利用記録、調査回、品質確認、公開集計を別のテーブルで管理します。
| データ | 役割 | 公開範囲 |
|---|---|---|
| 調査回 | 期間、募集条件、同意文、方法論の版を固定 | 条件を公開 |
| 参加者 | ランダムIDと大まかな属性、参加状態を管理 | 個票は非公開 |
| 利用記録 | 一回の利用目的、領域、結果、外部確認を保存 | 匿名化した例のみ |
| 品質確認 | 重複、個人情報、分類不明のフラグを保存 | 件数と基準を公開 |
| 公開調査 | 出典、対象者、期間、元の設問と分類対応を保存 | 出典つきで別系列表示 |
| 公開集計 | 公開時点の分子、分母、抑制状態を固定 | 少数セルを除き公開 |
DBはCloudflare D1で扱えるSQLite互換スキーマとして実装済みですが、現在はローカルの設計段階です。実際のD1作成と回答受付は、同意・削除・保存期限を確定してから行います。
プライバシーと安全性
自由記述には、本人や第三者の氏名、連絡先、勤務先の非公開情報、病歴などが混入する可能性があります。入力前に記載禁止項目を示し、回収後も機械的・人的な確認を行い、公開用データから除外します。
健康、法律、金融など高い正確性が求められる利用は、利用量と回答の正しさを分けて扱います。「多く使われている」ことを「AIだけで判断してよい」という推奨には変換しません。
BEFORE COLLECTION
実際に募集を始める前に、同意文、保存期間、削除依頼の窓口、アクセス権、個人情報が混入した場合の処理を確定します。これらが未確定の間は収集を開始しません。
公開する指標と最低条件
| 公開指標 | 定義 | 最低条件 |
|---|---|---|
| 利用目的率 | 参加者のうち各目的で1回以上使った人の割合 | 有効参加者数を分母として併記 |
| 利用構成比 | 有効利用記録に占める各主目的の割合 | 全体の有効記録数と参加者数を併記 |
| 継続利用率 | 同じ目的の利用が複数週あった人の割合 | 複数週の調査だけで算出 |
| 目的 × 領域 | 目的と生活領域の組み合わせ | セルが少数の場合は統合または非表示 |
| 自己評価 | 解決・一部有用・不採用などの回答 | 正確性の客観評価とは呼ばない |
| 外部確認率 | AI回答後に別の情報源を確認した割合 | 回答者の自己申告として掲載 |
| 質問例 | 本人が公開用に要約した代表例 | 個人を推測できる内容を除外 |
少数回答から順位を作りません。初回調査と次回調査で募集経路や参加者構成が違う場合、単純な増減として比較せず、条件差を示します。
あらかじめ分かっている限界
- 自発参加者は、一般人口よりAIへの関心や利用頻度が高い可能性がある。
- 本人が要約した質問は、実際の入力文や会話の文脈を完全には再現しない。
- 7日間では季節変動や一時的なニュースの影響を分離できない。
- 役立ったという自己評価は、回答内容の事実上の正確性を保証しない。
- この標本から日本全体の利用率や各サービスの市場シェアは推定しない。
これらの限界があるため、利用日記は「何が起きていそうか」を見つける探索データとして使い、対象者と設問を確認できる公開調査を別系列で並べます。分母の違う割合を合算した総合スコアは作りません。