RESEARCH 002 / DESIGN VERSION 0.1

日本でAIが何に使われ始めているか:初回調査プロトコル

日本でAIが何に使われ始めているかを調べるための、利用目的分類、利用日記、匿名化、集計、公開条件を定めた事前公開プロトコルです。

状態
事前公開 / 未調査
公開
更新
読了目安
約9分
編集
AEOLab.編集部
STATUSこのページは観測結果ではありません。利用実態の収集前に、何を集め、何を集めず、どの範囲まで結論にするかを固定するための設計書です。参加募集・データ取得はまだ開始していません。

調べたい問い

中心となる問いは「日本語利用者が、日常のどの場面で、何を達成するためにAIを使ったか」です。特定サービスの利用率だけではなく、利用目的と生活領域を掛け合わせて観測します。

  • 利用目的は、どうすれば/知る・学ぶ/調べる・整理/比較・おすすめ/文章・表現/計画・アイデア/相談・判断/作業・自動化の8分類。
  • 領域は、生活・家事/学び・勉強/買い物・選択/仕事・業務/旅行・移動/人間関係・表現/エンタメ・趣味/健康・セルフケアの8分類。
  • 質問が外部情報を必要とする度合いは、利用量とは別の補助属性として低・中・高で扱う。

一つの利用が複数目的に当てはまる場合は、利用者が達成したかった主目的を一つ選び、副目的を任意で保存します。分類者の推測だけで決めません。

初回は100人・7日間の探索調査

項目初回設計公開時の注意
参加者日本語でAIを利用する18歳以上、目標100人募集経路、年代、職種、利用頻度を併記
期間連続7日間の利用日記調査日と曜日、季節要因を記載
記録単位一つの目的を達成するための一連の利用会話の往復数では数えない
回答方法利用直後または当日中の短い自己記録記憶による誤差を限界として記載
位置づけ探索的なパイロット調査全国代表値・市場シェアとは表現しない

参加者100人は公開設計上の目標で、確保済みの人数ではありません。募集方法や予算によって変更する場合は、収集開始前にこのページを改訂します。

1回の利用で取得する項目

  1. 利用目的:8分類から主目的を選択。
  2. 生活領域:8分類から選択。
  3. 質問の要約:個人名、企業秘密、健康情報などを除き、本人が内容を一文で言い換える。
  4. 利用サービス:選択式。サービス名を公表したくない回答も許容。
  5. 結果:解決した/一部役立った/役立たなかった/確認できない。
  6. 外部確認:公式サイトや他の情報源を追加確認したか。
  7. 回答への対応:そのまま使った/修正した/参考だけにした/使わなかった。

AIとの会話全文、アップロードしたファイル、アカウント識別子は標準の取得項目に含めません。質問例の公開には、本人が公開用に要約した文章だけを使います。

利用者と利用回数を分けるDB設計

一人の参加者が文章作成を20回使い、別の参加者が比較を1回使った場合、回数だけを集計すると「文章作成が圧倒的に一般的」に見えます。そのため、参加者、利用記録、調査回、品質確認、公開集計を別のテーブルで管理します。

データ役割公開範囲
調査回期間、募集条件、同意文、方法論の版を固定条件を公開
参加者ランダムIDと大まかな属性、参加状態を管理個票は非公開
利用記録一回の利用目的、領域、結果、外部確認を保存匿名化した例のみ
品質確認重複、個人情報、分類不明のフラグを保存件数と基準を公開
公開調査出典、対象者、期間、元の設問と分類対応を保存出典つきで別系列表示
公開集計公開時点の分子、分母、抑制状態を固定少数セルを除き公開

DBはCloudflare D1で扱えるSQLite互換スキーマとして実装済みですが、現在はローカルの設計段階です。実際のD1作成と回答受付は、同意・削除・保存期限を確定してから行います。

プライバシーと安全性

自由記述には、本人や第三者の氏名、連絡先、勤務先の非公開情報、病歴などが混入する可能性があります。入力前に記載禁止項目を示し、回収後も機械的・人的な確認を行い、公開用データから除外します。

健康、法律、金融など高い正確性が求められる利用は、利用量と回答の正しさを分けて扱います。「多く使われている」ことを「AIだけで判断してよい」という推奨には変換しません。

BEFORE COLLECTION
実際に募集を始める前に、同意文、保存期間、削除依頼の窓口、アクセス権、個人情報が混入した場合の処理を確定します。これらが未確定の間は収集を開始しません。

公開する指標と最低条件

公開指標定義最低条件
利用目的率参加者のうち各目的で1回以上使った人の割合有効参加者数を分母として併記
利用構成比有効利用記録に占める各主目的の割合全体の有効記録数と参加者数を併記
継続利用率同じ目的の利用が複数週あった人の割合複数週の調査だけで算出
目的 × 領域目的と生活領域の組み合わせセルが少数の場合は統合または非表示
自己評価解決・一部有用・不採用などの回答正確性の客観評価とは呼ばない
外部確認率AI回答後に別の情報源を確認した割合回答者の自己申告として掲載
質問例本人が公開用に要約した代表例個人を推測できる内容を除外

少数回答から順位を作りません。初回調査と次回調査で募集経路や参加者構成が違う場合、単純な増減として比較せず、条件差を示します。

あらかじめ分かっている限界

  • 自発参加者は、一般人口よりAIへの関心や利用頻度が高い可能性がある。
  • 本人が要約した質問は、実際の入力文や会話の文脈を完全には再現しない。
  • 7日間では季節変動や一時的なニュースの影響を分離できない。
  • 役立ったという自己評価は、回答内容の事実上の正確性を保証しない。
  • この標本から日本全体の利用率や各サービスの市場シェアは推定しない。

これらの限界があるため、利用日記は「何が起きていそうか」を見つける探索データとして使い、対象者と設問を確認できる公開調査を別系列で並べます。分母の違う割合を合算した総合スコアは作りません。