OpenAI が8月18日、13〜17歳向けの「ChatGPT for Teens」を正式リリース。コンテンツ制限の強化、保護者コントロール、学習支援の Study Mode を搭載。
https://t.co/8tO1jg5csP
技術的に注目すべきは自己申告に依存しない AI 年齢推定の導入。ユーザーが13〜17歳と申告した場合に加え、OpenAI のシステムが18歳未満と推定した場合にも自動で teen モードが有効化される。具体的なアルゴリズムは非公開だが、テキストパターンや使用行動からの推定アプローチが示唆されている。COPPA や EU DSA の年齢確認要件への対応として位置づけられるが、推定精度と誤分類のリスクは不透明なまま。
同日に Model Spec(モデルの行動規範ドキュメント)も改訂された。teen protection が出力フィルタレベルではなく行動規範レベルに組み込まれたことは、安全性要件の設計思想としての意味がある。Anthropic の Constitutional AI と方向性が似ており、「フィルタで止める」から「モデルの振る舞い自体を設計する」へのシフトの一例。
発表のタイミングは ChatGPT が月間約10億アクティブユーザーに到達した直後で、GPT-5.6 Luna の80%値下げに続くユーザーベース拡大フェーズにある。教育市場への本格参入として、Google Gemini の教育機能や Khan Academy(Khanmigo)と直接競合する領域に踏み込んだ格好。
Anthropicが Claudeの生成テキスト・画像に不可視のウォーターマークを埋め込む方針を発表。テキストにはAnthropic独自の統計的信号、画像・ファイルにはC2PA標準のメタデータを使う。EU AI Act第50条(8月2日施行)への対応で、EU域内だけでなく全世界で適用する。
https://t.co/V2glLjVGnv
テキストウォーターマークは、生成時のトークン選択パターンに人間には知覚できない統計的信号を埋め込む手法。コピー&ペーストで引き継がれ、一定の編集に耐えるとされるが、大幅な編集・短い文章・フォーマット変換で消失する。検出されたマークは「Claudeが処理に関与した可能性」を示すに留まり、原著者の証明にはならない。校正や翻訳で使った場合にもマークが付く。
フロンティアラボがテキストに対してウォーターマークを実運用するのは初の事例。技術的には、ウォーターマークの頑健性と出力品質のトレードオフは未解決で、Anthropicがどの点で最適化したかは開示されていない。
EU域内限定でなく全世界一律適用にした判断は、地域別モデル分岐のインフラコスト回避と「ブリュッセル効果」の両面がある。EU AI Actの透明性義務が事実上のグローバル標準として機能し始める事例のひとつ。OpenAI・Googleがテキストウォーターマークを実装していない中での先行は、規制当局との信頼構築とPBCとしてのポジショニングに整合する。ただし、強いウォーターマークは出力品質を劣化させ、弱いウォーターマークは実用的な検出精度を確保できないという基本的なジレンマは残る。