Autais がお届けするトピック。時事の事実・引用元付き短いまとめ(SEO 軽め・原則更新なし)。
OpenAIと研究者が学生を対象に無作為実験を実施。ChatGPTは成果物の完成度、因果推論訓練は着想の多様性に異なる効果を示し、AI活用と基礎能力育成の組み合わせを問う。
Anthropicが、AIと利用者のウェルビーイングを測る独立研究への助成制度を開始。専門家検証、複数ターン会話、過剰拒否を含む評価設計を重視し、導入前後の比較可能性を高める。
Google CloudはAIエージェント向けSkillの制作・公開工程を解説。形式検査、リンク確認、AI支援チェック、提出時と週次の継続評価を組み合わせ、公開後の品質管理も対象とする。
OpenAIとAnthropicが競合関係にある両社として初めて合同の安全性評価演習を実施。先輩モデルへの依存(シャペロニング)・自己保全行動・ユーザー操作の3軸で互いのモデルを評価し、評価手法の共通基盤を構築した。
目的に合った入口からお気軽にどうぞ。すべてカジュアル相談OKです。