モデル
METR
AIモデルの能力とリスクを評価する研究組織。研究やアプリ開発などの作業をAIが自律的にどこまで実行できるかを調べ、長い作業の完遂能力やソフトウェア開発の生産性を検証する。自律的なAIが生む重大なリスクを測る科学的方法を開発し、研究や評価結果を公開する。
関連記事
政策・セーフティ
Anthropic、Claudeの認可外アクセス事案と対策を公表
関連ヘッドライン(過去7日)
- 政策・セーフティ
AIモデルの能力とリスクを評価する研究組織。研究やアプリ開発などの作業をAIが自律的にどこまで実行できるかを調べ、長い作業の完遂能力やソフトウェア開発の生産性を検証する。自律的なAIが生む重大なリスクを測る科学的方法を開発し、研究や評価結果を公開する。