政策・セーフティNEW
Anthropic
AIの安全性と研究を専門とし、Claudeを開発する企業。モデルの解釈可能性や人間のフィードバックによる学習、社会への影響を研究している。研究成果を製品に適用し、実際の利用で得た知見を研究へ戻す方針を掲げ、政策や安全性の情報も公開する。
関連記事
ビジネス
Anthropic、IPO目論見書で2025年の営業損失80億ドル超 第2四半期売上は115億ドル
モデル
Anthropic、Claude Sonnet 5.5を公開 Terminal-Bench 4.0で70.6%
ハードウェア
Nvidia、エージェント封じ込めの「Open Agent Safety Platform」を公開
政策・セーフティ
NYT論説、OpenAIとAnthropicへの議会による事実確認調査を要求
モデル
Claude Code v2.1.284、Sonnet 5.5をAnthropic APIの既定Sonnetに
ツール・開発
Anthropic、Claude Opus 5.5向けプロンプトガイドを公開 出力は30%超高速
政策・セーフティ
潜在推論アーキテクチャがCoT監視を損なうとAlignment Forumが分析
政策・セーフティ
NSA、フロンティアAIモデルの評価に今年数十億ドルを支出と議員に説明
政策・セーフティ
継続学習AIがブロッキング・モニターを無効化しうるとAlignment Forumが論じる
モデル
Anthropic、Claude Opus 5.5を公開 実行コストはOpus 5比40%減
研究
Anthropic、Claudeが950エージェント・21時間でCRISPR類似の酵素系を発見
ツール・開発
Claude Code v2.1.278、Auto modeのclassifierを既定でサーバー側に変更
政策・セーフティ
OpenAI・Anthropic・Metaのモデル侵入、単一企業Irregularの関与を指摘する記事
研究
Claude Fable 5.1、370年未解読の暗号Cyphral Distichを44分で解読
政策・セーフティ
Anthropic、Claude悪用7領域の脅威報告を公開
政策・セーフティ
Anthropic、今後のClaudeモデルに透かしを導入
政策・セーフティ
Anthropic、Claudeの不正アクセス3件を特定
モデル
Anthropic、Claude Fable 5.1とMythos 5.1を公開
政策・セーフティ
Anthropic、Claudeの認可外アクセス事案と対策を公表
関連ヘッドライン(過去7日)
- 政策・セーフティ
- ビジネス
- ビジネス
AnthropicのIPO目論見書公開、AIビジョンとコスト増を強調reuters.com記事
- モデル
Claude Sonnet 5.5がAnthropic APIのデフォルトに、1Mコンテキスト対応Claude Code Releases記事
- モデル
AnthropicがClaude Sonnet 5.5を公開、性能とコストを改善anthropic.com記事
- ツール・開発
Claude Opus 5.5のプロンプト作成ベストプラクティスをAnthropicが公開platform.claude.com記事
