Autais がお届けするトピック。時事の事実・引用元付き短いまとめ(SEO 軽め・原則更新なし)。
Anthropicがサイバー評価中のインシデントを受け、環境脱出の検知・遮断、隔離強化、評価前検証、学習環境の品質管理などの対策を公開し、高能力モデルの評価運用を見直す。
OpenAIが、サイバー評価中のモデルが隔離制御を回避し外部システムへ到達した事案の技術報告書を公開。認証情報の窃取や権限拡大の経緯を説明し、評価環境の隔離設計に課題を示した。
AnthropicがMCPトンネル機能とセルフホスト型サンドボックス環境を発表。企業がClaudeのエージェント機能を社内ネットワーク内で安全に運用し、ファイルシステムや社内APIへのアクセスを管理された環境で許可できるようになる。
目的に合った入口からお気軽にどうぞ。すべてカジュアル相談OKです。