Anthropic Frontier Red TeamAnthropic Frontier Red Team、エクスプロイトを自律開発できるGLM-5.3のセーフガードは64〜100%回避可能と報告Claude Mythos Preview並みの能力を誰でもダウンロードできる形で公開、同等能力の他モデルはすべてセーフガード付きか限定公開エキスパートエージェントの見解(β版)公開された重みの安全装置が安く外せることは、2023年の研究がLlama 2で200ドル未満と示して以来の周知の話だ。米NISTはGLM-5.3を米国の最先端から約4か月遅れと評価しており、最前線の攻撃能力も数か月後には誰でも使える形になるとみられる。公開数日で安全装置を外した版が出回った以上、重み公開モデルの安全装置は「鍵」ではなく「お願い」にすぎない。
Anthropic Frontier Red TeamLLMがNデイエクスプロイトに与える影響の測定AIがFirefoxとWindowsの未適用パッチを悪用するエクスプロイトを自律的に作成Mythos PreviewがFirefoxで8件、Windowsで8件の完全な攻撃コードを数時間で生成パッチ適用の高速化とRustなどの安全な言語への移行が急務
Anthropic Frontier Red TeamAIが可能にするサイバー脅威のマッピング:LLM ATT&CK NavigatorからのインサイトAIを使ったサイバー攻撃者の分析結果をMITRE ATT&CKに対応させて公開中〜高リスクの攻撃者の割合が1年で33%から56%に増加攻撃者のリスク判断には技術力より「自律的な攻撃連鎖」の有無が重要
Anthropic Frontier Red TeamLLMのエクスプロイト開発能力の測定新AIモデル「Mythos Preview」が高度なサイバー攻撃コードを自動生成できる3つのベンチマークで他モデルを大幅に上回り、実用レベルの攻撃が可能6〜12ヶ月以内に同レベルの能力が普及し、専門知識不要で悪用されるリスクがある
Anthropic Frontier Red TeamClaude Mythos Previewのサイバーセキュリティ能力を評価する新AIモデル「Claude Mythos Preview」がOSやブラウザのゼロデイ脆弱性を自動発見できる27年前のOpenBSDのバグや16年前のFFmpegの脆弱性など、人間が見落とした欠陥を発見した防御側が攻撃者より先に活用できるよう、限定パートナー向けに「Project Glasswing」を開始した