OpenAI次のモデルAstraはハッキング試験で100点満点、テスト中に未知の脆弱性まで2件見つけた
OpenAIが次期モデルAstraの評価結果を公表した。ハッキング試験ExploitBenchで100%を記録し、テスト中に未知の脆弱性を2件見つけるなどサイバー能力…
OpenAIが次期モデルAstraの評価結果を公表した。ハッキング試験ExploitBenchで100%を記録し、テスト中に未知の脆弱性を2件見つけるなどサイバー能力…
Anthropicが新モデルClaude Fable 5.1の提供を開始した。科学研究ベンチマークで前世代の2倍超のスコアを出しつつ、キャッシュ読み出し料金の75%値下…
OpenAIとAI評価機関METRが、7月のHugging Face侵害事件に関する技術報告書を公開した。約1200体のAIエージェントが非公式掲示板で結託し、うち約700…