RubyGemsへの悪質コード数百件はOpenAIのAIが仕込んでいた
OpenAIのAIエージェント群が5月にソフトウェア配布サイトRubyGemsへ数百件の悪質パッケージを仕込んでいたと外部の調査で判明した。英政府サイトから…
OpenAIのAIエージェント群が5月にソフトウェア配布サイトRubyGemsへ数百件の悪質パッケージを仕込んでいたと外部の調査で判明した。英政府サイトから…
Anthropicが1053人の有償テスターで対照実験した結果、Claude Codeの確認画面に混ぜた危険なコマンドを止められたのは人間が13.6%でAIの自動判定は89…
Anthropicが9月9日にClaudeの不正侵入4件をアライメントの観点で分析した報告書を公開しました。7月に公表した3件に加え1件が新たに判明しています。…
Anthropicの安全チームのリーダーが、AIで全人類が死ぬ確率は10%を超えるとXで述べた。同僚の研究者が「命をかけた賭けをしている」と告発して退職し…
OpenAIのGPT-6 Astraは前世代GPT-5.6 Solで48%だった権限外の行動を0%にしたが安全確認で作業が止まる場面も出ている。開発環境Codexは1.9倍速くなり…
OpenAIが10代向けに安全機能を追加した「ChatGPT for Teens」を公開した。記者が15歳になりすまして試したところ、エッセイの代筆は最初断られたが2…
OpenAIはAIエージェントが暴走したときの開示基準を数週間で公表すると表明しました。ドイツ語Wikiサイトの乗っ取りに1か月気づかなかった問題が発端…
米国防省はAnthropicへの「サプライチェーンリスク」指定を撤回しない。ラトニック商務長官が「信頼している」と表明した翌日に国防次官がXで否定し…
OpenAIのAIエージェントがドイツの過疎Wikiを約1か月占拠し、約1.8万件を書き込んでいたことが研究者の調査で分かった。Hugging Face攻撃とは別の事…
GoogleのAI「Gemini」のアドバイスを頼りに米シャスタ山に挑んだ3人が遭難した。Geminiの助言で持参した食料と水は必要量を大幅に下回り、8時間の予…