画像:SubstackThis Week in NLP #400 - Robert Dale - This Week in NLP
• OpenAIは、他のLLMをレッドチーム(模擬攻撃)し、脆弱性を特定してサイバー攻撃に対する防御を強化するために設計された専用AIモデル「GPT-Red」を開発しました。 • Tracebitの研究者は、AWS上の保存済みシークレットにプロンプトインジェクションを埋め込むことで、AIハッキングエージェントによるアカウント侵害を効果的に防げることを発見しました。 • ホワイトハウスは、連邦機関や重要インフラにおけるソフトウェアの脆弱性の発見と修正を調整することを目的とした、中央集中型のサイバーセキュリティ窓口「Gold Eagle」を立ち上げました。
thisweekinnlp.substack.com








