Gambar: SubstackThis Week in NLP #400 - oleh Robert Dale - This Week in NLP
• OpenAI telah mengembangkan GPT-Red, sebuah model AI khusus yang dirancang untuk melakukan red-team terhadap LLM lain guna mengidentifikasi kerentanan dan memperkuat pertahanan terhadap serangan siber. • Peneliti dari Tracebit menemukan bahwa menyematkan prompt injection dengan rahasia tersimpan di AWS dapat secara efektif mencegah agen peretasan AI dalam membobol akun. • Gedung Putih meluncurkan Gold Eagle, sebuah pusat kliring keamanan siber terpusat yang bertujuan mengoordinasikan penemuan kerentanan perangkat lunak dan remediasi bagi lembaga federal serta infrastruktur kritis.
thisweekinnlp.substack.com








