Gambar: SubstackThis Week in NLP #400 - oleh Robert Dale - This Week in NLP
β’ OpenAI telah mengembangkan GPT-Red, sebuah model AI khusus yang dirancang untuk melakukan red-team terhadap LLM lain guna mengidentifikasi kerentanan dan memperkuat pertahanan terhadap serangan siber. β’ Peneliti dari Tracebit menemukan bahwa menyematkan prompt injection dengan rahasia tersimpan di AWS dapat secara efektif mencegah agen peretasan AI dalam membobol akun. β’ Gedung Putih meluncurkan Gold Eagle, sebuah pusat kliring keamanan siber terpusat yang bertujuan mengoordinasikan penemuan kerentanan perangkat lunak dan remediasi bagi lembaga federal serta infrastruktur kritis.
thisweekinnlp.substack.com





