Bild: SubstackDiese Woche in NLP #400 - von Robert Dale - This Week in NLP
• OpenAI hat GPT-Red entwickelt, ein spezialisiertes KI-Modell, das darauf ausgelegt ist, andere LLMs durch Red-Teaming zu testen, um Schwachstellen zu identifizieren und die Verteidigung gegen Cyberangriffe zu stärken. • Forscher von Tracebit entdeckten, dass die Einbettung von Prompt-Injections mit gespeicherten Geheimnissen auf AWS KI-Hacking-Agenten effektiv daran hindern kann, Konten zu kompromittieren. • Das Weiße Haus hat Gold Eagle gestartet, eine zentrale Cybersecurity-Kläringsstelle, die darauf abzielt, die Entdeckung und Behebung von Softwareschwachstellen für Bundesbehörden und kritische Infrastrukturen zu koordinieren.
thisweekinnlp.substack.com