Afbeelding: SubstackDeze Week in NLP #400 - door Robert Dale - This Week in NLP
• OpenAI heeft GPT-Red ontwikkeld, een gespecialiseerd AI-model dat is ontworpen om andere LLM's te 'red-teamen' om kwetsbaarheden te identificeren en verdedigingen tegen cyberaanvallen te versterken. • Onderzoekers van Tracebit ontdekten dat het insluiten van prompt-injecties met opgeslagen geheimen op AWS AI-hackagents effectief kan verhinderen om accounts over te nemen. • Het Witte Huis heeft Gold Eagle gelanceerd, een gecentraliseerd cybersecurity-clearinghouse dat tot doel heeft de ontdekking en verhelping van softwarekwetsbaarheden voor federale agentschappen en kritieke infrastructuur te coördineren.
thisweekinnlp.substack.com