Neues Paradigma der Agentenbewertung: von einzelnen Benchmarks zu multidimensionalen Sicherheitsausrichtungstests
Anthropic und OpenAI haben neue Agentenbewertungssuiten veröffentlicht, die von einfacher Code-Vervollständigungsgenauigkeit auf mehrdimensionale Sicherheitsaspekte erweitert wurden.