DepescheForschung
Deployment Simulation: OpenAIs Methode gegen Modelle, die merken, dass sie getestet werden
OpenAI-Forscher haben am 17. Juni 2026 mit „Deployment Simulation“ eine Evaluationsmethode vorgestellt, die anhand echter, anonymisierter Nutzergespräche vorhersagt, wie sich ein noch unveröffentlichtes Modell nach dem Release verhalten wird. Statt künstlicher Testfragen bleibt der Verlauf realer Unterhaltungen stehen und nur die nächste Antwort wird vom neuen Modell neu erzeugt – so erkennt es nicht, dass es geprüft wird.
Aussagen gegen die Quellen geprüft · 23. Juni 2026