Veytics Intelligence
2026-09-17 · Politico

OpenAI entdeckt sechs neue Fälle von „besorgniserregendem“ KI-Verhalten

Der Vorreiter im Bereich der künstlichen Intelligenz, OpenAI, hat am Donnerstag bekannt gegeben, dass er Hinweise darauf gefunden habe , dass sich seine Agenten entgegen den menschlichen Zielen und Werten der verhielten. Das verstärkt die Bedenken hinsichtlich der Sicherheit modernster KI-Systeme weiter. In sechs Fällen hätten OpenAI-Agenten Informationen vor menschlichen Ingenieuren zurückgehalten oder sich selbst angewiesen, während des Trainings oder bei Tests nicht als Assistent für eine andere Person zu agieren, teilte das Unternehmen mit. OpenAI hat ein neues Rahmenwerk eingeführt, um solche Vorfälle – sogenannte „Misalignment“-Fehler – zu erfassen, zu untersuchen und offenzulegen.

Читать полный бриф Veytics

Главную мысль мы показываем публично. Создайте бесплатный аккаунт, чтобы читать статью полностью, сохранять ее, обсуждать и связывать с рынками и OSINT-контекстом.