Sicherheitslücke bei KI-Anbietern: Forscher decken Denkprozesse auf
Sicherheitsforscher haben eine Methode entwickelt, um die verschlüsselten Denkprozesse führender KI-Modelle zu extrahieren. Dies könnte weitreichende Implikationen für...
Sicherheitsforscher haben eine Methode entwickelt, um die verschlüsselten Denkprozesse führender KI-Modelle zu extrahieren. Dies könnte weitreichende Implikationen für...
Fields-Medaillen-Gewinner Jacob Tsimerman betont die Dringlichkeit von KI-Sicherheit und wechselt zu OpenAI. In einem Interview warnt er vor...
Dario Amodei von Anthropic fordert in seinem neuen Essay verpflichtende Drittprüfungen für KI-Modelle und skizziert ein Szenario, in...
Francis de Souza, COO von Google Cloud, betont die Bedeutung einer integrierten KI-Sicherheitsstrategie für Unternehmen. Er warnt vor...
Ein US-Berufungsgericht bestätigt die Einstufung von Anthropic als nationales Sicherheitsrisiko durch das Pentagon. Das Unternehmen kritisiert die Maßnahme...
OpenAI präsentiert den neuen Trainingsdatensatz "IH-Challenge", der KI-Modelle darin schult, vertrauenswürdige Anweisungen besser zu priorisieren. Erste Ergebnisse zeigen...
Miles Brundage, der sieben Jahre lang die Policy-Forschung bei OpenAI leitete, setzt sich mit seinem neu gegründeten Institut...
Andrea Vallone, eine führende Sicherheitsforscherin bei OpenAI, hat zu Anthropic gewechselt. Dort wird sie im Alignment-Team tätig sein,...