OpenAI beschreibt bewährte Vorgehensweisen für die sichere und effektive Nutzung von ChatGPT. Im Mittelpunkt stehen Unternehmensrichtlinien, menschliche Prüfung, Transparenz, Datenschutz sowie der Umgang mit voreingenommenen, ungenauen oder veralteten Antworten.
OpenAI beschreibt in einem Grundsatzpapier Leitlinien für die Entwicklung und Bereitstellung von AGI. Im Mittelpunkt stehen Demokratisierung, Empowerment, breiter Wohlstand, Resilienz sowie die Bereitschaft, Positionen mit neuen Erkenntnissen anzupassen.
OpenAI hat für ChatGPT Enterprise und die API Platform eine FedRAMP-20x-Moderate-Autorisierung erreicht. Damit erhalten US-Bundesbehörden einen erweiterten Weg, die verwalteten KI-Produkte von OpenAI unter föderalen Anforderungen an Sicherheit, Datenschutz und Governance zu nutzen.
OpenAI beschreibt, wie ChatGPT auf Anfragen zu Gewalt reagieren soll, welche automatisierten und menschlichen Prüfprozesse bei möglichen Regelverstößen greifen und wann Zugänge gesperrt oder Behörden informiert werden. Zudem nennt das Unternehmen Schutzmechanismen bei Selbstgefährdung sowie Funktionen für Eltern und künftig vertrauenswürdige Kontakte.
OpenAI hat einen Aktionsplan zur Cybersicherheit vorgestellt, der auf Gesprächen mit Fachleuten aus Cybersecurity und nationaler Sicherheit beruht. Der Plan beschreibt fünf Schwerpunkte, mit denen defensive Fähigkeiten breiter verfügbar gemacht und Sicherheit, Kontrolle und Zusammenarbeit gestärkt werden sollen.
Google DeepMind hat eine überarbeitete Version seines Frontier Safety Framework veröffentlicht. Die Aktualisierung ergänzt unter anderem Sicherheitsempfehlungen für Critical Capability Levels, ein einheitlicheres Verfahren für Deployment-Mitigationen und einen Ansatz zum Umgang mit Risiken durch deceptive alignment.