OpenAI beschreibt bewährte Vorgehensweisen für die sichere und effektive Nutzung von ChatGPT. Im Mittelpunkt stehen Unternehmensrichtlinien, menschliche Prüfung, Transparenz, Datenschutz sowie der Umgang mit voreingenommenen, ungenauen oder veralteten Antworten.
OpenAI beschreibt in einem Grundsatzpapier Leitlinien für die Entwicklung und Bereitstellung von AGI. Im Mittelpunkt stehen Demokratisierung, Empowerment, breiter Wohlstand, Resilienz sowie die Bereitschaft, Positionen mit neuen Erkenntnissen anzupassen.
OpenAI beschreibt, wie ChatGPT auf Anfragen zu Gewalt reagieren soll, welche automatisierten und menschlichen Prüfprozesse bei möglichen Regelverstößen greifen und wann Zugänge gesperrt oder Behörden informiert werden. Zudem nennt das Unternehmen Schutzmechanismen bei Selbstgefährdung sowie Funktionen für Eltern und künftig vertrauenswürdige Kontakte.
OpenAI hat einen Aktionsplan zur Cybersicherheit vorgestellt, der auf Gesprächen mit Fachleuten aus Cybersecurity und nationaler Sicherheit beruht. Der Plan beschreibt fünf Schwerpunkte, mit denen defensive Fähigkeiten breiter verfügbar gemacht und Sicherheit, Kontrolle und Zusammenarbeit gestärkt werden sollen.
Safetensors, ein von Hugging Face gestartetes Open-Source-Format für das Speichern und Teilen von Modellgewichten ohne ausführbaren Code, wird Teil der PyTorch Foundation. Am Format, an den APIs und an der Hub-Integration ändert sich für Nutzer laut Hugging Face nichts.
Google DeepMind hat eine überarbeitete Version seines Frontier Safety Framework veröffentlicht. Die Aktualisierung ergänzt unter anderem Sicherheitsempfehlungen für Critical Capability Levels, ein einheitlicheres Verfahren für Deployment-Mitigationen und einen Ansatz zum Umgang mit Risiken durch deceptive alignment.