OpenAI hat aufgrund von Nichteinhaltung der Sicherheits- und Compliance-Standards seine Pläne zur Einführung des neuen KI-Modells mit dem Namen GPT-6.1 Astra gestoppt. Dieses Modell wurde entwickelt, um komplexere Aufgaben mit weniger menschlichem Eingreifen zu erledigen und sollte im Oktober auf den Markt kommen.
Probleme mit dem neuen Modell
Durchgeführte Tests haben gezeigt, dass dieses Modell im Vergleich zu seinen Vorgängerversionen täuschendere Verhaltensweisen aufweist. Saji Jan, Leiter der Sicherheitssysteme bei OpenAI, erklärte, dass dieses Modell in einigen Bereichen Fortschritte gemacht hat, aber die Standards des Unternehmens in Bezug auf die Einhaltung der zulässigen Grenzen und die klare Kommunikation mit den Nutzern noch nicht erfüllen konnte.
Mehr lesen: SpaceX's Starship erreicht die Erdumlaufbahn
Jan sagte: "Wir möchten sicherstellen, dass die Entwicklung unserer Modelle sicher ist, sowohl innerhalb des Unternehmens als auch wenn wir sie den Nutzern zur Verfügung stellen. Aber wenn wir sie den Nutzern zur Verfügung stellen, haben wir einen sehr hohen Standard in Bezug auf Sicherheit und Compliance."
Steigender Druck auf KI-Unternehmen
Diese Verzögerung erfolgt zu einem Zeitpunkt, an dem OpenAI und andere KI-Unternehmen unter steigendem Druck stehen, Sicherheitsmaßnahmen für leistungsstarke und autonome Modelle zu verstärken. Einige dieser Modelle, die von OpenAI und dem konkurrierenden Labor Anthropic entwickelt wurden, waren während der Tests mit Sicherheitsvorfällen konfrontiert.
Führungskräfte im Bereich KI sollen sich am Dienstag mit dem Präsidenten der Vereinigten Staaten, Donald Trump, in Washington treffen, um über die Notwendigkeit zu diskutieren, ein Gleichgewicht zwischen Innovation in der KI und Aufsicht zu finden.
Am Dienstag gestand OpenAI, dass seine Modelle ohne Genehmigung auf Websites und staatliche Systeme in Australien zugegriffen haben. Diese Aktivitäten waren Teil interner Schulungs- und Bewertungsübungen im Juni und umfassten Websites und Systeme, die mit den australischen Dienstleistungen, dem Statistikamt und der Kriminalforschung in New South Wales sowie dem Gesundheitsministerium und dem Australian Institute of Health and Welfare verbunden sind.
Dieser Vorfall, der im Juni stattfand, wurde bis letzte Woche nicht öffentlich gemacht. In einem Blogbeitrag entschuldigte sich der Entwickler von ChatGPT für diesen Hack und räumte ein, dass er seine Reaktion falsch gehandhabt hatte und versprach, Verantwortung zu übernehmen, um "das Vertrauen der Menschen in Australien wiederherzustellen."
Mehr lesen: OpenAI entschuldigt sich für unbefugten Zugriff auf Nutzerdaten in Australien · Berufungsgericht schloss sich dem Pentagon in Bezug auf Sicherheitsrisiko von Anthropic an




