// LINUX-MAGAZIN — LINUX & OPEN SOURCE
Claude programmiert Claude – zumindest zu einem Viertel
(C) unter Verwendung eines Motivs von Andrei Suslov / 123RF.com
In einem Blogpost hat Anthropic verschiedene Methoden vorgestellt, anhand derer sich die Entwicklungsgeschwindigkeit eines KI-Modells ablesen lassen soll.
Eine dieser Größen ist der Grad, in dem das Modell autonom an seiner eigenen Verbesserung arbeitet. Bei Clause sollen es im August 26 Prozent gewesen sein, im März waren es erst 1 Prozent. Um den Wert zu ermitteln, wurden alle Arten von Forschungs- und Entwicklungsaufgaben im Bereich KI erfasst, der aktuelle Automatisierungsgrad jeder Aufgabe bewertet und die Bewertungen anschließend zusammengefasst. Dafür wurde eine Skala von Epoch AI verwendet, die von AL0 (keine Einbindung von KI) bis AL5 (KI arbeitet vollständig autonom, ohne menschliches Eingreifen) reicht. In AL3 kooperiert die KI: Sie kann unter enger menschlicher Anleitung große Teile der Arbeit erledigen. In AL4 “leitet die KI”: Sie kann den Großteil der Aufgabe von Anfang bis Ende anhand einer übergeordneten Vorgabe erledigen, während der Mensch die Aufsicht übernimmt.
Anhand dieser Einteilung ergab sich: Claude arbeitet noch nirgendwo vollständig autonom, aber es leitet die Entwicklung in 26 Prozent der Fälle, der Anteil der Arbeit, bei denen es kooperiert, liegt bei über 90 Prozent.
Diese Zahlen könnte nach Ansicht von Anthropic jedes KI-Forschungslabor erheben und veröffentlichen. Dem stehen nur noch zwei Schwierigkeiten entgegen: zum einen der Mangel an einer allgemeinverbindlichen Methodologie, zum anderen der Umstand, dass die KI-Systeme wiederum durch KI-Systeme bewertet werden. Das könnte bedeuten, dass das beurteilende Modell dieselben Fehler machen könnte wie das Modell, das es überprüft. Um diesen Herausforderungen zu begegnen, könnten die Messungen eines Entwicklers durch eine dritte Partei oder durch Modelle anderer Entwickler verifiziert werden, wobei Schutzmaßnahmen ergriffen werden müssten, um den Austausch wettbewerbsrelevanter Daten zu begrenzen.
Der Fachkräftemangel wird zunehmend zum Sicherheitsrisiko: Mehr als drei Viertel der befragten IT-Security- und Führungsverantwortlichen sagen, dass sich der Personalmangel negativ auf die IT-Sicherheit ihrer Organisation auswirkt.
Die Fedora-Entwickler haben Fedora 45 für den Beta-Test freigegeben. Das stabile Release wird für Ende Oktober erwartet.
OpenAI hat ein Rahmenwerk veröffentlicht, das es in Zukunft verwenden will, um Fälle von Fehlausrichtung bei KI-Modellen zu verfolgen, zu untersuchen und bekanntzumachen. Zum Start werden sechs neue Fälle beschrieben.
Amazon hat vor Gericht verloren und muss bei Produktempfehlungen transparenter sein. Das Melden illegaler Inhalte darf nicht erschwert werden.
Der Firefox-Browser wird künftig mit KI-Funktionen von Mistral versorgt. Mozilla setzt dabei bewusst auf ein Open-Source-Produkt.