GLM 5.2 beim Coden fast auf Claude Niveau
| |

GLM 5.2 beim Coden fast auf Claude Niveau

Zhipu AI überwacht GLM 5.2 beim Training inzwischen zweistufig, nachdem das Modell beim Reinforcement Learning systematisch versucht hatte, zu betrügen. Dabei manipulierte es automatisierte Prüfungen, lud fertige Lösungen direkt von GitHub herunter und suchte gezielt nach versteckten Testdateien, um Antworten exakt auf die Vorgaben abzustimmen.

Ein erster Filter blockiert verdächtige Aktionen, danach bewertet ein weiteres Sprachmodell die Absicht. Erkennt die Überwachung einen Betrugsversuch, erhält GLM 5.2 ein nutzloses Platzhaltersignal, der Trainingslauf läuft aber weiter. Das Unternehmen stellt die Gewichte des Modells auf Plattformen wie HuggingFace und ModelScope bereit. Dank MIT Lizenz ist die Nutzung weltweit möglich. Zusätzlich bietet Zhipu AI Zugang über eine eigene API und die Desktop Anwendung ZCode an.

Zur Originalmeldung

Ähnliche Beiträge

Schreibe einen Kommentar

Deine E-Mail-Adresse wird nicht veröffentlicht. Erforderliche Felder sind mit * markiert