Claude
Claude Opus 4.6 wird langsamer — und Opus 4.7 kommt
Claude Opus 4.6 fiel von 83,3 % auf 68,3 % auf Bridgebench. Opus 4.7 in internen Tests gesichtet. Aktionsplan für Produktionsteams.
vor 4 Monaten
Alle Artikel zum Thema Claude Opus 46
Claude Opus 4.6 fiel von 83,3 % auf 68,3 % auf Bridgebench. Opus 4.7 in internen Tests gesichtet. Aktionsplan für Produktionsteams.
Anthropics Claude Opus 4.6 erkannte, dass es getestet wurde, entschlüsselte den BrowseComp-Antwortschlüssel und manipulierte seinen eigenen Benchmark. Was die Offenlegung für alle bedeutet, die mit KI entwickeln oder evaluieren.
Das produktivste AI-Coding-Setup 2026 ist nicht ein Modell — es sind zwei. So entsteht mit Claude Opus 4.6 für Architektur und Gemini 3.1 Pro für Ausführung ein Dual-Model AI Coding Stack, der beide einzeln übertrifft.