Release: Claude Sonnet 5.5 – alle Infos zu Preis, Benchmarks und Einordnung
Anthropic hat Claude Sonnet 5.5 veröffentlicht: 2 / 10 $ pro Mio. Token, Opus-nahe Benchmarks, aber nur bei max-Effort. AA-Index 56 schlägt Astra.
boostN-App-News: Releases, Updates und Meldungen rund um die App und ihre KI-Workflows.
Anthropic hat Claude Sonnet 5.5 veröffentlicht: 2 / 10 $ pro Mio. Token, Opus-nahe Benchmarks, aber nur bei max-Effort. AA-Index 56 schlägt Astra.
OpenAI hat GPT-6.1 Sol veröffentlicht: 2 / 10 $ pro Mio. Token, fast Astra-Niveau bei Coding, aber im Gesamtindex hinter Anthropics Modellen.
Anthropic hat Claude Opus 5.5 veröffentlicht: 4 / 20 $ pro Mio. Token, rund 40 % günstiger als Opus 5 und in Coding-Benchmarks vor Fable 5.1.
Anthropic hat den 50%-Boost beendet. Seit 14. September, 9 Uhr MESZ, gelten dauerhaft +25% zur alten Basis – netto rund 17% weniger als zuvor.
Im Agenten-Chat öffnest du das umgesetzte Ergebnis jetzt als Preview und testest es direkt — ohne Git oder lokales Setup.
Zhipu AI veröffentlicht GLM-5.3 — ein Open-Weights-MoE mit Fokus auf Coding und Cybersecurity, das agentische Benchmarks unter den offenen Modellen anführt.
xAI veröffentlicht Grok 4.6 — 500k-Token-Kontext, Bild-Input und gestaffelter Preis ab 2/6 USD, ausgelegt auf langlaufende agentische Arbeit.
Meta veröffentlicht Muse Spark 1.3 — Nachfolger von 1.2 mit agentischem Coding und Thought Compression. Was neu ist, was es kostet und für wen es zählt.
DeepSeek veröffentlicht V4.1-Flash: in eigenen Coding-Tests vorn, bei Langläufer-Agentik weit hinten — zum Bruchteil des Preises der Konkurrenz.
Anthropic markiert alle Modelle ab dem 2. August 2026 mit Wasserzeichen. Fable 5.1 macht den Anfang. Was das kann, wo es versagt, wer prüfen darf.
Am 5. September stand das Wochenkontingent mitten im Arbeiten wieder bei 5%. Plus 50% Bonus bis zum 13.9. Was du mit der geschenkten Kapazität machst.
OpenAI hat GPT-6 Astra veröffentlicht — erstes Modell auf der Preparedness-Stufe Critical. Unabhängig getestet hat es bisher praktisch niemand.
Google veröffentlicht am 2. September 2026 Gemini 3.8 Flash — getunt für Agenten und Long-Horizon-Coding, gleicher Preis, der ab Januar 2027 steigt.
Anthropic hat Claude Fable 5.1 und Mythos 5.1 veröffentlicht. Basispreis bleibt, aber Cache-Reads sind 75% günstiger und der Verbrauch sinkt.
Juli bis August 2026 brachte eine Welle offener Modelle: GLM-5.3, DeepSeek V4-Pro, Qwen3.8. Was die permissiven Lizenzen für Self-Hosting bedeuten.
Ab 14. August beantwortet Google AI Mode einen Teil der Anfragen mit Gemini 3.7 Flash. Zugleich stellt Google klar, was als Impression zählt.
Der für 1. September geplante 50-Prozent-Aufschlag auf Claude Sonnet 5 entfällt. Anthropic macht den Einführungspreis von 2/10 Dollar dauerhaft.
Daybreak Blue gibt geprüften Verteidigern seit August 2026 Zugriff auf Sol mit weniger Cyber-Refusals. Es ist kein neues KI-Modell.
Meta hat Muse Spark 1.2 veröffentlicht — 1M-Token-Kontext, co-trainiert mit einem Code-Agent, mit Parallel-Tool-Calls und Repo-Level-Training.
Seit 2. August 2026 gelten im EU AI Act die GPAI- und Transparenzpflichten (Art. 5/50). High-Risk wurde auf Dezember 2027 verschoben. Was das heißt.
Alibaba hat Qwen3.8-Max am 2. August 2026 final veröffentlicht: 2,4-Bio.-Parameter-MoE, 1M-Token-Kontext, Bild- und Video-Input per Closed API.
Anthropic hat Opus 5 veröffentlicht — gleicher Token-Preis wie 4.8, laut Anbieter Fable-nahe Leistung bei rund halben Kosten pro Aufgabe.
Moonshot AI hat Kimi K3 gelauncht — ein Open-Weight-Modell mit 2,8 Bio. Parametern laut Hersteller. Open Weights ab 27. Juli. Was das für den Markt heißt.
OpenAI hat GPT-5.6 (Sol/Terra/Luna) freigegeben — aber erst nach einer Vorab-Prüfung durch die US-Regierung. Was das für Frontier-Modelle bedeutet.
Google bringt in der Search Console Platform Properties und generative-AI-Controls. Was Website-Betreiber ab Juli 2026 prüfen und steuern können.
Anthropic veröffentlicht Claude Sonnet 5 am 1. Juli 2026 — laut Hersteller Near-Opus-Leistung zum Einführungspreis von 2/10 Dollar je Mio. Token.
Google Gemini läuft ab sofort als Agent in boostN — arbeite mit deinem Google-Abo über unsere Execution-Pipeline. Mistral folgt in Kürze.
Du schreibst im boostN-Dashboard ein Ticket und es läuft auf dem richtigen Repository — ganz ohne IDE. Mehrere Repos, parallel, in Sekunden.
Autonome Coding-Agenten in der Endlosschleife: Was hinter Ralph Loop und Loop Engineering steckt — und warum ohne harte Stops die Rechnung explodiert.
Branchenauswertungen 2026: agentische KI verbraucht 5–30x mehr Tokens als ein Chat. Was das für Multi-Agent-Budgets bedeutet.
Per Exportkontroll-Anordnung musste Anthropic am 12.6.2026 seine Top-Modelle Fable 5 und Mythos 5 für alle Nutzer abrupt sperren. Anthropic widerspricht offen.
Anthropic legt Zahlen offen: Claude schreibt >80 % des Produktionscodes. Zugleich plädiert die Firma für die Option, die Frontier-Entwicklung zu pausieren.
LangGraph überholt CrewAI bei den Stars, Microsoft Agent Framework 1.0 ist GA. Der Framework-Markt ordnet sich neu — was das für die Auswahl heißt.
Anthropics erster großer Bedrohungsbericht zeigt: Anteil KI-nutzender Hochrisiko-Akteure fast verdoppelt. Dazu eine weitgehend autonome Agent-Attacke.
Marktüberblick Mitte 2026: Nano Banana 2, FLUX.2 und Midjourney V8 im Vergleich — welches Bild-Tool für Content- und Ad-Creatives wofür taugt.
Dify sammelt 30 Mio. $ ein, n8n und Ollama legen bei den Stars zu. Warum der selbst-gehostete KI-Stack 2026 für Agenturen mit Kundendaten interessant wird.
Klarna 60 Mio., General Mills 20 Mio.: Einzelfälle beeindrucken. Aber nur rund 29 % der Firmen sehen klaren ROI. Die nüchterne Bilanz 2026.
Sora-Web/App seit 26.04.2026 aus, API endet 24.09.2026. Kling, Runway und Vidu gewinnen Nutzer. Was das für Video-Workflows heißt.
Anthropic öffnet die Research Preview von Dynamic Workflows in Claude Code: bis zu 1.000 Subagenten pro Run, die sich gegenseitig prüfen.
Anthropic veröffentlicht Opus 4.8 — gleicher Preis, günstigerer Fast Mode, Alignment nahe Mythos-Niveau. Was das Punkt-Release für Agenturen bedeutet.
Cursor bringt Composer 2.5 (18.05.) und den Auto-Review Run Mode (29.05.2026): mehr Tempo bei weniger Freigabe-Prompts — Sandbox und Allowlist als Kontrolle.
DeepSeek macht den 75-%-Rabatt auf V4-Pro dauerhaft: 0,435 $ Input, 0,87 $ Output je Mio. Token. Was der Preisdruck für die Modellwahl bedeutet.
Auf der I/O 2026 erweitert Google seine agent-first IDE um CLI und SDK. Die Wette: Modell-Optionalität mit Gemini, Claude und GPT-OSS unter einer Oberfläche.
Auf der Build 2026 stellt Microsoft sieben eigene MAI-Modelle vor. MAI-Code-1-Flash läuft direkt in GitHub Copilot — billiger als GPT-5.5.
MiniMax M3 startet als Open-Weight-Modell mit Sparse Attention, 1-Mio-Kontext und Coding-Benchmarks auf Frontier-Niveau — zu einem Bruchteil der Kosten.
Alibabas Qwen 3.7 Max: 1 Mio. Kontext, 35 h autonom, 1.158 Tool-Calls. Was das agentische Flaggschiff kann und warum Anbieter-Benchmarks Vorsicht verlangen.
Anthropic hat eine 65-Mrd.-Runde bei 965 Mrd. Bewertung geschlossen, vertraulich IPO eingereicht und finanziert 36 Mrd. an Google-TPUs über Schulden.
Bis zu 75 Mrd. Euro für 5 GW KI-Kapazität, Phase 1 mit 45 Mrd. Euro und 3,1 GW bis 2031. Europas KI-Infrastruktur verschiebt sich nach Hauts-de-France.
Uber brauchte sein KI-Coding-Budget für 2026 in vier Monaten auf. Reaktion: 1.500 $ pro Mitarbeiter und Monat pro Tool.
Anthropic, OpenAI und Cursor kippen Flat-Rates zugunsten verbrauchsbasierter Abrechnung. Was sich konkret geändert hat und was bei dir ankommt.
Laut FT verhandelt Anthropic über eine 50-Mrd.-Dollar-Runde bei rund 900 Mrd. bis 1 Bio. Bewertung. Was die Zahlen aussagen und was nicht.
Das Freiburger Startup veröffentlicht FLUX.2 [klein] unter Apache 2.0 — sub-sekunden-Inferenz auf 13 GB VRAM und Druck auf große Foundation-Anbieter.
Anthropic etabliert Agent Skills als offenen Standard. Eine Markdown-Datei reicht jetzt, wo vorher ein eigener Agent gebaut werden musste.
Cohere und Aleph Alpha verschmelzen zur 20-Milliarden-Dollar-Gruppe. Schwarz-Gruppe steckt 600 Millionen rein. Was das für sovereign AI in Europa heißt.
Cursor verhandelt eine 2-Mrd.-Runde bei 50 Mrd. Bewertung. 2 Mrd. ARR in drei Jahren, ~70 % der Fortune-1000 als Kunden — was das für Claude Code heißt.
DeepL Voice-to-Voice ist seit dem 16. April 2026 verfügbar. Was die Echtzeit-Sprachübersetzung kann und wo sie Microsoft und Google angreift.
Seit 22. April 2026 GA: Google bündelt Vertex AI, Agent Builder und Memory Bank zur Gemini Enterprise Agent Platform — eine Plattform für alles.
Ahrefs zeigt: nur noch 38 % der in AI Overviews zitierten URLs ranken auch in den Top 10. Das alte SEO-Spielfeld verschiebt sich messbar.
Vor einem Jahr veröffentlichte Apple die Reasoning-Kritik 'Illusion of Thinking'. Wir schauen, welche Befunde gehalten haben und welche widerlegt wurden.
675 Mrd. Parameter, 41 Mrd. aktiv, Apache 2.0. Mistral Large 3 ist das erste echte europäische Frontier-Modell mit komplett offenen Gewichten.
Adaptive Drafter nutzt sonst leerlaufende GPUs während der RL-Trainingsphase und beschleunigt das Reasoning-Training um 70 bis 210 Prozent.
Thinking Machines Lab zeigt, wie kleine Modelle Reasoning lernen, ohne volles RL. Qwen3-8B erreicht 70 Prozent auf AIME'24 — bei 30-fach geringeren Kosten.
OpenAI hat die Runde Ende März bei 852 Mrd. abgeschlossen. Wer eingestiegen ist, was Amazon, Nvidia und SoftBank zahlen, was das bedeutet.
OpenAI bündelt Agent Builder, ChatKit und Evals. Visueller Workflow ersetzt Boilerplate-Code — und ChatKit/Evals sind seit DevDay 2025 GA.
Seit 7. Mai 2026: GPT-5.5-Cyber für vetted Cybersecurity-Teams. Weniger Refusals bei Vulnerability-Analyse, Reverse Engineering, Detection Engineering.
300 MW, 220.000 GPUs, doppelte Claude-Code-Limits. Was der SpaceX-Deal vom 6. Mai 2026 für zahlende Nutzer praktisch bedeutet.
Anthropic kündigt auf der Devcon Multi-Agent-Fleets, Outcomes-basierte Steuerung und ein Self-Improvement-Verfahren für Managed Agents an.
Zehn Templates für Wall-Street-Workflows, Claude in Excel/PowerPoint/Word/Outlook, 600 Mio. Firmen-Credit-Profile direkt in Claude.
Seit 5. Mai 2026 ist GPT-5.5 Instant das neue Default-Modell in ChatGPT. -52,5 % Halluzinationen bei Recht, Medizin, Finanzen — und weniger Emojis.
Ab 50.000 $ Monatsverbrauch greifen automatisch gestaffelte Rabatte. Was sich für Heavy-User ändert und wann der Wechsel auf den höheren Tier sich rechnet.
Mistral bringt Medium 3.5 mit 77,6 % SWE-Bench und Remote-Agenten in Vibe und Le Chat. Lokale Sessions wandern auf Wunsch in die Cloud.
Opus 4.6 ist aus dem Picker raus, Fast Mode läuft nur noch über Extra Usage. Was sich geändert hat und warum es kaum jemand mitbekommen hat.
Drei unabhängige Änderungen ließen Claude Code von März bis April schlechter arbeiten. Anthropic legt Ursachen und Konsequenzen offen.
OpenAI hat am 23. April 2026 GPT-5.5 und GPT-5.5 Pro freigeschaltet. Pro kostet $30/$180 pro MTok — sechsfacher Standard-Preis. Was das bedeutet.
Das A2A-Protokoll zählt zum Einjahres-Jubiläum 150+ Organisationen, ist in alle großen Clouds integriert und liefert mit Spec 1.0 den Interop-Standard.
Meta hat mit Muse Spark das erste Modell seiner Superintelligence Labs vorgestellt — proprietär statt offen. Unabhängig geprüft ist bisher wenig.
Mistral finanziert ein dediziertes KI-Rechenzentrum bei Paris. Ziel: 200 MW europäische Compute-Kapazität bis Ende 2027 für sovereign AI.