Neueste Entwicklungen in der künstlichen Intelligenz
Cursor hat innerhalb einer Woche drei Neuerungen ausgerollt. Google-Workspace-Plugins ermöglichen es Agenten, in Gmail, Drive und Calendar zu lesen, zu schreiben und zu handeln. Cursor für iPad ist für alle kostenpflichtigen Tarife verfügbar und bietet angeheftete Sidebar-Chats, um mehrere Agenten gleichzeitig zu beobachten. Cursor Start ist für 649 Rupien pro Monat für indische Entwickler gestartet, inklusive Grok 4.5 und Composer.
DeepSeek hat V4-Flash Version 0731 zu $0,14 pro Million Input-Tokens und $0,28 für Output veröffentlicht, mit einem 1M-Kontextfenster sowie Denk- und Nicht-Denk-Modus. Cache-Treffer kosten $0,0028 pro Million. Die Preisdokumentation enthält eine ausdrückliche Warnung: DeepSeek plant, die API-Preise anzuheben, wobei eine deutliche Erhöhung erwartet wird.
OpenAI hat den Preis von GPT-5.6 Luna auf 0,20 $ pro Million Input-Token und 1,20 $ pro Million Output-Token gesenkt. Luna startete bei 1 $ pro Million Input-Token, was einer Senkung von 80 % entspricht. Der Rest der Familie bleibt bei Terra 2 $/12 $ und Sol 5 $/30 $ pro Million Token.
Google hat die öffentliche Vorschau für Gemini Robotics ER 2 mit zwei Endpunkten gestartet: gemini-robotics-er-2-preview für fortgeschrittenes räumliches Denken und Multi-Roboter-Koordination sowie eine Streaming-Variante, die für Echtzeit-Einsatz über die Live API optimiert ist. Die vorherige Generation, gemini-robotics-er-1.6-preview, wird am 31. August 2026 abgeschaltet.
Anthropic hat Erkenntnisse offengelegt, die das Unternehmen bei der Untersuchung von drei realen Vorfällen gewonnen hat, die durch seine Cybersicherheits-Evaluierungen zutage traten. Die Veröffentlichung ist Teil der laufenden Sicherheitsberichterstattung des Unternehmens und keine Produktankündigung.
Anthropic hat eine Stellungnahme veröffentlicht, in der das Unternehmen seine Position zu Open-Weights-Modellen darlegt. Am selben Tag wurde die Zusammenarbeit mit Cognizant erweitert, um Claude bei Unternehmenskunden einzusetzen.
Anthropic veröffentlichte Claude Opus 5 am 24. Juli. Es bietet agentisches Coding und Computer Use auf Spitzenniveau bei unverändertem Opus-Preis: 5 $ pro Million Eingabe- und 25 $ pro Million Ausgabe-Tokens — halb so teuer wie Claude Fable 5. Opus 5 hat ein Kontextfenster von 1 Mio. Tokens, bis zu 128K Ausgabe-Tokens, standardmäßig aktiviertes „Thinking“ und einen Wissensstand von Mai 2026. Es ist jetzt Standard bei Claude Max und das stärkste Modell bei Claude Pro.
Am 22. Juli kündigten AMD und Anthropic eine strategische Partnerschaft an: bis zu zwei Gigawatt AMD-Instinct-GPUs der MI450-Serie, das erste Gigawatt in der ersten Jahreshälfte 2027. AMD will bis zu 5 Mrd. $ in Anthropic investieren, während Anthropic sich verpflichtet, über die Laufzeit KI-Serverchips im zweistelligen Milliardenbereich zu kaufen. Zudem starteten beide eine Engineering-Kooperation, bei der Claude Instinct-Workloads und die ROCm-Software optimiert — eine direkte Kampfansage an Nvidias Vormacht bei KI-Infrastruktur.
Google hat gemini-3.6-flash und gemini-3.5-flash-lite in die allgemeine Verfügbarkeit überführt. 3.6 Flash bringt bessere Token-Effizienz sowie stärkere Code- und Agentic-Planungsfähigkeiten zu einem niedrigeren Preis; Flash-Lite ist auf latenzarme Subagent-Aufgaben ausgerichtet. Mit ihnen kommt eine Breaking Change: temperature, top_p und top_k werden für beide Modelle als veraltet eingestuft.
Googles Gemini 3.5 Pro — im Mai auf der I/O mit 2-Mio.-Token-Kontext und einer Deep-Think-Reasoning-Schicht vorgestellt — verzögerte sich Mitte Juli erneut. Nach dem Ziel eines Starts am 17. Juli soll Google verschoben haben, als das Modell interne Qualitätsziele bei Halluzinationsraten und realer Zuverlässigkeit verfehlte; DeepMind soll das Basismodell verworfen und neu aufgebaut haben. Das schnellere Gemini 3.5 Flash bleibt Googles aktuelles stabiles Modell.
Am 16. Juli erließ die Europäische Kommission zwei verbindliche Beschlüsse nach dem Digital Markets Act, die Google verpflichten, konkurrierenden KI-Assistenten gleichen Zugang zu Android zu gewähren. Google muss 11 Systemfunktionen für Dritt-KI öffnen — darunter On-Device-Modellzugriff, Hintergrundaufgaben und Bildschirmkontext gleichauf mit Gemini — die meisten Änderungen bis August 2027. Ein zweiter Beschluss verpflichtet Google, ab Januar 2027 anonymisierte Suchdaten mit rivalisierenden Suchmaschinen und KI-Chatbots zu teilen. Google wehrt sich vehement und warnt vor Sicherheitsrisiken.
Am 16. Juli veröffentlichte das chinesische Unternehmen Moonshot AI Kimi K3 — ein offenes Mixture-of-Experts-Modell mit 2,8 Billionen Parametern und 1-Mio.-Token-Kontext, das bislang größte offene Modell überhaupt. Innerhalb von Stunden stieg es mit 1679 Punkten auf Platz 1 der Frontend Code Arena von LMArena und überholte Claude Fable 5 in dem Benchmark, der den Praxiswert von Coding am direktesten misst. Ein Signal, dass offene Modelle aus China trotz US-Chip-Exportgrenzen an der Spitze mitspielen.
Am 9. Juli veröffentlichte OpenAI die GPT-5.6-Familie in drei Stufen: Sol (Spitzenmodell), Terra (Mittelklasse) und Luna (schnell und günstig). Sam Altman sagte, Sol sei bei Coding-Aufgaben rund 54% token-effizienter als die Vorgängergeneration. Neben den Modellen brachte OpenAI ChatGPT Work — einen Agenten, der ganze Aufgaben erledigt statt nur zu antworten — sowie GPT-Live, einen Voll-Duplex-Sprachmodus, der gleichzeitig zuhört und spricht.
Am 24. Juni hat Google Gemini 3.5 Flash um Computer Use erweitert: Das Modell kann die Benutzeroberfläche eines Computers steuern — klicken, tippen und durch Apps navigieren — und Aufgaben als autonomer Agent erledigen. Damit kommt agentische UI-Automatisierung in Googles schnellstes stabiles Modell. Das größere Gemini 3.5 Pro mit Deep-Think-Reasoning und 2-Millionen-Token-Kontext wird weiterhin für Juli erwartet.
Anthropic veröffentlichte am 9. Juni Claude Fable 5 — das erste öffentlich verfügbare Mythos-Modell. Führende Leistung in fast allen getesteten Benchmarks: Software-Engineering, Vision, wissenschaftliche Forschung und autonome Aufgabenausführung. Gleichzeitig erschien Claude Mythos 5 mit eingeschränktem Zugang für genehmigte Organisationen im Bereich staatlicher Cybersicherheit. Bis zum 22. Juni kostenlos für Pro-, Max-, Team- und Enterprise-Nutzer; ab dem 23. Juni $10/$50 pro 1 Mio. Tokens.
Alle GitHub Copilot-Tarife wechselten am 1. Juni zur nutzungsbasierten Abrechnung. Die Kosten jeder Interaktion richten sich nun nach dem verwendeten Modell und den verbrauchten Tokens. Neue Währung: GitHub AI Credits (1 Credit = 0,01 $). Pro-Tarif enthält 1.500 Credits/Monat, Pro+ enthält 7.000 (39 $/Monat), Max enthält 20.000. Business- und Enterprise-Kunden erhalten zusätzliche Credits in der Übergangszeit bis 1. September 2026.
Anthropic hat in einer Series-H-Finanzierungsrunde 65 Milliarden Dollar bei einer Post-Money-Bewertung von 965 Milliarden Dollar eingesammelt. Die Runde wurde von Altimeter, Dragoneer, Greenoaks und Sequoia angeführt. Am 1. Juni reichte das Unternehmen vertraulich ein S-1-Formular für einen Börsengang ein. Der annualisierte Umsatz erreichte im Mai 2026 rund 47 Milliarden Dollar, übertraf OpenAI (rund 852 Milliarden) und macht Anthropic zum wertvollsten KI-Startup der Geschichte.
Anthropic veröffentlicht Opus 4.8 nur 41 Tage nach 4.7. Der USAMO 2026-Mathematik-Score stieg von 69,3% auf 96,7%. Dynamic Workflows in Claude Code starten bis zu 1.000 parallele Subagenten für Repository-weite Aufgaben. Der Fast-Modus wurde von $30/$150 auf $10/$50 pro Million Tokens gesenkt — eine 3-fache Kostensenkung. Basispreis unverändert: $5/$25 pro Million Tokens.
ByteDance gab Pläne bekannt, bis zu 70 Milliarden Dollar in KI-Rechenzentren und Infrastruktur im Jahr 2026 zu investieren — fast dreimal so viel wie die 25 Milliarden Dollar im Jahr 2025. Das Unternehmen plant, den Großteil aus eigenen Gewinnen von rund 50 Milliarden Dollar im Jahr 2025 zu finanzieren. Die Summe stellt ByteDance auf dasselbe Niveau wie Microsoft und Google.
Googles produktdichtestes I/O seit Jahren. Gemini 3.5 Flash ersetzt das bisherige Flaggschiff mit Flash-Geschwindigkeit für $1,50/1M Tokens. Gemini Spark startet als proaktiver 24/7-Personalagent auf Cloud-VMs. Die Android-XR-Brille mit echtem Display kommt zu ersten Tests. Google AI Ultra ersetzt den $250/Monat-Plan für $100/Monat.
Andrej Karpathy — Mitgründer von OpenAI und ehemaliger KI-Chef bei Tesla — ist zu Anthropic gewechselt. Er baut ein neues Team auf, das Claude selbst einsetzt, um die Pretraining-Forschung zu beschleunigen. Er arbeitet unter Nick Joseph, dem Leiter des Pretraining-Bereichs. Der Wechsel wird als Signal für Anthropics wachsende Anziehungskraft auf Top-KI-Talente gewertet.
Eine Bundesgeschworenenjury in Kalifornien wies einstimmig alle Ansprüche in Elon Musks 150-Milliarden-Dollar-Klage gegen OpenAI und Sam Altman zurück. Urteil in unter zwei Stunden: Verjährungsfrist war abgelaufen. Musk kündigte Berufung an.
OpenAI und Dell Technologies haben sich zusammengetan, um Codex über die Dell AI Data Platform in hybriden und On-Premises-Unternehmensumgebungen bereitzustellen — OpenAIs erster expliziter On-Premises-Vertriebsdeal. Codex hat jetzt über 4M aktive Entwickler pro Woche.
Cursor lieferte Composer 2.5, betrieben von Kimi K2.5, mit ~63% auf SWE-Bench — vergleichbar mit Claude Opus 4.7 — für $0,50/Aufgabe vs. $7/Aufgabe für Opus. Ebenfalls enthalten: Multi-Repo-Cloud-Agentenumgebungen, Dockerfile-basiertes Setup und Enterprise-Audit-Logs.
Google I/O 2026 startet diese Woche, wobei die Ankündigung eines neuen Gemini-Modells für den 19. Mai erwartet wird. Google hat größere Updates für die Gemini-Familie und das breitere Google-KI-Produktportfolio angekündigt. Die Veranstaltung folgt auf die Google Android Show 2026, auf der Gemini Intelligence für die Automatisierung mehrstufiger Aufgaben auf Android vorgestellt wurde.
HeyGen hat die alten unbegrenzten Avatar-Video-Tarife am 15. Mai 2026 eingestellt. Alle neuen HeyGen-Abonnements sind nun credit-basiert. Zusammen mit der Preisumstellung wurden Avatar V, das aus 15 Sekunden Filmmaterial Studio-Qualität erzeugen kann, und die Seedance 2.0-Videointegration eingeführt.
AWS blockierte ab dem 15. Mai 2026 neue Anmeldungen für das Amazon Q Developer IDE-Plugin und kündigte dessen Nachfolger an: Kiro, eine spec-getriebene agentische IDE. Kiro nutzt „Specs“ (Anforderungen in natürlicher Sprache, die die vollständige Implementierung steuern) und „Hooks“ (automatische Auslöser beim Speichern von Dateien oder bei Commits). Der Support für das IDE-Plugin endet am 30. April 2027.
Bei der Google Android Show 2026 hat Google Gemini Intelligence vorgestellt — eine neue Ebene, die mehrstufige Aufgaben wie Einkäufe, Buchungen und Kalenderverwaltung direkt auf Android-Geräten automatisiert. Die Funktion kommt im Sommer 2026 auf Samsung- und Google-Telefone. Zudem kündigte Google Googlebooks an — neue Android-Laptops von Acer, ASUS und Lenovo mit integriertem Gemini.
Cursor 3.4 führt agentische Entwicklungsumgebungen ein: Agenten richten nun Dockerfile-definierte Umgebungen ein, arbeiten gleichzeitig über mehrere Repositories hinweg und laufen parallel. Cursor 3.3 hatte bereits PR-Reviews direkt im Editor eingeführt. BugBot wechselt ab Juni 2026 zu einer nutzungsbasierten Abrechnung.
Notion hat am 13. Mai 2026 die Developer Platform 3.5 veröffentlicht. Die Workers Runtime ermöglicht Entwicklern das Bereitstellen serverloser JavaScript-Logik innerhalb von Notion. Database Sync ermöglicht bidirektionale Verbindungen zu externen Datenbanken. Bidirektionale Webhooks erlauben es Notion, Events zu empfangen und zu senden. Der Plan Mode ermöglicht autonome, mehrstufige KI-Agenten innerhalb von Notion-Workflows.
Krea AI hat sein Foundation-Modell Krea 2 veröffentlicht, das von Grund auf neu entwickelt wurde und den Schwerpunkt auf Ästhetik und Stilübertragung legt. Zum Start gehören außerdem Krea Nodes (Bild-Workflows aus Textbeschreibungen erstellen) und Krea Edit (Bereichsbearbeitung, Relighting, Bilderweiterung). Seedance 2.0 ist nun in allen kostenpflichtigen Plänen verfügbar.
OpenAI hat DALL-E 2 und DALL-E 3 am 12. Mai 2026 offiziell eingestellt. Beide werden durch das Modell gpt-image-2 ersetzt, das ChatGPT Images 2.0 antreibt und native 2K-Auflösung, mehrsprachiges Text-Rendering sowie bis zu 8 Bilder pro Prompt im Denkmodus bietet.
Pika 2.5 beseitigt Flimmerartefakte und sorgt für ein durchgängig stabiles Erscheinungsbild von Charakteren über verschiedene Szenen hinweg. PikaStream 1.0 führt KI-Videochat in Echtzeit ein: Nutzer führen Live-Gespräche mit KI-Agenten, die als generierte Video-Charaktere dargestellt werden. Pika baut sich zu einer KI-Social-Video-App-Plattform aus, die Erstellung, Teilen und KI-Interaktion in Echtzeit kombiniert.
Luma AI hat Ray3.14 veröffentlicht, mit nativer 1080p-Videoausgabe (ohne Upscaling), einer Generierungsgeschwindigkeit, die 4x schneller ist als bei Ray2, und 3x geringeren Kosten pro generierter Sekunde. Character Seeds sorgen für ein konsistentes Erscheinungsbild von Charakteren über mehrere Clips hinweg. Modify with Instructions ermöglicht textgesteuerte Bearbeitungen nach der Generierung, ohne dass eine vollständige Neugenerierung nötig ist.
Kling AI hat v3.5 veröffentlicht, mit nativer 1080p/60fps-Ausgabe, verlängerter Clip-Länge im Pro-Tarif auf bis zu 2 Minuten (die längste verfügbare Einzelgenerierung) sowie verbesserter Bewegungsphysik für Fluiddynamik und Stoffsimulation. Kuaishou prüft eine Ausgliederung von Kling AI als eigenständiges Unternehmen bei einer Bewertung von rund 20 Milliarden US-Dollar.
Midjourney V8.1 bietet native 2K-Auflösung, eine Generierungsgeschwindigkeit, die 3 bis 4 Mal schneller ist als bei V7, sowie einen Raw-Modus für eine wörtlichere Interpretation von Prompts. Öffentliche Profile ermöglichen es Creators, ihre Arbeiten sozial zu teilen. Midjourney TV startet als Echtzeit-Stream von Community-Generierungen. V8.2 wurde als nächstes Release angekündigt.
Figma hat einen MCP-Server (Model Context Protocol) eingeführt, mit dem KI-Agenten wie Cursor und Claude Designs direkt auf der Figma-Canvas erstellen und bearbeiten können. Die integrierten KI-Bildwerkzeuge umfassen jetzt Vectorize, Remove Background, Erase und Expand — der Export nach Photoshop entfällt damit. Außerdem sind nun Spracheingabe und Text auf Pfad verfügbar.
OpenAI hat GPT-5.3 Instant als Standardmodell in ChatGPT durch GPT-5.5 Instant ersetzt. Das neue Modell liefert bei kritischen Anfragen 52,5 % weniger Halluzinationen und bindet für Plus- und Pro-Nutzer den Speicher aus vergangenen Unterhaltungen, Gmail und gespeicherten Dateien ein.
Das NIST-Zentrum für KI-Standards und Innovation kündigte Vereinbarungen mit Microsoft, Google und xAI an, um unveröffentlichte KI-Modelle vor dem Launch auf nationale Sicherheitsrisiken zu evaluieren. Der Schritt wurde durch Anthropics eingeschränktes Mythos-Modell ausgelöst. Anthropic fehlt bemerkenswert in der Vereinbarung.
Die KI-Musikplattform Suno sammelt eine Series-D-Finanzierungsrunde bei einer Bewertung von 5 Milliarden US-Dollar ein und mehr als verdoppelt damit ihre Bewertung von 2,45 Milliarden US-Dollar vom November 2025. Das Unternehmen zählt inzwischen 2 Millionen zahlende Abonnenten und erstellt täglich 7 Millionen Tracks.
Novo Nordisk kündigte eine strategische Partnerschaft mit OpenAI an, um KI in der Medikamentenentwicklung, klinischen Studien, Herstellung, Lieferketten und kommerziellen Operationen zu integrieren. Der Deal zielt auf die Beschleunigung neuer Behandlungen für Fettleibigkeit und Diabetes ab.
Anthropic hat ein neues Frontier-Modell namens Mythos entwickelt, das laut dem Unternehmen bei Cybersicherheitsfähigkeiten «weit voraus» gegenüber allen anderen Modellen ist. Aufgrund der Risiken beschränkt Anthropic den Zugang auf eine ausgewählte Gruppe geprüfter Organisationen. Das Modell veranlasste das Weiße Haus, einen formellen KI-Überprüfungsprozess in Betracht zu ziehen.
Anthropics Model Context Protocol (MCP) überschritt im März 2026 97 Millionen Installationen und entwickelte sich von einem experimentellen Standard zur grundlegenden Infrastruktur für den Aufbau von KI-Agenten. Jeder große KI-Anbieter liefert jetzt MCP-kompatibles Tooling.
Googles Gemini 3.1 Pro hat sich als Gesamtführer in Benchmarks bei unabhängigen Evaluierungen etabliert, anführend bei 13 von 16 wichtigen Benchmarks. Schlüsselwerte: 80,6% auf SWE-bench, 94,3% auf GPQA Diamond (höchster Wert eines Modells), 2M Token Kontextfenster über Text, Bild, Audio und Video.
Mistral hat Small 4 veröffentlicht — ein Open-Source-Modell mit 119 Milliarden Parametern, 256k Kontextfenster, konfigurierbarem Reasoning und multimodalen (Vision-)Fähigkeiten. Es kombiniert schnelles Instruction-Following, tiefes Denken und Bildverständnis in einem einzigen Modell.
Microsoft und OpenAI haben ihren grundlegenden Vertrag von 2019 neu geschrieben: Microsoft beendet seine Azure-Umsatzbeteiligung an OpenAI, OpenAI kann nun über Amazon Web Services und Google Cloud verkaufen, und die berühmte «AGI-Klausel» wird entfernt. Anthropics ARR hat OpenAIs zum ersten Mal mit $30B übertroffen, was die Neuverhandlung beschleunigt haben könnte.
Google kündigte eine Investition von bis zu 40 Milliarden Dollar in Anthropic an — beginnend mit 10 Milliarden bei einer Bewertung von 350 Milliarden Dollar. Google Cloud verpflichtet sich zusätzlich zu 5 Gigawatt Rechenkapazität über fünf Jahre.
OpenAI hat GPT-5.5 veröffentlicht — das bislang leistungsstärkste Modell mit deutlichen Verbesserungen beim agentic Coding via Codex, bei der Datenanalyse und der autonomen Softwarebedienung. Verfügbar für Plus-, Pro-, Business- und Enterprise-Nutzer.
Anthropic hat Claude Design veröffentlicht, sein erstes eigenständiges Design-Produkt im Rahmen von Anthropic Labs. Das auf Claude Opus 4.7 basierende Tool erstellt aus Konversationen heraus Präsentationen, Mockups und Marketingmaterialien — inklusive automatischer Generierung von Markensystemen aus bestehenden Codebasen oder Design-Dateien. Verfügbar ohne Zusatzkosten für Claude Pro-, Max-, Team- und Enterprise-Abonnenten.
Adobe hat Creative Agent gestartet — eine KI-Orchestrierungsschicht, die einen einzelnen Prompt in natürlicher Sprache akzeptiert und koordinierte Workflows in Photoshop, Premiere, Lightroom und Illustrator ausführt. Die Custom Models Beta ermöglicht markenspeziifisches Fine-Tuning. Soundgenerierung wurde zu Adobe Firefly hinzugefügt.