KI•POWERBOOST Newsletter08. Oktober 20269 Min. Lesezeit
Diese Woche haben KI-Agenten Konten, Rechte und eine Mailadresse bekommen
Google und Microsoft geben KI-Agenten eigene Konten, eine Lücke bei Amazon zeigt, warum das wichtig ist. Dazu: ChatGPT antwortet mit interaktiven Oberflächen, Claude baut Live-Dashboards und Haiku 5.5 wird 90 Prozent günstiger.
🎨Claude baut jetzt Live-Dashboards und Erklärvideos
Anthropic hat zwei neue Beta-Funktionen für Claude vorgestellt. Mit Claude Dashboards verwandelst du Datenquellen wie BigQuery, Databricks, Snowflake oder Salesforce per Texteingabe in Live-Dashboards, die sich automatisch aktualisieren. Zu jedem Datenpunkt zeigt Claude die zugrunde liegende Abfrage an, und die Dashboards lassen sich an Tools wie Amplitude, Grafana oder Hex weitergeben. Claude Motion erstellt aus Text, Diagrammen und Bildern animierte Erklärvideos, die du als Code bearbeiten und als MP4 exportieren kannst. Dashboards gibt es für alle zahlenden Nutzer, Motion zunächst nur in Team- und Enterprise-Plänen. Außerdem haben Docs, Slides und Design die Beta verlassen und stehen jetzt in allen Plänen zur Verfügung, auch im kostenlosen.
Warum das wichtig ist
Claude wird damit vom Chatfenster zur Arbeitsumgebung für fertige Ergebnisse. Reportings und Erklärcontent, für die du bisher ein BI-Tool oder einen Videoeditor gebraucht hast, entstehen direkt im Gespräch.
🚀ChatGPT antwortet jetzt mit interaktiven Oberflächen
OpenAI hat GPT-6 mit einer neuen Oberfläche namens Intelligent UI in ChatGPT gebracht. Statt nur Text auszugeben, antwortet ChatGPT jetzt passend zur Frage mit Grafiken, Buttons, Diagrammen und Formularen. Vergleiche erscheinen nebeneinander, Erklärungen als interaktive Diagramme, und du kannst dir direkt im Chat kleine Tools wie einen Sparrechner oder ein Spiel bauen lassen. Bezahlkunden nutzen dabei GPT-6 Sol, kostenlose Nutzer GPT-6 Luna. Außerdem kann GPT-6 schon während des Nachdenkens antworten, was die Wartezeit um 44 Prozent verkürzen soll. Der Rollout startete am 7. Oktober für Plus, Pro, Business und Enterprise, einen Tag später folgten Free und Go.
Warum das wichtig ist
Der Chat als reines Textfenster hat ausgedient: Antworten werden zu kleinen Anwendungen, mit denen du direkt weiterarbeitest. Google hat mit Neural Expressive schon im Mai etwas Ähnliches in Gemini gestartet, jetzt zieht OpenAI für alle Nutzer nach.
💰Claude Haiku 5.5: Anthropic senkt Preise um bis zu 90 Prozent
Anthropic hat Claude Haiku 5.5 veröffentlicht, das kleinste und schnellste Modell der Claude-Familie. Das Kontextfenster wächst von 200.000 auf eine Million Tokens, die maximale Ausgabe von 64.000 auf 128.000 Tokens. Das Modell entscheidet selbst, wann es zusätzliche Denkschritte braucht, und kann erstmals einen Browser bedienen. Im Intelligence Index von Artificial Analysis kommt es auf 43 Punkte, 26 mehr als Haiku 4.5, und liefert bei praxisnaher Wissensarbeit ähnliche Ergebnisse wie GPT-6 Astra. Für Prompts bis 100.000 Tokens kostet Haiku 5.5 nur 0,10 Dollar pro Million Input- und 0,50 Dollar pro Million Output-Tokens, 90 Prozent weniger als der Vorgänger. Zusätzlich halbiert Anthropic bei Sonnet 5.5 den Preis für gecachte Eingaben.
Warum das wichtig ist
Ein Modell auf diesem Niveau für Centbeträge macht KI auch für Aufgaben mit riesigem Volumen bezahlbar, etwa das Auswerten tausender Dokumente oder Kundenanfragen. Der Preiskampf der letzten Wochen erreicht damit auch die kleinen Modelle.
🤖Google macht Gemini zum Agenten, zuerst für Unternehmen
Google baut Gemini zu einem KI-Agenten aus, der Ziele statt einzelner Anweisungen bekommt und selbst plant, wie er sie erreicht. Der Agent verteilt Arbeit an Unteragenten, nutzt eigene Skills und Tools, schreibt Code, plant Meetings und protokolliert jede Aktion. Für jede Aufgabe wählt er automatisch das passende Modell, auf Wunsch zunächst auch Claude von Anthropic. Angebunden werden unter anderem Google Workspace, Microsoft 365, Slack, Jira, Confluence, BigQuery, Snowflake und MCP-Server. Der Agent bekommt ein eigenes Workspace-Konto mit E-Mail-Adresse und kennt Teamstrukturen und Freigabeprozesse. Er läuft auf iOS, Android, Windows, Mac und in der Kommandozeile, getestet haben ihn unter anderem Shopify, PayPal und On. Preise und einen Termin für Privatnutzer nennt Google noch nicht.
Warum das wichtig ist
Dass Google in seinem eigenen Agenten auch Claude anbietet, zeigt, wie sich der Markt verschiebt: Entscheidend ist nicht mehr nur das eigene Modell, sondern wer die Arbeit im Unternehmen orchestriert. Agenten mit eigener Identität werden dabei zum neuen Standard.
💼Windows 11 bekommt einen eigenen Desktop für KI-Agenten
Microsoft hat einen agentischen Desktop für Windows 11 vorgestellt, auf dem KI-Agenten eigenständig Aufgaben erledigen. Die Agenten laufen in abgeschotteten Microsoft Execution Containers und bekommen eigene Benutzerkonten mit getrennten Zugriffsrechten, über Agent 365 verwalten Organisationen sie zentral. Dazu kommen neue Copilot-Funktionen: Copilot Home ordnet lokale Dateien nach Kontext, Copilot Code erstellt native Windows-Apps mit lokaler KI, und Autopilot automatisiert mehrstufige Aufgaben wie das Sammeln von Dokumenten und den Versand von Mails. Die Container sind ab sofort verfügbar, die Copilot-Funktionen sollen in den kommenden Monaten auf Copilot+-PCs kommen. Neue Geräte zeigten Partner wie Asus, Dell, HP, Lenovo und MSI.
Warum das wichtig ist
Agenten wandern vom Browser direkt ins Betriebssystem. Spannend ist der Sicherheitsansatz: Bekommt jeder Agent ein eigenes Konto mit begrenzten Rechten, lässt sich klar regeln, worauf er zugreifen darf. Wie wichtig das ist, zeigt die AgentCore-Lücke direkt darunter.
🛡️Sicherheitslücke in Amazons AgentCore: Ein Prompt reichte für ganze Agenten-Flotten
Die Sicherheitsfirma Zenity Labs hat in Amazon Bedrock AgentCore eine Schwachstellenkette namens „AgentCorruption“ entdeckt. Auf der AWS-Plattform betreiben Unternehmen wie Sony und Ericsson ihre KI-Agenten. Ein Angreifer brauchte nur Chatzugriff auf einen öffentlichen Agenten: Mit einer einfachen Aufforderung brachte er ihn dazu, den internen Metadatendienst von AWS abzufragen und temporäre Zugangsdaten an einen externen Server zu schicken. Damit ließen sich alle Agenten im selben Konto und in derselben Region kompromittieren, Quellcode herunterladen, private Gespräche lesen, Passwörter und API-Schlüssel abgreifen und das Gedächtnis von Agenten manipulieren. Zenity meldete die Lücke im Dezember 2025, AWS hat die Standardeinstellungen inzwischen abgesichert.
Warum das wichtig ist
Der Fall zeigt das Grundproblem von Agenten: Ein einziger öffentlich erreichbarer Agent mit zu vielen Rechten reicht als Einfallstor. Wer Agenten einsetzt, sollte ihnen nur die Rechte geben, die sie wirklich brauchen.
Google hat mit AI Edge Foresight eine macOS-App vorgestellt, die komplett lokal auf deinem Rechner arbeitet. Sie erfasst Notizen, transkribiert Meetings aus Google Meet, Zoom oder über das Mikrofon und greift auf lokale Dateien zu, etwa Office-Dokumente, PDFs, Markdown-Dateien und Browser-Lesezeichen. Darin kannst du semantisch suchen und dir Inhalte zusammenfassen lassen. Unter der Haube laufen das Embedding-Modell EmbeddingGemma 2 und Gemma 4. Laut Google findet die gesamte KI-Verarbeitung lokal statt, die App funktioniert auch offline. Sie läuft nur auf Macs mit Apple Silicon und wird direkt über Googles Website verteilt, nicht über den App Store.
Warum das wichtig ist
Lokale KI wird alltagstauglich: Meeting-Notizen und Dokumentensuche ohne Cloud sind gerade für sensible Firmendaten ein starkes Argument. Prüf trotzdem genau, welche Ordner du der App freigibst.
Maxi ist zurück: Was wirklich hinter den Kulissen lief
Maxi ist zurück, und wir haben selbst nicht damit gerechnet. In dieser Folge erzählen Maxi und ich offen, warum er gegangen ist, warum es keine Verabschiedungsfolge gab und warum wir gemerkt haben, dass uns beiden etwas fehlt.
Was hinter den Kulissen passiert ist: Wir erzählen dir offen, warum Maxi ausgestiegen ist und warum wir jetzt doch wieder zusammen am Mikro sitzen.
Euer Feedback zum fehlenden Abschied: Viele von euch haben uns geschrieben, dass der Abschied ohne letzte gemeinsame Folge nicht okay war. Ihr hattet recht, und das sprechen wir klar an.
KI bleibt der Kern: Jede Folge gibt dir weiterhin etwas Konkretes und Umsetzbares mit.
Neu dabei: Business, Mindset und die menschliche Seite: Du erfährst, wie du mit KI wirklich weiterkommst, als Unternehmer und als Mensch.
Feste Aufnahmetermine: Wir haben Termine vereinbart, die für uns beide funktionieren, damit die Folgen regelmäßig kommen.
Mit Eleven v4 hat ElevenLabs sein bisher ausdrucksstärkstes Sprachmodell veröffentlicht. Es liest Texte wie ein Sprecher, mit Emotion, Pausen und Betonung, und funktioniert in mehr als 90 Sprachen.
Kombiniert mit einem Klon deiner eigenen Stimme produzierst du so Voiceovers, Podcast-Intros oder Kursinhalte, ohne jedes Mal selbst ins Mikro zu sprechen.
Der HackElevenLabs bietet zwei Arten von Voice Clones. Für einen Instant Voice Clone reichen ein bis zwei Minuten sauberes Audio, das Ergebnis steht in wenigen Minuten. Ein Professional Voice Clone braucht 30 Minuten bis drei Stunden Aufnahmen, trainiert drei bis sechs Stunden und ist laut ElevenLabs kaum noch vom Original zu unterscheiden. Mit v4 bringt er jetzt auch das volle emotionale Spektrum mit. Professional Voice Cloning gibt es ab dem Creator-Plan.
So probierst du es ausÖffne in ElevenLabs den Bereich „My Voices“ und lege eine neue Stimme an. Lade eine Aufnahme hoch, in der du gleichmäßig und in einem Stil sprichst, am besten ohne Hall und Hintergrundgeräusche. Anschließend bestätigst du per Sprachaufnahme, dass es deine eigene Stimme ist. Danach wählst du bei Text-to-Speech das Modell Eleven v4 und deine Stimme und steuerst mit Audio-Tags wie [pause], [whispers] oder [excited], wie der Text klingen soll.
Warum das ein brutaler Mehrwert istDu sparst dir Aufnahmesessions, Versprecher und Nachbearbeitung. Änderungen am Skript sind in Sekunden neu vertont, und mehrsprachige Versionen deiner Inhalte entstehen in deiner eigenen Stimme. Wichtig: Klone nur deine eigene Stimme oder Stimmen, für die du eine ausdrückliche Zustimmung hast.
Beispiel-Skript mit Audio-Tags für Eleven v4
Willkommen zu meinem neuen Kurs. [pause] Heute zeige ich dir, wie du in zehn Minuten deinen ersten KI-Agenten baust.
[excited] Und das Beste: Du brauchst dafür keine einzige Zeile Code.
[whispers] Ein kleiner Tipp vorab: Halte dir einen Stift bereit.
Plattform, die Hunderte KI-Modelle verschiedener Anbieter über eine einzige API bündelt. Du wechselst zwischen Claude, GPT, Gemini und Co. mit einer Zeile Code, hast alle Kosten an einem Ort und bekommst automatische Ausweichlösungen, wenn ein Anbieter hakt. Spannend ist das vor allem für alle, die KI in eigene Apps, Tools oder Automationen einbauen.
Wichtige KI-Features
Eine API für Hunderte Modelle: Alle Chat-Modelle nutzen dieselbe Schnittstelle, dazu kommen Bild-, Video- und Sprachmodelle.
Keine Aufschläge auf Modellpreise: Abgerechnet wird pro Token zum Preis des jeweiligen Anbieters, ohne Grundgebühr.
Automatische Fallbacks: Fällt ein Anbieter aus oder greift ein Rate-Limit, springt OpenRouter auf einen anderen Anbieter um.
Modellvergleich: Modelle lassen sich nach Preis, Kontextlänge und Benchmarks direkt nebeneinanderstellen.
Kostenlose Modelle: Varianten mit dem Zusatz „:free“ kosten nichts und haben ein tägliches Limit.
Rankings aus echter Nutzung: Leaderboards zeigen, welche Modelle über die API tatsächlich am meisten genutzt werden.
Praxisnutzen
Du testest neue Modelle am Tag ihres Releases, ohne für jeden Anbieter einen eigenen Account anzulegen.
Deine Apps und Automationen laufen weiter, auch wenn ein einzelner Anbieter ausfällt.
Besonders nützlich für Entwickler, Automatisierer und Teams, die mehrere KI-Modelle flexibel einsetzen und ihre Kosten im Blick behalten wollen.