Niklas Volland
Kalenderwoche41
KI•POWERBOOST Newsletter 08. Oktober 2026 9 Min. Lesezeit

Diese Woche haben KI-Agenten Konten, Rechte und eine Mailadresse bekommen

Google und Microsoft geben KI-Agenten eigene Konten, eine Lücke bei Amazon zeigt, warum das wichtig ist. Dazu: ChatGPT antwortet mit interaktiven Oberflächen, Claude baut Live-Dashboards und Haiku 5.5 wird 90 Prozent günstiger.

Ankündigung von Anthropic: „Introducing Claude Dashboards and Claude Motion – Now in beta“ als Videoplayer, daneben drei Diagramm-Kacheln
© Bild: Anthropic

Claude baut jetzt Live-Dashboards und Erklärvideos

Anthropic hat zwei neue Beta-Funktionen für Claude vorgestellt. Mit Claude Dashboards verwandelst du Datenquellen wie BigQuery, Databricks, Snowflake oder Salesforce per Texteingabe in Live-Dashboards, die sich automatisch aktualisieren. Zu jedem Datenpunkt zeigt Claude die zugrunde liegende Abfrage an, und die Dashboards lassen sich an Tools wie Amplitude, Grafana oder Hex weitergeben. Claude Motion erstellt aus Text, Diagrammen und Bildern animierte Erklärvideos, die du als Code bearbeiten und als MP4 exportieren kannst. Dashboards gibt es für alle zahlenden Nutzer, Motion zunächst nur in Team- und Enterprise-Plänen. Außerdem haben Docs, Slides und Design die Beta verlassen und stehen jetzt in allen Plänen zur Verfügung, auch im kostenlosen.

Warum das wichtig ist

Claude wird damit vom Chatfenster zur Arbeitsumgebung für fertige Ergebnisse. Reportings und Erklärcontent, für die du bisher ein BI-Tool oder einen Videoeditor gebraucht hast, entstehen direkt im Gespräch.

Quelle und mehr dazu
Hand mit Smartphone, ChatGPT zeigt einen interaktiven Gartenplan mit Bildern und Kacheln, daneben der Schriftzug „GPT-6 with Intelligent UI“
© Bild: OpenAI

ChatGPT antwortet jetzt mit interaktiven Oberflächen

OpenAI hat GPT-6 mit einer neuen Oberfläche namens Intelligent UI in ChatGPT gebracht. Statt nur Text auszugeben, antwortet ChatGPT jetzt passend zur Frage mit Grafiken, Buttons, Diagrammen und Formularen. Vergleiche erscheinen nebeneinander, Erklärungen als interaktive Diagramme, und du kannst dir direkt im Chat kleine Tools wie einen Sparrechner oder ein Spiel bauen lassen. Bezahlkunden nutzen dabei GPT-6 Sol, kostenlose Nutzer GPT-6 Luna. Außerdem kann GPT-6 schon während des Nachdenkens antworten, was die Wartezeit um 44 Prozent verkürzen soll. Der Rollout startete am 7. Oktober für Plus, Pro, Business und Enterprise, einen Tag später folgten Free und Go.

Warum das wichtig ist

Der Chat als reines Textfenster hat ausgedient: Antworten werden zu kleinen Anwendungen, mit denen du direkt weiterarbeitest. Google hat mit Neural Expressive schon im Mai etwas Ähnliches in Gemini gestartet, jetzt zieht OpenAI für alle Nutzer nach.

Quelle und mehr dazu
Ankündigung von Anthropic: Schriftzug „Claude Haiku 5.5“ mit Datum 7. Oktober 2026 über einem geschwungenen Bogen
© Bild: Anthropic

Claude Haiku 5.5: Anthropic senkt Preise um bis zu 90 Prozent

Anthropic hat Claude Haiku 5.5 veröffentlicht, das kleinste und schnellste Modell der Claude-Familie. Das Kontextfenster wächst von 200.000 auf eine Million Tokens, die maximale Ausgabe von 64.000 auf 128.000 Tokens. Das Modell entscheidet selbst, wann es zusätzliche Denkschritte braucht, und kann erstmals einen Browser bedienen. Im Intelligence Index von Artificial Analysis kommt es auf 43 Punkte, 26 mehr als Haiku 4.5, und liefert bei praxisnaher Wissensarbeit ähnliche Ergebnisse wie GPT-6 Astra. Für Prompts bis 100.000 Tokens kostet Haiku 5.5 nur 0,10 Dollar pro Million Input- und 0,50 Dollar pro Million Output-Tokens, 90 Prozent weniger als der Vorgänger. Zusätzlich halbiert Anthropic bei Sonnet 5.5 den Preis für gecachte Eingaben.

Warum das wichtig ist

Ein Modell auf diesem Niveau für Centbeträge macht KI auch für Aufgaben mit riesigem Volumen bezahlbar, etwa das Auswerten tausender Dokumente oder Kundenanfragen. Der Preiskampf der letzten Wochen erreicht damit auch die kleinen Modelle.

Quelle und mehr dazu
Logo der Google-Cloud-Veranstaltung „Gemini at Work ’26“ auf schwarzem Hintergrund
© Bild: Google

Google macht Gemini zum Agenten, zuerst für Unternehmen

Google baut Gemini zu einem KI-Agenten aus, der Ziele statt einzelner Anweisungen bekommt und selbst plant, wie er sie erreicht. Der Agent verteilt Arbeit an Unteragenten, nutzt eigene Skills und Tools, schreibt Code, plant Meetings und protokolliert jede Aktion. Für jede Aufgabe wählt er automatisch das passende Modell, auf Wunsch zunächst auch Claude von Anthropic. Angebunden werden unter anderem Google Workspace, Microsoft 365, Slack, Jira, Confluence, BigQuery, Snowflake und MCP-Server. Der Agent bekommt ein eigenes Workspace-Konto mit E-Mail-Adresse und kennt Teamstrukturen und Freigabeprozesse. Er läuft auf iOS, Android, Windows, Mac und in der Kommandozeile, getestet haben ihn unter anderem Shopify, PayPal und On. Preise und einen Termin für Privatnutzer nennt Google noch nicht.

Warum das wichtig ist

Dass Google in seinem eigenen Agenten auch Claude anbietet, zeigt, wie sich der Markt verschiebt: Entscheidend ist nicht mehr nur das eigene Modell, sondern wer die Arbeit im Unternehmen orchestriert. Agenten mit eigener Identität werden dabei zum neuen Standard.

Quelle und mehr dazu
Aufgeklappter dunkler Laptop mit Windows-Hintergrundbild neben einem flachen schwarzen Zusatzgerät auf einem hellen Tisch
© Bild: Microsoft

Windows 11 bekommt einen eigenen Desktop für KI-Agenten

Microsoft hat einen agentischen Desktop für Windows 11 vorgestellt, auf dem KI-Agenten eigenständig Aufgaben erledigen. Die Agenten laufen in abgeschotteten Microsoft Execution Containers und bekommen eigene Benutzerkonten mit getrennten Zugriffsrechten, über Agent 365 verwalten Organisationen sie zentral. Dazu kommen neue Copilot-Funktionen: Copilot Home ordnet lokale Dateien nach Kontext, Copilot Code erstellt native Windows-Apps mit lokaler KI, und Autopilot automatisiert mehrstufige Aufgaben wie das Sammeln von Dokumenten und den Versand von Mails. Die Container sind ab sofort verfügbar, die Copilot-Funktionen sollen in den kommenden Monaten auf Copilot+-PCs kommen. Neue Geräte zeigten Partner wie Asus, Dell, HP, Lenovo und MSI.

Warum das wichtig ist

Agenten wandern vom Browser direkt ins Betriebssystem. Spannend ist der Sicherheitsansatz: Bekommt jeder Agent ein eigenes Konto mit begrenzten Rechten, lässt sich klar regeln, worauf er zugreifen darf. Wie wichtig das ist, zeigt die AgentCore-Lücke direkt darunter.

Quelle und mehr dazu
Schriftzug „Amazon Bedrock AgentCore“ über einem sechseckigen Symbol mit stilisiertem Gehirn
© Bild: Amazon

Sicherheitslücke in Amazons AgentCore: Ein Prompt reichte für ganze Agenten-Flotten

Die Sicherheitsfirma Zenity Labs hat in Amazon Bedrock AgentCore eine Schwachstellenkette namens „AgentCorruption“ entdeckt. Auf der AWS-Plattform betreiben Unternehmen wie Sony und Ericsson ihre KI-Agenten. Ein Angreifer brauchte nur Chatzugriff auf einen öffentlichen Agenten: Mit einer einfachen Aufforderung brachte er ihn dazu, den internen Metadatendienst von AWS abzufragen und temporäre Zugangsdaten an einen externen Server zu schicken. Damit ließen sich alle Agenten im selben Konto und in derselben Region kompromittieren, Quellcode herunterladen, private Gespräche lesen, Passwörter und API-Schlüssel abgreifen und das Gedächtnis von Agenten manipulieren. Zenity meldete die Lücke im Dezember 2025, AWS hat die Standardeinstellungen inzwischen abgesichert.

Warum das wichtig ist

Der Fall zeigt das Grundproblem von Agenten: Ein einziger öffentlich erreichbarer Agent mit zu vielen Rechten reicht als Einfallstor. Wer Agenten einsetzt, sollte ihnen nur die Rechte geben, die sie wirklich brauchen.

Quelle und mehr dazu
Oberfläche von AI Edge Foresight: Meeting-Notizen links, daneben die von der KI aufbereiteten Notizen
© Bild: Google

Google bringt lokale KI-App für den Mac

Google hat mit AI Edge Foresight eine macOS-App vorgestellt, die komplett lokal auf deinem Rechner arbeitet. Sie erfasst Notizen, transkribiert Meetings aus Google Meet, Zoom oder über das Mikrofon und greift auf lokale Dateien zu, etwa Office-Dokumente, PDFs, Markdown-Dateien und Browser-Lesezeichen. Darin kannst du semantisch suchen und dir Inhalte zusammenfassen lassen. Unter der Haube laufen das Embedding-Modell EmbeddingGemma 2 und Gemma 4. Laut Google findet die gesamte KI-Verarbeitung lokal statt, die App funktioniert auch offline. Sie läuft nur auf Macs mit Apple Silicon und wird direkt über Googles Website verteilt, nicht über den App Store.

Warum das wichtig ist

Lokale KI wird alltagstauglich: Meeting-Notizen und Dokumentensuche ohne Cloud sind gerade für sensible Firmendaten ein starkes Argument. Prüf trotzdem genau, welche Ordner du der App freigibst.

Quelle und mehr dazu
Cover der KI-Talk-Folge: Porträt neben dem Schriftzug „Die ganze Wahrheit“ und einem leuchtenden On-Air-Schild

Maxi ist zurück: Was wirklich hinter den Kulissen lief

Maxi ist zurück, und wir haben selbst nicht damit gerechnet. In dieser Folge erzählen Maxi und ich offen, warum er gegangen ist, warum es keine Verabschiedungsfolge gab und warum wir gemerkt haben, dass uns beiden etwas fehlt.

  • Was hinter den Kulissen passiert ist: Wir erzählen dir offen, warum Maxi ausgestiegen ist und warum wir jetzt doch wieder zusammen am Mikro sitzen.
  • Euer Feedback zum fehlenden Abschied: Viele von euch haben uns geschrieben, dass der Abschied ohne letzte gemeinsame Folge nicht okay war. Ihr hattet recht, und das sprechen wir klar an.
  • KI bleibt der Kern: Jede Folge gibt dir weiterhin etwas Konkretes und Umsetzbares mit.
  • Neu dabei: Business, Mindset und die menschliche Seite: Du erfährst, wie du mit KI wirklich weiterkommst, als Unternehmer und als Mensch.
  • Feste Aufnahmetermine: Wir haben Termine vereinbart, die für uns beide funktionieren, damit die Folgen regelmäßig kommen.
ElevenLabs-Oberfläche mit Modell Eleven v4: Skript mit Audio-Tags wie [warm] und [whispered] für mehrere Sprecher
© Bild: ElevenLabs

Eigene Stimme klonen mit ElevenLabs v4

Mit Eleven v4 hat ElevenLabs sein bisher ausdrucksstärkstes Sprachmodell veröffentlicht. Es liest Texte wie ein Sprecher, mit Emotion, Pausen und Betonung, und funktioniert in mehr als 90 Sprachen.

Kombiniert mit einem Klon deiner eigenen Stimme produzierst du so Voiceovers, Podcast-Intros oder Kursinhalte, ohne jedes Mal selbst ins Mikro zu sprechen.

  1. Der Hack ElevenLabs bietet zwei Arten von Voice Clones. Für einen Instant Voice Clone reichen ein bis zwei Minuten sauberes Audio, das Ergebnis steht in wenigen Minuten. Ein Professional Voice Clone braucht 30 Minuten bis drei Stunden Aufnahmen, trainiert drei bis sechs Stunden und ist laut ElevenLabs kaum noch vom Original zu unterscheiden. Mit v4 bringt er jetzt auch das volle emotionale Spektrum mit. Professional Voice Cloning gibt es ab dem Creator-Plan.
  2. So probierst du es aus Öffne in ElevenLabs den Bereich „My Voices“ und lege eine neue Stimme an. Lade eine Aufnahme hoch, in der du gleichmäßig und in einem Stil sprichst, am besten ohne Hall und Hintergrundgeräusche. Anschließend bestätigst du per Sprachaufnahme, dass es deine eigene Stimme ist. Danach wählst du bei Text-to-Speech das Modell Eleven v4 und deine Stimme und steuerst mit Audio-Tags wie [pause], [whispers] oder [excited], wie der Text klingen soll.
  3. Warum das ein brutaler Mehrwert ist Du sparst dir Aufnahmesessions, Versprecher und Nachbearbeitung. Änderungen am Skript sind in Sekunden neu vertont, und mehrsprachige Versionen deiner Inhalte entstehen in deiner eigenen Stimme. Wichtig: Klone nur deine eigene Stimme oder Stimmen, für die du eine ausdrückliche Zustimmung hast.
Beispiel-Skript mit Audio-Tags für Eleven v4
Willkommen zu meinem neuen Kurs. [pause] Heute zeige ich dir, wie du in zehn Minuten deinen ersten KI-Agenten baust.

[excited] Und das Beste: Du brauchst dafür keine einzige Zeile Code.

[whispers] Ein kleiner Tipp vorab: Halte dir einen Stift bereit.
Startseite von OpenRouter: „The Unified Interface For Every Model“ mit Kennzahlen und Funktionskacheln
© Bild: OpenRouter

OpenRouter

Plattform, die Hunderte KI-Modelle verschiedener Anbieter über eine einzige API bündelt. Du wechselst zwischen Claude, GPT, Gemini und Co. mit einer Zeile Code, hast alle Kosten an einem Ort und bekommst automatische Ausweichlösungen, wenn ein Anbieter hakt. Spannend ist das vor allem für alle, die KI in eigene Apps, Tools oder Automationen einbauen.

Wichtige KI-Features
  • Eine API für Hunderte Modelle: Alle Chat-Modelle nutzen dieselbe Schnittstelle, dazu kommen Bild-, Video- und Sprachmodelle.
  • Keine Aufschläge auf Modellpreise: Abgerechnet wird pro Token zum Preis des jeweiligen Anbieters, ohne Grundgebühr.
  • Automatische Fallbacks: Fällt ein Anbieter aus oder greift ein Rate-Limit, springt OpenRouter auf einen anderen Anbieter um.
  • Modellvergleich: Modelle lassen sich nach Preis, Kontextlänge und Benchmarks direkt nebeneinanderstellen.
  • Kostenlose Modelle: Varianten mit dem Zusatz „:free“ kosten nichts und haben ein tägliches Limit.
  • Rankings aus echter Nutzung: Leaderboards zeigen, welche Modelle über die API tatsächlich am meisten genutzt werden.
Praxisnutzen
  • Du testest neue Modelle am Tag ihres Releases, ohne für jeden Anbieter einen eigenen Account anzulegen.
  • Deine Apps und Automationen laufen weiter, auch wenn ein einzelner Anbieter ausfällt.
  • Besonders nützlich für Entwickler, Automatisierer und Teams, die mehrere KI-Modelle flexibel einsetzen und ihre Kosten im Blick behalten wollen.

Zum Tool

KI-Kennzeichnung

Sämtliche Textinhalte dieser Ausgabe wurden mit Hilfe von KI erstellt und anschließend sorgsam menschlich redaktionell überprüft.

Jede Woche neu in dein Postfach

Abonniere jetzt meinen kostenlosen KI•POWERBOOST Newsletter und bleibe in der hochdynamischen KI-Welt auf dem Laufenden.

Newsletter abonnieren