Zum Inhalt springen
3 Min. Lesezeit

Voice-Agenten, verlässlichere Workflows und neue Prüfstandards

KI-AgentenOpen-Weight-ModelleComplianceCybersecurityLokale KI

Guten Morgen!

Im heutigen Briefing geht es um Voice-Modelle, Agentenprüfungen, Enterprise-KI, neue Abos und eine mögliche Übernahme.

Google bringt Gemini 3.8 Live für Voice-Agenten

Google führt Gemini 3.8 Live und eine Extended-Thinking-Version für komplexe, mehrstufige Voice-Workflows ein. Laut Anbieter können die Modelle während eines Gesprächs Tools aufrufen; 3.8 Live verarbeitet zudem visuelle Eingaben und ermöglicht Wechseln zwischen 97 Sprachen.

Der Rollout läuft über Gemini API und AI Studio, für Unternehmen zunächst teilweise als Vorschau mit Einladung. Google meldet für Extended Thinking 68,6 Prozent auf τ-Voice und 35,1 Prozent auf τ-Voice-banking; unabhängige Praxisergebnisse fehlen bislang. Generiertes Audio wird mit SynthID markiert. [1]

Wiederholte Tests zeigen Konsistenzlücke bei Agenten

Ein ReAct-Agent mit GPT-4.1 löste im AppWorld-Test durchschnittlich 77,4 Prozent der Aufgaben, bestand aber nur 53 Prozent in allen fünf Wiederholungen. IBM-Forscher sprechen hierbei von einem "Consistency Gap".

Ihr Consistency Analyzer identifiziert instabile Entscheidungspunkte anhand vorhandener Aufzeichnungen über die Aktivität der Agenten, ohne Aufgaben vollständig erneut auszuführen. Automatisch erzeugte Handlungsrichtlinien verringerten den Unterschied laut Studie von 24,4 auf 12 Prozentpunkte, ohne die durchschnittliche Genauigkeit zu reduzieren. [2]

Frontier-Labs beraten über gemeinsame Sicherheitsstandards

OpenAI, Anthropic und Google DeepMind sprechen laut OpenAIs Politikchef Chris Lehane seit mehreren Wochen über KI-Sicherheit. Berichten zufolge erwägen die Unternehmen auch ein gemeinsames Gremium; Details zur Ausgestaltung sind bislang nicht bekannt.

Parallel veröffentlichte das AI Evaluator Forum mit AEF-1 einen vorgeschlagenen Mindeststandard für unabhängige Prüfungen. Anthropic sagte eingebetteten Prüfern weitreichenden internen Zugang zu, OpenAI unterstützt das Konzept ebenfalls; mögliche Konflikte mit dem Wettbewerbsrecht bleiben ungeklärt. [3] [4]

AIUC prüft KI-Agenten mit rund 5.000 Tests

AIUC bietet Unternehmen eine externe Prüfung und Zertifizierung von KI-Agenten nach dem eigenen Standard AIUC-1 an. Rund 5.000 Tests untersuchen unter anderem Jailbreaks, Halluzinationen und Datenlecks; KI-Systeme führen die Prüfungen aus und analysieren die Daten, Menschen verifizieren den abschließenden Audit.

AIUC nennt Cursor, Lovable, Harvey und ElevenLabs als Kunden und hat eine Series A über 40 Millionen Dollar abgeschlossen. In den Standard fließen Rückmeldungen eines Konsortiums aus etwa 250 Sicherheits- und Risikoverantwortlichen ein. [5]

Salesforce und Nvidia entwickeln eigenes Reasoning-Modell

Salesforce will mit Koa erstmals ein eigenes Reasoning-Modell als Alternative zu geschlossenen Frontier-Modellen in Agentforce anbieten. Das auf Nvidias Open-Weight-Modell Nemotron basierende System wurde per Post-Training auf Vertrieb, Marketing und Kundenservice spezialisiert.

Derartige Anpassungen an Open-Source Modelle werden unter dem Begriff SLM's (Small Local Models) auch für datenschutzbewusste Mittelständler immer interessanter.

Nach Angaben von Salesforce kamen synthetische statt realer Kundendaten zum Einsatz. Koa soll weniger Tokens benötigen und über das Agentforce-Gateway je nach Aufgabe ausgewählt werden; konkrete Vergleichswerte zu Leistung und Kosten nannte das Unternehmen nicht. [6]

Meta bündelt KI-Funktionen in neuen Abos

Meta führt mit Meta One neue Abonnements für erweiterte KI-Nutzung auf Facebook, Instagram und WhatsApp ein. Core kostet 7,99 Dollar und Premium 19,99 Dollar monatlich; genaue Nutzungslimits hängen laut Meta von Land, Anwendung und Systembedingungen ab.

Für Unternehmen und Creator beginnen die Tarife bei 14,99 Dollar und reichen bis zu einer Max-Stufe ab 499 Dollar monatlich. Je nach Tarif umfassen sie höhere Limits des Meta Business Agent, Teamzugänge, Analytics, WhatsApp-Funktionen und die Erkennung von Identitätsmissbrauch. [7]

OpenAI soll Glass Imaging übernommen haben

OpenAI hat den Smartphone-Kameraspezialisten Glass Imaging laut Wall Street Journal für mehr als 300 Millionen Dollar übernommen. Das 2019 gegründete Unternehmen nutzt neuronale Netze, um Aufnahmen direkt beim Auslösen an die Eigenschaften einzelner Kamerasysteme anzupassen.

Die Gründer arbeiteten zuvor bei Apple am Portrait Mode. OpenAI bestätigte den Bericht zunächst nicht; bereits 2025 hatte das Unternehmen das von Jony Ive mitgegründete Geräte-Startup io für 6,5 Milliarden Dollar gekauft. [8]

Constantin Luckenbach

Constantin Luckenbach
LinkedIn
constantin@sicher-ki.de
+49 160 94620957

Philipp Parzer

Philipp Parzer
LinkedIn
phil@sicher-ki.de
+43 660 543 9322

Zeit für individuelle Insights?

Wir sind KI-Experten und haben in und mit mehreren KI-Startups gearbeitet. Für etablierte Unternehmen jeder Größe haben wir KI in bestehende Abläufe integriert. Wir bringen zehn Jahre Erfahrung als Softwareentwickler und Business-Owner mit.

Quellen

  1. Introducing Gemini 3.8 Live and 3.8 Live Extended Thinking
  2. Your Agent Aced the Task. Will It Do It Again?
  3. [AINews] AEF-1 standard emerges for Third Party Evaluators, as Xai, OpenAI, and Anthropic all cosign
  4. OpenAI, Anthropic, Google have been in talks on AI safety for weeks | TechCrunch
  5. Early Anthropic hire, former METR COO have found a way to rein in rogue AI agents | TechCrunch
  6. Salesforce and Nvidia's new reasoning model is everything the AI labs should fear | TechCrunch
  7. Meta expands subscription push with new AI-focused plans | TechCrunch
  8. OpenAI buys smartphone camera maker Glass Imaging for $300 million, report says | TechCrunch