Zum Inhalt springen
3 Min. Lesezeit

GPT-6 und Opus 5.5 kosten weniger, Nvidias neues OSS-Transkriptionsmodell, Google plant privates Gedächtnis in der Cloud

PerformanceKI-AgentenOpen-Weight-ModelleResearchInvestmentLokale KIVoice-Agenten

Guten Morgen!

Im heutigen Briefing geht es um günstigere Modelle, Fortschritte von Google und neue Modelle zur lokalen Verwendung, außerdem gibt es weitere Finanzierungsrunden für AI-Startups.

OpenAI und Anthropic verschärfen den Modell-Preiskampf

Mit der Veröffentlichung von GPT-6 Sol und Luna hat OpenAI die Preise gegenüber den entsprechenden GPT-5.6-Modellen ungefähr halbiert. Anthropic zufolge erreicht ihr neues Modell Claude Opus 5.5 bei den meisten Aufgaben das Niveau von Fable 5.1 und kostet bei der Standardeinstellung 40-50% Prozent weniger als Opus 5. Der Listenpreis fiel um 20 Prozent auf 4 beziehungsweise 20 Dollar je Million Input- und Output-Token. [1] [2] [3]

Google automatisiert wissenschaftliche Optimierung

Googles Empirical Research Assistance (ERA) protokolliert mithilfe einer Baumstruktur Ergebnisse aus bisherigen Experimente und lässt Gemini selbständig vielversprechende Notebooks auswählen und verändern**.** Laut dem beteiligten Forscher John Platt gingen daraus mindestens zehn wissenschaftlich relevante Arbeiten hervor; ungeeignete Metriken und Overfitting bleiben zentrale Risiken.

"Es ist fast als hätte man einen übereifrigen Forschungsassistenten, der niemals schläft"

[4]

Google plant privates Langzeitgedächtnis in der Cloud

Google will ihre Architektur "Private AI Compute" um einen persistenten, geräteübergreifenden Speicher für persönliche KI-Assistenten erweitern. Nutzerdaten sollen verschlüsselt in individuellen Datenbanken liegen, während persönliche Geräte die Schlüssel halten; zur Verarbeitung werden die Daten vorübergehend in einer Secure Enclave entschlüsselt. Geräte sollen außerdem die Authentizität der Serversoftware prüfen, bevor sie persönliche Daten übertragen. [5]

Gemini 3.8 erzeugt und repliziert Stimmen

Google hat Gemini 3.8 Flash TTS und Flash-Lite TTS für steuerbare Sprachausgabe vorgestellt. Flash kann Stimmen per Textbeschreibung gestalten oder anhand einer 30-sekündigen Aufnahme replizieren und unterstützt mehr als 100 Sprachen und Dialekte. Für die Replikation verlangt Google eine passende Einwilligungsaufnahme und Nutzungsrechte; SynthID-Wasserzeichen und C2PA-Nachweise sollen generierte Audiodateien kennzeichnen. [6]

Nvidia veröffentlicht Open-Weight-Modell mitSprecherzuordnung

Nvidias Nemotron 3 Diarization ist ein Open-Weight-Modell mit 100 Millionen Parametern für Speaker Diarization in Live-Aufnahmen und aufgezeichneten Gesprächen. Es unterstützt bis zu acht Sprecher sowie überlappende Sprache und belegte laut Nvidia mit 14,72 Prozent Fehlerrate Platz eins im ersten VoiceArena Diarization-Bench. Das Modell liefert anonyme Sprecherkanäle, die für Transkripte mit separater Spracherkennung kombiniert werden müssen. [7]

Ema erhält 77 Millionen Dollar für Unternehmensagenten

Ema hat in einer Series-B-Runde 77 Millionen Dollar aufgenommen und die Gesamtfinanzierung damit auf 140 Millionen Dollar erhöht. Das Startup koordiniert Teams von KI-Agenten, die mehrstufige Abläufe in HR, IT und Finanzen über bestehende Unternehmensanwendungen hinweg ausführen. Ema meldet mehr als eine Million aktive Unternehmensnutzer und über 150 Millionen Dollar gebuchtes Vertragsvolumen, einschließlich mehrjähriger Verträge. [8]

Snorkel AI verdreifacht Bewertung nahezu auf 3,5 Milliarden Dollar

Snorkel AI hat eine 350 Millionen Dollar Finanzierungsrunde abgeschlossen und wird nun mit 3,5 Milliarden Dollar bewertet, fast dreimal so hoch wie vor 17 Monaten. Das Unternehmen liefert vollständige Trainingsdatensätze und Reinforcement-Learning-Umgebungen, die Synthetic Data mit der Arbeit von Fachexperten verbinden. Snorkel beziffert seine annualisierte Umsatzrate (ARR) auf 375 Millionen Dollar, 18-mal so viel wie zwölf Monate zuvor. [9]

Qualcomm bringt größere KI-Modelle lokal aufs Smartphone

Qualcomm hat die Prozessoren Snapdragon 8 Elite Gen 6 und Elite Extreme Gen 6 für kommende Smartphones vorgestellt. Die Extreme-Variante soll ein Mixture-of-Experts-Modell mit insgesamt 30 Milliarden Parametern lokal ausführen können. Ein neuer Sensor-Hub unterstützt kleinere Modelle bis 200 Millionen Parameter für Sprecherunterscheidung, persönliche Erinnerungen und lokale Voice Agents; Motorola kündigte ein erstes Smartphone für dieses Jahr an. [10]

Constantin Luckenbach

Constantin Luckenbach
LinkedIn
constantin@sicher-ki.de
+49 160 94620957

Philipp Parzer

Philipp Parzer
LinkedIn
phil@sicher-ki.de
+43 660 543 9322

Zeit für individuelle Insights?

Wir sind KI-Experten und haben in und mit mehreren KI-Startups gearbeitet. Für etablierte Unternehmen jeder Größe haben wir KI in bestehende Abläufe integriert. Wir bringen zehn Jahre Erfahrung als Softwareentwickler und Business-Owner mit.

Quellen

  1. [AINews] Claude Opus 5.5, the new default model for AINews — and everybody cuts prices 40-50%
  2. Claude Opus 5.5, GPT-6 Sol, GPT-6 Luna, and a new price war
  3. GPT-6 ⚡, Opus 5.5 🧠, AI leaders at UN 🌐
  4. 🔬 An Oscar, Two Asteroids, and the Algorithm in Your sklearn: John Platt on AI for Science
  5. Advancing confidential AI with secure memory
  6. Gemini 3.8 text-to-speech says hello
  7. **Know Who Spoke When: Build Real-Time, Multi-Speaker AI with NVIDIA Nemotron 3 Diarization**
  8. Ema raises $77M as AI starts eating into enterprise software and services | TechCrunch
  9. Snorkel AI triples valuation to $3.5B as demand for AI training data booms | TechCrunch
  10. Qualcomm launches two new smartphone chips with emphasis on AI | TechCrunch