Nach Jahren der Verschiebungen, die Berichten zufolge einige Mitarbeiter ihre Jobs kosteten, hat Apple endlich einen komplett neu aufgebauten Siri ausgeliefert. Der Assistent, jetzt als „Siri AI" vermarktet, ist ab heute als Beta verfügbar und stellt die tiefgreifendste Überarbeitung des Produkts seit seiner ersten Einführung dar. Das überraschendste Detail ist nicht die Benutzeroberfläche oder die neuen Stimmen – es ist das, was darunter steckt: Googles Gemini-Modelle.

Die Veröffentlichung ist ein bemerkenswerter Moment für Apple, das einen Großteil der vergangenen Jahre damit verbracht hat, sich als ein Unternehmen zu positionieren, das so viel Berechnung wie möglich auf der Hardware des Nutzers selbst behält. Das Fundament seines Flaggschiff-Assistenten an die Modellfamilie eines Konkurrenten zu übergeben, ist ein pragmatisches Eingeständnis, dass der Aufbau von Sprachmodellen in Frontier-Größenordnung im eigenen Haus länger dauert, als der Markt zu warten bereit war.

Das Gemini-Fundament hinter dem neuen Siri

Laut Apple läuft der neue Siri teilweise auf dem Gerät und teilweise über Private Cloud Compute, die datenschutzorientierte Server-Infrastruktur des Unternehmens. Apple erklärt, dass persönliche Daten der Nutzer weder gespeichert noch dem Unternehmen selbst zugänglich gemacht werden – eine Behauptung, die zentral dafür geworden ist, wie Apple seine KI-Geschichte rahmt. Das hybride Design bedeutet, dass einfachere Anfragen lokal bearbeitet werden können, während schwerere Denkaufgaben in die Cloud ausgelagert werden.

Ob diese Aufteilung einer Prüfung standhält, ist eine offene Frage, doch sie spiegelt ein breiteres Branchenmuster wider: Leistungsfähige Assistenten erfordern zunehmend eine Mischung aus lokaler Hardware und Remote-Compute. Apples Antwort besteht darin, die Cloud-Ebene proprietär und vertraglich eingeschränkt zu halten, statt alles an eine Drittanbieter-API weiterzuleiten.

  • On-Device-Verarbeitung für leichte Aufgaben
  • Private Cloud Compute für anspruchsvollere Anfragen
  • Persönliche Daten werden laut Unternehmen weder gespeichert noch Apple zugänglich gemacht
  • Gemini-Modelle liefern die zugrunde liegende Sprachfähigkeit

Was der neu aufgebaute Assistent tatsächlich kann

Die zentrale Fähigkeit ist persönlicher Kontext. Apple erklärt, dass Siri nun auf Informationen aus Nachrichten, E-Mails und Fotos zugreifen, lesen kann, was gerade auf dem Bildschirm angezeigt wird, und Ergebnisse aus dem Web einbeziehen kann. Diese Kombination soll den Assistenten über Einzelbefehl-Interaktionen hinaus in mehrstufige Aufgaben führen.

Systemweite App-Aktionen erweitern die Reichweite weiter. Siri kann im Namen des Nutzers eine E-Mail entwerfen oder ein Foto bearbeiten und teilen. Apples eigenes Beispiel beinhaltet die Anfrage nach einem Familienrezept, das in einer Messages-Unterhaltung erwähnt wurde, woraufhin Siri die Zutaten in die Reminders-App überträgt – eine Aktionskette, die zuvor mehrere manuelle Schritte erfordert hätte.

Auch die Integration von Drittanbietern gehört zum Angebot. Siri funktioniert zum Start mit Apps wie WhatsApp und Audible, wobei Outlook, Notability und Tripsy folgen sollen. Es gibt zudem mehrere Möglichkeiten, den Assistenten aufzurufen.

  • Das Weckwort „Hey Siri"
  • Die Seitentaste
  • Die Dynamic Island
  • Spotlight auf iPad und Mac

Eine eigene Siri-App synchronisiert Chat-Verläufe über iCloud geräteübergreifend, und Apple fügt neue Stimmen zusammen mit einer überarbeiteten Diktierfunktion hinzu, die laut Unternehmen auf seinem On-Device-Modell AFM Core Advanced läuft.

Eine schrittweise Einführung, ohne die EU und China

Vorerst ist Siri AI nur auf Englisch verfügbar und als Beta gekennzeichnet. Apple erklärt, dass Unterstützung für Französisch, Japanisch, Koreanisch, Portugiesisch und Spanisch im nächsten Monat folgen wird. Die Funktionen sind an den Software-Zyklus 2027 gebunden und erscheinen in iOS 27, iPadOS 27, macOS 27, watchOS 27 und visionOS 27.

Die folgenreichere Einschränkung ist geografischer Natur. Der Dienst wird in dieser Phase nicht in der Europäischen Union oder China starten. Regulatorische Reibungen in beiden Märkten haben wiederholt beeinflusst, wie große Plattformbetreiber KI-Funktionsveröffentlichungen staffeln, und Apples Entscheidung hält die ehrgeizigsten Teile seines Assistenten vorerst aus zwei bedeutenden Regionen heraus. Nutzer dort müssen auf einen Zeitplan warten, den Apple noch nicht genannt hat.

Jenseits von Siri: Apple Intelligence breitet sich im gesamten System aus

Siri ist nur ein Teil der Geschichte. Apple verteilt KI-Funktionen über seine Betriebssysteme hinweg und berührt Apps, die weit über den Assistenten selbst hinausgehen. Die Photos-App erhält Werkzeuge wie Spatial Reframing, Extend und eine überarbeitete Clean-Up-Funktion.

Image Playground kann nun fotorealistische Bilder generieren, eine Fähigkeit, die laut Apple über Private Cloud Compute läuft. Das Unternehmen hat zudem angedeutet, dass die Funktion den SynthID-Standard unterstützen wird, einen Wasserzeichen-Ansatz, der signalisieren soll, dass ein Bild synthetisch erzeugt wurde – ein Detail, das an Bedeutung gewinnt, da der Druck auf Plattformen wächst, KI-generierte Medien zu kennzeichnen.

  • Photos: Spatial Reframing, Extend und ein neu aufgebautes Clean Up
  • Image Playground: fotorealistische Generierung über Private Cloud Compute
  • Wasserzeichen: geplante SynthID-Unterstützung

Erste Eindrücke: praktische Fortschritte, anhaltende Verwirrung

Frühe Tester haben die praktischen Verbesserungen allgemein gelobt. Der Assistent scheint in Alltagssituationen nützlicher zu sein und bewältigt kontextbewusste Anfragen und app-übergreifende Aktionen, die der alte Siri nicht konnte. Das ist eine bedeutende Verschiebung für ein Produkt, das in der Kategorie der Sprachassistenten zum Synonym für unerfüllte Versprechen geworden war.

Das Lob ist nicht bedingungslos. Rezensenten berichten, dass Missverständnisse weiterhin auftreten, was darauf hindeutet, dass die neue Architektur die Fehler nicht beseitigt hat, die Nutzer lange frustriert haben. Besonders die Zuverlässigkeit bei mehrstufigen Aufgaben bleibt das schwierigste Problem – ein Assistent, der vier Schritte korrekt ausführt und beim fünften scheitert, kann ärgerlicher sein als einer, der es nie versucht hat.

Was als Nächstes zu beobachten ist

Das Beta-Label gibt Apple Raum zur Iteration, und die für nächsten Monat erwartete Spracherweiterung wird ein früher Test dafür sein, ob das Gemini-gestützte System über Englisch hinaus generalisiert. Die größeren Fragen sind struktureller Natur: Wie viel der Erfahrung kann Apple irgendwann wieder ins eigene Haus zurückholen, wann werden Regulierungsbehörden in der EU und China die Funktion sehen, und halten die Datenschutzgarantien rund um Private Cloud Compute einer unabhängigen Prüfung stand.

Vorerst hat Apple etwas getan, was es jahrelang vermieden hatte – den Assistenten ausgeliefert, den es immer wieder versprochen hatte, wobei die Technologie eines Konkurrenten einen Großteil der schweren Arbeit übernimmt.

Dieser Artikel basiert auf einer Berichterstattung von The Decoder. Lesen Sie den Originalartikel.

Originally published on the-decoder.com