Link kopiert!

Neue Siri kommt: Warum Apple immer noch Schwierigkeiten hat, aufzuholen

Apple möchte GPT-4-Klasse-Modelle lokal auf Ihrem iPhone ausführen. Die Physik deutet darauf hin, dass dies unmöglich sein könnte, ohne ein Loch in Ihre Tasche zu brennen.

🌐
Automatische Übersetzung

Dieser Artikel wurde automatisch aus dem englischen Original übersetzt. Zum englischen Original

Thermische Visualisierung eines iPhone-Prozessors, der ein lokales LLM ausführt.

Als Tim Cook „Apple Intelligence“ ankündigte, war die Aussage einfach: Datenschutz. Im Gegensatz zu OpenAI oder Google, die Ihre Daten in ihre riesigen Serverfarmen einspeisen möchten, möchte Apple, dass die KI auf Ihrem Telefon lebt. Sie wollen, dass das „Gehirn“ in Ihrer Tasche sitzt.

Es klingt edel. Es klingt sicher. Aber es gibt einen Grund, warum es noch niemand getan hat. Es hat nichts mit der Codequalität zu tun. Es geht ausschließlich um Thermodynamik und Speicherbandbreite.

Apple kämpft nicht gegen Google; Sie kämpfen gegen die Physik.

Der Haken: Das „Token“-Problem

Um zu verstehen, warum Siri im Jahr 2025 immer noch dumm ist, muss man sich die Speicherbandbreite ansehen. Ein LLM ist nur eine riesige Datei mit Gewichten (Zahlen). Ein Modell mit 7 Milliarden Parametern (int4 quantisiert) ist etwa 4 GB groß.

Um ein einzelnes Wort (Token) zu generieren, muss der Prozessor die gesamte 4-GB-Datei von den RAM-Chips in die Recheneinheiten lesen. Einen Satz mit 20 Wörtern bilden? Es muss diese 4-GB-Datei 20 Mal lesen.

Deep Dive: Die Erinnerungswand

Dies ist der „Speicherbandbreitenengpass“.

  • Das Problem: Die CPU Ihres Telefons ist schnell (3 GHz). Aber der Speicher Ihres Telefons (LPDDR5X) ist ein langsamer Strohhalm.
  • Die Mathematik: Ein iPhone 16 Pro hat eine Speicherbandbreite von ungefähr 50 GB/s.
  • Die Realität: Wenn Sie ein 4-GB-Modell 20 Mal pro Sekunde bewegen müssen (um eine menschliche Lesegeschwindigkeit zu erreichen), benötigen Sie 80 GB/s Bandbreite allein für die KI.

Damit bleibt für den Rest des Telefons null Bandbreite übrig. Dies führt zu „UI Jank“. Wenn die KI spricht, stottert Ihr Scrollen. Das Telefon fühlt sich kaputt an.

Advertisement

Die thermische Hülle: 5 Watt vs. 500 Watt

Eine Nvidia H100-GPU in einem Rechenzentrum verbraucht 700 Watt. Es verfügt über eine massive Flüssigkeitskühlung, um ein Schmelzen zu verhindern. Ein iPhone hat einen Gesamtwärmehaushalt von etwa 5 Watt. Bei höheren Werten ist der Akku in 45 Minuten leer und das Gehäuse wird zu heiß zum Halten.

Die Ingenieure von Apple versuchen, einen 700-Watt-Algorithmus in einen 5-Watt-Umschlag zu quetschen. Dies erreichen sie durch extreme Quantisierung (das Modell dümmer machen, um es kleiner zu machen) und „spekulative Dekodierung“ (3 Wörter vorausraten).

Aber die Hitze lügt nicht. Frühe Tests von iOS 19 zeigen, dass bei starker KI-Nutzung die Bildschirmhelligkeit nach 3 Minuten abnimmt. Das ist eine thermische Drosselung, die den Akku schützt.

Kontextgeschichte: Der RAM-Geiz kommt wieder zum Biss

Apple geizte jahrelang mit RAM. Ein iPhone hätte 6 GB, während ein Samsung Galaxy 12 GB hätte. Apple argumentierte: „Das Betriebssystem ist effizient! Es braucht nicht mehr RAM.“ Sie hatten Recht: für Apps. Sie lagen falsch: für KI.

Da das KI-Modell „heiß“ (im RAM geladen) bleiben muss, um reagieren zu können, verbraucht dieses 4-GB-Modell 50 % des Telefonspeichers.

  • Das Ergebnis: Wenn Sie Siri eine Frage stellen, muss das Telefon Instagram und Safari „killen“, um Platz für Siris Gehirn zu schaffen.
  • Das Benutzererlebnis: Sie kehren zu Safari zurück und die Seite wird neu geladen.

Aus diesem Grund wird gemunkelt, dass das iPhone 18 auf 12 GB oder 16 GB RAM springen soll. Es ist nicht für Spiele. Es geht darum, das KI-Gehirn am Leben zu halten, ohne Ihre anderen Apps zu zerstören.

Vorausschauende Analyse: Der „Private Cloud“-Kompromiss

Apple weiß, dass On-Device den Qualitätskampf verliert. Ein 3B-Parametermodell auf einem Telefon wird niemals so intelligent sein wie ein 1-TB-Parametermodell in der Cloud (GPT-4).

Aus diesem Grund haben sie Private Cloud Compute (PCC) entwickelt. Es ist ein Eingeständnis einer physikalischen Niederlage. Wenn Ihre Anfrage für das Telefon zu schwierig ist (Wärme-/Speichergrenzen), wird sie an eine Apple Silicon-Serverfarm weitergeleitet. Apple schwört, dass die Daten sofort gelöscht werden. Benutzer müssen ihnen vertrauen.

Aber die Zukunft liegt nicht nur „On-Device“. Es ist hybrid.

  • Tiny Brain (Telefon): Behandelt „Licht einschalten“, „Diesen Text lesen“, „Timer einstellen“.
  • Big Brain (Cloud): Behandelt „Eine E-Mail an den Chef schreiben“, „Dieses PDF zusammenfassen“, „Ein Bild erstellen“.

Das Fazit

Die neue Siri hat keine Probleme, weil die Ingenieure von Apple vergessen haben, wie man programmiert. Es ist schwierig, weil sich die Definition von „Berechnung“ über Nacht von „Burst“ (Öffnen einer App) zu „Sustained“ (Generieren von Token) geändert hat. Bis sich die Batteriechemie oder die Speicherphysik ändern, wird der Traum von einer superintelligenten, völlig privaten KI in der Tasche genau das bleiben: ein Traum.

Quellen (3)

Advertisement

🦋 Diskussion auf Bluesky

Auf Bluesky diskutieren

Beiträge werden gesucht...