06 Runden
Gelesen wird nur, was neu ist.
In jeder Runde wird der ganze Chat genau so aufbereitet, wie das Modell ihn aus dem Training kennt. Der Teil, den der Cache schon hält, wird übersprungen, nur der Rest wird eingelesen.
Own AI · On-Device-Assistent fürs iPhone
Own AI lässt Sprach- und Vision-Modelle direkt auf dem Gerät laufen. Chatte, befrage deine Dokumente, sprich freihändig und rechne Mathe-Aufgaben durch. Ein Einstiegsmodell ist schon dabei.
Abb. 01 Wo gedacht wird
Anderswo heißt fragen: senden.
Hier ist das Modell schon auf dem iPhone.
So werden eine Frage, ein Mietvertrag, ein Foto und deine Stimme dort gelesen, wo sie sind.
Lokale Inferenz sendet keinen Prompt an einen Modellanbieter.
Chatverlauf, importierte Dokumente, Suchindizes, gespeicherte Prompts und das Gedächtnis des Assistenten.
Kein Tracking und keine erfassten Daten.
Modell-Downloads, Websuche und Apple Intelligence sprechen mit ihren eigenen Diensten, und nur dann, wenn du sie nutzt.
Abb. 02 Frag deine Dokumente
Hänge PDFs, DOCX-, TXT-, RTF- oder Code-Dateien an und frag los. Die Suche im Dokument läuft auf dem iPhone, Scans können optional per OCR gelesen werden, und „Dokumentquellen“ zeigt die Seiten, auf die sich eine Antwort stützt.
Eine bewegte Skizze des Ablaufs. Frage und Antwort stammen aus dem Beispiel-Mietvertrag der App.





Abb. 03 Mathe, die sich selbst zeichnet
Antworten zeigen LaTeX sauber gesetzt und gliedern eine Herleitung in nummerierte Schritte. Jede Formel lässt sich im Formel-Inspektor öffnen, mit vier Tabs: Formel, Schritte, 2D und 3D.
A = ∫20(x² + 1) dx
= [x³3 + x]20
= (83 + 2) − 0
= 143 ≈ 4.67
Abb. 04 Stimme
Die Spracherkennung ist so eingestellt, dass sie auf dem Gerät läuft, und Antworten liest eine lokale Sprachausgabe mit sechs ladbaren Kokoro-Stimmen vor. Auch Audioaufnahmen lassen sich transkribieren.
Der freihändige Gesprächsmodus hört zu, antwortet laut und lässt dich ganz natürlich unterbrechen.Pro
Abb. 05 Das Regal
Ein kleines Einstiegsmodell, Qwen3 0.6B, steckt schon in der App, der erste Chat braucht also keinen Download. Von dort reicht der Katalog von 0,14 GB bis zu Riesen der Mac-Klasse, dazu kommen Apples Foundation Models auf kompatiblen Geräten mit iOS 26.
Own AI wählt ein Startmodell, das zu deinem Gerät passt. 25 der 88 verarbeiten Bilder, 22 sind kleiner als 1 GB.
Die Höhe der Buchrücken richtet sich nach der Zahl der Modelle pro Familie. Die größten Einträge sind für den Speicher eines iPad Pro oder eines Mac gedacht, nicht für ein Smartphone.
Die Checkliste stammt aus der App, die beiden Animationen sind ihre Lottie-Dateien.
Durchsuche Hugging Face nach MLX-Modellen der Community. Jedes wird mit deinem Gerät abgeglichen, bevor irgendetwas geladen wird: Architektur, Dateien, Chat-Vorlage, Quantisierung und Speicher. Danach beweist ein Selbsttest mit Laden und Antworten, dass es wirklich läuft.
Abb. 06–09 Unter der Oberfläche
Ein Sprachmodell auf einem Smartphone laufen zu lassen, ist vor allem eine Frage des Speichers. Vier Dinge, die die Engine dafür tut, jeweils als bewegte Skizze.
06 Runden
In jeder Runde wird der ganze Chat genau so aufbereitet, wie das Modell ihn aus dem Training kennt. Der Teil, den der Cache schon hält, wird übersprungen, nur der Rest wird eingelesen.
07 Entwurfsmodelle
Bei einigen größeren Modellen schlägt ein viel kleineres derselben Familie eine Handvoll Token vor, und das größere prüft sie in einem Durchgang. Das Ergebnis ist identisch mit dem, was das Hauptmodell allein liefert.
08 Speicherbewusstes Prefill
Beim Einlesen eines langen Prompts beendet ein Smartphone die App am ehesten. Deshalb wird er in Portionen gelesen, deren Größe sich nach dem Speicher richtet, der der App noch bleibt. Jede nutzt höchstens die Hälfte des Spielraums über der Speicheruntergrenze des Geräts.
09 Sitzungs-Cache
Verlässt du einen Chat, wird das Arbeitsgedächtnis des Modells dazu auf den Datenträger geschrieben. Öffnest du ihn mit demselben Modell wieder, ist der volle Kontext zurück, statt dass ein gekürztes Protokoll neu gelesen wird.
Einstellungen › Leistung hält pro Modell Medianwerte fest, gemessen auf deinem eigenen Gerät: Zeit bis zum ersten Token, Generierungstempo, Tempo der Prompt-Verarbeitung und höchster Speicherbedarf. Prompts und Antworten werden nie aufgezeichnet.
Abb. 10 Lernen
Aus einem Dokument wird ein Lernset: Karteikarten und Quizze mit Selbstbewertung, jeweils mit Quellzitat. Eine gewusste Frage kommt nach 1, 3, 7, 14 und dann 30 Tagen wieder. Eine nicht gewusste bleibt fällig.Pro
Probier es aus: Bewerte die Karte und sieh, wann sie wiederkommt.
Abb. 11 Deins
Sieben integrierte Persönlichkeiten, jede mit eigenem Prompt und eigener Temperatur. Das Gedächtnis ist standardmäßig deaktiviert. Aktiviert speichert es nur deinen Namen oder Details, um deren Speicherung du ausdrücklich bittest, und zwar auf diesem Gerät.
Temperatur
Niedriger ist beständiger, höher ist freier. Pro bringt eine Prompt-Bibliothek für bis zu 20 gespeicherte Personas.
Der Look „Modern“ – Papier und Tinte, mit einer Farbe deiner Wahl – bringt sieben Akzentfarben und drei Papiertöne mit, jeweils mit passendem Symbol für den Home-Bildschirm.
Abb. 12 Über die App hinaus
„Ask Own AI“
Sag den Satz oder bau dir etwas mit drei Kurzbefehl-Aktionen.
Sprich oder tippe auf einen schnellen Prompt. Das iPhone übernimmt das Denken, und eine kurze Antwort kommt zurück an dein Handgelenk. watchOS 11 oder neuer.
Model Status, Formula of the Day und Quick Actions, auf dem Home-Bildschirm.
Teile Text oder einen Link aus einer anderen App und stell Fragen dazu.
Die Oberfläche ist auf Englisch, Deutsch, Spanisch und Französisch lokalisiert.
Tafeln Elf Bildschirme, direkt aus der App
Kolophon Was es braucht, was es kostet
Chatte auf dem Gerät mit einem täglichen Nachrichtenkontingent. Jedes Katalogmodell lässt sich kostenlos auswählen.
Hebt die Limits für Nachrichten und Dokumente auf. Erhältlich monatlich, jährlich oder als einmaliger Kauf auf Lebenszeit.
Was das Gerät verlässt, und wann. Beim Chatten mit einem lokalen Modell wird nichts gesendet. Beim Download eines Modells werden dessen Dateien von Hugging Face abgerufen. Hugging Face kann dabei deine IP-Adresse und Geräte-Header sehen, aber keine persönlichen Inhalte. Eine Websuche sendet die von dir eingegebene Suchanfrage standardmäßig an DuckDuckGo, oder an Google, wenn du das auswählst. Wenn du Apple Intelligence wählst, können Prompts und Dokumenttexte von Apple verarbeitet werden, einschließlich Private Cloud Compute, und die App fragt nach, bevor dieses Modell verwendet wird.