Own AI App laden

Own AI · On-Device-Assistent fürs iPhone

Private KI, zu Hause auf deinem iPhone.

Own AI lässt Sprach- und Vision-Modelle direkt auf dem Gerät laufen. Chatte, befrage deine Dokumente, sprich freihändig und rechne Mathe-Aufgaben durch. Ein Einstiegsmodell ist schon dabei.

Abb. 01 Wo gedacht wird

Mit einem lokalen Modell werden deine Frage, Dokumente, Fotos und Stimme auf dem iPhone verarbeitet

Anderswo heißt fragen: senden.

Hier ist das Modell schon auf dem iPhone.

So werden eine Frage, ein Mietvertrag, ein Foto und deine Stimme dort gelesen, wo sie sind.

Lokale Inferenz sendet keinen Prompt an einen Modellanbieter.

Abb. 02 Frag deine Dokumente

Gib ihr den Mietvertrag. Sie zeigt auf die Seite.

Hänge PDFs, DOCX-, TXT-, RTF- oder Code-Dateien an und frag los. Die Suche im Dokument läuft auf dem iPhone, Scans können optional per OCR gelesen werden, und „Dokumentquellen“ zeigt die Seiten, auf die sich eine Antwort stützt.

  • Belegte Antworten, deren Quellen sichtbar sind.
  • Vollständig auf deinem Gerät durchsucht.
  • Mach im selben Chat weiter und entwirf etwa die E-Mail an den Vermieter aus dem, was wirklich im Mietvertrag steht.

Eine bewegte Skizze des Ablaufs. Frage und Antwort stammen aus dem Beispiel-Mietvertrag der App.

Ansicht „Dokumentquellen“ mit Apartment Lease.pdf, 3 Seiten, lokal für diesen Chat gespeichert
Own AI listet alle Gebühren aus einem angehängten Mietvertrag auf, mit dem Dokument-Chip über dem Eingabefeld
Eine Anschlussfrage, bei der Own AI auf Grundlage des Mietvertrags eine E-Mail an den Vermieter entwirft
  • Dokumentquellen
  • Fragen zu den Gebühren im Mietvertrag
  • Eine Anschlussfrage zur selben Datei
Eine Chat-Antwort, die x Quadrat plus eins von 0 bis 2 integriert, in vier Schritten gesetzt
Formel-Inspektor im Tab 2D mit dem Graphen von x hoch drei minus 4x und drei markierten Nullstellen

Abb. 03 Mathe, die sich selbst zeichnet

Gleichungen entfalten sich, dann werden sie zum Graphen.

Antworten zeigen LaTeX sauber gesetzt und gliedern eine Herleitung in nummerierte Schritte. Jede Formel lässt sich im Formel-Inspektor öffnen, mit vier Tabs: Formel, Schritte, 2D und 3D.

Schritt 1 von 4

A = ∫20(x² + 1) dx

= [x³3 + x]20

= (83 + 2) − 0

= 143 ≈ 4.67

  • Zieh über einen Graphen, um Koordinaten, Nullstellen und Extrema abzulesen.
  • „Matrizen & lineare Systeme“ löst Ax = b und berechnet Inverse und Eigenwerte.
  • Füge LaTeX mit Live-Vorschau ein oder schreib eine Formel von Hand auf die Mathe-Zeichenfläche.

Abb. 04 Stimme

Frag laut. Hör die Antwort.

Die Spracherkennung ist so eingestellt, dass sie auf dem Gerät läuft, und Antworten liest eine lokale Sprachausgabe mit sechs ladbaren Kokoro-Stimmen vor. Auch Audioaufnahmen lassen sich transkribieren.

Der freihändige Gesprächsmodus hört zu, antwortet laut und lässt dich ganz natürlich unterbrechen.Pro

Lokale Stimmen

Abb. 05 Das Regal

Ein Regal mit 88 Modellen, eines ist schon drin.

Ein kleines Einstiegsmodell, Qwen3 0.6B, steckt schon in der App, der erste Chat braucht also keinen Download. Von dort reicht der Katalog von 0,14 GB bis zu Riesen der Mac-Klasse, dazu kommen Apples Foundation Models auf kompatiblen Geräten mit iOS 26.

Own AI wählt ein Startmodell, das zu deinem Gerät passt. 25 der 88 verarbeiten Bilder, 22 sind kleiner als 1 GB.

Die Höhe der Buchrücken richtet sich nach der Zahl der Modelle pro Familie. Die größten Einträge sind für den Speicher eines iPad Pro oder eines Mac gedacht, nicht für ein Smartphone.

Die Checkliste stammt aus der App, die beiden Animationen sind ihre Lottie-Dateien.

Hol dir eines vom Hub nach HausePro

Durchsuche Hugging Face nach MLX-Modellen der Community. Jedes wird mit deinem Gerät abgeglichen, bevor irgendetwas geladen wird: Architektur, Dateien, Chat-Vorlage, Quantisierung und Speicher. Danach beweist ein Selbsttest mit Laden und Antworten, dass es wirklich läuft.

  • Importiere einen Modellordner direkt aus der Dateien-App.
  • „Modelle vergleichen“ schickt einen Prompt an zwei Modelle und zeigt Antworten und Tempo nebeneinander.
  • Automatische Modellwahl mit der Vorgabe „Schneller“, „Ausgewogen“ oder „Beste Qualität“.

Abb. 06–09 Unter der Oberfläche

Die Teile, die du nie siehst.

Ein Sprachmodell auf einem Smartphone laufen zu lassen, ist vor allem eine Frage des Speichers. Vier Dinge, die die Engine dafür tut, jeweils als bewegte Skizze.

06 Runden

Gelesen wird nur, was neu ist.

In jeder Runde wird der ganze Chat genau so aufbereitet, wie das Modell ihn aus dem Training kennt. Der Teil, den der Cache schon hält, wird übersprungen, nur der Rest wird eingelesen.

07 Entwurfsmodelle

Ein kleines Modell rät voraus.

Bei einigen größeren Modellen schlägt ein viel kleineres derselben Familie eine Handvoll Token vor, und das größere prüft sie in einem Durchgang. Das Ergebnis ist identisch mit dem, was das Hauptmodell allein liefert.

08 Speicherbewusstes Prefill

Lange Prompts, in passenden Portionen.

Beim Einlesen eines langen Prompts beendet ein Smartphone die App am ehesten. Deshalb wird er in Portionen gelesen, deren Größe sich nach dem Speicher richtet, der der App noch bleibt. Jede nutzt höchstens die Hälfte des Spielraums über der Speicheruntergrenze des Geräts.

09 Sitzungs-Cache

Chats merken sich, wo sie waren.

Verlässt du einen Chat, wird das Arbeitsgedächtnis des Modells dazu auf den Datenträger geschrieben. Öffnest du ihn mit demselben Modell wieder, ist der volle Kontext zurück, statt dass ein gekürztes Protokoll neu gelesen wird.

Einstellungen › Leistung hält pro Modell Medianwerte fest, gemessen auf deinem eigenen Gerät: Zeit bis zum ersten Token, Generierungstempo, Tempo der Prompt-Verarbeitung und höchster Speicherbedarf. Prompts und Antworten werden nie aufgezeichnet.

Abb. 10 Lernen

Fragen, die wiederkommen, wenn sie fällig sind.

Aus einem Dokument wird ein Lernset: Karteikarten und Quizze mit Selbstbewertung, jeweils mit Quellzitat. Eine gewusste Frage kommt nach 1, 3, 7, 14 und dann 30 Tagen wieder. Eine nicht gewusste bleibt fällig.Pro

  • Eine Frage, deren Zitat sich in ihrer Textstelle nicht finden lässt, wird verworfen.
  • „Antworten mit KI prüfen“ bewertet eine getippte Antwort: „Sieht richtig aus“, „Teilweise richtig“ oder „Nicht ganz“. Die Entscheidung bleibt bei dir.
  • Lernsets liegen verschlüsselt auf dem Gerät, und Erinnerungen sind lokale Mitteilungen.

Probier es aus: Bewerte die Karte und sieh, wann sie wiederkommt.

Abb. 11 Deins

Gib ihr ein Temperament und einen Farbton.

Sieben integrierte Persönlichkeiten, jede mit eigenem Prompt und eigener Temperatur. Das Gedächtnis ist standardmäßig deaktiviert. Aktiviert speichert es nur deinen Namen oder Details, um deren Speicherung du ausdrücklich bittest, und zwar auf diesem Gerät.

Temperatur

Niedriger ist beständiger, höher ist freier. Pro bringt eine Prompt-Bibliothek für bis zu 20 gespeicherte Personas.

Wähl eine Akzentfarbe. Diese Seite färbt sich neu ein.

Der Look „Modern“ – Papier und Tinte, mit einer Farbe deiner Wahl – bringt sieben Akzentfarben und drei Papiertöne mit, jeweils mit passendem Symbol für den Home-Bildschirm.

Papier

Abb. 12 Über die App hinaus

Es geht über die App hinaus.

„Ask Own AI“

Siri und Kurzbefehle

Sag den Satz oder bau dir etwas mit drei Kurzbefehl-Aktionen.

  • Ask Own AI
  • Get Answer from Own AI
  • Find AI Models

Begleiter für die Apple Watch

Sprich oder tippe auf einen schnellen Prompt. Das iPhone übernimmt das Denken, und eine kurze Antwort kommt zurück an dein Handgelenk. watchOS 11 oder neuer.

Drei Widgets

Model Status, Formula of the Day und Quick Actions, auf dem Home-Bildschirm.

Das Teilen-Menü

Teile Text oder einen Link aus einer anderen App und stell Fragen dazu.

ENAsk anything DEFrag irgendetwas ESPregunta lo que quieras FRDemandez n’importe quoi

Vier Sprachen

Die Oberfläche ist auf Englisch, Deutsch, Spanisch und Französisch lokalisiert.

Tafeln Elf Bildschirme, direkt aus der App

Jeder Bildschirm hier ist das Original.

Kolophon Was es braucht, was es kostet

Laden im App Store.

Laden im App Store

iPhone und iPad
iOS 18 oder neuer
Lokale Modelle
A14-Chip oder neueriPhone 12, iPhone SE (3. Generation) oder neuer
Apple Foundation Models
iOS 26und ein mit Apple Intelligence kompatibles Gerät
Apple Watch
watchOS 11 oder neuer
Sprachen
Englisch, Deutsch, Spanisch, Französisch
Quellcode
GNU AGPL v3

Kostenlos

Chatte auf dem Gerät mit einem täglichen Nachrichtenkontingent. Jedes Katalogmodell lässt sich kostenlos auswählen.

Pro

Hebt die Limits für Nachrichten und Dokumente auf. Erhältlich monatlich, jährlich oder als einmaliger Kauf auf Lebenszeit.

  • Gesprächsmodus
  • Lernsets
  • Prompt-Bibliothek
  • Unterhaltungs-Export
  • Chat-Ordner
  • Hugging-Face-Modelle
  • Eigene Modelle importieren
  • Modelle vergleichen
  • Bildeingabe

Was das Gerät verlässt, und wann. Beim Chatten mit einem lokalen Modell wird nichts gesendet. Beim Download eines Modells werden dessen Dateien von Hugging Face abgerufen. Hugging Face kann dabei deine IP-Adresse und Geräte-Header sehen, aber keine persönlichen Inhalte. Eine Websuche sendet die von dir eingegebene Suchanfrage standardmäßig an DuckDuckGo, oder an Google, wenn du das auswählst. Wenn du Apple Intelligence wählst, können Prompts und Dokumenttexte von Apple verarbeitet werden, einschließlich Private Cloud Compute, und die App fragt nach, bevor dieses Modell verwendet wird.