06 Tours
Seul le nouveau est lu.
À chaque tour, toute la discussion est mise en forme exactement comme le modèle l’a vue à l’entraînement. La partie que le cache contient déjà n’est pas relue, et seul le reste est transmis au modèle.
Own AI · assistant local pour iPhone
Own AI exécute des modèles de langage et de vision directement sur l’appareil. Discutez, interrogez vos documents, parlez en mains libres et faites des maths pas à pas, avec un modèle de départ déjà inclus.
Fig. 01 Là où se fait la réflexion
Ailleurs, demander, c’est envoyer.
Ici, le modèle est déjà dans le téléphone.
Une question, un bail, une photo et votre voix sont donc lus là où ils se trouvent.
L’inférence locale n’envoie aucun prompt à un fournisseur de modèles.
L’historique des conversations, les documents importés, les index de recherche, les prompts enregistrés et la mémoire de l’assistant.
Aucun suivi, aucune donnée collectée.
Le téléchargement de modèles, la recherche web et Apple Intelligence communiquent avec leurs propres services, et seulement lorsque vous les utilisez.
Fig. 02 Interrogez vos documents
Joignez des fichiers PDF, DOCX, TXT, RTF ou du code, puis posez votre question. La recherche s’effectue sur le téléphone, les documents numérisés peuvent passer par un OCR facultatif, et Sources du document affiche les pages sur lesquelles s’appuie une réponse.
Un croquis animé du déroulement. La question et la réponse proviennent du bail d’exemple de l’app.





Fig. 03 Des maths qui se dessinent toutes seules
Les réponses affichent le LaTeX et regroupent une démonstration en étapes numérotées. Toute formule s’ouvre dans l’Inspecteur de formule, avec quatre onglets : Formule, Étapes, 2D et 3D.
A = ∫20(x² + 1) dx
= [x³3 + x]20
= (83 + 2) − 0
= 143 ≈ 4.67
Fig. 04 Voix
La reconnaissance vocale est configurée pour s’exécuter sur l’appareil, et les réponses sont lues à voix haute par une synthèse vocale locale, avec six voix Kokoro à télécharger. Les enregistrements audio peuvent aussi être transcrits.
Le mode conversation mains libres écoute, répond à voix haute et vous laisse l’interrompre naturellement.Pro
Fig. 05 L’étagère
Un petit modèle de départ, Qwen3 0.6B, est livré avec l’app : la première discussion ne demande donc aucun téléchargement. Le catalogue va ensuite de 0,14 Go jusqu’à des géants taillés pour le Mac, auxquels s’ajoutent les Foundation Models d’Apple sur les appareils compatibles sous iOS 26.
Own AI choisit un modèle de départ adapté à votre appareil. 25 des 88 acceptent les images ; 22 pèsent moins de 1 Go.
La hauteur de chaque dos suit le nombre de modèles par famille. Les plus volumineux sont prévus pour la mémoire d’un iPad Pro ou d’un Mac, pas pour un téléphone.
La liste de contrôle est celle de l’app ; les deux animations sont ses fichiers Lottie.
Recherchez sur Hugging Face des modèles MLX de la communauté. Chacun est vérifié par rapport à votre appareil avant tout téléchargement : architecture, fichiers, modèle de conversation, quantification et mémoire. Ensuite, un autotest de chargement et de réponse prouve qu’il fonctionne réellement.
Fig. 06–09 Sous la page
Faire tourner un modèle de langage sur un téléphone est avant tout une question de mémoire. Voici quatre choses que fait le moteur pour y répondre, chacune esquissée en mouvement.
06 Tours
À chaque tour, toute la discussion est mise en forme exactement comme le modèle l’a vue à l’entraînement. La partie que le cache contient déjà n’est pas relue, et seul le reste est transmis au modèle.
07 Modèles brouillons
Pour quelques grands modèles, un modèle bien plus petit de la même famille propose une poignée de tokens, que le grand vérifie en une seule passe. Le résultat est identique à celui du modèle principal utilisé seul.
08 Préremplissage selon la mémoire
C’est à la lecture d’un long prompt qu’un téléphone risque le plus de fermer l’app. Il est donc lu par blocs dimensionnés selon la mémoire qu’il reste à l’app, chacun utilisant au plus la moitié de la marge disponible au-dessus du plancher mémoire de l’appareil.
09 Cache de session
Quittez une discussion, et la mémoire de travail que le modèle en a est écrite sur le disque. Rouvrez-la avec le même modèle, et tout le contexte revient, au lieu de la relecture d’une transcription tronquée.
Réglages › Performances conserve, pour chaque modèle, des médianes mesurées sur votre propre appareil : délai avant le premier token, vitesse de génération, vitesse de traitement du prompt et pic de mémoire. Les prompts et les réponses ne sont jamais enregistrés.
Fig. 10 Réviser
Un document devient une série de révision : des fiches et des quiz en auto-évaluation, chacun avec sa citation source. Une question sue revient après 1, 3, 7, 14 puis 30 jours. Une question manquée reste à revoir.Pro
Essayez : notez la fiche et voyez quand elle revient.
Fig. 11 Sur mesure
Sept personnalités intégrées, chacune avec son propre prompt et sa propre température. La mémoire est désactivée par défaut ; une fois activée, elle n’enregistre que votre nom ou les détails que vous lui demandez explicitement de retenir, sur cet appareil.
Température
Plus bas, c’est plus stable ; plus haut, plus libre. Pro ajoute une Bibliothèque de prompts pouvant contenir jusqu’à 20 personnalités enregistrées.
Le style Moderne (papier et encre, avec la couleur de votre choix) ajoute sept accents et trois tons de papier, chacun avec son icône d’écran d’accueil assortie.
Fig. 12 Au-delà de l’app
« Ask Own AI »
Dites la phrase, ou composez avec trois actions Raccourcis.
Parlez ou touchez un prompt rapide. L’iPhone se charge de réfléchir, et une réponse courte revient à votre poignet. watchOS 11 ou version ultérieure.
Model Status, Formula of the Day et Quick Actions, sur l’écran d’accueil.
Partagez du texte ou un lien depuis une autre app, puis posez vos questions dessus.
L’interface est disponible en anglais, allemand, espagnol et français.
Planches Onze écrans, tout droit sortis de l’app
Colophon Ce qu’il faut, ce que ça coûte
Discutez sur l’appareil avec un quota quotidien de messages. Choisir n’importe quel modèle du catalogue est gratuit.
Lève les limites de messages et de documents. Proposé au mois, à l’année ou en achat à vie.
Ce qui quitte l’appareil, et quand. Discuter avec un modèle local n’envoie rien. Télécharger un modèle récupère ses fichiers auprès de Hugging Face, qui peut voir votre adresse IP et les en-têtes de votre appareil, mais aucun contenu personnel. Une recherche web envoie la requête que vous avez saisie à DuckDuckGo par défaut, ou à Google si vous le choisissez. Si vous choisissez Apple Intelligence, les prompts et le texte des documents peuvent être traités par Apple, y compris via Private Cloud Compute, et l’app vous le demande avant d’utiliser ce modèle.