06 Turnos
Solo se lee lo nuevo.
En cada turno, el chat completo se renderiza exactamente en el formato con el que se entrenó el modelo. La parte que la caché ya contiene se omite y solo se introduce el resto.
Own AI · asistente en el dispositivo para iPhone
Own AI ejecuta modelos de lenguaje y visión en el propio dispositivo. Chatea, pregunta a tus documentos, habla sin usar las manos y resuelve matemáticas paso a paso, con un modelo inicial ya incluido.
Fig. 01 Dónde se piensa
En otros sitios, preguntar es enviar.
Aquí, el modelo ya está en el teléfono.
Así, una pregunta, un contrato de alquiler, una foto y tu voz se leen donde están.
La inferencia local no envía ningún prompt a un proveedor de modelos.
Historial de conversaciones, documentos importados, índices de recuperación, prompts guardados y memoria del asistente.
Sin rastreo y sin datos recopilados.
Las descargas de modelos, la búsqueda web y Apple Intelligence se comunican con sus propios servicios, y solo cuando los usas.
Fig. 02 Pregunta a tus documentos
Adjunta archivos PDF, DOCX, TXT, RTF o de código y pregunta. La búsqueda se hace en el teléfono, los documentos escaneados pueden pasar por un OCR opcional y Fuentes del documento muestra las páginas en las que se basó una respuesta.
Un boceto animado del flujo. La pregunta y la respuesta proceden del contrato de ejemplo de la app.





Fig. 03 Matemáticas que se dibujan solas
Las respuestas muestran LaTeX y agrupan cada derivación en pasos numerados. Cualquier fórmula se abre en el Inspector de fórmulas, con cuatro pestañas: Fórmula, Pasos, 2D y 3D.
A = ∫20(x² + 1) dx
= [x³3 + x]20
= (83 + 2) − 0
= 143 ≈ 4.67
Fig. 04 Voz
El reconocimiento de voz está configurado para ejecutarse en el dispositivo, y las respuestas se leen en voz alta mediante síntesis de voz local, con seis voces Kokoro descargables. También se pueden transcribir grabaciones de audio.
El modo conversación manos libres escucha, responde en voz alta y te deja interrumpir con naturalidad.Pro
Fig. 05 La estantería
La app incluye un pequeño modelo inicial, Qwen3 0.6B, así que el primer chat no requiere ninguna descarga. A partir de ahí, el catálogo va desde 0,14 GB hasta gigantes propios de un Mac, además de los Foundation Models de Apple en dispositivos compatibles con iOS 26.
Own AI elige un modelo inicial adecuado para tu dispositivo. 25 de los 88 admiten imágenes; 22 ocupan menos de 1 GB.
La altura de cada lomo refleja el número de modelos de la familia. Los más grandes están pensados para la memoria de un iPad Pro o de un Mac, no para un teléfono.
La lista de comprobación es la de la propia app; las dos animaciones son sus archivos Lottie.
Busca modelos MLX de la comunidad en Hugging Face. Cada uno se comprueba con tu dispositivo antes de descargar nada: arquitectura, archivos, plantilla de chat, cuantización y memoria. Después, una autoprueba de carga y respuesta demuestra que funciona de verdad.
Fig. 06–09 Bajo la página
Ejecutar un modelo de lenguaje en un teléfono es, sobre todo, una cuestión de memoria. Cuatro cosas que el motor hace al respecto, cada una esbozada en movimiento.
06 Turnos
En cada turno, el chat completo se renderiza exactamente en el formato con el que se entrenó el modelo. La parte que la caché ya contiene se omite y solo se introduce el resto.
07 Modelos borrador
En algunos modelos grandes, uno mucho más pequeño de la misma familia propone unos cuantos tokens y el modelo grande los verifica en una sola pasada. El resultado es idéntico al de ejecutar solo el modelo principal.
08 Prefill según la memoria
Al leer un prompt largo es cuando es más probable que el teléfono cierre la app. Por eso se lee en bloques cuyo tamaño depende de la memoria que le queda a la app; cada uno usa como máximo la mitad del margen disponible por encima del suelo de memoria del dispositivo.
09 Caché de sesión
Al salir de un chat, la memoria de trabajo que el modelo tiene de él se escribe en disco. Vuelve a abrirlo con el mismo modelo y recuperas el contexto completo, en lugar de que se vuelva a leer una transcripción recortada.
Ajustes › Rendimiento guarda las medianas de cada modelo medidas en tu propio dispositivo: tiempo hasta el primer token, velocidad de generación, velocidad de procesamiento del prompt y memoria máxima. Los prompts y las respuestas nunca se registran.
Fig. 10 Estudiar
Un documento se convierte en un conjunto de estudio: tarjetas y cuestionarios autoevaluados, cada uno con su cita de origen. Una pregunta acertada vuelve tras 1, 3, 7, 14 y, después, 30 días. Una fallada sigue pendiente.Pro
Pruébalo: valora la tarjeta y mira cuándo vuelve.
Fig. 11 Tuya
Siete personalidades integradas, cada una con su propio prompt y su temperatura. La memoria viene desactivada por defecto; si la activas, guarda solo tu nombre o los datos que le pidas expresamente que recuerde, en este dispositivo.
Temperatura
Más baja, más estable; más alta, más libre. Pro añade una Biblioteca de prompts con hasta 20 personalidades guardadas.
El aspecto Moderno, de papel y tinta con el color que elijas, añade siete colores de acento y tres tonos de papel, cada uno con un icono a juego para la pantalla de inicio.
Fig. 12 Más allá de la app
«Ask Own AI»
Di la frase o crea atajos con tres acciones de Atajos.
Habla o toca un prompt rápido. El iPhone se encarga de pensar y una respuesta breve vuelve a tu muñeca. watchOS 11 o posterior.
Model Status, Formula of the Day y Quick Actions, en la pantalla de inicio.
Comparte un texto o un enlace desde otra app y pregunta sobre él.
La interfaz está disponible en inglés, alemán, español y francés.
Láminas Once pantallas, directamente de la app
Colofón Qué necesita, qué cuesta
Chatea en el dispositivo con un cupo diario de mensajes. Elegir cualquier modelo del catálogo es gratis.
Elimina los límites de mensajes y documentos. Se ofrece de forma mensual, anual o como compra de por vida.
Qué sale del dispositivo y cuándo. Chatear con un modelo local no envía nada. Al descargar un modelo, sus archivos se obtienen de Hugging Face, que puede ver tu dirección IP y las cabeceras de tu dispositivo, pero ningún contenido personal. Una búsqueda web envía la consulta que escribiste a DuckDuckGo de forma predeterminada, o a Google si lo eliges. Si eliges Apple Intelligence, Apple puede procesar los prompts y el texto de los documentos, incluido Private Cloud Compute, y la app pregunta antes de que se use ese modelo.