IA en el dispositivo frente a IA en la nube: qué cambia de verdad para ti
La diferencia entre la IA en el dispositivo y la IA en la nube se reduce a un dato: dónde se ejecuta el modelo. Todo lo demás (privacidad, precio, velocidad, lo que puede hacer el modelo) se deriva de eso. Esta es la comparación desde el lado de la pantalla en el que está el usuario, con las cifras reales cuando las tenemos.
Los dos diseños
Con la IA en la nube, tu mensaje viaja a un centro de datos, un modelo muy grande responde allí y la respuesta vuelve. Con la IA en el dispositivo, tu mensaje se queda en el móvil y responde un modelo más pequeño que está ahí mismo. Orvena es del segundo tipo: ejecuta Qwen 3.5 4B, una descarga única de 3,1 GB, en la GPU del iPhone, y en iOS 27 también puede responder con Apple Intelligence, el modelo de Apple en el dispositivo, sin nada que descargar.
IA en el dispositivo frente a IA en la nube, punto por punto
| En el dispositivo (Orvena) | En la nube (ChatGPT y similares) | |
|---|---|---|
| Adónde van tus palabras | A ningún sitio. El modelo está en el móvil. | A los servidores del proveedor. |
| Cuenta | Ninguna. | Normalmente, para el historial, la facturación y los límites; ChatGPT tiene un modo limitado sin iniciar sesión. |
| Funciona sin conexión | Sí, incluidas las herramientas del móvil. | No. |
| Latencia | Sin ida y vuelta por la red. La respuesta aparece a medida que se escribe. | Red más cola de espera; varía con la carga. |
| Tamaño del modelo | Unos 4.000 millones de parámetros en el modelo propio de Orvena. | Cientos de miles de millones. |
| Memoria de la conversación | 16.384 tokens, unas 12.000 palabras, con el modelo propio de Orvena. En iOS 27, Apple Intelligence indica 8.192, aunque la documentación de Apple todavía dice 4.096. | Mucho mayor. |
| Precio | El asistente es gratis, incluido Apple Intelligence en iOS 27. Una sola compra de 14,99 $ para voz, conexiones, tareas programadas, Private Cloud Compute en iOS 27 y modelos en la nube con tu clave. | De 0 a 200 $ al mes en los planes de ChatGPT; 20 $ el Plus. |
| Móvil necesario | iPhone 15 Pro o posterior, con 8 GB de memoria. | Cualquier móvil. |
| Cuando cambia la política | No cambia nada de tus conversaciones anteriores. | Lo que diga la nueva política sobre las conversaciones guardadas. |
Lo que hace bien la IA en el dispositivo
Las peticiones que la gente de verdad le hace a un móvil. "Cambia mi reunión de las 3 de la tarde al jueves por la mañana." "Pon una alarma para que esté en el aeropuerto mañana a las 2 de la tarde, contando el tiempo de viaje." "Esta noche a las 9, compara el tiempo de mañana con mi primera reunión." "¿Qué ves en esta foto?" Un modelo del tamaño de un móvil, el propio de Orvena o Apple Intelligence, se encarga del lenguaje; las herramientas del propio móvil se ocupan del calendario y la alarma, y Mapas de Apple aporta el tiempo de viaje; la cita del calendario y la foto se interpretan en el dispositivo y no se envían a ningún sitio para leerlas.
Dónde es mejor la nube
En la escala. Un modelo de centro de datos sabe más, razona durante más tiempo, escribe mejor y puede tener en su contexto un documento del tamaño de un libro. Para investigaciones largas, un campo especializado o textos que tienen que ser excelentes y no solo buenos, notarás la diferencia, y hoy ningún esfuerzo de ingeniería en el móvil cierra esa brecha. Los servicios en la nube también añaden funciones que necesitan infraestructura, como agentes que navegan durante minutos seguidos.
Un híbrido, hecho con cuidado
No tienes que elegir una sola vez. La página Modelos de Orvena muestra todos los motores que puede usar: en Integrado, Apple Intelligence en iOS 27; en Modelos en el dispositivo, el modelo descargado propio de Orvena; y en Nube, Private Cloud Compute de Apple en iOS 27, sin claves que configurar y con un límite diario fijado por Apple, o cualquier modelo de OpenRouter con tu propia clave. El ajuste de motor predeterminado, Automático (en Ajustes, Avanzado), usa tu modelo descargado, o Apple Intelligence mientras no haya ninguno listo, y nunca cambia a la nube por su cuenta. Con OpenRouter, antes de la primera petición a la nube de una conversación, Orvena pregunta si debe enviar esa conversación y sus resultados de herramientas al proveedor. Private Cloud Compute pregunta una sola vez, cuando lo eliges. Con cualquiera de los dos, los datos de salud o financieros vuelven a pedir permiso cada vez. La pantalla de voz muestra en qué modo estás: "en este iPhone" en verde, "nube" en ámbar.
Cómo decidir
Apunta las últimas diez cosas que le pediste a un asistente. Si la mayoría tenían que ver con tu propia vida (tu agenda, tus fotos, un mensaje que estabas escribiendo, algún sitio cercano al que ir), lo adecuado por defecto es la IA en el dispositivo: los datos son personales y las tareas están de sobra al alcance de un modelo del tamaño de un móvil. Si la mayoría eran investigación o textos largos, te conviene tener acceso a la nube parte del tiempo, idealmente como una decisión que tomas en cada petición y no como el único modo que existe.
Preguntas frecuentes
¿La IA en el dispositivo es más lenta que la IA en la nube?
Por token, un móvil es más lento que una GPU de un centro de datos, pero no hay espera de red y la respuesta aparece a medida que se escribe, así que las respuestas cortas parecen inmediatas. Lo que tarda más en un móvil es leer una conversación larga antes de que empiece la respuesta.
¿Private Cloud Compute es tan privado como la IA en el dispositivo?
No de la misma manera. Funciona en los servidores de Apple, así que la petición sale del móvil y necesita conexión. Apple dice que "los datos que se procesan en Private Cloud Compute no se almacenan ni se ponen a disposición de Apple" y que "investigadores independientes de privacidad y seguridad pueden verificar esta promesa de privacidad en cualquier momento". En el dispositivo, no hay ningún servidor en la conversación sobre el que hacer esa promesa.
¿Ejecutar IA en el móvil gasta mucha batería?
Una pregunta corta gasta muy poco. Una conversación de voz larga calienta el móvil igual que un juego y gasta batería en consecuencia. No se ejecuta nada en segundo plano salvo una respuesta que ya hayas empezado.
¿La IA en el dispositivo puede buscar en la web?
Sí. Cuando pides información actual, la consulta va al proveedor de búsqueda, como iría desde un navegador, y la lectura y el resumen se hacen en el móvil.
Orvena ejecuta su modelo en el iPhone y te deja elegir Private Cloud Compute de Apple, o un modelo en la nube con tu propia clave, cuando una petición lo requiere.
Descargar en el App Store