IA no dispositivo vs IA na nuvem: o que muda realmente para si
A diferença entre a IA no dispositivo e a IA na nuvem é um único facto: onde o modelo funciona. Tudo o resto decorre disso: a privacidade, o preço, a velocidade e o que o modelo consegue fazer. Esta é a comparação do lado de quem usa o ecrã, com os números reais sempre que os temos.
As duas arquiteturas
Com a IA na nuvem, a sua mensagem viaja até um centro de dados, um modelo muito grande responde lá, e a resposta faz o caminho de volta. Com a IA no dispositivo, a sua mensagem fica no telemóvel e um modelo mais pequeno responde lá. O Orvena é do segundo tipo: executa o Qwen 3.5 4B, um download único de 3,1 GB, na GPU do iPhone e, no iOS 27, também pode responder com a Apple Intelligence, o modelo da Apple no dispositivo, sem nada para descarregar.
IA no dispositivo vs IA na nuvem, lado a lado
| No dispositivo (Orvena) | Na nuvem (ChatGPT e semelhantes) | |
|---|---|---|
| Para onde vão as suas palavras | Para lado nenhum. O modelo está no telemóvel. | Para os servidores do fornecedor. |
| Conta | Nenhuma. | Normalmente, para o histórico, a faturação e os limites; o ChatGPT tem um modo limitado sem sessão iniciada. |
| Funciona offline | Sim, incluindo as ferramentas do telemóvel. | Não. |
| Latência | Sem ida e volta pela rede. A resposta aparece à medida que é escrita. | Rede mais fila de espera; varia com a carga. |
| Tamanho do modelo | Cerca de 4 mil milhões de parâmetros no modelo do próprio Orvena. | Centenas de milhares de milhões. |
| Memória da conversa | 16 384 tokens, cerca de 12 000 palavras, com o modelo do próprio Orvena. No iOS 27, a Apple Intelligence indica 8 192, embora a documentação da Apple ainda diga 4 096. | Muito maior. |
| Preço | O assistente é gratuito, incluindo a Apple Intelligence no iOS 27. Uma compra de 14,99 USD para voz, ligações, tarefas agendadas, Private Cloud Compute no iOS 27 e modelos na nuvem com a sua chave. | De 0 a 200 USD por mês nos planos do ChatGPT; 20 USD no Plus. |
| Telemóvel necessário | iPhone 15 Pro ou mais recente, com 8 GB de memória. | Qualquer telemóvel. |
| Quando a política muda | Nada muda nas suas conversas anteriores. | O que a nova política disser sobre as conversas guardadas. |
O que a IA no dispositivo faz bem
Os pedidos que as pessoas fazem realmente a um telemóvel. "Muda a minha reunião das 3 da tarde para quinta-feira de manhã." "Define um alarme para eu estar no aeroporto amanhã às 2 da tarde, contando com o tempo de viagem." "Hoje às 9 da noite, compara a meteorologia de amanhã com a minha primeira reunião." "O que vês nesta fotografia?" Um modelo à medida de um telemóvel, o do próprio Orvena ou a Apple Intelligence, trata da linguagem; as ferramentas do próprio telemóvel tratam do calendário e do alarme, e os Mapas da Apple fornecem o tempo de viagem; a entrada do calendário e a fotografia são compreendidas no dispositivo e não são enviadas para lado nenhum para serem lidas.
Onde a nuvem é melhor
Na escala. Um modelo de centro de dados sabe mais, raciocina durante mais tempo, escreve melhor e consegue manter no contexto um documento do tamanho de um livro. Para pesquisas longas, uma área especializada ou textos que têm de ser excelentes e não apenas bons, vai sentir a diferença, e hoje nenhuma engenharia no telemóvel elimina essa distância. Os serviços na nuvem também acrescentam funcionalidades que precisam de infraestrutura, como agentes que navegam na web durante minutos seguidos.
Um híbrido, feito com cuidado
Não tem de escolher de uma vez por todas. A página Modelos do Orvena lista todos os motores que pode usar: em Integrado, a Apple Intelligence no iOS 27; em Modelos no dispositivo, o modelo descarregado do próprio Orvena; e em Nuvem, o Private Cloud Compute da Apple no iOS 27, sem chave para configurar e com um limite diário definido pela Apple, ou qualquer modelo do OpenRouter com a sua própria chave. A definição de motor predefinida, Automático (em Ajustes, Avançado), usa o seu modelo descarregado, ou a Apple Intelligence enquanto nenhum estiver pronto, e nunca muda para a nuvem por iniciativa própria. Com o OpenRouter, o Orvena pergunta antes do primeiro pedido à nuvem numa conversa se deve enviar essa conversa e os resultados das ferramentas ao fornecedor. O Private Cloud Compute pergunta uma única vez, quando o escolhe. Com qualquer um deles, o Orvena volta a pedir autorização sempre que estejam em causa dados de saúde ou financeiros. O ecrã de voz mostra em que modo está: "neste iPhone" a verde, "nuvem" a âmbar.
Como decidir
Anote as últimas dez coisas que pediu a um assistente. Se a maioria era sobre a sua própria vida, a sua agenda, as suas fotografias, uma mensagem que estava a escrever, um sítio perto para onde ir, a IA no dispositivo é a predefinição certa: os dados são pessoais e as tarefas estão bem ao alcance de um modelo à medida de um telemóvel. Se a maioria era pesquisa ou escrita longa, vai querer acesso à nuvem parte do tempo, de preferência como uma escolha que faz pedido a pedido e não como o único modo que existe.
Perguntas frequentes
A IA no dispositivo é mais lenta do que a IA na nuvem?
Por token, um telemóvel é mais lento do que uma GPU de centro de dados, mas não há espera pela rede e a resposta aparece à medida que é escrita, por isso as respostas curtas parecem imediatas. O que demora mais num telemóvel é ler uma conversa longa antes de a resposta começar.
O Private Cloud Compute é tão privado como a IA no dispositivo?
Não da mesma forma. Funciona nos servidores da Apple, por isso o pedido sai do telemóvel e precisa de ligação à internet. A Apple diz que "os dados processados no Private Cloud Compute não são armazenados nem tornados acessíveis à Apple" e que "investigadores independentes de privacidade e segurança podem verificar esta promessa de privacidade a qualquer momento." No dispositivo, não há nenhum servidor na conversa sobre o qual fazer essa promessa.
Executar IA no telemóvel gasta a bateria?
Uma pergunta curta custa muito pouco. Uma conversa de voz longa aquece o telemóvel como um jogo e gasta bateria em conformidade. Nada corre em segundo plano, exceto uma resposta que já começou.
A IA no dispositivo continua a poder pesquisar na web?
Sim. Quando pede informação atual, a pesquisa vai para o fornecedor de pesquisa, como iria a partir de um navegador, e a leitura e o resumo acontecem no telemóvel.
O Orvena executa o seu modelo no iPhone e deixa-o escolher o Private Cloud Compute da Apple, ou um modelo na nuvem com a sua própria chave, quando um pedido o exige.
Descarregar na App Store