AI på enheden vs. AI i skyen: hvad der reelt ændrer sig for dig
Forskellen mellem AI på enheden og AI i skyen er ét faktum: hvor modellen kører. Alt andet (privatliv, pris, hastighed, hvad modellen kan) følger af det. Her er sammenligningen set fra brugerens side af skærmen, med de faktiske tal, hvor vi har dem.
De to designs
Med AI i skyen rejser din besked til et datacenter, en meget stor model svarer dér, og svaret rejser tilbage. Med AI på enheden bliver din besked på telefonen, og en mindre model svarer dér. Orvena er den anden slags: den kører Qwen 3.5 4B, en engangsoverførsel på 3,1 GB, på iPhonens GPU, og på iOS 27 kan den også svare med Apple Intelligence, Apples model på enheden, uden at du skal hente noget.
AI på enheden vs. AI i skyen, side om side
| På enheden (Orvena) | I skyen (ChatGPT og lignende) | |
|---|---|---|
| Hvor dine ord havner | Ingen steder. Modellen er på telefonen. | På udbyderens servere. |
| Konto | Ingen. | Som regel, til historik, betaling og grænser; ChatGPT har en begrænset tilstand uden login. |
| Virker offline | Ja, også telefonens værktøjer. | Nej. |
| Svartid | Ingen tur frem og tilbage over netværket. Svaret streames, mens det skrives. | Netværk plus kø; varierer med belastningen. |
| Modelstørrelse | Omkring 4 milliarder parametre for Orvenas egen model. | Hundredvis af milliarder. |
| Samtalehukommelse | 16.384 tokens, omkring 12.000 ord, med Orvenas egen model. På iOS 27 rapporterer Apple Intelligence 8.192, selvom Apples dokumentation stadig siger 4.096. | Meget større. |
| Pris | Assistenten er gratis, inklusive Apple Intelligence på iOS 27. Ét køb til $14,99 for stemme, forbindelser, planlagte opgaver, Private Cloud Compute på iOS 27 og cloudmodeller med din nøgle. | $0 til $200 om måneden for ChatGPTs planer; $20 for Plus. |
| Telefon, der kræves | iPhone 15 Pro eller nyere, 8 GB hukommelse. | Enhver telefon. |
| Når politikken ændres | Intet ændrer sig ved dine tidligere samtaler. | Det, den nye politik siger om gemte samtaler. |
Det er AI på enheden god til
De anmodninger, folk faktisk giver en telefon. "Flyt mit møde klokken 3 i eftermiddag til torsdag morgen." "Sæt en alarm, så jeg er i lufthavnen klokken 2 i morgen eftermiddag, med rejsetiden regnet med." "I aften klokken 9, tjek morgendagens vejr op mod mit første møde." "Hvad kan du se på dette foto?" En model i telefonstørrelse, Orvenas egen eller Apple Intelligence, klarer sproget; telefonens egne værktøjer klarer kalenderen og alarmen, og Apple Kort leverer rejsetiden; kalenderaftalen og fotoet forstås på enheden og sendes ikke nogen steder hen for at blive læst.
Her er skyen bedre
Skala. En model i et datacenter ved mere, ræsonnerer længere, skriver bedre og kan rumme et dokument på længde med en bog i sin kontekst. Til lang research, et specialiseret fagområde eller tekster, der skal være fremragende frem for gode, vil du mærke forskellen, og ingen mængde ingeniørarbejde på telefonen lukker det hul i dag. Cloudtjenester tilføjer også funktioner, der kræver infrastruktur, f.eks. agenter, der browser i flere minutter ad gangen.
En hybrid, gjort med omtanke
Du behøver ikke vælge én gang for alle. Orvenas side Modeller viser alle de motorer, den kan bruge: under "Indbygget" Apple Intelligence på iOS 27, under "Modeller på enheden" Orvenas egen hentede model, og under "Cloud" Apples Private Cloud Compute på iOS 27, uden nogen nøgle at sætte op og med en daglig grænse fastsat af Apple, eller en hvilken som helst OpenRouter-model med din egen nøgle. Standardindstillingen for motor, Automatisk (i Indstillinger, Avanceret), bruger din hentede model eller Apple Intelligence, indtil en model er klar, og skifter aldrig til skyen af sig selv. Med OpenRouter spørger Orvena før den første cloudanmodning i en samtale, om samtalen og dens værktøjsresultater må sendes til udbyderen. Private Cloud Compute spørger én gang, når du vælger den. Med begge bliver du spurgt igen hver gang ved sundheds- eller økonomidata. Stemmeskærmen viser, hvilken tilstand du er i: "på denne iPhone" i grønt, "cloud" i ravgult.
Sådan vælger du
Skriv de sidste ti ting ned, du har spurgt en assistent om. Hvis de fleste handlede om dit eget liv, din tidsplan, dine fotos, en besked, du var ved at skrive, eller et sted at tage hen i nærheden, er AI på enheden det rigtige udgangspunkt: dataene er personlige, og opgaverne ligger godt inden for, hvad en model i telefonstørrelse kan klare. Hvis de fleste var research eller lange tekster, vil du gerne have adgang til skyen en del af tiden, helst som et valg, du træffer for hver anmodning, frem for den eneste mulighed, der findes.
Ofte stillede spørgsmål
Er AI på enheden langsommere end AI i skyen?
Pr. token er en telefon langsommere end en GPU i et datacenter, men der er ingen ventetid på netværket, og svaret streames, mens det skrives, så korte svar føles øjeblikkelige. Det, der tager længere tid på en telefon, er at læse en lang samtale, før svaret begynder.
Er Private Cloud Compute lige så privat som AI på enheden?
Ikke på samme måde. Den kører på Apples servere, så anmodningen forlader telefonen og kræver en forbindelse. Apple siger, at "de data, der behandles i Private Cloud Compute, ikke gemmes eller gøres tilgængelige for Apple", og at "uafhængige forskere inden for privatliv og sikkerhed til enhver tid kan verificere dette løfte om privatliv." På enheden er der ingen server i samtalen, som løftet skal gælde for.
Dræner det batteriet at køre AI på telefonen?
Et kort spørgsmål koster meget lidt. En lang stemmesamtale gør telefonen varm, ligesom et spil gør, og bruger batteri derefter. Intet kører i baggrunden, bortset fra et svar, du allerede har startet.
Kan AI på enheden stadig søge på nettet?
Ja. Når du beder om aktuel information, går søgningen til søgeudbyderen, ligesom den ville fra en browser, og læsningen og opsummeringen sker på telefonen.
Orvena kører sin model på iPhonen og lader dig vælge Apples Private Cloud Compute eller en cloudmodel med din egen nøgle, når en anmodning kræver det.
Hent i App Store