Cum rulezi un asistent AI offline pe iPhone: cerințe și configurare
Poți rula un asistent AI offline chiar pe telefon, fără niciun server în spate, pe iPhone-urile recente. Pe iOS 27, cu Apple Intelligence activat, poate funcționa imediat, iar modelul propriu al Orvena se configurează în aproximativ zece minute, cea mai mare parte fiind descărcarea. Acesta este ghidul practic: ce telefoane se califică, cât spațiu ocupă, cum îl configurezi, la ce să te aștepți și exact ce funcții au nevoie în continuare de internet.
Cerințe pentru a rula AI offline pe iPhone
| Telefon | iPhone 15 Pro sau mai nou: 15 Pro și 15 Pro Max; orice iPhone 16, inclusiv 16e; iPhone 17, 17e, Air, 17 Pro sau 17 Pro Max; și iPhone 18 Pro, 18 Pro Max și iPhone Duo, pe care Apple le listează pentru Apple Intelligence. Orvena verifică în timpul configurării dacă telefonul are 8 GB de memorie. |
| Neacceptate | iPhone 15 și 15 Plus, iPhone 14 și modelele mai vechi, precum și toate modelele iPhone SE. Au 6 GB sau mai puțin. |
| iOS | iOS 26. Apple Intelligence și Private Cloud Compute în Orvena necesită iOS 27. |
| Spațiu de stocare | 3,1 GB pentru modelul propriu al Orvena sau nicio descărcare în Orvena cu Apple Intelligence pe iOS 27 (Apple spune că Apple Intelligence în sine ocupă până la 8 GB sau până la 14 GB pe iPhone 17 Pro, 17 Pro Max și Air). Adaugă 331 MB și 400 MB pentru cele două pachete de voce, dacă folosești vocea. Păstrează aproximativ 4 GB liberi înainte să începi. |
| Conexiune | Doar pentru descărcări. Pentru 3,1 GB, Wi-Fi este alegerea înțeleaptă, dar merge și cu date mobile. După aceea, deloc. |
Cerința de memorie este cea care contează cu adevărat. Modelul ocupă puțin peste 3 GB de memorie cât timp rulează, iar iOS are nevoie de restul. Pe un telefon cu 6 GB, sistemul ar închide aplicația înainte ca modelul să termine de încărcat, așa că Orvena verifică memoria telefonului în timpul configurării inițiale și îți spune direct, în loc să lase descărcarea să ruleze și să eșueze mai târziu.
Configurarea
- Instalează Orvena din App Store. Asistentul este gratuit și nu trebuie să creezi niciun cont.
- Parcurge paginile de configurare inițială. Pe pagina modelului, dacă iPhone-ul rulează iOS 27 cu Apple Intelligence activat și setat la o limbă acceptată de Apple Intelligence, un card Apple Intelligence afișează "Integrat în iOS. Gata de folosit, fără nimic de descărcat." Poți începe cu el imediat; atinge Folosiți dacă nu este deja bifat. Pentru modelul propriu al Orvena (Qwen 3.5 4B, sub licența Apache 2.0), atinge Obțineți ca să pornești descărcarea. Are 3,1 GB în zece fișiere, fiecare verificat la sosire cu un hash publicat.
- Poți ieși din aplicație dacă vrei. Descărcarea continuă în fundal și poți explora aplicația între timp. Dacă este întreruptă, se reia de unde s-a oprit când o atingi.
- Întreabă ceva. Primul răspuns sosește imediat ce modelul este încărcat. iOS îți cere fiecare permisiune (calendar, mementouri, poze și așa mai departe) prima dată când o solicitare are nevoie de ea, cu motivul afișat.
- Opțional: deblochează vocea. Cele două pachete de voce se descarcă în fundal, iar prima dată când vorbești într-o limbă, iOS descarcă modelul de recunoaștere pe dispozitiv pentru acea limbă, lucru care apare o singură dată ca "Se pregătește…".
Ce funcționează fără conexiune
Tot ce are nevoie doar de model și de telefon:
- Conversația, redactarea, rezumarea textului pe care îl lipești și citirea unei poze pe care o atașezi. Modelul propriu al Orvena are un encoder vizual, așa că poza este înțeleasă pe telefon.
- Calendarul: citirea evenimentelor, adăugarea unuia, mutarea unuia. Mementourile: adăugare, listare, bifare. Fiecare modificare lasă un card cu butonul Anulați.
- Alarmele și minutarele, care sună chiar dacă închizi aplicația, inclusiv în modul silențios și cu un mod Concentrare activ.
- Căutarea în poze după dată, album, loc sau tip, de exemplu capturi de ecran sau selfie-uri.
- Rezumatul tău din Apple Sănătate: pași, somn și antrenamente.
- Căutarea unui contact, citirea fișierelor pe care le-ai importat, controlul aplicației Muzică, rularea unei scurtături.
- Conversațiile vocale, după ce pachetele de voce sunt pe telefon.
Ce are încă nevoie de internet și unde ajunge
| Funcție | Ajunge la |
|---|---|
| Căutare pe web | DuckDuckGo, când ceri informații actuale. |
| Deschiderea unei pagini web | Acel site, ca într-un browser. |
| Vremea | Serviciul meteo al Apple. |
| Locuri, timpi de deplasare, adresa ta actuală | Hărți Apple și geocodare. |
| Servicii conectate | Notion, Linear, GitHub sau orice server MCP pe care îl adaugi, cu autentificare în propriul tău cont. |
| Private Cloud Compute | Serverele Apple, pe iOS 27, după ce îl alegi pe pagina Modele. |
| Modele din cloud | OpenRouter, cu propria ta cheie, după ce îți dai consimțământul. |
| Voce live în cloud | OpenAI, cu propria ta cheie, după ce îți dai consimțământul. |
În modul Avion, acestea îți spun pur și simplu că nu pot contacta serviciul. Dacă ai ales Private Cloud Compute, Orvena răspunde în schimb cu Apple Intelligence pe iPhone, atunci când acesta acceptă limba ta, și adaugă o notă care spune asta: "Acest răspuns a fost generat pe acest iPhone." Nimic altceva din aplicație nu are unde să meargă: nu există statistici de utilizare, nu există un server de conturi și nu există niciun server Orvena între tine și aceste servicii.
La ce să te aștepți
Răspunsurile apar pe măsură ce sunt scrise, iar cele scurte încep în una sau două secunde. La o conversație lungă, răspunsul începe mai târziu, pentru că citirea istoricului este partea costisitoare pe un telefon. Modelul propriu al Orvena raționează înainte să răspundă, implicit; pe pagina Modele poți dezactiva asta pentru răspunsuri mai rapide, iar în Configurări, Avansat îți poți seta propriul buget. Apple Intelligence nu are o setare de gândire. Cu modelul propriu al Orvena, fereastra conversației este de 16.384 de tokenuri, aproximativ 12.000 de cuvinte. Orvena citește dimensiunea ferestrei Apple Intelligence din iOS, iar pe iOS 27 aceasta a raportat 8.192 de tokenuri, așa că acolo conversațiile lungi rămân mai repede fără spațiu. Când o conversație depășește fereastra, Orvena păstrează cele mai recente schimburi complete și le lasă deoparte pe cele mai vechi; nu le rezumă. Dacă nici așa nu încape în Apple Intelligence, afișează "Această conversație este prea lungă pentru Apple Intelligence. Începeți o conversație nouă sau treceți în Modele la modelul Orvena descărcat."
O întrebare scurtă consumă foarte puțină baterie. O conversație vocală lungă încălzește telefonul așa cum o face un joc. Dacă treci la altă aplicație, un răspuns de la Apple Intelligence sau de la un motor din cloud mai continuă puțin timp, iar un răspuns de la modelul propriu al Orvena se oprește și continuă când revii; alarmele și minutarele sună singure; o sarcină programată te anunță la ora pe care ai cerut-o și rulează când o deschizi.
Cum economisești spațiu
Pagina Modele îți permite să treci la o variantă cu precizie mixtă a aceluiași model (3,57 GB, apeluri de instrumente mai precise) sau să elimini modelul ca să eliberezi spațiu. Fiecare pachet de voce poate fi eliminat separat. Istoricul conversațiilor este un fișier pe telefon, criptat cu protecția completă a fișierelor din iOS și exclus din copiile de rezervă. Ștergerea aplicației elimină totul: modelul, vocile și istoricul.
Dacă ceva nu merge
- Descărcarea s-a oprit. Atinge-o. Se reia de unde rămăsese, iar fiecare fișier este verificat din nou cu hash-ul său.
- "Acest dispozitiv nu poate rula Orvena." Telefonul are mai puțin de 8 GB de memorie. Nicio setare nu poate schimba asta.
- "Preparing the speech model took too long." (Pregătirea modelului de vorbire a durat prea mult.) Prima sesiune vocală într-o limbă nouă descarcă de la Apple modelul de recunoaștere pentru acea limbă și are nevoie o dată de conexiune. Încearcă din nou peste câteva momente.
- Răspunsurile par lente. Dezactivează gândirea pe pagina Modele sau pune întrebări mai scurte într-o conversație nouă. Pe iOS 27 poți trece și la Apple Intelligence, la Integrat, pe pagina Modele. În plus, modul Consum redus înjumătățește automat bugetul de gândire.
- "Apple Intelligence nu acceptă încă această limbă." Modelul Apple acoperă mai puține limbi decât cel propriu al Orvena. Descarcă modelul Orvena pe pagina Modele ca să conversezi în acea limbă.
Întrebări frecvente
Modelul se descarcă de fiecare dată când deschid aplicația?
Nu. Descărcarea de 3,1 GB are loc o singură dată. După aceea, modelul se încarcă din spațiul de stocare al telefonului și rulează fără nicio conexiune la rețea.
Chiar funcționează în modul Avion?
Da. Conversația, imaginile și toate instrumentele telefonului funcționează cu conexiunile radio oprite. Doar căutarea pe web, deschiderea paginilor web, vremea, locurile, serviciile conectate, Private Cloud Compute, modelele din cloud și vocea live în cloud au nevoie de conexiune, iar când nu o au îți spun asta.
Cât spațiu de stocare ocupă?
Nicio descărcare în Orvena dacă folosești Apple Intelligence pe iOS 27. Modelul propriu al Orvena are 3,1 GB, plus 331 MB și 400 MB pentru cele două pachete de voce, dacă folosești vocea. Păstrează aproximativ 4 GB liberi înainte să începi.
Îl pot rula pe un iPhone 15 sau 14 Pro?
Nu. Aceste telefoane au 6 GB de memorie, iar modelul are nevoie de puțin peste 3 GB din ea, în timp ce iOS are nevoie de rest. iPhone 15 Pro și toate modelele mai noi se califică.
Apple Intelligence funcționează offline?
Modelul de pe dispozitiv, da. Apple spune că aplicațiile îl pot folosi și că "funcționalitățile pe care le construiești funcționează offline." În Orvena, Apple Intelligence răspunde și folosește instrumentele telefonului cu conexiunile radio oprite. Private Cloud Compute, modelul mai mare al Apple de pe serverele sale, are nevoie de conexiune.
Orvena este gratuită în App Store pentru iPhone 15 Pro sau mai nou. Pe iOS 27 poate porni cu Apple Intelligence, iar modelul ei propriu se descarcă o singură dată și rulează pe telefon.
Descarcă din App Store