iPhone에서 AI 어시스턴트를 오프라인으로 실행하는 방법: 요구 사항과 설정
iPhone에서 AI 어시스턴트를 오프라인으로, 즉 뒤에 서버 없이 휴대폰 자체에서 실행하는 일은 최신 iPhone에서 가능합니다. Apple Intelligence를 켠 iOS 27에서는 바로 작동할 수 있고, Orvena 자체 모델은 설정에 약 10분이 걸리며 그 대부분은 다운로드 시간입니다. 이 글은 실전 가이드입니다. 어떤 휴대폰이 해당하는지, 공간은 얼마나 필요한지, 어떻게 설정하는지, 무엇을 기대할 수 있는지, 그리고 정확히 어떤 기능이 여전히 인터넷을 필요로 하는지 다룹니다.
iPhone에서 AI를 오프라인으로 실행하기 위한 요구 사항
| 휴대폰 | iPhone 15 Pro 이상: 15 Pro와 15 Pro Max, 16e를 포함한 모든 iPhone 16, iPhone 17, 17e, Air, 17 Pro, 17 Pro Max, 그리고 Apple이 Apple Intelligence 지원 기종으로 명시한 iPhone 18 Pro, 18 Pro Max, iPhone Duo입니다. Orvena는 설정 중에 8 GB 메모리가 있는지 확인합니다. |
| 지원되지 않음 | iPhone 15와 15 Plus, iPhone 14 이하, 그리고 모든 iPhone SE. 메모리가 6 GB 이하입니다. |
| iOS | iOS 26. Orvena에서 Apple Intelligence와 Private Cloud Compute(비공개 클라우드 컴퓨팅)를 쓰려면 iOS 27이 필요합니다. |
| 저장 공간 | Orvena 자체 모델은 3.1 GB이고, iOS 27에서 Apple Intelligence를 쓰면 Orvena 안에서는 다운로드가 없습니다(Apple에 따르면 Apple Intelligence 자체는 최대 8 GB, iPhone 17 Pro, 17 Pro Max, Air에서는 최대 14 GB를 차지합니다). 음성을 사용한다면 두 음성 팩용으로 331 MB와 400 MB가 더 필요합니다. 시작하기 전에 약 4 GB의 여유 공간을 확보하세요. |
| 연결 | 다운로드할 때만 필요합니다. 3.1 GB이니 Wi-Fi가 적당하지만 셀룰러로도 됩니다. 그 이후에는 필요 없습니다. |
진짜 조건은 메모리입니다. 모델은 실행되는 동안 3 GB가 조금 넘는 메모리를 쓰고, 나머지는 iOS가 필요로 합니다. 6 GB 휴대폰에서는 모델 로딩이 끝나기 전에 시스템이 앱을 종료해 버리므로, Orvena는 온보딩 중에 휴대폰의 메모리를 확인해서, 다운로드를 진행했다가 나중에 실패하게 두는 대신 분명하게 알려 줍니다.
설정하기
- App Store에서 Orvena를 설치합니다. 어시스턴트는 무료이며, 만들어야 할 계정도 없습니다.
- 온보딩 페이지를 차례로 넘깁니다. 모델 페이지에서, iPhone이 iOS 27을 실행 중이고 Apple Intelligence가 켜져 있으며 Apple Intelligence가 지원하는 언어로 설정되어 있다면 Apple Intelligence 카드에 "iOS에 기본 제공됩니다. 다운로드 없이 바로 사용할 수 있습니다."라고 표시됩니다. 바로 이것으로 시작할 수 있으며, 아직 선택되어 있지 않다면 '사용'을 탭하세요. Orvena 자체 모델(Apache 2.0 라이선스의 Qwen 3.5 4B)을 쓰려면 '받기'를 탭해 다운로드를 시작합니다. 10개 파일로 된 3.1 GB이며, 각 파일은 도착할 때마다 공개된 해시와 대조해 확인됩니다.
- 원한다면 앱을 떠나도 됩니다. 다운로드는 백그라운드에서 계속되며, 그동안 앱을 둘러볼 수도 있습니다. 중단되더라도 탭하면 멈춘 지점부터 이어서 받습니다.
- 질문해 봅니다. 모델이 로드되자마자 첫 답변이 도착합니다. 캘린더, 미리 알림, 사진 등의 권한은 요청에 처음 필요할 때 iOS가 이유와 함께 하나씩 묻습니다.
- 선택 사항: 음성 기능을 잠금 해제합니다. 두 음성 팩은 백그라운드에서 내려받아지며, 어떤 언어로 처음 말할 때 iOS가 그 언어의 온디바이스 인식 모델을 가져오는데, 이때 한 번 "준비 중…"이 표시됩니다.
연결 없이 작동하는 기능
모델과 휴대폰만 있으면 되는 모든 것이 작동합니다.
- 대화, 초안 작성, 붙여 넣은 텍스트 요약, 첨부한 사진 읽기. Orvena 자체 모델에는 비전 인코더가 있어 사진을 휴대폰에서 이해합니다.
- 캘린더: 일정 읽기, 추가, 옮기기. 미리 알림: 추가, 목록 보기, 완료. 변경할 때마다 '실행 취소'가 달린 카드가 남습니다.
- 알람과 타이머. 앱을 닫아도, 무음 모드와 집중 모드 중에도 울립니다.
- 날짜, 앨범, 장소, 또는 스크린샷이나 셀피 같은 종류로 사진 검색하기.
- Apple 건강 요약: 걸음 수, 수면, 운동.
- 연락처 찾기, 가져온 파일 읽기, 음악 제어, 단축어 실행.
- 음성 팩이 휴대폰에 있다면 음성 대화.
여전히 인터넷이 필요한 기능과 전송 대상
| 기능 | 전송 대상 |
|---|---|
| 웹 검색 | 최신 정보를 요청할 때 DuckDuckGo. |
| 웹 페이지 열기 | 브라우저처럼 해당 사이트. |
| 날씨 | Apple의 날씨 서비스. |
| 장소, 이동 시간, 현재 주소 | Apple 지도와 지오코딩. |
| 연결된 서비스 | Notion, Linear, GitHub 또는 직접 추가한 MCP 서버. 내 계정으로 로그인합니다. |
| Private Cloud Compute | iOS 27에서, '모델' 페이지에서 선택한 뒤 Apple 서버. |
| 클라우드 모델 | 동의한 뒤, 내 키로 OpenRouter. |
| 실시간 클라우드 음성 | 동의한 뒤, 내 키로 OpenAI. |
에어플레인 모드에서는 이 기능들이 서비스에 연결할 수 없다고 알려 줄 뿐입니다. Private Cloud Compute를 선택했다면, 사용 중인 언어를 지원하는 경우 Orvena는 대신 iPhone의 Apple Intelligence로 답하고 그 사실을 알리는 메모를 덧붙입니다. "이 답변은 이 iPhone에서 생성되었어요." 앱의 나머지 부분에는 데이터가 갈 곳이 없습니다. 분석도, 계정 서버도 없고, 사용자와 이 서비스들 사이에 Orvena 서버도 없습니다.
기대할 수 있는 것
답변은 작성되는 대로 스트리밍되며, 짧은 답변은 1~2초 안에 시작됩니다. 긴 대화에서는 답변이 시작되기까지 더 오래 걸립니다. 휴대폰에서는 대화 기록을 읽는 것이 가장 비용이 큰 부분이기 때문입니다. Orvena 자체 모델은 기본적으로 답하기 전에 추론합니다. '모델' 페이지에서 추론을 끄면 더 빠르게 답하며, 설정의 '고급'에서 추론 예산을 직접 정할 수도 있습니다. Apple Intelligence에는 추론 설정이 없습니다. Orvena 자체 모델의 컨텍스트 윈도우는 16,384 토큰(영어 기준 약 12,000단어)입니다. Orvena는 Apple Intelligence의 컨텍스트 윈도우 크기를 iOS에서 읽어 오는데, iOS 27에서는 8,192 토큰으로 보고되었으므로 그쪽에서는 긴 대화가 더 빨리 한계에 이릅니다. 대화가 윈도우보다 길어지면 Orvena는 가장 최근의 온전한 턴을 남기고 가장 오래된 턴을 제외합니다. 요약하지는 않습니다. 그렇게 해도 Apple Intelligence에 맞지 않으면 "이 대화는 Apple Intelligence에서 처리하기에 너무 길어요. 새 대화를 시작하거나 '모델'에서 다운로드한 Orvena 모델로 전환하세요."라고 표시됩니다.
짧은 질문은 배터리를 거의 쓰지 않습니다. 긴 음성 대화는 게임을 할 때처럼 휴대폰을 따뜻하게 만듭니다. 다른 앱으로 전환하면 Apple Intelligence나 클라우드 엔진의 답변은 잠시 동안 계속 생성되고, Orvena 자체 모델의 답변은 일시 정지되었다가 돌아오면 이어집니다. 알람과 타이머는 앱과 상관없이 울리고, 예약 작업은 요청한 시각에 알림을 보낸 뒤 알림을 열면 실행됩니다.
가볍게 유지하기
'모델' 페이지에서 같은 모델의 혼합 정밀도 버전(3.57 GB, 도구 호출이 더 정확함)으로 전환하거나, 모델을 제거해 공간을 확보할 수 있습니다. 음성 팩도 각각 따로 제거할 수 있습니다. 대화 기록은 휴대폰 안의 파일로, iOS의 완전한 파일 보호로 암호화되고 백업에서 제외됩니다. 앱을 삭제하면 모델, 음성, 기록까지 모두 삭제됩니다.
문제가 생겼을 때
- 다운로드가 멈췄습니다. 탭하세요. 멈춘 지점부터 이어서 받으며, 모든 파일을 해시와 다시 대조해 확인합니다.
- "이 기기에서는 Orvena를 실행할 수 없어요." 휴대폰의 메모리가 8 GB 미만입니다. 이를 바꿀 수 있는 설정은 없습니다.
- "Preparing the speech model took too long."(음성 모델을 준비하는 데 너무 오래 걸렸습니다) 새 언어의 첫 음성 세션은 그 언어의 음성 인식기를 Apple에서 내려받으므로 한 번은 연결이 필요합니다. 잠시 후 다시 시도하세요.
- 답변이 느리게 느껴집니다. '모델' 페이지에서 추론을 끄거나, 새 대화에서 더 짧게 질문해 보세요. iOS 27에서는 '모델' 페이지의 '기본 제공'에서 Apple Intelligence로 전환할 수도 있습니다. 저전력 모드에서는 추론 예산도 자동으로 절반이 됩니다.
- "Apple Intelligence는 아직 이 언어를 지원하지 않아요." Apple의 모델은 Orvena 자체 모델보다 지원하는 언어가 적습니다. 그 언어로 대화하려면 '모델' 페이지에서 Orvena 모델을 다운로드하세요.
자주 묻는 질문
앱을 열 때마다 모델을 다운로드하나요?
아닙니다. 3.1 GB 다운로드는 한 번만 이루어집니다. 그 이후에는 모델이 휴대폰 저장 공간에서 로드되어 네트워크 없이 실행됩니다.
정말 에어플레인 모드에서도 작동하나요?
네. 무선 연결을 모두 끈 상태에서도 대화, 이미지, 모든 휴대폰 도구가 작동합니다. 연결이 필요한 것은 웹 검색, 웹 페이지 열기, 날씨, 장소, 연결된 서비스, Private Cloud Compute, 클라우드 모델, 실시간 클라우드 음성뿐이며, 연결할 수 없을 때는 그렇다고 알려 줍니다.
저장 공간은 얼마나 필요한가요?
iOS 27에서 Apple Intelligence를 쓰면 Orvena 안에서는 다운로드가 없습니다. Orvena 자체 모델은 3.1 GB이며, 음성을 사용한다면 두 음성 팩용으로 331 MB와 400 MB가 더 필요합니다. 시작하기 전에 약 4 GB의 여유 공간을 확보하세요.
iPhone 15나 14 Pro에서도 실행할 수 있나요?
아닙니다. 이 휴대폰들은 메모리가 6 GB인데, 모델이 그중 3 GB가 조금 넘게 필요하고 나머지는 iOS가 필요로 합니다. iPhone 15 Pro와 그 이후의 모든 모델이 해당됩니다.
Apple Intelligence는 오프라인에서 작동하나요?
온디바이스 모델은 작동합니다. Apple에 따르면 앱이 이 모델을 사용할 수 있고 "여러분이 만든 기능은 오프라인에서도 작동합니다." Orvena에서는 무선 연결을 끈 상태에서도 Apple Intelligence가 답하고 휴대폰 도구를 사용합니다. Apple 서버에서 실행되는 Apple의 더 큰 모델인 Private Cloud Compute는 연결이 필요합니다.
Orvena는 App Store에서 iPhone 15 Pro 이상용으로 무료입니다. iOS 27에서는 Apple Intelligence로 시작할 수 있고, 자체 모델은 한 번 내려받으면 휴대폰에서 실행됩니다.
App Store에서 다운로드