オンデバイスAIとクラウドAIの違い:あなたにとって実際に何が変わるのか
オンデバイスAIとクラウドAIの違いは、ひとつの事実に尽きます。モデルがどこで動くかです。プライバシー、価格、速度、モデルにできることなど、それ以外はすべてそこから決まります。ここでは画面のこちら側、つまりユーザーの立場から、わかっている範囲で実際の数字を添えて比較します。
2つの設計
クラウドAIでは、メッセージはデータセンターに送られ、そこで非常に大きなモデルが答え、その答えが戻ってきます。オンデバイスAIでは、メッセージはスマートフォンにとどまり、より小さなモデルがそこで答えます。Orvenaは後者です。一度だけダウンロードする3.1 GBのQwen 3.5 4BをiPhoneのGPUで動かし、iOS 27では、AppleのオンデバイスモデルであるApple Intelligenceで、何もダウンロードせずに答えることもできます。
オンデバイスAIとクラウドAIの比較
| オンデバイス(Orvena) | クラウド(ChatGPTなど) | |
|---|---|---|
| 言葉の送り先 | どこにも送られません。モデルはスマートフォン上にあります。 | プロバイダのサーバー。 |
| アカウント | 不要。 | 履歴、課金、利用制限のために、通常は必要。ChatGPTには、ログインせずに使える制限付きのモードがあります。 |
| オフラインで動作 | はい。スマートフォンのツールも含めて。 | いいえ。 |
| レイテンシ | ネットワークの往復がありません。答えは書かれるそばからストリーミングされます。 | ネットワークと待ち行列の時間。負荷によって変わります。 |
| モデルの大きさ | Orvena独自のモデルで約40億(4B)パラメータ。 | 数千億パラメータ。 |
| 会話の記憶 | Orvena独自のモデルで16,384トークン(英語で約12,000語)。iOS 27のApple Intelligenceは8,192と報告しますが、Appleのドキュメントには今も4,096と書かれています。 | はるかに大きい。 |
| 価格 | アシスタントは無料で、iOS 27のApple Intelligenceも含まれます。音声、外部接続、予約タスク、iOS 27のPrivate Cloud Compute、自分のキーで使うクラウドモデルは、14.99ドルの一度の購入。 | ChatGPTのプランは月額0ドルから200ドル。Plusは20ドル。 |
| 必要なスマートフォン | iPhone 15 Pro以降、8 GBのメモリ。 | どれでも。 |
| ポリシーが変わったとき | 過去の会話については何も変わりません。 | 保存された会話については、新しいポリシーの定めるとおりになります。 |
オンデバイスが得意なこと
人がスマートフォンに実際に頼むことです。「午後3時の予定を木曜の朝に変更して。」「移動時間を含めて、明日の午後2時に空港に着けるようアラームをセットして。」「今夜9時に、明日の天気を最初の会議と照らし合わせて。」「この写真に何が見える?」スマートフォンサイズのモデル(Orvena独自のものでもApple Intelligenceでも)が言葉を扱い、カレンダーとアラームはスマートフォン自身のツールが処理し、移動時間はAppleマップが出します。カレンダーの予定も写真もデバイス上で理解され、読み取りのためにどこかへ送られることはありません。
クラウドのほうが優れているところ
規模です。データセンターのモデルは、より多くを知り、より長く推論し、より上手に書き、本1冊分の文書をコンテキストに収められます。長い調べ物や専門的な分野、良いだけでなく優れていなければならない文章では、その差を感じるでしょう。そして今のところ、スマートフォン側でどれだけ工夫しても、その差は埋まりません。クラウドサービスは、何分もかけてウェブを閲覧するエージェントのように、インフラを必要とする機能も加えています。
慎重に作られたハイブリッド
どちらか一方を一度きりで選ぶ必要はありません。Orvenaの「モデル」ページには、使えるすべてのエンジンが並びます。「内蔵」にはiOS 27のApple Intelligence、「デバイス上のモデル」にはダウンロードしたOrvena独自のモデル、「クラウド」にはiOS 27のAppleのPrivate Cloud Compute(キーの設定は不要で、Appleが定める1日の上限あり)と、自分のキーで使うOpenRouterのあらゆるモデルです。デフォルトのエンジン設定である「自動」(「設定」の「詳細」)は、ダウンロードしたモデルを使い、準備できたモデルがない間はApple Intelligenceを使います。勝手にクラウドへ切り替えることはありません。OpenRouterの場合、Orvenaは会話で最初のクラウドリクエストを送る前に、その会話とツールの結果をプロバイダに送るかどうかを確認します。Private Cloud Computeは、選んだときに一度だけ確認します。どちらの場合も、健康や金融のデータは毎回あらためて確認します。音声画面には、今どちらのモードなのかが表示されます。緑の「この iPhone 上」と、琥珀色の「クラウド」です。
選び方
最近アシスタントに頼んだことを10個書き出してみてください。ほとんどが自分の生活、つまり予定、写真、書いていたメッセージ、近くの行き先についてなら、オンデバイスが正しいデフォルトです。データは個人的なもので、タスクはスマートフォンサイズのモデルで十分に対応できる範囲です。ほとんどが調べ物や長い文章なら、ときどきはクラウドを使いたくなるはずです。理想は、それが唯一のモードではなく、リクエストごとに自分で選べる選択肢であることです。
よくある質問
オンデバイスAIは、クラウドAIより遅いですか?
トークンあたりで見れば、スマートフォンはデータセンターのGPUより遅くなります。しかし、ネットワークの待ち時間がなく、答えは書かれるそばからストリーミングされるので、短い答えはすぐに返ってくるように感じられます。スマートフォンで時間がかかるのは、答えが始まる前に長い会話を読み込む部分です。
Private Cloud Computeは、オンデバイスAIと同じくらいプライベートですか?
同じ意味でプライベートなわけではありません。Appleのサーバー上で動くので、リクエストはスマートフォンの外に出て、接続も必要です。Appleは"Private Cloud Computeで処理されるデータは保存されず、Appleがアクセスできるようになることもありません"と述べ、"独立したプライバシーとセキュリティの研究者が、このプライバシーの約束をいつでも検証できます"としています。オンデバイスなら、そうした約束の対象となるサーバーが、そもそも会話の中にありません。
スマートフォンでAIを動かすと、バッテリーが減りますか?
短い質問ならほとんど消費しません。長い音声会話は、ゲームと同じようにスマートフォンを温め、それに応じてバッテリーを使います。すでに始めた返答を除いて、バックグラウンドで動くものはありません。
オンデバイスAIでも、ウェブを検索できますか?
はい。最新の情報を求めると、ブラウザから検索するときと同じようにクエリが検索プロバイダに送られ、読み取りと要約はスマートフォン上で行われます。
OrvenaはiPhone上でモデルを動かし、リクエストに応じて、AppleのPrivate Cloud Computeか、自分のキーで使うクラウドモデルを選べるようにします。
App Storeでダウンロード