イベント日:2026年9月9日
Desert Ant Labsは、消費者向けデバイス上で直接動作するよう設計された18種類の特化型人工知能モデルのカタログとともに事業を開始し、製品データをクラウドサービスへ繰り返し送信することに代わる選択肢として、ローカル推論を位置付けている。
この欧州企業によると、モデルのうち12種類は安定版で、6種類はベータ版だ。音声、画像、テキストのタスクを対象とし、Swift、Kotlin、JavaScript向けの単一のソフトウェア開発キットを通じて利用できる。汎用モデルを1つ提供するのではなく、明確に限定された機能ごとに別々の小型モデルを構築している。
同社の売り文句は、遅延、運用コスト、プライバシーを軸としている。スマートフォンやコンピューター上で動作するモデルでは、リクエストのたびに料金が発生したり、ネットワークの往復通信を待ったりする必要がない。入力はユーザーのデバイス内に保持でき、外部サーバーへ送信される顧客データの量を減らせる。Desert Antによると、これらのモデルは月間アクティブデバイス数が最大10万台の製品まで無料で、エンドユーザーがトークンやアカウントを管理する必要もない。
この取り組みは、オンデバイス優先の方針で開発された動画アプリ「Detail」を構築したチームの経験から生まれた。公開時の説明によると、それでもクリップの自動編集やポッドキャスト音声の強調といった機能にはクラウドAPIが必要で、利用の拡大に伴ってインフラ費用が増加した。これを受けてチームは、そうした特定の処理向けのモデルを訓練した。
Desert Antは、音声強調処理では同社のClearモデルがDolbyの処理を置き換え、Vozによってアプリケーション内のローカル文字起こしが5倍高速になったと報告している。別のモデルであるClipsは、10分間の動画から短い区間を選び出す284メガバイトのシステムだ。同社は、同程度の品質のClaude Sonnetワークフローと比べ、10倍高速かつエネルギー消費を470分の1に抑えながら、5秒で12本のクリップを生成できると主張している。これらのベンチマーク主張は同社によるもので、提示された証拠に基づく独立した検証は行われていない。
IOS 27向けに計画されているDetailの次期バージョンでは、アプリケーションに残るクラウドAI呼び出しをDesert Antのローカルモデルで置き換える予定だ。Apple製ハードウェアでは、ClearとVozがNeural Engineを使用する。ブラウザでは、ClearがWebAssemblyを通じて同じ重みを実行できる。開発者はGitHub上のネイティブSDKへアクセスでき、コマンドラインツール、またはHugging Face経由でブラウザ上からモデルを試すことができる。
同社は、計画中の最初の100モデルを、録音のノイズ除去、画像へのタグ付け、テキストからの日付抽出といった反復作業のために常時稼働するレイヤーと説明している。将来のルーティングレイヤーでは、まず小規模なローカルモデルを選び、必要に応じてより大きなモデルへ切り替え、タスクが本当に必要とする場合にのみクラウドを使用する。
このアプローチは、頻繁に発生する製品上のやり取りの多くには、フロンティア規模の汎用モデルは必要ないという、より広範な見方を反映している。Desert Antは今後、同社の小型システムが実際のデバイスやワークロード全体で精度を維持できることを実証する必要があるが、今回の立ち上げによって、開発者はその見方を検証するための統一された手段を得ることになる。



