概要

Arm CPU上でエージェント型AIを加速

AI Summary

Arm SME2は、行列処理を多用するAIワークロードをCPU上で直接高速化し、応答性が高く、プライベートなオンデバイス体験の実現を支援します。最新のArm C2 CPUクラスターに搭載された拡張SME2機能により、開発者は音声認識、検索、生成AI、そして新たなエージェント体験を支えるその他のワークロードを高速化できます。

メリット

SME2が重要な理由?

エージェント型AIを最大1.7倍高速化

モバイルにおけるエージェント型AIの構成要素となる音声、個人メモリー、推論処理のワークロードを高速化します。*

応答性の高いオンデバイスAI

軽量なAIモデルをCPU上で実行し、エージェントワークフロー全体で低レイテンシのオンデバイス体験をサポートします。

幅広いフレームワークのサポート

Arm KleidiAIの統合を通じて、12を超えるAIフレームワークと100以上のサードパーティ製アプリケーションにわたり、SME2のアクセラレーションを活用できます。

モバイルAIのユースケースで実証済み

リアルタイム翻訳、音声認識、画像認識、背景ぼかし、物体検出など、実世界でのさまざまな体験をサポートします。

**テスト済みのエージェント型AIワークロードにおいて、CSS for Mobile 2は、基準とした前世代のプラットフォームよりも実行を最大1.7倍高速化します。

特長

最新のAIワークロード向けに構築

軽量AIのための行列処を高速化

音声、メモリー検索、推論、その他のAIタスクなど、専用のオンデバイスモデルで多用される、行列処理を高速化します。

低精度モデルのサポート

2ビットワークロードを含む、コンパクトな量子化AIモデルをサポート、メモリー使用量を削減し、実行効率を向上させます。

AI同時実行

文字起こし、翻訳、音声生成、その他のAIワークロードをCPU上で同時に実行し、応答性の高いマルチステージ体験を実現します。

スケーラブル設計

エントリーレベルからフラッグシップのモバイルデバイスまで、柔軟なパフォーマンスを提供し、デバイス間で一貫した開発者およびユーザーエクスペリエンスを保証します。

SME2ドキュメントを読む
サクセスストーリー
SME2:AndroidにおけるオンデバイスAIの進化

ArmとGoogleがヘテロジニアス・コンピューティングを活用して、AndroidでオンデバイスAIをどのように進化させているかをご覧ください。SME2がCPU上でAIを直接高速化することで、開発者はAndroidエコシステム全体にわたり、より高速で応答性が高く、拡張性に優れたAI体験の提供が可能になります。

 
「LiteRTとGoogle AI Edgeは、オンデバイスで利用可能な最高のアクセラレーションを活用するように設計されており、対応プラットフォームではデフォルトでArm SME2を選択しています。Google AI Edge Galleryでは、SME2が要求の厳しい生成AIワークロードをCPU上で直接高速化する支援をすることで、Gemmaのようなモデルを用いたオンデバイス翻訳など、応答性に優れたエクスペリエンスを実現します。Armとのコラボレーションでは、最適化されたソフトウェアとハードウェアの連携により、開発者がより高度なパフォーマンスを引き出せるよう支援しています。」 
Google、オンデバイスML開発者ツール責任者、Na Li氏
ユースケース

SME2の実践

SME2は、個人用のインテリジェントで低レイテンシなオンデバイスAIワークロードを支え、エージェントによる通話、パーソナライズされたワークアウトコーチング、没入型NPCインタラクション、ニューラルイメージングなどのユースケースを実現します。

 
 
 
開発者

開発者向けに構築

 

PyTorch、ONNX Runtime、XNNPACK、llama.cppなどの主要なAIフレームワークとランタイムライブラリにわたるネイティブSME2サポートにより、開発者はコードを1行も変更せずにSME2のメリットを活用できます。SME2によって強化されたパフォーマンスは、iOSやiPadOSからmacOS、そして近々Androidまで、Armベースのプラットフォーム間で移植可能です。

 

新しいArm Developer Launchpad for SME2をご覧ください。SME2のアクセラレーションとユースケース、ステップバイステップのチュートリアル、実践的な学習パスについて学びましょう。

SME2で構築を開始する開発者ブログを読む
関連製品

CSS for Mobile 2プラットフォームを探る

Arm CSS for Mobile 2

Arm CSS for Mobile 2

Mali G2-Ultra NXは、次世代のモバイルAI体験を実現する、AIオーケストレーション、ニューラルグラフィックス、システムIP 、ソフトウェアを組み合わせたコンフィギュラブルなコンピューティングプラットフォーム、CSS for Mobile 2の一部です。

Arm C2 CPU Cluster

Arm C2 CPUクラスター

AIオーケストレーションと応答性の高いアプリケーションパフォーマンスを実現する、SME2搭載の高性能Arm CPUクラスターです。

つながる

最新ニュース、ケーススタディ、インサイトをキャッチアップできるサブスクリプションにぜひ登録してください。

ニュースレターにサインアップ

よくある質問:SME2

SME2とは?

SME2(Scalable Matrix Extension 2)は、Armv9.3-Aアーキテクチャの高度なCPU命令セットであり、AIおよびMLワークロード、特にLLMやコンピュータービジョンなどのマトリックスを多用するタスクを高速化するように設計されています。Arm KleidiAIを介して一般的なAIフレームワークとシームレスに統合され、コードを変更することなくよりハイパフォーマンスと効率を実現します。

SME2はデバイス上のAIパフォーマンスをどのように向上させますか?

SME2は、CPU上で直接行列演算を実行することで、別個のNPUやクラウドリソースを必要とせずに、大規模言語モデルの推論を最大6倍高速化し、ビジョンとオーディオの処理を3倍向上させます。

SME2をサポートするデバイスは?

iPhone 17(A19)、Apple Mシリーズ端末およびフラッグシップAndroid端末で現在利用可能です。

SME2は開発者にどのようなメリットをもたらしますか?

SME2はPyTorchONNX Runtime、XNNPACKなどのフレームワークと自動的に統合されるため、開発者はコードを書き直すことなくAIワークロードを高速化できます。開発者は、ツールチェーン、SDK、トレーニングなどのモバイルリソースでArm AIを見て、すぐに作業を開始できます。

SME2は生成AIアプリケーションに役立ちますか?

もちろんです。SME2は、リアルタイム翻訳、写真/ビデオの強化、オーディオ生成、モーション分析などの生成AIタスクをデバイス上で直接高速化します。これにより、より高速で、よりプライベートで、よりエネルギー効率の高いユーザーエクスペリエンスが実現します。開発者は、モバイルリソース上でArm AIを使用してこれらの機能を実装する方法を学ぶことができます。