このクラスターは、DeepSeek V4 Flashをローカルで実行し、企業にプライベートかつスケーラブルなAIを提供する。
,台北、2026年8月18日 /PRNewswire/ — 高性能ミニPC分野をリードするイノベーターであるGEEKOMは、4台のGEEKOM A9 MegaシステムにDeepSeek V4 Flashを導入しました。この成果は、GEEKOMがコンパクトコンピューティング分野で培った専門知識を、実用的なエンタープライズAIへとどのように応用しているかを示しています。
このクラスターは、データセンターのサーバーに依存するのではなく、4台のA9 MegaミニPCをUSB4経由で接続し、一つの分散型プラットフォームとして機能します。各A9 MegaはAMD Ryzen AI Max+ 395を搭載し、16個のZen 5 CPUコア、Radeon 8060Sグラフィックス、ユニファイドメモリをコンパクトな筐体に統合しています。
Ubuntu、ROCm、およびDwarfStarは、最適化されたDeepSeek V4 Flashモデルが複数のマシンに分散配置されます。OpenAI互換APIがアプリケーションとAIエージェントを接続し、USB4により、独自仕様の高速スイッチやサーバーラックが不要になります。
エンタープライズAIを企業の現場へ
このクラスターにより、組織は機密情報を自らの管理下に置きながら、高度なAIを活用できます。プロンプト、ドキュメント、ソースコード、認証情報、および中間結果は、パブリッククラウドに送信されることなく、ローカルインフラストラクチャ内に留めておくことができます。
企業は、方針、マニュアル、契約書、報告書、その他の社内文書を検索・分析する社内専用のナレッジアシスタントを構築できます。また、このプラットフォームは、文書レビュー、ソースコード分析、ローカル環境での検索拡張生成、複数ソースを用いた調査、管理されたワークフローの自動化にも対応しています。
Hermes Agentなどのエージェントシステムでは、クラスターはアクションを実行する前に、ツール、ポリシー、メモリ、ログ、コード、取得した情報を処理できます。この技術構成は最大25万トークンのコンテキストで稼働した実績があり、長文の文書、大規模なコードベース、複雑な多段階処理に適しています。
実績ある性能と柔軟な拡張性
同時実行数1の場合、32トークンおよび128トークンのテストで、システムは約14.61トークン/秒を達成し、最初のトークンが生成されるまでの時間は、P95値で約0.42秒でした。さらに重要なのは、単にテキスト生成が速いだけでなく、長いプロンプトに対して、より大きな処理能力と高い高速化性能を提供する点です。
組織は、まず1台または2台のシステムから導入を始め、ニーズの拡大に合わせて4台まで拡張できます。各A9 Megaは、単独で動作することも、分散推論の一部として機能することもでき、柔軟性と長期的な価値を最大化します。
この成果は、ミニPCイノベーションの最前線におけるGEEKOMの地位をさらに強固にするものです。コンパクトで単体でも利用できるコンピューターを、利用しやすいローカルAIプラットフォームへと変えることで、GEEKOMは、企業、研究所、教室、エッジ環境においてミニPCが実現できることを引き続き再定義しています。

