벤처스퀘어
한눈에 보기
MOREH, an AI infrastructure solutions company led by CEO Cho Kang-won, unveiled its 'Token Factory OS' and distributed inference technology for heterogeneous AI accelerators at the AI Infra Summit 2026 in Santa Clara, held September 15-17. The company demonstrated a system combining Nvidia H100 and AMD MI300X, where prefill was handled by H100 and decode by MI300X, achieving up to 1.67x throughput improvement compared to same-vendor accelerator configurations. MOREH's MoAI Inference Framework connects accelerators from Nvidia, AMD, and Tenstorrent into a single logical cluster, aiming to help data centers optimize token production efficiency without depending on a single hardware vendor.
Read full article由CEO赵康元领导的AI基础设施解决方案公司MOREH在9月15日至17日于圣克拉拉举行的AI Infra Summit 2026上发布了“Token Factory OS”以及面向异构AI加速器的分布式推理技术。公司展示了将Nvidia H100与AMD MI300X结合的方案,由H100负责预填充(prefill),MI300X负责解码(decode),相比同厂商加速器配置最高实现1.67倍的吞吐量提升。MOREH的MoAI Inference Framework将Nvidia、AMD及Tenstorrent等不同架构的加速器整合为单一逻辑集群,旨在帮助数据中心在不依赖单一硬件供应商的情况下优化令牌生产效率。
查看原文チョ・カンウォン代表が率いるAIインフラソリューション企業MOREHは、9月15日から17日にサンタクララで開催されたAI Infra Summit 2026において「Token Factory OS」および異機種AIアクセラレータ向けの分散推論技術を公開した。同社はNvidia H100とAMD MI300Xを組み合わせたシステムを披露し、プリフィルをH100が、デコードをMI300Xが担当する構成により、同一ベンダーのアクセラレータ構成と比較して最大1.67倍のスループット向上を確認した。MOREHのMoAI Inference Frameworkは、Nvidia、AMD、Tenstorrentなど異なるアーキテクチャのアクセラレータを一つの論理クラスタに統合し、特定のハードウェアベンダーに依存せずにデータセンターがトークン生産効率を最適化できるようにすることを目指している。
原文を読むMOREH, une entreprise de solutions d'infrastructure IA dirigée par le PDG Cho Kang-won, a dévoilé son 'Token Factory OS' ainsi qu'une technologie d'inférence distribuée pour accélérateurs IA hétérogènes lors de l'AI Infra Summit 2026 à Santa Clara, du 15 au 17 septembre. L'entreprise a présenté un système combinant Nvidia H100 et AMD MI300X, où le préremplissage était géré par le H100 et le décodage par le MI300X, atteignant une amélioration du débit jusqu'à 1,67 fois par rapport à des configurations d'accélérateurs du même fournisseur. Le MoAI Inference Framework de MOREH relie des accélérateurs Nvidia, AMD et Tenstorrent en un seul cluster logique, dans le but d'aider les centres de données à optimiser l'efficacité de la production de jetons sans dépendre d'un seul fournisseur de matériel.
Lire l'article