什么是 MOS
榨干每一颗芯片的极限性能
对于任何进行 AI 推理的企业而言,MOS 存在于模型与芯片之间:这一优化层会在恰当的时机,将每一步处理调度到合适的加速器上——无论是 GPU、CPU、NPU 还是 XPU,单独使用或组合使用。
榨干每一颗芯片的极限性能——适用于任何进行 AI 推理的企业。
架构设计
端到端的主权掌控
从对话到芯片,每一层都由您掌控。四层架构,零外部依赖。
1
对话界面
终端用户看到并使用的层——聊天、助手或应用——可按贵公司的偏好自由构建与托管。
2
开源大语言模型
任意开源语言模型,选择适合您使用场景的版本与规模——不依赖单一模型供应商。
3
MultiCortex OS
编排执行的 AI 操作系统:MOS 正运行于此,将每项工作负载分配到可用的加速器上。
4
硬件
任意厂商的 GPU、CPU、NPU 或 XPU——MultiCortex 从贵公司已有的硬件中榨取性能。
零硬件与软件锁定
为何重要
端到端,零锁定
更换硬件供应商或模型,不应该意味着要重写您的 AI 基础设施。MOS 的设计初衷正是让这种切换变得透明无感。
任意硬件
GPU、CPU、NPU 或 XPU——来自任意厂商。贵公司不会被锁定在单一芯片品牌上。
任意模型,任意语言
支持开源模型以及您的团队已在使用的编程语言,无需被迫迁移。