Skip to content

核心技术

MOS — MultiCortex Optimization Stack

一个位于 AI 模型与硬件之间的软件层,优化其在芯片上的运行方式。

什么是 MOS

榨干每一颗芯片的极限性能

对于任何进行 AI 推理的企业而言,MOS 存在于模型与芯片之间:这一优化层会在恰当的时机,将每一步处理调度到合适的加速器上——无论是 GPU、CPU、NPU 还是 XPU,单独使用或组合使用。

榨干每一颗芯片的极限性能——适用于任何进行 AI 推理的企业。

架构设计

端到端的主权掌控

从对话到芯片,每一层都由您掌控。四层架构,零外部依赖。

1

对话界面

终端用户看到并使用的层——聊天、助手或应用——可按贵公司的偏好自由构建与托管。

2

开源大语言模型

任意开源语言模型,选择适合您使用场景的版本与规模——不依赖单一模型供应商。

3

MultiCortex OS

编排执行的 AI 操作系统:MOS 正运行于此,将每项工作负载分配到可用的加速器上。

4

硬件

任意厂商的 GPU、CPU、NPU 或 XPU——MultiCortex 从贵公司已有的硬件中榨取性能。

零硬件与软件锁定

为何重要

端到端,零锁定

更换硬件供应商或模型,不应该意味着要重写您的 AI 基础设施。MOS 的设计初衷正是让这种切换变得透明无感。

任意硬件

GPU、CPU、NPU 或 XPU——来自任意厂商。贵公司不会被锁定在单一芯片品牌上。

任意模型,任意语言

支持开源模型以及您的团队已在使用的编程语言,无需被迫迁移。

了解 MOS 的实际应用

了解将这项技术应用于已在生产环境中运行 AI 的企业的产品。