支撑海量智能体(Agent)运行
CPU 驱动,承载智能体平台和业务应用
与传统负载和容器负载统一架构,降低独立建设和管理成本。
弹性资源池支撑指数级增长;大量智能体(Agent)瞬时创建与销毁,实现秒级伸缩。
满足并发读写、7x24 稳定运行、权限隔离、审计追踪与安全管控。
打通智能体(Agent)到工具、MCP、模型的链路可观测,追踪上下文、调用路径和资源消耗。
提供智能体(Agent)友好的基础架构能力接口。
让企业在自己的云里大规模运行生产级智能体
基于榫卯企业云平台,SmartX 将虚拟化、容器、分布式存储、网络安全、模型服务平台与运维能力整合为一套可演进的云基础设施,统一支撑传统应用、容器应用、智能体(Agent)。
构建 Agent Ready 的企业云基础设施获取电子书 →
企业需要面向大规模智能体(Agent)运行的基础设施承载能力,支撑持续增长的模型调用与上下文处理。
CPU 驱动,承载智能体平台和业务应用
与传统负载和容器负载统一架构,降低独立建设和管理成本。
弹性资源池支撑指数级增长;大量智能体(Agent)瞬时创建与销毁,实现秒级伸缩。
满足并发读写、7x24 稳定运行、权限隔离、审计追踪与安全管控。
打通智能体(Agent)到工具、MCP、模型的链路可观测,追踪上下文、调用路径和资源消耗。
提供智能体(Agent)友好的基础架构能力接口。
GPU 驱动,承载私有模型、公有模型
统一管理异构 AI 芯片,提高 GPU 等关键资源的使用效率。
统一管 理各类模型,支持模型快速上线并提供稳定可靠的模型服务。
面向长上下文、多轮对话场景,提供低延迟、高性能推理能力。
覆盖 GPU 资源消耗、推理实例性能、调用日志和 Token 用量等指标。
传统应用
容器应用
智能体应用Agent 原生文件共享插件

...
...

DeepSeek

Qwen
GLM
Minimax

...

以榫卯企业云平台为底座,将虚拟机、容器、存储、网络安全和智能体(Agent)原生文件共享能力整合在统一架构中。
为 Agent 提供统一的运行时环境和安全沙箱能力,确保 Agent 可靠、安全运行。
提供高性能块与文件存储,满足 Agent 并发读写、上下文私有数据存储和跨 Agent 数据共享需求。
结合网络流量可视化能力,直观呈现 Agent 与 MCP 服务之间的调用拓扑;同时通过虚拟机与容器统一安全策略,保障 Agent 之间、Agent 与 MCP 服务之间的通信安全。
提供面向 Agent 协作场景的原生文件共享组件,更好支持多 Agent 协同与数据流转。
榫卯 AI 平台结合 SKS 容器服务,为不同场景快速搭建生产级模型基础设施,保障模型服务高效上线、稳定运行。
统一接入私有模型与内外部公有模型,支撑 DeepSeek、Qwen、GLM 等模型服务管理。
融合 vLLM、SGLang 等推理引擎能力,面向长上下文和多轮对话等场景,提供高吞吐、低延迟的推理服务。
内置模型网关,统一内外部模型调用入口,通过用量统计、配额管理、访问控制和访问日志,精细化管理每一次模型调用,让问题排查、安全审计与资源治理都有据可查。
统一纳管多地域、多类型的 AI 服务器,内置 GPU 虚拟化,提升异构芯片利用效率。
覆盖 GPU 硬件、推理实例健康状态、模型资源消耗与调用日志等关键环节,帮助快速定位问题、安全审计、评估性能并优化资源使用。

在榫卯企业云平台上统一支撑内部规范查询助手、翻译、运维等智能体应用,通过 AI 平台实现内部已有模型与自建模型的统一管理与治理。

基于榫卯 AI 平台实现算力和模型的统一管理,支撑各类 AI 应用。

基于榫卯企业云平台提供算力资源,支撑视频识别小模型,通过榫卯 AI 平台实现大语言模型的统一管理。