AI 基础设施

让企业在自己的云里大规模运行生产级智能体

基于榫卯企业云平台,SmartX 将虚拟化、容器、分布式存储、网络安全、模型服务平台与运维能力整合为一套可演进的云基础设施,统一支撑传统应用、容器应用、智能体(Agent)。

构建 Agent Ready 的企业云基础设施获取电子书 →
AI 基础设施官方配图
趋势洞察

智能体(Agent)快速增长,放大 Token 与基础设施压力

智能体(Agent)的落地正在改变企业 AI 基础设施的需求形态。随着智能体(Agent)数量增长、调用链路变长、Token 用量上升,企业不仅需要模型推理能力,也需要面向大规模智能体(Agent)运行的弹性资源、数据访问、安全隔离与全链路可观测能力。
Agentic AIToken 用量与基础设施压力随智能体(Agent)规模快速上升

企业需要面向大规模智能体(Agent)运行的基础设施承载能力,支撑持续增长的模型调用与上下文处理。

两大场景

海量智能体(Agent)运行与模型推理:两大场景与不同需求

智能体(Agent)基础设施需要同时面向两类关键场景:一类是 CPU 驱动的智能体(Agent)运行,承载智能体编排、工具调用、上下文处理与业务系统访问;另一类是 GPU 驱动的模型推理,承载模型服务、AI 网关、推理引擎与异构算力调度。

支撑海量智能体(Agent)运行

CPU 驱动,承载智能体平台和业务应用

统一架构

与传统负载和容器负载统一架构,降低独立建设和管理成本。

弹性资源池

弹性资源池支撑指数级增长;大量智能体(Agent)瞬时创建与销毁,实现秒级伸缩。

稳定与安全

满足并发读写、7x24 稳定运行、权限隔离、审计追踪与安全管控。

链路可观测

打通智能体(Agent)到工具、MCP、模型的链路可观测,追踪上下文、调用路径和资源消耗。

智能体(Agent)友好

提供智能体(Agent)友好的基础架构能力接口。

模型推理服务

GPU 驱动,承载私有模型、公有模型

资源管理

统一管理异构 AI 芯片,提高 GPU 等关键资源的使用效率。

模型服务

统一管理各类模型,支持模型快速上线并提供稳定可靠的模型服务。

推理引擎

面向长上下文、多轮对话场景,提供低延迟、高性能推理能力。

可观测治理

覆盖 GPU 资源消耗、推理实例性能、调用日志和 Token 用量等指标。

平台能力

一套云平台支撑从传统应用到智能体时代的演进

SmartX AI 基础设施解决方案基于榫卯企业云平台,将传统应用、容器应用、智能体(Agent)运行与模型推理纳入统一的企业云架构,帮助企业在已有基础设施基础上建设 AI 能力,减少独立 AI 基础设施带来的架构割裂与管理复杂度。

Agent 运行CPU 驱动

传统应用
容器应用
Agent 平台
安全沙箱智能体编排Skills
智能体应用

Agent 原生文件共享插件

榫卯®企业云平台
虚拟机容器存储网络安全
各类通用服务器(或一体机)
......
Prompt + Context
Tokens 返回
Answer / Tool Call

模型服务GPU 驱动

榫卯® AI 平台
模型层AI 网关

DeepSeek

Qwen

GLM

Minimax

私有模型公有模型
推理引擎vLLMSGLang...
榫卯®企业云平台
容器管理与服务...
GPU 服务器(或 AI 一体机)
...
场景实践

两类 AI 基础设施场景并行演进

AI 基础设施需要同时承载 CPU 驱动的智能体(Agent)运行与 GPU 驱动的模型推理。前者强调传统业务、容器应用与 Agent 平台统一运行,后者强调模型服务、推理引擎与异构算力资源统一管理。
智能体(Agent)运行

无缝支撑传统业务 + 智能体(Agent)大规模运行

以榫卯企业云平台为底座,将虚拟机、容器、存储、网络安全和智能体(Agent)原生文件共享能力整合在统一架构中。

Agent 运行架构
传统应用OA / CRM / 数据库容器应用微服务 / API / DevOpsAgent 平台编排 / Skills / Tools
榫卯企业云平台虚拟化 · 容器 · 高性能块 / 文件存储 · 网络安全 · 可观测 · AFS
各类通用服务器或一体机
容器

为 Agent 提供统一的运行时环境和安全沙箱能力,确保 Agent 可靠、安全运行。

高性能存储

提供高性能块与文件存储,满足 Agent 并发读写、上下文私有数据存储和跨 Agent 数据共享需求。

安全

结合网络流量可视化能力,直观呈现 Agent 与 MCP 服务之间的调用拓扑;同时通过虚拟机与容器统一安全策略,保障 Agent 之间、Agent 与 MCP 服务之间的通信安全。

Agent 友好

提供面向 Agent 协作场景的原生文件共享组件,更好支持多 Agent 协同与数据流转。

模型推理

降低推理模型部署管理难度,提升资源使用效率

榫卯 AI 平台结合 SKS 容器服务,为不同场景快速搭建生产级模型基础设施,保障模型服务高效上线、稳定运行。

模型推理服务架构
私有模型DeepSeek / Qwen / GLM公有模型统一接入与路由
榫卯 AI 平台AI 网关 · 模型管理 · 推理引擎 vLLM / SGLang
GPU 服务器或 AI 一体机
模型服务

统一接入私有模型与内外部公有模型,支撑 DeepSeek、Qwen、GLM 等模型服务管理。

高性能推理

融合 vLLM、SGLang 等推理引擎能力,面向长上下文和多轮对话等场景,提供高吞吐、低延迟的推理服务。

模型治理

内置模型网关,统一内外部模型调用入口,通过用量统计、配额管理、访问控制和访问日志,精细化管理每一次模型调用,让问题排查、安全审计与资源治理都有据可查。

资源管理

统一纳管多地域、多类型的 AI 服务器,内置 GPU 虚拟化,提升异构芯片利用效率。

全链路可观测

覆盖 GPU 硬件、推理实例健康状态、模型资源消耗与调用日志等关键环节,帮助快速定位问题、安全审计、评估性能并优化资源使用。

成功案例

不同场景下的 AI 基础设施落地实践

大型船舶工程公司智能体与模型完整支撑体系案例配图
智能体运行 + 模型服务制造

大型船舶工程公司构建智能体(Agent)与模型完整支撑体系

榫卯企业云平台 / 榫卯 AI 平台

在榫卯企业云平台上统一支撑内部规范查询助手、翻译、运维等智能体应用,通过 AI 平台实现内部已有模型与自建模型的统一管理与治理。

三级甲等综合性医院统一模型即服务平台案例配图
模型服务医疗

三级甲等综合性医院构建统一模型即服务平台

榫卯 AI 平台

基于榫卯 AI 平台实现算力和模型的统一管理,支撑各类 AI 应用。

三级甲等综合性医院算力资源和模型资源统一交付案例配图
算力与模型统一交付医疗

三级甲等综合性医院实现算力资源和模型资源的统一交付,满足不同类型模型的运行需求。

榫卯企业云平台 / 榫卯 AI 平台

基于榫卯企业云平台提供算力资源,支撑视频识别小模型,通过榫卯 AI 平台实现大语言模型的统一管理。