2025年,AI Agent基础设施领域迎来了真正的爆发拐点。各大主流云厂商几乎在同一时间推出了新一代架构,目标明确:为AI Agent打造更加强大的“躯干”。这场技术竞赛的背景十分清晰——DeepSeek、Qwen这类开源大模型已经为Agent提供了近乎“开挂”的认知大脑,而MCP生态的繁荣又赋予了它灵活的四肢。据IDC预测,全球将有80%的企业在今年部署Agent应用。当大脑和四肢协同进化,承载它们的躯干自然成为了技术攻坚的核心战场。
来看看几大云厂商的最新动作:
- AWS推出了AgentCore(预览版),基于Lambda FaaS深度定制,重点解决标准Lambda在长时执行、状态记录、会话隔离等方面的关键限制。
- Azure的AI Foundry Agent Service,集成了Functions FaaS的事件驱动能力,让Agent服务的构建和部署变得更加灵活高效。
- Google Cloud的Vertex AI Agent Builder,虽然官方没有明说,但业内普遍推断它高度依赖Cloud Run来支撑长时运行、并发处理和有状态需求。
- 阿里云则拿出了函数计算Function AI,基于FC FaaS的Serverless x AI运行时深度优化,提供模型服务、工具服务、Agent服务,开发者可以像搭积木一样自由组合使用。
这些技术的目标出奇一致:为Agent打造一个更高弹性、更低延迟、更强安全、更长会话的“躯干”,让Agent真正从实验室走进千万级企业场景。当认知和行动完成闭环,Agent Infra的技术代差,将直接决定企业AI创新与数字化转型的速度和质量。
Agent Infra 乘风而来
共性需求
Agent开发范式的演进,正在对底层基础设施提出全新要求——这几乎已成为行业共识。AWS、Azure、Google Cloud、阿里云等主流云厂商的新一代Agent Infra,都在集中攻克长时运行、会话亲和、会话隔离、企业级IAM和VPC、模型/框架开放等关键技术。背后驱动的,是三类核心Agent形态的共性需求:
- LLM Agent连续调用工具的强诉求:LLM Agent需要连续调用工具链完成复杂推理,这个过程可能跨越数分钟甚至数小时。传统Serverless的执行时长限制(比如AWS Lambda的15分钟上限)会直接中断任务。因此,新一代Agent Infra必须突破这个瓶颈,支持长时运行。同时,为了维持多轮对话的上下文一致性,还需要会话亲和来确保同一请求路由到同一计算实例,避免状态丢失。
- Workflow Agent对状态管理的依赖:自动化工作流,比如数据处理Pipeline,需要持久化记录执行状态。传统Serverless的无状态特性无法保存中间结果,而新一代Agent Infra通过提供有状态会话,保障工作流的原子性和可恢复性。会话隔离则确保多租户或高并发场景下任务互不干扰,满足企业级安全合规要求。
- Custom Agent的灵活性与生态整合:Custom Agent需要集成异构工具——API、领域模型、数据库、Code Interpreter、Browser Use等等。这就要求新一代Agent Infra支持模型/框架开放,比如AutoGen、LangChain、AgentScope。封闭式架构会限制Agent的能力扩展,而云厂商通过解耦计算层与框架层,提供插件化集成接口,为开发者打开了更大的创新空间。
技术路径
新一代Agent Infra保留了Serverless的核心优势——全托管免运维、轻量弹性更经济,同时通过关键功能(长时运行、会话亲和、会话隔离)和技术突破(状态持久化、冷启动优化、开放集成),解决了LLM Agent的持续推理、Workflow Agent的复杂状态流转、Custom Agent的灵活定制等核心需求。这意味着,Agent开发正在从“手动拼凑传统组件”转向“利用原生Infra实现高效、安全、可扩展的开发部署”,这是一条全新的技术演进路径。
架构原则
在Agent技术架构加速进化的大背景下,函数计算“五年磨一剑”并非虚言,而是将理论瓶颈转化为经过大规模实践验证的企业级解决方案。核心共识是:未来的Serverless架构必须遵循三大基本原则——开源开放、组装式设计、灵活定制。这不是技术空想,而是业务驱动、市场淘沙后得出的生存法则。
开源开放是企业自由进化的保障。以模型服务为例:PoC阶段可以用商业模型快速验证;规模扩张时切换到混合架构,核心业务拥抱开源模型实现自主可控,边缘场景沿用商业服务来降本增效;到了业务成熟期,通过微调或训练后的自有模型,实现更深度的业务创新。这种阶梯式的进化路径,让企业始终掌握技术选择权。
组装式设计的本质,是拒绝重复造轮子。想象一个视频转码工作流:它需要无缝串联函数计算、消息队列、日志服务、对象存储等十多种云产品。真正的价值在于:原子能力自由拼装,像搭乐高一样调用高弹性、高可靠的云原生组件;生态级互联,跨产品的IAM鉴权和VPC网络互通实现安全隔离;韧性设计内化,工作流自带容错、回放、自愈能力,故障不再是停机噩梦。
而灵活定制则需要破解更深层的命题:解耦资源层与服务层。资源层持续锤炼冷启动、弹性伸缩等原子能力,成为“沉默的基石”;服务层则专注场景创新,将客户需求转化为技术驱动力。当LLM Agent的多轮会话需求暴涨时,资源层需要快速优化长时任务和状态记录的调度算法;当Workflow Agent的某些工作流节点需要毫秒级响应时,服务层则需要灵活调配资源——比如通过毫秒级快照加弹性策略实现冷启动加速。市场价值是技术边界的唯一标尺,打破技术边界必须为用户带来价值。
如今,函数计算正是以这种“双螺旋结构”推动架构进化:向下吸纳硬件红利,构筑高效资源池;向上生长出企业级Agent创新场景。当行业仍在持续探索Agent Infra技术架构的新形态时,以落地实践为锚点,或许是更务实的选择。
从Cloud Native 到 AI Native
2020年
函数计算业内首推OCI标准镜像——打破FaaS和容器的技术边界
作为业内第一个支持OCI标准镜像的Serverless平台,函数计算彻底解决了环境依赖的碎片化问题。传统Serverless受限于运行时语言版本和依赖库的固化配置,而OCI镜像将应用与其完整运行环境打包交付,实现了开发、测试、生产环境的绝对一致。这一创新直接推动Serverless进入企业核心生产场景,也为后续GPU等异构计算的支持奠定了坚实基础。
2021年
函数计算业内首推Serverless GPU——Serverless x AI 全新开发范式
面对AI负载对算力的严苛需求,函数计算首创Serverless GPU异构实例,突破三大技术壁垒:第一,精益使用稀缺资源,按请求实时分配GPU算力且支持切分使用,避免传统虚机或容器驻留导致的资源浪费;第二,冷启动加速降时延,通过镜像加速和模型加速,秒级甚至毫秒级快照优化冷启动,拓宽了实时和准实时推理的应用场景;第三,技术升级释放红利,1秒计费粒度,弹性实例满足中小客户经济使用,常驻实例则满足企业客户的固定预算。这一创新直接推动Serverless技术在图像识别、实时推理等场景的普及,拉开了Serverless x AI的工业化序幕。
2022年
函数计算业内首推24小时长时任务——打破执行时长枷锁
传统Serverless受限于短时任务模型,比如AWS Lambda的15分钟上限,难以承载视频处理、数据分析、科学计算等长时负载。函数计算率先支持24小时超长任务,关键技术突破包括:状态持久化,内置队列实现FIFO,由平台自动化异步消费执行,并记录任务状态;弹性强隔离,基于轻量级虚拟机池化技术,弹性供给算力,实现数据隔离和性能隔离;自动高可用,事件驱动任务执行,自动重试,无冗余资源浪费,成功或失败自动处理。这一创新大大拓宽了Serverless在音视频处理、文件处理、批处理与流式计算等领域的适用场景。
2023-2025年
函数计算FunctionAI Agent原生底座——从资源供给到智能服务的生产级跨越
2023到2025年,函数计算以“场景驱动技术创新、开放推进价值突破”为核心理念,推出FunctionAI服务。在Serverless x AI运行时基础上,构建了三位一体的生产级能力和最佳实践:
- 模型服务:支持开发者灵活高效地自建模型——比如魔搭社区、HuggingFace上数万模型的本地化部署,或云上托管微调模型,上传镜像或模型文件即可完成部署。这突破了商业模型厂商绑定的限制,实现了“框架无关、模型自主”的技术选择权。
- 工具服务:通过MCP Server一键托管,比如高德地图导航工具、CloudOps、PolarDB、RDS、DataWorks等数十款阿里云官方MCP工具。集成50多个开箱即用的插件工具,支持VPC打通企业私有生态,并且可以作为解决方案一键输出为企业专属的MCP MarketPlace,满足金融、政务等高合规场景的定制化需求。
- Agent服务:基于函数计算的沙箱运行时与会话亲和/会话隔离等功能,实现Agent Runtime和Sandbox Runtime的弹性伸缩与安全隔离。同时开放组装式原子功能,允许将FunctionAI能力无缝嵌入企业自研平台。此外,FunctionAI官方提供的AgentFlow服务,提供类似Dify的可视化工作流开发体验,采用自研引擎,10倍提升Agent运行效率。对比Dify社区版,AgentFlow可以灵活定制工作流节点,零成本打通云上生态。
展望
函数计算Agent Infra的差异化在于“原子化组装”、“开放生态”与“选择权”:
- 不同于业界其他产品,函数计算拒绝与商业模型锁定。开发者可以自由组合使用任意开源模型——Llama3、DeepSeek、ComfyUI、Stable Diffusion,以及云上工具。
- 通过Serverless资源池化与VPC深度集成,企业在享受SaaS级敏捷体验(5分钟自建模型、10分钟构建Agent)的同时,还能保障核心业务的自建掌控力。这正是“混合架构”演进路径的终极形态:兼顾了SaaS的易用性与自建的稳定性、成本可控性和定制灵活性。
当业界聚焦一体化解决方案(封闭生态或有限制的开源开放)时,函数计算选择成为“AI乐高”的底座。开发者不必在“快速验证”与“深度定制”之间妥协,而是以开放架构实现“从实验室到生产可用”的无缝跨越,让Agent真正成为企业数字生产力的通用组件。
Serverless是当前技术领域最有可能演进为AI Native Infra的技术架构。函数计算正着力打造模块化的Agent Infra之剑,助力开发者从“生态应用者”进阶为“能力定义者”,最终推动AI技术走向开放共享的创新之路。
