2026 GOAI 世界人工智能开源大赛「Agent Infra 新智基座」赛道正式启动

简介: 2026 年 7 月 21 日,首届 GOAI 世界人工智能开源大赛在杭州云谷中心正式启动。作为大赛核心赛道之一,由阿里云承办的“新智基座(Agent Infra)”赛道面向全球征集可运行、可验证、可审计的企业级多智能体系统方案,寻找能够真正让多个智能体协同工作、并经得起生产环境检验的优秀作品。

2026 年 7 月 21 日,首届 GOAI 世界人工智能开源大赛在杭州云谷中心正式启动。作为大赛核心赛道之一,由阿里云承办的新智基座(Agent Infra)”赛道面向全球征集可运行、可验证、可审计的企业级多智能体系统方案,寻找能够真正让多个智能体协同工作、并经得起生产环境检验的优秀作品。


开幕式声音:从 AI 开源到 Agent 基础设施


在开幕致辞中,之江实验室主任、阿里云创始人、杭州市开源人工智能基金会名誉理事长王坚AI 时代的“开源”做了重新定义。他指出,AI 时代的开源,其含义远超软件时代的代码与知识产权——每一个对外开放的 AI 模型背后,都是能源、算力与工程能力的综合开放,本质是一种 open resource(开放资源),而不仅仅是 open source(开放源码)。把模型的代码和权重放出来只是起点,让支撑模型运行的整套基础设施随之开放、可用、可协作,才是 AI 开源真正兑现价值的关键。

image.png

image.png


阿里云副总裁唐洪在圆桌对话中表示:开源 AI 与云是同一枚硬币的两面。当前比“用好模型”更关键的下一步,是“用好智能体”——整个 Agent 的规模化部署、运行环境、工具调度、身份治理、可观测与安全审计,都是开发者不可回避的一整套基础设施。也正因如此,阿里云此次专门设立“新智基座(Agent Infra)”赛道,并将自身能力升级为面向 Agent 与 AI 新场景的 AI Cloud,希望与全球开发者一起,把 AI 从“能跑的 Demo”推向“可信的 Production”。

image.png


阿里云技术专家杨翊在媒体见面会上对本赛道做了进一步技术解读。他指出,过去一年行业涌现了大量“单体 Agent”应用,但企业真实场景都需要多个专业角色分工协作,“单个 Agent 再聪明,也无法替代一支专业团队。”Agent Infra 赛道的技术出发点,不是让 Agent 更聪明,而是把多个 Agent 组织成一个可治理、可观测、可进化的生产级系统。

image.png


赛道背景:为什么需要 Agent 基础设施


过去一年,Agent 正从问答工具加速走进企业生产环境,逐渐成为新的生产要素。然而,当多个智能体同时进入真实工作流,问题远比“让模型更聪明”复杂:多个 Agent 如何分工协作?任务过程能否被完整追踪?工具调用失败后如何处理?高风险操作能否审批和回滚?


一个运维故障的排查,需要告警分析、根因定位、方案制定、执行变更、结果验证等多个环节协同;一个金融理赔流程,则涉及材料审核、风控规则、资金划拨等多个专业角色配合。这些问题指向同一个方向——企业需要的不再是单个 Agent 的能力展示,而是一套可工程化、可治理、可信任的多 Agent 基础设施。


这一关系,类似于虚拟化之于云计算、操作系统之于移动互联网:底层基础设施的成熟度,决定了上层应用的规模化天花板。这正是设立新智基座赛道的核心逻辑——当前智能体从 Demo 走向 Production 的真正瓶颈,不在单个 Agent 的能力上限,而在支撑多 Agent 协同运行的基础设施层。


赛道定位:聚焦多智能体协同基础设施


新智基座赛道要求参赛团队从真实业务场景出发,设计由不少于 3 个不同职能 Agent 组成的完整任务闭环,展现任务拆解、上下文传递、工具调用、结果验证、执行证据沉淀以及安全审计等能力,并将关键能力封装为可复用的 Skill。


赛道从“团队协同、可验证可回滚、持续进化”三个维度考察系统工程能力,分别对应 AgentTeams 多 Agent 协同底座与 AgentLoop 观测评估飞轮两大开源基础设施。其中 AgentTeams 作为必选协同设计基点,通过 Manager–Team Leader–Worker 分层架构实现任务编排与混合框架调度;AgentLoop 提供全栈观测、效果评估与自进化调优能力,让 Agent 系统在真实业务反馈中持续进化。


换言之,这条赛道考察的不是“谁的 Agent 更聪明”,而是“谁能把多个 Agent 组织成一个可治理、可观测、可进化的生产级系统”。


核心要求:Skill 工程化与可复用性


赛道的核心导向,是“可复用”而非“一次性”。参赛作品应将关键能力沉淀为可复用的 Skill,而不是一段只能运行一次的脚本或一场单次演示。具体而言,参赛作品应重点体现:


  • 多 Agent 协同完成复杂任务;
  • Skill 可复用与工程化封装;
  • 工具、系统或云产品的稳定接入;
  • 上下文管理与执行证据沉淀;
  • 安全边界、审批、回滚与审计机制;
  • 作品的开放/开源计划与长期成长价值。


参赛条件:真实场景与闭环能力


赛道提供零人工运维、智能客服自主闭环、软件研发全流程协同、金融风控与理赔自动化等参考方向,但不限制行业,鼓励团队从自身最熟悉的真实业务出发。适合参赛的项目通常具备三个特点:


  • 第一,问题来自真实场景,且需要多个角色协作完成;
  • 第二,任务能够形成闭环——系统不仅能提出建议,还能调用工具推动执行并验证结果;
  • 第三,关键能力可以复用——项目能沉淀出 Skill、工具接口或协同流程,迁移到相似场景中去。


赛道特别提示:相比功能庞杂却无法真正运行的“大平台”,一个场景真实、结构清晰、证据完整的“小闭环”,往往更具竞争力。


评审标准:场景、协同与工程并重


赛道设置五项评审维度:场景价值与行业可复制性(25%)、多 Agent 协同与自主闭环能力(25%)、Skill 工程体系与生态复用(25%)、工程落地与运行验证及安全审计(20%)、开放与开源贡献(5%)。


从权重分布可以看出,赛道并不单独奖励“炫技”,而是将真实场景价值、系统协同能力与工程落地水平放在同等重要的位置,引导团队做出既有行业意义、又经得起运行检验的作品。


赛程与奖项


赛道设计了从初赛到决赛的清晰进阶路径。初赛阶段不强制提交代码,团队可通过作品简介和方案 PPT 说明设计思路;复赛需提交可执行的 AgentTeams 代码包和可运行 Demo;决赛则需完成现场展示与答辩。


赛程安排:初赛提交截止 8 月 16 日;8 月 24 日公布复赛入围名单(Top 30);9 月 3 日复赛提交截止;9 月 10 日公布决赛入围名单(Top 15);9 月 22 日线下决赛答辩;9 月 23 日 GOAI DAY 颁奖及生态对接。


奖项方面,赛道冠军 50 万元、亚军 30 万元、季军 10 万元;表现优异的项目还有机会角逐 100 万元 GOAI 全场大奖。参赛团队 1-3 人,组队规则和报名详情请访问大赛官网。


结语


从“一个 Agent 完成一次任务”到“一组 Agent 稳定承担一类工作”,中间需要一套完整的工程体系。新智基座赛道寻找的,正是能够让 Agent 真正协作、执行并接受验证的开发者和团队。


正如王坚院士在开幕式上所说,AI 开源的价值不止于代码,而在于让整套基础设施随之开放、可用、可协作。新智基座赛道希望以 GOAI 为平台,与全球开发者共同定义多 Agent 时代的基础设施标准,推动智能体技术从实验室的演示走向千行百业的规模化落地。


大赛钉钉选手交流群如下,群内将进行赛题解析、导师答疑、大赛奖励、资源申请、提交要求等最新信息同步,欢迎大家扫码入群,与导师和更多选手交流互动。


image.png

钉钉群号:186080014742

大赛报名现已开放,欢迎报名参赛:

https://www.goaihz.com/tracks?track=infra

相关文章
|
2天前
|
人工智能 JSON 安全
|
2天前
|
云安全 人工智能 安全
|
2天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max-Preview深度全解析:2.4万亿参数旗舰MoE模型+Token Plan限时优惠完整落地指南
2026年7月,全新旗舰级混合专家大模型Qwen3.8-Max-Preview正式开放抢先体验,作为通义千问Qwen3系列规格最高、综合推理能力顶尖的新一代模型,该模型总参数量达到2.4万亿(2.4T),是当前线上可调用的原生多模态旗舰模型,综合推理水准对标海外顶级Fable 5模型,在复杂工程开发、长文档深度分析、多步骤智能体自治、跨境多语言创作、海量数据挖掘五大高难度业务场景实现跨越式性能提升。
667 0
|
2天前
|
人工智能 自然语言处理 数据挖掘
最新版通义千问(Qwen3.8-Max-Preview)功能介绍
2026年,通义千问正式推出全新旗舰级大模型 **Qwen3.8-Max-Preview 预览版**,作为首款突破万亿参数规格的新一代基座模型,该模型总参数量达到**2.4万亿**,采用全新迭代的MoE混合专家架构,综合推理性能、长文本处理、多模态理解、复杂任务规划能力全面超越前代Qwen3.7-Max版本,整体实力跻身全球第一梯队,可对标海外顶级旗舰模型,是当前面向复杂工程开发、多智能体协同、超长文档解析、专业办公自动化场景的最优国产基座模型。
691 0
|
4天前
|
人工智能
Qwen3.8抢先体验!正式版即将发布并开源!
千问Qwen3.8即将开源,参数达2.4T,进化速度以“天”计,实力媲美Fable 5。预览版Qwen3.8-Max已上线阿里Token Plan等平台,限时优惠:日间Credits低至1折,夜间更优,个人/团队版月付仅35元起!
621 22
|
3天前
|
人工智能 测试技术 语音技术
Qwen-Audio-3.0-TTS 正式发布!AI 语音从 “能说话” 升级到 “会带情绪表达”
阿里云发布Qwen-Audio-3.0-TTS语音合成大模型,支持细粒度标签控制(如[gasp][angry])、freestyle自由风格、16种语言及20种方言,声学鲁棒性强。含Flash(首包延时300ms)和Plus(全球榜单冠军)双版本,已在百炼平台开放调用。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
560 1
|
4天前
|
人工智能 自然语言处理 数据挖掘
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
Qwen3.8-Max-Preview是通义千问Qwen3系列旗舰MoE大模型,参数达2.4万亿,综合推理能力居行业第一梯队。支持思考/快速双模式,擅长大模型五大高难场景。现于阿里云百炼Token Plan、Qoder及QoderWork上线体验,个人版低至39元/月。在阿里云百炼官网:https://t.aliyun.com/U/fPVHqY 免费领取千万Tokens
493 1
Qwen3.8-Max 预览版全解析:2.4 万亿参数旗舰模型,Token Plan 限时优惠指南
|
10天前
|
缓存 UED 开发者
Codex109天重置23次,明天还要再送一次
Codex近109天完成23次额度重置,7月14日将迎来第24次。Tibo高频响应用户反馈:优化GPT-5.6高消耗问题、补发失效福利、调整重置时间——形成“反馈→回应→修复→补偿”正向闭环,彰显以用户为中心的产品哲学。(239字)
888 12