导航菜单
首页 OPC项目 北京OPC OPC完全指南 AI资讯 AI应用市场 OPC市场 OPC导航 工具推荐 关于
深度分析 2026-07-30

北京 Agent 蓝图:十项措施的底层逻辑与时代变量

2026 年北京智能体新政深度解读

10 项措施
4 个维度
9 层解读
聚焦 Agentic AI

2026年7月23日,北京市发改委联合市委网信办、市科委中关村管委会、市经济和信息化局,正式印发《北京市关于加快智能体引领发展的若干措施》。

文件只有十条。但它一口气把 Agentic AI、Harness Engineering、AI OS、FDE、OPC、Token 经济、TaaS、AaaS、RaaS、Token 工厂、AIP 这些几个月前还仅存在于论文和创业者 PPT 里的词,直接写进了正式政策。

这不是一份"支持AI发展"的常规文件。这是一份智能体经济的基础设施设计蓝图。

底层数据

发布会上,北京市发改委党组副书记林剑华给出了一组数字:2026年上半年,北京人工智能领域融资规模突破950亿元,占全国三成以上;豆包月活突破3.82亿,日均 Token 调用量高达180万亿次,形成断崖式领先。全市已累计完成大模型备案259款、AI产品登记195款,覆盖通用大模型、行业垂直模型、端侧模型等多元品类,头部模型注册用户超20亿,日均调用量超14亿次。

这些数字的含义很简单:北京已经不是AI产业基地之一,它是全球AI密度最高的城市区域之一。

而这份十项措施,要解决的问题不是"怎么发算力券",而是"怎么让智能体成为新经济的基础单元"。

十条措施的结构

十项措施分属四个维度:技术引领(第一、二条)、应用落地(第三、四、五条)、产业生态(第六、八条)、安全治理与开放(第七、九条),第十条是保障措施。但真正的逻辑线不是"分类",而是"从底层能力到上层价值"的层层递进。

01 让模型具备行动力

第一条"持续提升基础模型能力"的关键句不是参数规模,而是"持续提升大模型实际任务完成能力"

这个表述精准定位了当前AI产业的核心瓶颈。Benchmark 分数高不等于能完成任务。一个 Agent 连续执行100步任务,即使单步正确率99%,100步全对的概率也只有36.6%。如果加上工具调用失败、环境异常、上下文污染、权限阻塞等现实噪音,真实完成率会更低。

所以文件把在线学习、持续学习、自主进化、超长程任务、复杂推理与规划、工具调用、长上下文、多智能体协同、记忆——这九个技术要素全部放在了第一条。它们共同指向一个目标:可依赖的行动能力。

02 驾驭层工程——被政策正名的系统工程

第二条"实施驾驭层工程(Harness Engineering)"可能是整份文件里最具产业信号价值的一条。

Harness Engineering 这个概念最早在2026年4月的论文《Agentic Harness Engineering》中被系统化提出。实验数据表明:保持基础模型不变,仅迭代工具、中间件、长期记忆和可观测系统,十轮后 Terminal-Bench 2 的 Pass@1 从 69.7% 提升到 77.0%。换到其他模型家族上,依然有 5.1 到 10.1 个百分点的提升。

消融实验的结论更关键:最大增益来自工具、中间件和长期记忆,单纯修改系统 Prompt 贡献有限。

这意味着什么?意味着基础模型的能力决定上限,驾驭层工程决定下限。而大多数企业真正能做的、应该做的,恰恰是在驾驭层建立壁垒。

政策在这一条里还点到了技能市场、软件商店、AIP(智能体互联协议)等互联标准。这是一个极其前瞻的判断——未来软件的直接用户将不再只是人,还有 Agent。Agent 需要机器可读的能力说明、接口、身份、权限、价格和服务质量。谁能被 Agent 发现并成为它完成任务时的默认 Skill,谁就拿到了下一代软件分发的船票。

03 从功能软件到需求智能

第三条的核心概念是"需求智能"。过去软件的智能经历了三层跃迁:功能智能(AI 只负责某个节点)→ 流程智能(AI 串起几个连续步骤)→ 需求智能(用户只表达结果,系统自己判断路径)。

这对应政策里的"原生AI软件"和"超级软件"。超级软件不是功能更多,而是能跨过原有软件边界,统一理解需求,再把分散的能力重新编排。这句话背后是一个产业级的判断:UI 可能会被 Skill 吞掉,软件的设计、分发和商业模式都会因此重构。

文件还专门写了FDE(前沿部署工程师),这类角色会进入客户现场,跟业务人员一起拆流程、接系统、清数据,再把新问题带回产品。服务一个客户,沉淀一套轨迹;服务十个客户,找出共性结构。这是行业 Agent 绕不开的产品化路径。

04 终端——Agent 的感知与执行系统

第四条将智能体深度嵌入智能手机、智能眼镜、智能耳机、可穿戴设备、智能机器人和智能汽车,同时提出"芯模云端用"五位一体协同发展

这五个字的排列不是修辞。芯片提供算力,模型提供智能,云端提供弹性,终端提供感知与执行,应用提供场景。任何一层的短板都会拉低整体体验。政策还明确将符合条件的 AI 终端新产品纳入以旧换新和购新补贴范围——这一步直接拉动了需求侧。

05 OPC——企业边界的重构

第五条是整个政策中最具社会想象空间的一条:"支持以 OPC(一人公司)为代表的创新创业新模式"

这不是简单的"鼓励创业"。它的底层逻辑是经济学中一个经典问题——科斯在 1937 年解释的"公司为什么存在"。因为内部协调成本低于市场交易成本。

而 Agent 正在同时压低执行成本和协调成本。写代码、做设计、管客户、回咨询、出报表——这些过去需要不同岗位协作的工作,可以被一个人通过多套 Agent 串起来。企业的最小可行规模因此开始下降。

政策没有只喊口号。它配套了弹性算力、专业孵化、创业辅导、科技金融、知识产权、OPC 社区、全周期服务站、供需对接、便利化登记——相当于把过去公司内部的后台能力,搬到社会公共服务层。

全球数据也在印证这个趋势。Grand View Research 数据显示,全球 AI Agent 市场 2025 年为 76.3 亿美元,预计 2030 年达到 526.2 亿美元,年复合增长率 46.3%。Carta 数据表明,2025 年上半年美国 36.3% 的新创公司是单人创始人。Sam Altman 公开表示相信一人公司能达到十亿美元估值,Dario Amodei 给出 70-80% 的概率认为 2026 年就会出现一人独角兽。

06 Token 经济——从计费到价值定价

第六条可能是整份文件中最具经济学想象力的一条。

它不仅支持Token 即服务(TaaS)、智能体即服务(AaaS)、结果即服务(RaaS)三种商业模式,更关键的一句是:"鼓励创新主体从 Token 消耗量计费转向价值计费。"

这是对 AI 商业模式的根本性重新定义。

Agent 执行的是动态任务。任务长度、上下文大小、推理轮数、工具数量、重试次数都不确定。花出去 20 亿 Token 什么都没得到,在 Agent 领域不算意外。所以 Agent 公司必须算一笔新账:每个成功任务的成本(Cost per Successful Task),再往上算每个成功任务为客户创造的价值(Value per Successful Task)。

政策还提出探索 Token 券和智能体服务券,将符合条件的 Token 新产品纳入中小企业服务券范围。Token 工厂解决供给,服务券启动需求,价值计费让商业闭环跑下去。

07 安全——从内容审核到运行时治理

第七条的安全措施从内容审核走到了运行时治理。Agent 拥有行动权——改代码、调用支付、控制设备、代表用户联系他人。风险也从"一句话说错了"扩展到"一件事做错了"。

2026年5月,国家网信办等三部门发布的《智能体规范应用与创新发展实施意见》已提出划分仅限用户本人决策、需要用户授权决策和智能体自主决策三个边界。这对 Agent 产品设计是核心约束:哪些动作自动执行,哪些必须二次确认,哪些数据只读,哪些权限一次性收回,哪些结果必须由人承担最终责任。

安全不是后补项,而是准入证。谁能证明自己的 Agent 可控、可查、可停,谁才能进入金融、医疗、政务和大型企业的核心流程。

08 银河算廊——为智能生产建设算力物流

第八条提出"银河算廊"工程,建设面向智能体高频并发、低延迟需求的新型算力基础设施,推动算力网络与 5G-A、6G、F5G 融合。

这背后的判断是:训练大模型像集中式大工程,Agent 推理像一张长期运行的生产网络。未来需要调度的不只是 GPU,还包括云、边、端的异构芯片、不同大小的模型、不同地区的数据权限、不同网络条件,以及每个任务能承受的时间和预算。

09 开源与出海——网络效应的制高点

第九条提出建设中国-上合组织国家 AI 应用合作中心,"一国一策"研究出海路径,同时建设有全球影响力的开源社区。

Agent 天生要连接。一个 Skill 接入后可以服务所有兼容 Agent,Agent 越多开发者越愿意提供 Skill,Skill 越多 Agent 越有用——这是典型的双边网络效应。谁的协议和框架被广泛采用,谁就掌握生态话语权。开源是推动事实标准形成的最快路径。

10 保障措施——1亿扶持与组织设计

第十条明确统筹国家和市区财政资金、政府投资基金、市场化基金,对技术攻关、共性平台和示范应用项目择优给予最高 1 亿元资金支持。区级层面,符合条件的算力部署、软件技改、"模型首方案"等给予最高不超过 3000 万元支持。

从责任部门安排看,涉及发改委、网信办、科委中关村管委会、经信局、国资委、商务局、市场监管局、人才局、人社局、教委、政务和数据局、统计局等十余个部门。智能体已跨出单一技术产业,开始同时影响科技、制造、消费、创业、金融、监管、人才和国际合作。

时代的变量

把十条放在一起看,北京在做的事情其实只有一件:搭建一套让智能体能够大规模、安全、高效运行的基础设施。

这十条措施的真正意义不在"支持",而在"定义"——定义什么是智能体时代的基础模型标准(实际任务完成能力)、什么是产业中台的正确形态(Harness Engineering)、什么是下一代软件的范式(需求智能 + 超级软件)、什么是新商业的最小单元(OPC)、什么是新经济的计价单位(价值计费)、什么是新的基础设施(银河算廊)。

对创业者来说,这份政策给出了三个明确的信号。

第一,机会在"驾驭层"。基础模型会越来越集中,但每家公司都有自己独特的数据、流程、权限、规则、术语和异常处理方式。把这些变成可复用的 Agent 系统,才是真正的护城河。

第二,选场景有五把尺子:任务频率、人工成本、数字化程度、结果可验证性和错误可撤销性。五项占得越多,Agent 越容易产生真实 ROI。

第三,OPC 不是"一个人省钱",而是"一个人 + 一套 Agent 系统的产能"。需要三种资产:行业判断力、客户与信任、可复用的 Agent 系统。注册公司和租办公室可以排在这三样之后。

政策已经给出了蓝图。剩下的问题是:谁先把这些概念变成每月稳定运行、可验证交付、持续进化的真实系统。

智能体经济的序幕已经拉开。而这十项措施,就是舞台的搭建图纸。

关注智能体生态发展

创客OPC持续追踪 AI 政策、Agent 生态与 OPC 创业趋势,提供深度分析与前沿洞察。

了解更多 →

本文数据来源

  • 北京市发改委 2026年7月23日新闻发布会
  • 《北京市关于加快智能体引领发展的若干措施》(京发改〔2026〕1185号)
  • 国家网信办等三部门《智能体规范应用与创新发展实施意见》(2026年5月)
  • Grand View Research: AI Agent Market Report 2025-2030
  • Carta: State of Startups H1 2025
  • 《Agentic Harness Engineering》(2026年4月)