开源AI 2026 第一版 2026年7月 新西兰最北端,一名毛利语广播员在获得许可的情况下,为毛利语(一种市场太小而无法生存的语言)训练语音模型,该许可确保数据与其人民同在。在东非,农民利用在手机上离线运行的模型诊断木薯疾病,这些田野从未被云服务触及。在瑞士,一个公共联盟在公共超级计算机上训练了一个国家模型,并发布了全部内容:权重、数据、训练代码。 拉斐·克里科里安 首席技术官,Mozilla 他们都没有征得许可,而且他们也不可能租用这里。他们拥有这里——这才是关键所在。 请将以下内容视为一张地图:OpenAI 在哪些方面取得了优势——一些数据甚至让我们感到惊讶——以及它在哪些方面存在不足。一个隐藏其弱点的情况就是广告。 条款。 0102030405能力、成本与采用——证据当前状态首都、公司、经济谁在赌可选择性,主权,国家战略为什么它正在发生 everywhere模型上方的层及其开放的间隙背带是新的前沿阵地层仍开启时,应在哪里操作五份赌注 开源AI的现状 2026年开源AI,用四个数字来说明。 自2023年你尝试以来,发生了什么变化? 那次经历是真实的。它也有两代模型之久了。 The capability gap: 8.04%→0.5%→3.3%. 在Chatbot Arena上,通过24个月的三个阶段,实现封闭式引导胜过开放式引导。 一个3.3%的平均数掩盖了参差不齐的前沿。 问题已不再是开放模型是否足够好,而是这项工作负载需要什么。 在36个月内,费用下降了50倍——从20美元降至每1000万代币0.40美元。 GPT-4级别性能的最低配置模型——混合API列表平均价格(出入均计),对数刻度——与先前平台迁移成本曲线的历史比率进行对比。 最大的跌幅是开放权重:Llama 3.1,然后是DeepSeek,在一个季度内将GPT-4级别的底线砸了11倍。 开路称重站现在占所有代币的三分之一。 所有通过 OpenRouter 路由的代币中,Open Weight 的份额,2024年11月 - 2026年6月。 开放式重量主导代币使用。 OpenRouter上6月每月代币使用量。按使用量排名前五的模型均为开源模型。 开启状态赢得代币。关闭状态仍赢得请求。 超过3.5:1。五款量级最高的模型均为开放权重,其中DeepSeek V4 Flash(18.4T)领先,其次是Owl Alpha / LongCat-2.0(11T)和MiMo-V2.5(14.9T)。 按请求数量计算,关闭的美国服务商仍然领先。开放的优势集中在代币密集型编码和代理型工作负载上——也就是支出所在的地方。 Fro tier reasoning 现在在 MIT 许可下提供。 DeepSeek-R1(2025年1月)对阵OpenAI o1-1217——推理能力同属一流,价格却只是几分之一。 近乎相同的推理得分下,存在约27倍的价差。15元 · 60元 OpenAI o1-1217 每百万个token的价格,进 · 出 — 专有 从实验到生产的采用漏斗。 开放式栈在功能方面表现优异,但在操作方面较为简便。 九层堆叠,按九项标准(1-5分)进行评分,各列按强弱顺序排列。最冷的两列——标准化和企业准备度——在每个层级中重复出现。 解除已部署的封锁,而非未部署的。 按组织规模划分,采用者进入量产的比例。如果差距是资源问题,规模本应缩小它——但并没有。 同样的挑战,无处不在。 按地区划分,各挑战的命名者占比。 谁在用它。 开磅计重是一种商业模式。 已融资公司、付费客户、实际收入。 开发者运行的开源用例比闭源的多。 每个开发者的平均用例数量,以及开放型模型是如何组合的。 文丘里资助的开源生态系统。 已披露总资金,百万美元。颜色标示堆叠层。 企业正在跨行业购买。 六家最大的科技公司悉数到场。 合并已经开始。 2023年至2026年开源AI领域及周边的重要收购。 资金堆栈有漏洞。 按堆叠层级和资本类型划分的资本强度,0-3。颜色越深代表资本越多。 米特模型在大规模应用时会出现问题。 三家企业,三次基于代币定价的碰撞。 ST RIPE UBER 微软 开源模型的推理成本降低了73%。 2026年AI编程预算四个月用尽 截至2026年6月30日,取消大部分Claude Code许可证 工程师每月账单为500至2000美元,但在每件工具每位员工支出上限为1500美元后,账单被限制在此额度内。 数月内,部门年度人工智能预算已被代币计费所耗尽。 vLLM上承载了5000万次每日API调用,仅使用了三分之一GPU集群——这是一项公司拥有所有权并能进行预测的固定成本。 微软正在探索用于其最繁重的Copilot工作负载的Azure托管DeepSeek V4——这家全球最大的软件公司,正绕过其自身合作伙伴的计费。 六月份之前 两次失败的导火索:转向基于使用量的定价模式,导致供应商而非客户掌控了单位经济。当一项工具过于有用而不需要限制使用时,拥有其经济权比租用更重要。 五分之一的使用率,4%的收入。 OpenRouter上模型层使用量和收入的开放与封闭份额,2025年5月至9月。 按使用量计算,DeepSeek V4 Flash 是最常用的模型,其智能排名第六。Anthropic 拥有四个最强大的模型中的三个,并且大约处理了每周八分之一的 token。 为什么它正在发生,到处都是。 开放是选择,而非意识形态。 云时代已经做过这个实验:专有API加上数据引力使得退出惩罚性。遣返浪潮就是凭证。 03 · 为何此事正处处发生 十九天里,最新的一级方程式赛车一直是深色的。选项性不再抽象。 Claude Fable 5上线后三天,一份美国出口管制令切断了访问权限。十八天后,一项第二项决定撤销了该令——访问权限于7月1日恢复,此时距离切断访问已过去十九天。所有基于该端点构建的人都从外部见证了这两项决定的发生。 您可以关闭一个模型。您无法关闭已在您的机器上运行的副本。主权就是以国家规模持有同样的论点。 中国退出,下载所有人。 累计Hugging Face下载量,以及中文开放权重在OpenRouter代币中的占比。 平台使用频率最高的十个项目之间的交通模型 2026年2月,Qwen下载了接下来八个组织的全部数据。 超过26,000个DeepSeek企业账户;在58%的2025年新人工智能初创公司技术组合中 警告是真实的——训练数据的不可见性,硬编码的拒绝。解决方案是架构性的:至少有八个司法管辖区禁止托管的应用程序;企业无论如何都会采用这些权重,无论是自行托管还是通过西方端点。来源:Hugging Face · OpenRouter。 开放性产业政策是中国产业政策。 转向中国开源权重是一个有意的政策结果。 欧洲正在将开放权重视为产业政策。 一个逐步升级的序列,2025年2月 – 2026年7月。 阿玛莉亚 & SPARK 葡萄牙以550万欧元的价格出售一个完全开源的大型语言模型;德国开源其公共管理人工智能平台 符合资格的开源系统将在《人工智能法案》中获得定向豁免 我们不能依赖他人来维持医院运行、保障电网稳定和确保服务安全的技术。 加拿大:设计中的主权。 主权基础设施,由开放重量模型提供支持。 人工智能可以像互联网和手机那样发展——成为一种主要削弱人们权力的技术。或者,它也可以赋能使用者。我们正朝着后一种方向努力。 $890M 为加拿大研究人员和创新者开放的、属于主权国家的AI超级计算机 弗罗斯特·尼克(Nick Frosst),Cohere联合创始人——关于开源Command A+ 2026年6月:特鲁多总理启动“AIforall”计划。其六大支柱之一是一个明确的“主权基础”——保护加拿大数据与知识产权,减少对外国供应链的依赖。 A+ 命令(2026年5月):一个用于企业智能代理任务的 218B 参数 MoE,仅需两台 H100 即可运行。北码 Mini 预计于六月推出——专为“主权开发者生态系统”而构建。 印度:38,000块GPU和500万名新开发者。 70多项国家人工智能战略及制定。 最大公开的国家人工智能基础设施投入。 背带是新的前层。 代理 harness 是另一个用户代理。 用户端编写代码,代表他们与世界进行协商——这比浏览器更高一层。 已是一款产品类别 网络时代 97MLangChain已获得126,000+ GitHub星标,在编排领域拥有60%的开发者份额。 浏览器 用户端编写代码,代表用户与服务器进行协商 每月MCP SDK下载量,首年拥有超过10,000个活跃服务器 代理时代 元利用 代理 harness 市场正在向上整合——统一层(例如 Databricks开源的 Omnigent)将独立的代理生态系统打包并交换,置于同一治理平面之下。 编排循环、工具、内存、沙箱和权限模型——生产难题集中的地方 模型正在吃 harness。 在实验室将线束内部化后,八周内将21.8点的线束优势压缩至约3点。 21.8分的优势——领先于重量的挽具 21.8分的差距缩小至约3分。在所有同时出现这两种型号的测试中,实验室自制的线束胜出。 针对某一实验室权重进行精细调优的系统能在其他模型上表现下降。锁定效应是优化的副作用——一道正在形成的护城河。在经过验证的顶级梯队中,未出现任何开放模型。来源:Terminal-Bench 2.0 / 2.1 排行榜。 在中性护套上,价格差距是5倍。 终端-工作台2.1分数与每项任务成本对比,所有模型均在同一中性基座上运行(vals.ai Terminus-2)。 MCP:2M → 97M单月下载量,历时16个月。 每月组合 Python + TypeScript 官方 SDK 下载量。四个有文档记录的点,直接连接——两者之间的一切都将是插值。 从约200万的启动基准点,下载量增长了4750%。 28% 每月下载量达9700万。八周内存在30多个CVE漏洞。 收养正在超越治理。 ~21% 据报道,许多公司已建立起成熟的代理治理机制——其采纳速度正快于管控步伐。 OAuth 2.1 + PKCE 现MCP强制要求;A2A船舶签署代理卡——身份验证已解决,授权未解决 Anthropic 向 Linux 基金会的 Agentic AI 基金会捐赠了 MCP,同时还有 Block 的鹅和 OpenAI 的 AGENTS.md。白金会员:AWS、Google、Microsoft、OpenAI。 2025年12月 关闭并不等于安全。 该机制追踪由谁承担操作负担:关闭的API默认内置安全措施;开放的部署则要求您自行接入相同的控制机制。它衡量的是工作由谁完成——而非风险存在于何处。 授权检索已送达非授权接收者——重量机密的保密未能阻止此事。 在推理、长期背景和问责制方面,封闭仍然领先。 IC终端部代理 82.0% vs 67.9% GPT-5.5(Codex CLI)与DeepSeek-V4-Pro-Max在终端-Bench 2.0上的对比:存在14分的差距,这一差距大于在静态基准测试上的差距 火鸡合规与安全 责任 SOC 2 · HIPAA · ZDR 相关方承担法律责任 默认情况下,封闭供应商套餐符合要求。开放式重量领导者在对安全指数的评分中表现不佳——DeepSeek在FLI人工智能安全指数上获得F级评分(0.37/4)。 向封闭供应商付款,东西坏了则由他人承担责任。自建开放重量,后果自负。 该模型易于更换。内存是资产。 其中一部分会随着时间的推移而贬值,另一部分则会增值。 可拥有的建筑 01 可移植格式——受版本控制的纯 Markdown,与本地联系人及电子表格同步,不受任何提供方管辖