北京词元无限成立一年融资三轮、登顶编程榜:字节系团队为何能跑赢GPT-5?窗口期还有多长 📅 2026-07-29 📰 钛媒体 🏷️ 融资 · AI编程 · SWE-Bench · 企业服务 一家成立刚满一年的中国创业公司,在被称为"AI编程图灵测试"的全球权威评测中,把GPT-5、Claude等主流大模型甩在了身后。与此同时,资本正在加速押注。 北京词元无限科技有限公司 (下称"词元无限")自研的编程智能体 InfCode ,于2026年7月在 SWE-Bench Verified 榜单上以 79.4% Pass@1 得分刷新全球纪录,超越同期GPT-5约65%的成绩;在难度更高的 Multi-SWE-bench C++子集 中,InfCode以25.58%的解决率大幅领先 Claude 3.7 Sonnet(8.59%)和 DeepSeek V3(7.75%)。C++因手动内存管理和复杂编译体系,此前行业领先模型解决率不足8%。 🔑 一句话理解SWE-Bench: 它不考AI会不会补全一行代码,而是给AI一个真实的GitHub Issue(Bug或新功能),让AI独立完成"理解问题→定位代码→修改文件→提交通过测试的完整补丁"——这是真实软件工程师的日常工作流。 核心指标一览 79.4% SWE-Bench Pass@1 (GPT-5约65%) 25.58% Multi-SWE-bench C++ (Claude: 8.59%) 3轮 天使→天使+→天使++ 累计融资数亿元 10+ 头部金融/通信客户 年营收预测破亿 融资节奏:成立一年,每月都有进展 2025年7月3日 词元无限在北京海淀注册成立,注册资本200万元,法定代表人最初为刘杰。注册地址位于海淀区苏州街神州数码大厦。 2025年12月 — 天使轮 完成数千万元天使轮融资,投资方为某软件产业CVC(据工商信息推测为神州数码关联方),航行资本任财务顾问。此时公司成立不到6个月。同月, InfCode在Multi-SWE-bench Java榜单首次登顶 。 2026年3月 词元无限入选海淀区2026年度第2批创新型中小企业拟认定名单。北京市通用人工智能产业创新伙伴计划将其吸纳为"模型伙伴"。 2026年6月 — 天使+轮 完成数千万元天使+轮融资,由 华控基金、水木创投联合领投 ,厦金创新跟投。本轮前公司完成一系列工商变更:注册资本从260万增至约299万,法定代表人从刘杰变更为杨萍,董事会从3人扩至7人。新增金豫江(华控系)、杨铭舟(水木系)等投资人董事。 2026年7月27日 — 天使++轮 一个月内完成第二笔融资,由 临芯投资领投 ,华控基金继续跟投。三轮累计融资额已达 数亿元 。公司表示资金将用于打造"中国首个全自主、高安全、自进化的企业级AI Agent基础设施平台"。 2026年7月29日 钛媒体报道InfCode以79.4%得分登顶SWE-Bench,超越GPT-5。新闻发布当天完成第三轮融资官宣。 团队:字节老将 + 清华姚班 + 产业老兵 词元无限的创始组合是这轮资本故事的核心支撑。 联合创始人兼CEO杨萍 ,2018年至2024年任职字节跳动,是字节内部MarsCode及后续Trae产品的研发总负责人,曾主导万人级研发体系的AI化改造。她研发的多智能体测试系统覆盖了字节多条核心产品线。 联合创始人兼CTO王伟 ,清华大学2005级计算机系、姚班首批成员。曾任知名具身机器人公司和大模型创业公司技术合伙人,2023年创立大模型开源社区OpenCSG。 首席科学家袁源 ,北京航空航天大学教授、博导,清华大学计算机博士,师从中国科学院院士张钹,是北航复杂关键软件环境全国重点实验室核心成员,2026年3月加入公司。 据公司披露,三位联合创始人早年就有过合作,2025年开始系统性探讨AI Coding方向后决定共同创业。 InfCode凭什么跑赢GPT-5?三层技术设计 SWE-Bench评测的不是模型参数量,而是AI解决真实软件问题的全流程能力。InfCode在技术架构上做了三个针对性设计: ① 代码意图分析 — 传统检索工具在大型代码库中"只认字面、找不到根因"。InfCode让智能体能理解自然语言背后的功能意图,直接定位承载问题逻辑的代码单元,而非被表面关键词带偏。 ② 基于AST的结构化检索 — 自研基于抽象语法树的检索引擎,精确区分同名标识符的语义角色(类名/函数名/变量名),避免文本搜索常见的"噪声爆炸"。 ③ 对抗式双智能体架构 — 一个"代码补丁生成器"负责改代码,一个"测试补丁生成器"专门找漏洞、扩展测试覆盖面。两者在闭环中反复对抗,倒逼补丁质量迭代。团队已将技术方案公开于arXiv。 这套方法论在实际项目中已得到验证。在 某银行核心系统POC 中,InfCode生成的代码可用性达到88%以上,节省约40%人天,代码质量与银行中级工程师相当。在与 神州数码 联合打造的软硬一体方案中,研发效率提升39%,平均节省工时39.07%,代码可用率达88.31%。 竞争格局:大厂正在入场,窗口期有多长? 词元无限选择了一条与大厂正面竞争的路径——不同于面向个人开发者的AI编程助手(如Cursor、GitHub Copilot),词元无限定位"企业级AI Agent基础设施"。 产品 厂商 定位 部署模式 InfCode/InfOne 词元无限 企业级AI Agent基础设施 私有化部署,模型中立 Trae 字节跳动 AI原生IDE(含企业版) SaaS+私有化 通义灵码 阿里巴巴 企业级AI编码助手 SaaS+私有化 CodeBuddy 腾讯 AI编程助手 SaaS Cursor Anysphere AI原生IDE(个人/团队) SaaS Claude Code Anthropic AI编程Agent(CLI) 云端SaaS 从市场份额和生态资源看,字节Trae背靠字节内部庞大的研发体系和豆包大模型,阿里通义灵码同样依托通义千问生态。相比之下,词元无限虽然榜单成绩领先,但品牌知名度和客户规模仍有限。 不过, 2026年7月的一系列安全事件正在重塑竞争天平 : ⚠️ 安全事件冲击波 • 7月8日,工信部发布风险提示,指出AI编程工具Claude Code存在安全隐患; • 阿里巴巴随即宣布内部全面禁用Claude Code; • 随后Grok Build CLI被曝在用户不知情时将整个代码仓库打包上传至云端。 这些事件让企业客户意识到:当AI Agent从"提建议"升级为"自主调工具、改代码、执行任务",数据主权和权限管控成为不可回避的采购否决项。 词元无限从一开始就押注这个需求缺口: 全自主、高安全、私有化部署 。其平台不绑定任何单一模型,代码和数据全部运行在客户自有环境中,配套权限管控、数据隔离、操作审计完整链路。在此前的安全事件冲击下,这一差异化定位正在从"加分项"变为"准入门槛"。 商业验证:10+头部客户,但护城河仍需检验 据公司披露,词元无限已服务 十余家金融、通信、软件领域头部客户 ,2026年年度营收预测破亿。公司官网(tokfinity.com)展示的产品矩阵以InfOne为顶层平台,配套四大核心智能体:DeepMap(代码知识图谱)、InfCode(数字程序员)、InfTest(测试智能体)、TokenHub(Token调度与治理)。 但值得关注的风险信号同样明显: 📋 2025年年报显示社保参保人数为0 (来源:天眼查年度报告)。这反映出公司成立初期团队规模极小,或通过灵活用工方式组织研发。到2026年中融资密集落地后,团队扩张速度将直接决定交付能力。 💰 天使轮融资至今仅约7个月 ,累计融资额"数亿元"的具体分配比例未披露。在一级市场整体偏紧的环境下,后续融资能否持续取决于企业级订单的规模化节奏。 🏢 大厂围剿不可忽视 。字节Trae是杨萍此前亲手参与的产品,阿里通义灵码、腾讯CodeBuddy均在加速迭代。大厂拥有更强的品牌信任、更完整的云生态和更低的获客成本。词元无限目前的先发优势集中在"私有化部署+安全合规"这一细分窗口。 ⚙️ SWE-Bench排名是静态快照 。榜单成绩验证了技术能力,但企业采购决策的周期(3-12个月)远长于评测刷新周期。在此期间,竞品模型可能在下一轮评测中反超。 ❓ 两个关键问题 1. InfCode的榜单优势能否转化为稳定的企业级订单? 目前年营收预测破亿,但企业级AI Agent的采购决策涉及安全合规审查、存量系统集成、持续运维成本。银行和通信行业的头部客户对供应商稳定性极为敏感,创业公司的存续能力是一个隐性门槛。 2. 面对字节Trae、阿里通义灵码等大厂产品入局,创业公司的窗口期还有多长? 安全事件(Claude Code、Grok Build)正在为私有化部署路线创造需求窗口,但这个窗口是否足够让词元无限跑通商业闭环、建立客户粘性,取决于未来6-12个月的交付质量和复购数据。 下一步验证什么? 词元无限当前有三个可追踪的验证节点: 第一,团队建设速度。 融资计划中明确提到"深化与清华大学、北京航空航天大学的联合研究"。从0社保到规模化研发团队的转换效率,将决定产品迭代节奏。 第二,标杆客户复购和转介绍。 十余家金融、通信头部客户的"年度营收预测破亿"是否可持续,后续季度能否披露续约率和客单价数据,是市场检验商业模型的关键指标。 第三,大厂安全合规路线的跟进速度。 如果字节Trae或阿里通义灵码快速补齐私有化部署和安全管控能力,词元无限的差异化窗口将大幅收窄。 据Gartner预测,到2035年代理型AI可能驱动约30%的企业应用软件收入,市场规模超过4500亿美元。词元无限的选择是在这个巨大的增量市场里,从"必须使用安全可控AI基础设施的企业"这一细分切口进入。榜单第一是信号,但真正的长跑才刚刚开始。 📎 来源与参考 • 钛媒体:成立1年融资3轮,前字节女高管创业,跑赢GPT-5登顶编程榜 • 头条科技:中国AI初创词元无限评测登顶,79.4%准确率 • 环球网:SWE-Bench登顶背后,中国AI Agent的工程能力正在被重新定义 • 投中网:词元无限完成天使++轮融资,累计融资数亿元 • 张通社:词元无限完成数千万元天使+轮融资 • 天眼查:北京词元无限科技有限公司 工商信息 • 天眼查:词元无限 融资历史 • 天眼查:词元无限 新闻舆情 本文基于公司档案、公开新闻及网络信息综合整理,数据截止2026年7月29日。