武汉新说世语:Fish Audio种子轮5200万美元落定,徐新与梅西同投一位00后——ARR五个月翻倍,能撑起2.5倍融资额吗 2026年7月28日,AI语音公司Fish Audio宣布完成5200万美元种子轮融资,由徐新创办的今日资本与Coreline Ventures共同领投,梅西参与创办的投资平台Play Time等跟投。同一天,其最新模型S2.1 Pro面向公众开放。这笔钱的规模本身不算新闻,真正的问题是:一个从开源社区、卧室显卡起家的22人团队,凭什么让徐新和梅西出现在同一张领投名单上——以及,相当于当前ARR 2.5倍的种子轮定价,赌的到底是什么。 一、先把数字摆齐:这轮融资的骨架 融资金额 5200万美元 约3.66亿元人民币,种子轮 领投方 今日资本(徐新)、Coreline Ventures 跟投方 359 Capital、Play Time(梅西)、HF0、645 Ventures、Parable、Carya Venture Partners、Alphaist Partners、Bayhouse Ventures等 ARR(年经常性收入) 2100万美元 约1.4亿元人民币,公司7月披露 ARR增速 2026年2月约1000万→7月2100万 约5个月翻一倍 融资额 ÷ ARR 约2.5倍 种子轮即按当前收入定价,隐含估值未披露 人均ARR 约95万美元 2100万 ÷ 22人 用户规模 800万+ 使用开源或托管版本 社区声音模型 200万+ 平台沉淀的创作者声音模型 团队规模 22人 创业初期仅3人,过去一年扩张至22人 模型发布 过去一年5款 4款语音生成+1款语音转文字;3款开源,S2.1 Pro仅付费API 开源项目 Fish Speech,GitHub约3.1万–3.2万星 起家产品,社区增长引擎 口径说明: 本轮融资、ARR、用户数、团队规模等数字,均来自媒体转述的运营主体Fish Audio(总部位于美国帕洛阿尔托)的公司披露;境内注册主体武汉新说世语的工商信息与之分属不同口径,详见下文第二节。两者不能混用。 二、武汉新说世语是谁:境内注册主体与境外运营主体 武汉新说世语科技有限公司2024年5月15日成立于武汉东湖新技术开发区,注册资本100万元人民币,法定代表人夏良宽,股东为夏良宽(认缴99万元,持股99%)与占禧燕(认缴1万元,持股1%),工商登记参保人数2人,登记网站为 fish-audio.cn。天眼查将其列为“存续、小微企业”。 需要特别区分主体边界: 媒体所报道的22人团队、2100万美元ARR,均指向运营主体Fish Audio,而非这家境内注册公司 ——后者工商口径的参保人数两年均为2人。境内实体与海外业务主体在业务链条中的具体关系,在本次已核验的公开范围内未见明确披露,这一点本身值得后续跟踪。 境内主体有一条可核验的公开动态:2025年11月27日,武汉新说世语作为新引入的3家企业之一,入驻武汉东西湖区的中科钛领(武汉)创新园(网安科创中心3楼),园区定位东西湖区“1+4+N”现代产业体系孵化载体。 工商登记轨迹:注册资本100万→1000万→100万 2024-05-15 成立,注册资本100万元,夏良宽99%、占禧燕1% 2024-07-18 注册资本增至1000万元,认缴出资调整为990万/10万元 2026-04-24 注册资本减至100万元(认缴调整为99万/1万元),同日章程备案;天眼查将“投资人变更”“注册资本变更”列为预警提醒 减资发生在融资官宣前约3个月,属于登记层面的调整;仅凭工商记录无法判断其与融资安排之间的因果关系,但“先减资、后融资”的时间顺序值得记录在案。 三、时间线:从卧室里的一张RTX 4090,到5200万美元 2023年 创始人廖世嘉(Shijia Liao)从马里兰大学毕业,全职加入英伟达,从事视觉基础模型研究;此前已参与So-VITS-SVC、GPT-SoVITS等开源语音项目,因喜欢动漫、虚拟主播而尝试克隆动漫角色声音 2024年7月 离开英伟达全职创业;早期在卧室用单张RTX 4090训练语音模型,该工作成为后续S2模型的技术基础 2024年下半年 项目以Fish Speech名义开源,吸引游戏开发者、动漫爱好者与内容创作者,GitHub累计约3.1万–3.2万星 2025-11-27 境内主体武汉新说世语入驻中科钛领(武汉)创新园 2026年2月 公司披露ARR约1000万美元 2026-07-28 宣布5200万美元种子轮(今日资本+Coreline Ventures领投);同日S2.1 Pro开放;披露ARR 2100万美元、用户800万+、团队22人 值得注意的是两位创始人的分工:廖世嘉任创始人兼首席科学家(首席科学家由00后创始人出任,这在AI公司里并不常见),联合创始人兼CEO为曹睿莎(Rissa Cao)。据媒体报道,Alphaist是Fish Audio最早出资的机构VC,本轮继续出现在跟投名单中。 四、生意拆解:开源社区如何变成三分之二的企业收入 Fish Audio的获客路径与多数语音公司不同:先用免费开源模型(Fish Speech)把开发者、游戏工作室和内容创作者圈进来,再向上卖创作者套餐(按月解锁语音生成时长与声音克隆),最后卖企业API和平台企业版。据公司披露, 连同开发者在内,企业业务现已贡献约三分之二的收入 ,典型客户包括HeyGen(AI虚拟形象)、Sanas(语音转换)与LiveKit(语音智能体)。 技术差异化的公开口径如下(IT桔子速递整理):自研VITS双自回归架构,仅需5秒音频样本即可完成声音克隆,支持83种语言,首包延迟约70毫秒,生成速度约为Cartesia的2倍,制作成本约为ElevenLabs的六分之一;同时提供超过1.5万项自然语言控制选项,情绪、语调、节奏可做词级调节。CEO曹睿莎的说法是:创作场景要表现力(语气、情绪、停顿像人),企业场景要可控性(在指定边界内稳定输出),Fish Audio试图同时交付这两类工程目标。 对照: 语音生成赛道的既有玩家包括ElevenLabs、WellSaid、Cartesia、Speechify、Async(前身为Podcastle)和Krisp,大厂AI实验室的语音能力也在快速迭代。Fish Audio的差异化筹码目前是:小团队、低训练成本、开源社区信任、企业客户占比高——但前两项会随着融资后扩张被稀释,后两项需要持续验证。 五、投资方视角:徐新的AI坐标,与梅西的Play Time 这笔交易的两个名字,分别对应两条不同的资本逻辑。 今日资本(徐新)。 徐新的历史战绩集中在消费与互联网,但近三年的AI下注密度明显抬升:2023年,今日资本控股的全德美嘉参与智谱B3轮,投入2.5亿元、获得约1135万股;2026年1月8日智谱登陆港交所,按最新市值计算这笔投资账面浮盈约百亿元级别,是今日资本在AI上最重的一笔回报。此外,今日资本2025年7月与美团龙珠共同领投具身智能公司星海图A4轮并在A5轮跟投(两轮合计超1亿美元),2026年2月星海图10亿元B轮时老股东继续追加;2026年7月又向AI婚恋公司良配投出1500万元天使轮。从大模型、具身智能到AI婚恋、AI语音,徐新2022年那句“未来20年改变世界的是人工智能”正在变成一条连续的投资线。本轮她选择以共同领投身份进入AI语音赛道。 Play Time(梅西)。 据媒体报道,Play Time于2022年10月在旧金山成立,slogan为“At the intersection of sports & technology(体育与科技的交汇处)”,首期基金规模约2亿美元(彭博报道口径)。成立至今累计出手约10次,早期围绕足球主业(Matchday、AC Momento),此后重心转向AI与机器人:AI数据标注平台SuperAnnotate、物理世界基础模型公司Perceptron、李飞飞的World Labs,再到本次的Fish Audio。对梅西而言,语音生成是AI组合里的新格子;对Fish Audio而言,Play Time带来的更多是品牌与全球化叙事的溢价。 六、风险观察:钱到位了,什么还没解决 估值赌点在于增速而非利润。 种子轮融资额≈当前ARR的2.5倍,隐含估值未披露。支撑这一定价的只有一条曲线:ARR从2月的约1000万美元到7月的2100万美元,5个月翻倍。一旦增速回落,2.5倍的口径会立刻显得昂贵。融资用途(扩充企业销售团队、深化开发者工具与API基础设施、研发音频理解模型与语音到语音转换)决定了这笔钱短期内很难转化为利润。 声音版权争议尚未根治。 此前有创作者反映声音在未获授权情况下被上传至Fish Audio平台。公司称已把下架流程自动化——提交声音样本或合同证明归属后,3分钟内可下架——但在创作者主动发现并申请之前,其声音仍可能持续被使用。领投方Coreline Ventures合伙人本田大辅也承认:“同意机制、透明度和署名权必须内嵌于产品本身,而非事后补救。”这既是合规风险,也是开源社区信任这一核心资产的隐患。 开源与商业化的张力。 5款模型中3款开源,最新款S2.1 Pro转为付费API。开源是增长引擎,但开源模型也意味着竞品可以在此基础上做产品化,差异化窗口可能被压缩——尤其当头部玩家资金更充裕时。 境内主体口径小且刚经历减资。 武汉新说世语参保2人、注册资本100万元,2026年4月刚完成从1000万到100万的减资。境内实体在融资架构与业务链条中的角色,公开信息尚不足以确认,需后续披露才能看清。 竞品与大厂夹击。 ElevenLabs等已在创作者和企业两端卡位,大模型实验室的语音能力迭代没有放缓迹象。Fish Audio“低成本、高表现力”的护城河能守多久,取决于其API生态和创作者网络能否形成正循环。 七、下一步验证什么 年内计划发布的音频理解模型能否如期落地,语音到语音(speech-to-speech)模型进展如何——这是产品线的下一块拼图; S2.1 Pro作为第一款闭源付费模型的API收入与续费率——验证“社区用户愿不愿意付费”; 企业+开发者收入占比能否从约三分之二继续提升——验证企业市场能否独立撑起增长; 声音所有权验证、许可条款与创作者收益分成机制何时上线——这是化解版权争议、保住社区信任的关键动作; 团队从3人扩到22人后再扩一轮,人均ARR(现约95万美元)还能不能守住——单位经济性是小团队叙事的核心。 一句话总结这笔交易:徐新和梅西押的不是Fish Audio今天的收入,而是“开源社区→企业付费”这条路径在语音赛道上的复制能力。种子轮给到2.5倍ARR,本质是给增速付了溢价;接下来5到8个季度,ARR能不能从2100万美元继续翻倍,将直接决定这轮定价是便宜还是贵。 来源 投资界|徐新投一位00后(2026-08-06) 投资界·搜狐转载|徐新投一位00后(全文) 搜狐·TechCrunch编译|Fish Audio完成5200万美元种子轮融资,布局AI语音模型市场 今日头条|Fish Audio 完成 5200 万美元种子轮 搜狐·IT桔子速递|全球创投24小时(Fish Audio融资条目及技术参数) 湖北日报|3家企业入驻,东西湖这个创新园再添“生力军”(武汉新说世语入驻信息) 百家号|梅西,投了一家公司,为传感器装上“大脑”(Play Time背景) 天眼查|武汉新说世语科技有限公司(工商基础信息、股东、主要人员、企业年报、工商变更)