Fish Audio 走的是 DeepSeek 那条路
2026-08-15
7 月 28 日,Fish Audio 宣布完成 5200 万美元种子轮,Coreline Ventures 和今日资本联合领投。种子轮融这个数,已经超过很多公司的 A 轮。 这家公司成立 12 个月,ARR 从零做到 2100 万美元,800 万用户,团队 22 人。 参照物只有一个。ElevenLabs 今年 2 月完成 5 亿美元融资,估值 110 亿,ARR 超过 3.3 亿美元,体量是 Fish Audio 的十几倍。但看 Fish Audio 怎么打,会想起另一家公司。开源、低价、加上一条不一样的架构路线,这个组合上一次见到是在 DeepSeek。 开源在这里承担分发职能 Fish Audio 起于一个开源项目。联合创始人兼首席科学家冷月(Shijia Liao)是 00 后,前 NVIDIA 研究员,做视频方向。他不满意市面上合成语音的表现力,用一块游戏 GPU 在卧室训了个模型扔上 GitHub,训练素材主要是 VTuber 内容。这个项目叫 Fish Speech,现在 31,000 多个 Star。 开源在这里是分发。Fish Audio 用的是自己写的「Fish Audio Research License」,模型可以随便下载测试,商用要付费。开发者在自己机器上跑通了、性能心里有数了,后面采购的阻力就小很多。平台现在有 200 万个社区上传的语音模型,月活超过 100 万,这些用户没有一分钱是买来的。 ElevenLabs 纯闭源,不提供自托管。 四到八倍的价格差 Fish Audio 的 API 大约每千字符 0.015 美元,ElevenLabs 是 0.06 到 0.12 美元。 订阅层面同样明显。F
本文为付费内容,订阅后阅读全文。