编辑 | 王兆洋
2026年中旬,明星 AI 视频生成应用创业公司 OiiOii 的账上现金还有9位数的人民币,但它还是启动了新一轮融资。
此前,它与字节跳动旗下的云服务平台火山引擎签署了一项年度框架协议:OiiOii 需在2026年底向火山引擎支付5000万元人民币。
这令 OiiOii 的账面现金有些紧张。而5000万元将被用于购买字节跳动旗下最成功的 AI 产品——多模态视频生成模型 Seedance 2.0 的“纯血版” API。
所谓的“纯血版”,即字节跳动旗下的火山引擎官方渠道提供、具有完整权限的 Seedcance API 供给。
在 Seedance 2.0 惊艳 AI 产业与整个影视制作行业后,市面上充斥着来源复杂的 Seedance API,一些来路不明的中转站服务商,以相对低廉的价格,把 Seedance 2.0 和它的低配版—— Seedance 2.0 mini、Seedance 2.0 fast 混起来卖。用户想生成一段电影质感的大片,最后拿到的只是一节废品。
“纯血版” Seedance 2.0 API 是 AI 视频生成应用的生命线。如同大语言模型对顶级算力即英伟达高端 GPU 的依赖,顶级模型的 API 和调取 API 产生的 token,也在根本上决定着 AI 应用 ——它们通常被称为 AI Agent ——的基本能力。
因此,顶级模型的 token 成了稀缺且昂贵的硬通货。而 Seedance 2.0 无疑是这个星球上目前最强大的视频模型。
根据官方信息,Seedance 2.0 在无视频输入生成720p 视频时,每百万 tokens 的价格是46元,1秒视频成本约0.99元。而同样生成720p规格视频的成本,可灵3.0是0.6元,Vidu Q3-pro 约0.68元,Seedance 2.0 贵了不止一星半点。
以漫剧、短剧生成为强项的 OiiOii 需要强大的 Seedance 2.0,但用公司接近40%的现金流购买它的 token,听上去还是有些疯狂。
而对当今的 AI 应用创业公司而言,这早已司空见惯。比起大语言模型创业公司(包括 OpenAI 和 Anthropic)通常将融资金额的70%到80%直接用于购买或租赁 GPU 以及支付云计算算力,这已经不算什么了。
OiiOii 们购买的,并不是基于真实业务需求的 token 消耗量,而是 Seedance 2.0 API 的首发权。
很少有人注意到:OiiOii 结束内测正式上线的2026年4月2日,正是 Seedance 2.0 向企业开放公测的当日。这简直像是火山引擎宣布 OiiOii 成为 Seedance 2.0 的首批分销商,而不是 OiiOii 当天上线了自己的视频 Agent。
这不重要,抢先提供“纯血版”的 Seedance 2.0 更重要。
“纯血版” Seedance 2.0 打包出售的是一整套权益体系,如人脸库权限、最高并发数等。它直接决定了创业公司的产品能不能顺畅地跑起来。
如果一款 AI 视频生成应用面向 C 端,用户需要实时生成,就必须有足够高的并发次数。而模型刚上线时算力紧张,如果不能获得火山引擎的并发支持,Agent 的用户就得排队、超时,甚至无法生成视频。
有 AI 视频应用从业者对我们透露:1000 万元的 Seedance2.0 年框大约对应400次并发,而500万元年框大约对应 200次并发。价格差在哪里,用户体验就差在哪里。
图源:火山方舟
用户能够调用库存的更多人脸资源,而不是那越看越瘆人的那几张“AI 人脸”来回轮着用,也是跟着 Seedance 的年框价格走的。买与不买的差异,就是产品生与死的区别,你似乎别无选择。
“毛亏率”
在顶级模型的能力决定了 AI 应用的能力上限,以高昂的价格对 AI 应用“卡脖子”之后, 以 token 价格作为锚点向用户收取订阅费用,就注定成了一门“二房东”生意,一道永远算不赢的算术题,一个模型定价表上的变量函数。
即便如此,OiiOii 获得的 Seedance 2.0 首发权也并非独家。多家 OiiOii 同行如 LibTV 和 Flova等,也都拿到了 Seedance 2.0 的“首发”资格,几乎在同一时间高调宣布自己的产品接入了 Seedance 2.0,价格同样不菲。
火山引擎就是这般博爱,它不会给任何一家公司 Seedance 2.0 单独首发的优待,顶格年框也不行。而且,火山引擎的价格底线非常强硬:几乎没有折扣,千万级合同的 token 消耗多用多返,上限10%,也就是最多给相当于合同金额10%算力券。
另一方面,火山严格禁止倒买倒卖,避免低价 token 流入灰色市场。
在这套机制下,一个残酷事实浮现出来:AI 视频工具几乎不可能从满血的 Seedance 2.0 token 中挣到钱。
理论上,按 Seedance 2.0 的 token 原始价格卖给客户的话,不算返点,毛利率最高10%。但现实是,没有任何一家 AI 视频生成工具会按更高的价格——哪怕是原始价格,而出售 Seedance 2.0 的 token。毕竟在理论上,谁都可以直接和火山引擎做生意。有中间商赚差价,为什么不直接谈?
据“智能涌现”的报道:漫剧和影视制作公司也大多直接采购“满血级” Seedance 2.0 API,其中不乏行业头部公司,金额最高的一次充值也是5000万。这充分说明了市场对 Seedance 2.0 的渴望,也意味着拿到 Seedance 2.0 最高权益的 AI 应用创业公司,如果对外提供的 token 价格没有竞争力,就没有人用。
“工具属性的产品,不存在忠诚度。”一位 VC 人士这样对我们说。
于是,一条“野路子”出来了:头部 AI 应用公司开始主动降价获客,甚至开始直接倒卖 token。
LibLib 的母公司演语科技(Evoken)是中国 token 采购量最大的 AI 应用公司。它从开源模型社区起步,旋即向多模态创作平台转型。同时,它激进地进行了持续多轮融资,近期完成了一笔3亿美元的 B 轮融资,投后估值逾20亿美元,形成了资本加产品矩阵的综合壁垒—— LibLib AI 是创作社区与图像生成平台,Lovart 和星流分别面向海外与国内设计市场,LibTV 切入专业视频生产……
然而,演语科技并没有自己研发任何一款模型,连后训练模型也没有。这导致外界经常争论这家公司是否只是头部模型的中转站,并无任何技术壁垒。 但毫无悬念的是:演语科技是顶级模型 token 的大户客商。
在视频工具方面,LibTV 是 Seedance 2.0 的顶级满血客户,签下了年框5000万的大单,用作 LibTV Agent 的弹药。而在设计工具上,去年 Nano Banana 爆火,LibLib 旗下的 Lovart 也与 Google Cloud 签署了总包千万美元级别的协议。
不过据 Similarweb 等第三方平台估算:2026年6月,Lovart 网站月访问量约为310万次,LibTV 网站月访问量约为220万次。这样的流量规模已经不小,但访问与创作不能划等号。公开的信息是:LibTV 的付费用户有大几十万,尽管已超过大部分同行,但基本确定无法消耗公司斥巨资购买的全部 Seedance 2.0 token。
火山引擎是不接受 token “退货”的,这就催生了 AI 应用公司的副业。
演语科技创始人、CEO 陈冕在接受“晚点 Latepost” 的采访时,主动提及外界传言 LibTV 转卖 Seedance 2.0 的API Key 赚差价,并明确否认。
而我们了解到的是:LibTV 转卖的 Seedance 2.0 API Key 的确没有“赚差价”,因为它是赔本卖的。
有 LibTV 的友商、从事 AI 视频生成的创业团队对我们表示:LibLib 多次试图把 Seedance 2.0 API 卖给他们,价格比直接找火山引擎还便宜: 直接从火山采购,1000 万元以上合同可以拿到 10% 算力券返还;但LibLib 还能在这个基础上,再给他们返 10% 。
这里面当然没有差价,更没有利润,但它产生了收入。它可推高 LibTV 的 ARR(年度经常性收入),为进一步为融资叙事提供数字支撑。
这类 ARR 的本质就是“负毛利”收入:以九折合同价格,即10%的优惠拿到 token,再优惠10%卖给需要更低价格 token 的友商,从结构上就是亏损的买卖。
它产生的甚至不是毛利率,而是“毛亏率”。
另一方面,LibTV 和 Lovart 对付费用户的价格策略,也让它作为一家 AI 应用公司的毛利率如镜花水月。
可以先粗算一笔账——
LibTV 标准版连续包年会员的月均价格为47.4元,官网估算可生成56秒 Seedance 2.0 720P 视频,相当于每秒会员收入约0.85元。假设用户将额度全部用于无视频输入时的 Seedance 2.0,并按火山引擎面价约0.99元/秒估算,仅计算模型调用成本,边际毛利率约为 -17% 。即使10%的算力券能够全部兑现,该项边际毛利率也只有约- 5%。而这 还要覆盖夜间折扣、开卡赠送额度和限时免费。
Lovart 的情况也是类似。若是把积分全部拿来用 GPT Image 2 生成 medium 质量的1K 图片,参考“最受欢迎的” Pro套餐年卡权益、眼下“月末狂欢”的39美元折扣价格和 OpenAI 官方 API 标准定价,当用户满额使用时,对应的边际毛利率约 -87% (前几天这项套餐折扣后的月均价格还是45美元,对应边际毛利率约为 -60% )。
不过这些都属于“压力测试”。在现实中,用户未必用满额度,也可能将积分用于成本更低的模型和生成方案,平台采购不同模型的 API 也可能拿到不同程度的折扣,让实际亏损收窄。
演语科技 CEO 陈冕在“晚点 Latepost”的访谈中也回应了这点:如果用户用满套餐额度的全部 token,LibTV 肯定亏损。但如果用户购买了100万积分,实际只用了20万,剩下的80万就成了利润。也有黑产用户对 LibTV 做逆向工程,把年费会员账号做成 API,就会导致亏损,所以要治理。
所谓的“逆向工程”,有一个指向明确的例子:2026年2月,在 Web 3 和 AI 领域颇有影响力的微信公众号“Web 3 天空之城”的运营者“城主”,发文声讨演语科技旗下的视觉设计应用 Lovart,称自己为 Lovart Pro 的会员资格支付了540美元年费,但10天后账号即被封禁,而且没有收到退款。“城主” 通过邮件申诉和与 Lovart 团队成员主动沟通,均未获得回复。
据我们了解,“城主”的会员账号被 Lovart 内部风控机制判定为实施了“逆向工程”,公司也升级了更严格的治理手段。而拒绝与“城主”进一步沟通并拒绝退费的决定,是陈冕本人做出的。
该事件一度引发不小风波,引发了对 AI 应用软件预付费机制、封号标准透明度和消费者权益保障的讨论,也足见寄望于用户只付款而不消耗 token 额度的商业模式,是何等脆弱;而且在 token 价格极度敏感的环境下,有多少可被反向套利的漏洞。
而事实上,真正搞“逆向工程”,将用不完的会员 token 封装成 API 进行出售的,正是 Lovart 或 LibTV 自己。
因为用户消耗不完的 token 并不能真的变成利润,AI 应用公司已经为这些额度向模型厂商支付了费用。
它们被包含在年度框架里。强势的模型厂商的逻辑是:用完可以再买,用不完绝对不退。所谓的100万积分用了20万,剩下的80万就变成了利润并不存在。也就是说,“用不完”的 token 额度,实际变成了 AI 应用公司的“库存”。
既然是库存,就得清仓甩卖,否则亏得更多。这也就解释了为什么有其它的 AI 视频生成团队会收到来自 LibTV 的 token 折扣价出售邀约。官方打击用户“逆向工程”转卖 token,其实是在与用户争夺 token 的转售资格。
比起 token“库存”再打折出售造成的亏损,用户满额使用权益带来的亏损更大。即便“用不完的 token 是利润”可以成立,它也锁死了盈利模式的上限——当全部用户都只充值但连一个 token 都不消耗的时候,它的利润理论上可以最大化。
用户多消耗一个 token,它就离亏损更进一步。这就形成了一种危险的逆向选择:它的价格越低,越容易吸引专门消耗昂贵模型的重度用户,这些用户积分使用率更高,留给平台的沉淀收入反而更少。
如此循环,AI 应用公司的亏损可能随之扩大,唯一好处就是有了短期更好看的 ARR。
AI 应用公司对此冷暖自知,但对 VC 展示时,它们依然能把这些“陷阱”藏起来。有 VC 人士对我们透露:LibLib 给投资人和资本市场展示的毛利率,很可能是正的。
这相当考验“财技”:赠送额度、限时免费、夜间折扣……这些真正吃掉毛利的刚性成本全部可计入销售费率,早期的高销售费率可以被美其名曰“增长投入”;全部的收入——包含用户购买会员积分和转卖 token 的收入都按原价计入,实现不同口径下的“正毛利率”并非不可能。
在我们和不少投资人与创业者的交流里,一个共识是:哪怕按最宽的口径计算,以消耗和销售 token 为核心商业模式的 AI 应用的毛利区间,也普遍只有 10%-25%,几乎无法覆盖各项成本。
大多数中国 AI 应用创业团队从第一天开始就拓展海外市场,但有知情人士计算后表示:海外一个付费用户的获取成本大约 200 美元,而用户平均付费 50 美元,token 毛利连用户增长都 cover 不住,更不用说产研、运营和管理的支出了。
过去几年,资本市场和创业圈偏好用 SaaS 框架理解AI应用。但现在投资人已经清醒,“SaaS 是用户越多越便宜,AI 应用反过来,用户越多你越亏”。
这点出了 AI 应用和传统软件最本质的不同——传统 SaaS 的边际成本会随着规模摊薄,而 AI 应用的边际成本却会随着使用量重新出现。用户越爱用,token 越多;token 越多,成本越重。
从底层看,AI应用公司运营的是“一条持续亏本的 token 周转链”,这就是“毛亏率”。
“token 控制器”
AI 应用创业公司也并非明知 token 是火坑还坚持往里跳,它们自己也身处混沌当中。
采购模型厂商的 token,表面成本是明摆在那里的,但是产品定价、用户补贴和毛利测算,都被来自模型的后置结算系统牵着走。起初以为挤挤就能出来的毛利,在账单跑出来之后,发现变成了毛亏率。
还以 Seedance 2.0为例:它一次视频生成的实际费用,会同时参考输入视频时长、输出视频时长、输出分辨率、帧率、模型版本、最低计费时长和时长档位。视频模型的API在1 秒到 4 秒可能统一按 4 秒计费,不同长度之间往往并不是线性增长。AI 应用公司签约后按日产生消耗,但通常要到 T+N 天才能在账单中看到逐笔费用。
这便构成了“困在 token 里”的典型状态:公司知道 token 明面上的成本,但不知道真实的成本会以什么方式,在什么时间,被放大到什么程度。
然而 AI 应用创业团队们却无法摆脱这种依赖,反而越陷越深。毕竟,它们离不开最顶级的模型带来的“好处”。
如果用公式来呈现 AI 应用的成本来源,那就是:“真实生成成本 = 单次生成价格 × 平均抽卡次数”。无论视频、图像还是 PPT设计都是如此。
顶级模型的生成成功率高,抽卡次数减少,有时反而会让底层计算成本变得更低。
前期成本高、效果好、抽卡次数少、综合成本未必最高的顶级模型,与是前期门槛低、调用便宜、抽卡次数多、综合成本提高、可能牺牲转化留存的次优模型,AI 应用团队该怎么选?
有业内人士透露:为了增加签单,可灵1.0的客户在很长一段时间内最低能拿到 3.5 折的折扣。这种折扣力度对可灵的推理成本来说本就是亏的,后期可灵模型升级,推理算力成本上涨,这个价格便是亏上加亏。它唯一的目的就是抢夺客户。
而客观的结果是:那些试图通过降价卖给应用公司更多 token 的模型厂商,还是会被置之次席。一个可以侧面印证的例子是:Seedance 2.0在 OpenRouter 上日请求量依然稳定在 3000次以上,可灵3.0只有300-400次。
因此,要解决天然的“毛亏率”,最直接的办法有两种:提高产品定价,或者降低 token 成本。从目前情况看,大部分AI 应用创业公司选择了后者。
表面上大家积极迭代产品、更新功能、做出差异,但实际上,很大一部分精力是在找便宜的 token。而便宜的 token,来源五花八门。
首先,“上游” AI Agent 公司的低价倾销是一个重要渠道。
就像前面提到的,LibLib 会向规模较小、融资或账面金额买不起满血版 Seedance 2.0 的 AI 应用团队销售 8.1 折的 token。一些创业公司欢迎这样的“优惠”,另一些则担心违反火山引擎的销售政策而不敢接盘。
其次,业务转型的同行也能提供低价 token。
如前面提到的,头部模型厂商的年框政策较为强势,有保底额度,“过期不候”——在一年内消耗不完,剩余 token 额度清零。这也是为什么转卖 token 被模型厂商屡禁不止的原因,无论止损、回本还是“制造”毛利,都决定了 AI 应用团队必须这么做。
尤其是当一些公司烧钱讲故事失败,无力继续或濒临倒闭时,它们剩下的“巨额” token 额度,便可能以极低的价格甩卖。
一个有意思的细节是:有些公司的 token 采购耗资千万以上,但主要目的本就不是为了做业务,而是为了讲故事:告诉资本市场,自己成了顶级模型厂的大客户,展示自己的实力,迅速再融一轮资。有 VC 界人士对我们说,买 token 在部分创业团队已经完全“脱实向虚”了。
此外,寻求政府补贴是常见且更为靠谱的获得更低价 token 的渠道。
市区一级的地方政府会为属地被认可的 AI 企业提供算力或模型补贴,于是应用公司也有机会把 token 成本降至原价的七五折至九折。不过这类资源并不普遍,为了拿到低价 token,大家要“八仙过海,各显神通”。
说到底,大家都在想办法拿到更便宜的 token。而这种对便宜 token 追求的最大化,势必导致“中转站”的泛滥。
作为地下 AI 产业,“中转站”本质是token 的批发转零售。它们大致可以分为三类。
第一类是“正规”转售,大规模采购海外模型的 token,拿到折扣再转卖国内,这还算是“正常”的经销商逻辑。
第二类是纯黑产,多由个人运营,“百万 token 三块钱”,随时跑路或被封。
第三类则是“池化”资源。这类中转站的操作方式是把各种零散渠道的 token 额度搜罗起来,搭出一个统一的调度层路由(router)。
中转站是 AI 应用市场最主要的低价 token 渠道之一。不过,这些资源的价格参差不齐,质量并不稳定。落在视频生成,就是司空见惯的“掺水”现象。
免责声明:本文仅用于信息交流,不构成投资建议。数字资产具有高风险,请自行判断。
← 返回最新