很抱歉,当前没有启用javascript,网站无法正常访问。请开启以便继续访问。
一个模型两个价!Meta奇招:分享会话数据可换Muse Spark调用费降九成
原创
2026-09-04 19:51 星期五
财联社 李莹
责编 林琦
①针对Muse Spark系列模型,Meta向愿意提供自己的提示词与模型回复的客户,开出平均约95%的模型调用折扣;
②此前,Meta在获取训练数据方面并不顺利,但用户数据对提升智能体工具的表现至关重要;
③部分大型企业并不愿让自己的数据被用于模型训练,甚至愿意为此支付高额溢价。

财联社9月4日讯(编辑 李莹)面对优质训练数据的长期匮乏,Meta近日出了一记‘奇招’:原本在多数AI工具中作为免费勾选项的数据授权,如今被它做成了一门明码标价的生意。

据媒体当地时间周五报道,针对Muse Spark系列模型,Meta向愿意提供自己的提示词与模型回复用于未来模型训练的客户,开出平均约95%的模型调用折扣。

Muse Spark系列最新的Muse Spark 1.3模型已于9月2日发布,Meta首席执行官扎克伯格称该模型展现了公司在编程与智能体能力上迄今为止最大的一次提升。

Meta为该系列模型设置了"标准"(Standard)与"贡献者"(Contributor)两个档位:两者调用的是同一模型、能力并无差别,核心区别在于Meta是否可将用户的提示词与模型输出用于改进自身产品。

按照Meta的说明,标准档位下相关数据不会被用于训练。

image

注:图为Meta针对Muse Spark系列模型官方定价表

据Meta官方定价文档,标准协议下,每百万输入token收费1.25美元,而在"贡献者"档位下仅需0.10美元;输出token的标准价为每百万4.25美元,贡献者档位则为0.20美元。

媒体报道指出,价差最悬殊的是"缓存输入token"——即智能体反复重传同一段上下文时被命中缓存、无需重算的部分:标准档每百万token 0.15美元,贡献者档仅0.002美元,相差约75倍。

image

数据的价码

报道指出,此前,Meta在获取训练数据方面并不顺利。今年早些时候启动的一项追踪员工电脑使用情况的计划遭到内部广泛批评,已于6月暂停。

用户数据对提升智能体工具的表现至关重要。开源智能体框架Pi的开发者Mario Zechner表示:"2025年4月到10月间,编程智能体能力之所以出现大幅跃升,原因在于Claude Code默认会保存用户全部的编程智能体会话,并将其用于强化学习训练。"

而厂商如今想要获取这些数据,面临着两重障碍。

一是数据“不存在”。报道称,随着模型使用的重心从软件工程转向更广泛的行业场景,许多专业工作流程复杂且不留数字痕迹,厂商既难评估智能体的表现,也无从改进。

二是存在也拿不到。美国普林斯顿大学计算机科学教授Arvind Narayanan指出,有充分证据显示大型企业并不愿让自己的数据被用于模型训练。

Narayanan在社交媒体上写道,企业客户宁可选择按token计费的企业版方案,也不采用Claude Max、ChatGPT Pro这类订阅制消费级方案,尽管后者折算下来要便宜10至20倍甚至更多;而两类方案的差别主要就在于数据留存政策与企业IT治理。

换言之,这些公司是在为"数据不进训练集"支付十几倍乃至更高的溢价。

或许正是出于对这一现实的认知,Meta选择以明确的价格补偿来换取数据。

报道称,Muse Spark定价指南把该“贡献者”档定位于"可以接受用你的数据进行训练"的场景——如搭原型、测集成、跑批量实验,即尚未上生产、数据本来就不敏感的工作场景。

Narayanan认为,该价格框架或许能反过来促使大型企业更审慎地区分:哪些数据是真正的专有资产,哪些其实可以拿去交换成本优势。

5.74W
要闻
股市
关联话题
16.88W 人关注
7.2W 人关注
6.81W 人关注
关于我们|网站声明|联系方式|用户反馈|网站地图|友情链接|举报电话:021-54679377转617举报邮箱:editor@cls.cn财联社举报
财联社 ©2018-2026上海界面财联社科技股份有限公司 版权所有沪ICP备14040942号-9沪公网安备31010402006047号互联网新闻信息服务许可证:31120170007沪金信备 [2021] 2号