很少有AI厂商笃信发布的产品能够“以数量换质量”,OpenAI偏偏是其中之一。一如之前连开12天发布会的豪举,昨天,OpenAICodex负责人ThibaultSottiaux(也就是大家熟悉的Tibo)宣布了一项持续28天的承诺:接下来的每一天,团队要么发布一项对大多数Codex或ChatGPTWork用户有明显价值的更新,要么执行一次完整额度重置。
活动来到Day1,OpenAI交出的答卷是提速。通过订阅使用GPT-6Astra和GPT-6.1Sol,默认速度将提高约50%,用户无需调整设置。
同一天,OpenAI还公布了两项方向完全不同的变化。ChatGPT和Codex的部分文字输出将开始加入不可见水印,ChatGPT的广告业务则准备引入更直观的图片展示形式。
放在一起看,几项更新很能说明OpenAI目前的处境。它需要让付费用户觉得订阅更值,也需要向监管解释AI内容从哪里来,同时还得让越来越大的用户规模,成为广告主愿意买单的生意。
模型之外,AI平台要面对的日常事务,正在越来越接近我们熟悉的互联网。
每天都要更新,用户期待一份可用的改进
Tibo的承诺有一个值得留意的限定,每天发布的改进,需要与大多数Codex或Work用户相关,而且效果足够明显。
换句话说,一项藏在角落里的小功能,很难满足用户对这份承诺的期待。对于每天使用AI工作的人,等待时间、操作是否方便、额度够不够用,都会直接影响他们愿不愿意继续付费。
Day1的提速,正好回应了这种需求。
按照Tibo的说明,GPT-6Astra和GPT-6.1Sol的默认速度优化覆盖OpenAI的订阅产品,也覆盖支持SigninwithChatGPT的合作伙伴,包括OpenCode、Pi、Amp和Devin。
用户通过ChatGPT账号在这些工具里使用订阅能力,也在此次调整的范围内。他表示,变化会在公告发布后的两小时内逐渐被用户感受到。
随后,Tibo又给出了一个更具体的数字,生成速度从每秒30token提升到每秒50token。
对于需要连续与模型交互的工作,提速仍然有实际意义。写代码需要反复读取文件、修改、测试和纠错,整理资料也可能经过多次搜索与生成,单次等待缩短后,累积下来的体验差异会更明显。
不过,比起提速,或许重置额度来的更实在些,我们也期待这28天能看到多几次。
给文字留下水印,也要承认水印的局限
提速让用户更容易使用AI,文字水印则回应了另一个问题。当生成内容进入邮件、文章、报告和公共讨论,外界还能不能识别它与AI的关系?
同样是今天,OpenAI公布了应对欧盟文字来源规则的方案。按照其公告,欧盟《AIAct》要求生成式AI提供商,让生成文字能够以机器可读的方式被识别。
全球API客户从当天起,可以为部分模型主动开启文字水印,默认状态仍然关闭。
未来几周,OpenAI会在欧盟范围内,为符合条件的ChatGPT和Codex文字输出加入不可见水印,覆盖各类套餐,但首发阶段不会将它设为全球默认功能。
OpenAI将这项技术称为textGrain。它会在模型选择词语时加入不可见的统计信号,检测工具再寻找这些信号,判断一段文字是否含有OpenAI水印。OpenAI还计划将技术开源。
难点在于,文字太容易被改动,而可供模型选择的表达方式,也因内容而异。
在目标误报率为1%的测试条件下,对于心理学等内容,检测工具能识别约80%的200-token水印文本,长度增加到400token时,识别率约为95%。数学内容的表达空间更小,检测表现明显更低。
编辑也会削弱信号。在另一组400-token文本测试中,将10%的词语替换为同义词,检测率会从约92%降至66%;替换比例达到25%后,检测率只剩17%。
几组数字说明,文字水印能提供线索,但距离可靠判断一篇文章的创作过程,还有相当大的距离。OpenAI也表示,在其用于评估Astra的基准测试中,没有观察到加入水印前后存在有意义的性能差异,不过这些测试仍然不能覆盖所有实际写作场景。
更关键的边界,是水印无法衡量人类贡献。
一个人自己完成文章,再让AI调整表达,和让AI生成全文,都可能涉及模型对文字的处理。检测到水印,无法说明作者投入了多少判断、编辑与创意,也不能据此判定版权、责任或内容真假。
水印同样不会关联具体用户、账号、提示词或对话。反过来,没有检测到水印,也无法证明文字由人类独立完成,文本过短、经过编辑或翻译、来自不支持水印的模型,都可能让信号无法被识别。
由于误报和漏报仍然存在,OpenAI暂时只向获批的研究人员和专业机构开放检测工具的申请,没有在上线时向公众全面开放。
当ChatGPT每周触达12亿人,广告开始长出熟悉的样子
比起水印,视觉广告更容易让普通用户感受到产品的变化。
OpenAI在同日公告中称,ChatGPT每周触达12亿人。对于这样规模的平台,订阅之外的商业收入,已经成为产品发展的一部分。
此次公布的新广告形式,将通过图片展示产品灵感、使用方式或相关体验。首批测试计划在本月晚些时候于美国启动,与一组初始广告主合作,展示场景选在ChatGPT生成图片的过程中。
按照OpenAI的说明,广告会被明确标注,并与正在生成的图片保持分离,广告也不会影响ChatGPT提供的回答。
选择图片生成作为测试场景,有它的商业逻辑。
用户在构思房间布置、活动方案或生活方式时,图片能让商品的使用场景变得更直观,也更容易让品牌进入用户的考虑范围。当然,是否能带来足够好的体验,还要等测试给出答案。
OpenAI同时扩充了广告效果衡量工具,与Hightouch、Tealium、LiveRamp等平台合作,方便广告主将已有系统中的转化数据传回ChatGPTAds,并引入更多归因和效果评估伙伴。
对广告主而言,真正需要回答的问题是,用户看过广告之后,是否产生了购买,以及这些购买有多少原本就会发生。
OpenAI公布了几组合作伙伴提供的早期结果。
DVRockerbox称,WeightWatchers在ChatGPTAds上的归因获客成本,比其综合付费搜索基准低15.3%;WorkMagic称,健康品牌Dose的增量购买中,67%来自全新客户;TripleWhale则称,PortlandLeather从ChatGPTAds获得的访问者中,93%是新访客。
此外,广告展示的位置,也需要新的规则。OpenAI表示,会评估对话是否适合展示广告,避免在情绪脆弱、敏感或其他不适宜的语境中投放,并与DoubleVerify、IntegralAdScience探索品牌适配评估。
按照公告,这些合作方将在受控测试环境中评估相关保护机制,不会访问真实用户的私人对话。
传统网站的广告通常围绕页面内容,ChatGPT的广告则出现在一段持续变化的对话旁边。平台越能理解用户当前想做什么,商业机会就越具体;同样,用户也会更在意,自己得到的建议究竟受到什么影响。
OpenAI承诺广告不影响回答,未来我们也将拭目以待。
28天更新承诺才刚开始,接下来每天会交出什么,仍然值得关注。不过,首日的几项变化已经让竞争的范围更清楚了,OpenAI同时要经营付费用户的效率、生成内容的透明度,以及广告主的商业回报。
AI平台越来越成熟,也越来越需要回答一个熟悉的问题。当它既是帮你做决定的助手,又是商家争取你注意力的地方,用户凭什么持续相信它?

相关文章

头条焦点
精彩导读
关注我们
【查看完整讨论话题】 | 【用户登录】 | 【用户注册】