在AI行业里,深信自家产品能靠“量变引发质变”的公司并不多见,而OpenAI恰恰是其中之一。
延续此前连续12天举办发布会的豪迈风格,昨日,OpenAI Codex负责人Thibault Sottiaux(也就是大家熟知的Tibo)对外公布了一项为期28天的计划:
从今天起,团队每天都会推出一项对大多数Codex或ChatGPT Work用户而言价值显著的更新,或者进行一次完整的额度重置。
活动第一天,OpenAI拿出的成果是速度提升。通过订阅使用GPT-6 Astra和GPT-6.1 Sol的用户,默认响应速度将提升约50%,且无需手动更改任何设置。
同日,OpenAI还宣布了两项方向截然不同的变动。ChatGPT和Codex的部分文字输出将开始嵌入不可见水印,而ChatGPT的广告业务则计划引入更直观的图片展示形式。
把这些更新放在一起看,能清晰反映出OpenAI当前的处境。它既要让付费用户感到订阅更划算,又要向监管机构说明AI内容的来源,同时还得把日益庞大的用户规模,转化为广告主愿意投入的商业价值。
模型之外,AI平台需要处理的日常事务,正越来越接近我们熟悉的互联网生态。
Tibo的承诺中有一个值得注意的限定条件:每天发布的改进,必须与大多数Codex或Work用户相关,且效果足够显著。
换句话说,一个隐藏在菜单深处的小功能,很难满足用户对这个承诺的期待。对于每天依赖AI工作的人来说,等待时长、操作便捷度、额度是否充足,这些因素都直接影响他们是否会继续付费。
Day 1的提速,恰好回应了这一核心需求。
根据Tibo的说明,GPT-6 Astra和GPT-6.1 Sol的默认速度优化不仅覆盖OpenAI的订阅产品,还适用于支持“Sign in with ChatGPT”的合作伙伴,包括OpenCode、Pi、Amp和Devin。
用户通过这些工具使用ChatGPT账号登录并调用订阅功能,同样会被此次调整涵盖。他表示,变化将在公告发布后的两小时内逐步被用户感知。
随后,Tibo给出了一个更精确的数据:生成速度从每秒30个token提升到了每秒50个token。
对于需要持续与模型交互的工作而言,提速依然具有实际意义。编写代码时需要反复读取文件、修改、测试和纠错;整理资料也可能经历多次搜索与生成过程。单次等待时间缩短后,累积下来的体验差异会更为明显。
不过,相比提速,或许额度重置更让人期待, 我们也希望这28天里能多见到几次。
提速让用户更便捷地使用AI,而文字水印则回应了另一个问题:当AI生成的内容进入邮件、文章、报告和公共讨论,外界还能否识别它与AI的关联?
同样在今天,OpenAI公布了应对欧盟文字来源规则的方案。根据其公告,欧盟《AI法案》要求生成式AI提供商确保其生成的文字能以机器可读的方式被识别。
全球API客户从即日起,可以为部分模型主动开启文字水印功能,但默认状态仍为关闭。
未来几周内,OpenAI将在欧盟范围内,为符合条件的ChatGPT和Codex文字输出加入不可见水印,覆盖所有套餐类型,但首发阶段不会将其设为全球默认功能。
OpenAI将这项技术命名为textGrain。它会在模型选择词语时嵌入不可见的统计信号,检测工具则通过寻找这些信号,来判断一段文字是否带有OpenAI水印。OpenAI还计划将这项技术开源。
难点在于,文字本身极易被修改,而模型可选的表达方式也因内容不同而差异巨大。
在目标误报率为1%的测试条件下,对于心理学等内容,检测工具能识别约80%的200-token水印文本;当文本长度增加到400 token时,识别率提升至约95%。数学内容的表达空间更小,检测表现则明显逊色。
编辑操作也会削弱信号。在另一组400-token文本测试中,将10%的词语替换为同义词,检测率会从约92%降至66%;当替换比例达到25%后,检测率仅剩17%。
这几组数据表明,文字水印能提供一定线索,但距离可靠地判断一篇文章的创作过程,仍有相当大的差距。OpenAI也表示,在其用于评估Astra的基准测试中,未观察到加水印前后存在有意义的性能差异,不过这些测试仍无法覆盖所有实际写作场景。
更关键的边界在于,水印无法衡量人类的贡献。
一个人自己完成文章,再让AI调整表达方式,与让AI直接生成全文,都可能涉及模型对文字的处理。检测到水印,并不能说明作者投入了多少判断、编辑与创意,也无法据此判定版权归属、责任划分或内容真伪。
水印同样不会关联具体用户、账号、提示词或对话。反之,没有检测到水印,也无法证明文字由人类独立完成。文本过短、经过编辑或翻译、来自不支持水印的模型,都可能导致信号无法被识别。
鉴于误报和漏报仍然存在,OpenAI目前仅向获批的研究人员和专业机构开放检测工具的申请,并未在发布时向公众全面开放。
相比水印,视觉广告更容易让普通用户感受到产品的变化。
OpenAI在同日公告中透露,ChatGPT每周触达12亿人。对于一个如此规模的平台,订阅之外的商业收入,已成为产品发展的一部分。
此次公布的新广告形式,将通过图片展示产品灵感、使用方式或相关体验。首批测试计划于本月晚些时候在美国启动,与一组初始广告主合作,展示场景选在ChatGPT生成图片的过程中。
根据OpenAI的说明,广告会被明确标注,并与正在生成的图片保持分离,广告也不会影响ChatGPT提供的回答。
选择图片生成作为测试场景,有其商业逻辑。
用户在构思房间布置、活动方案或生活方式时,图片能让商品的使用场景变得更直观,也更容易让品牌进入用户的考虑范围。当然,能否带来足够好的体验,还需等待测试结果来验证。
OpenAI同时扩充了广告效果衡量工具,与Hightouch、Tealium、LiveRamp等平台合作,方便广告主将现有系统中的转化数据传回ChatGPT Ads,并引入更多归因和效果评估伙伴。
对广告主而言,真正需要回答的问题是:用户看过广告后,是否产生了购买行为,以及这些购买中有多少原本就会发生。
OpenAI公布了几组合作伙伴提供的早期结果。
DV Rockerbox称,WeightWatchers在ChatGPT Ads上的归因获客成本,比其综合付费搜索基准低15.3%;WorkMagic称,健康品牌Dose的增量购买中,67%来自全新客户;Triple Whale则称,Portland Leather从ChatGPT Ads获得的访问者中,93%是新访客。
此外,广告展示的位置也需要新的规则。OpenAI表示,会评估对话是否适合展示广告,避免在情绪脆弱、敏感或其他不适宜的语境中投放,并与DoubleVerify、Integral Ad Science探索品牌适配评估。
按照公告,这些合作方将在受控测试环境中评估相关保护机制,不会访问真实用户的私人对话。
传统网站的广告通常围绕页面内容,而ChatGPT的广告则出现在一段持续变化的对话旁边。平台越能理解用户当前想做什么,商业机会就越具体;同样,用户也会更在意,自己得到的建议究竟受到什么影响。
OpenAI承诺广告不影响回答,未来我们也将拭目以待。
28天更新承诺才刚刚开始,接下来每天会交出什么,仍然值得关注。不过,首日的几项变化已经让竞争的范围更清晰了:OpenAI需要同时兼顾付费用户的效率、生成内容的透明度,以及广告主的商业回报。
AI平台越来越成熟,也越来越需要回答一个熟悉的问题。当它既是帮你做决定的助手,又是商家争取你注意力的地方,用户凭什么持续相信它?
附上参考资料:
https://openai.com/index/eu-text-provenance/
https://openai.com/index/new-chatgpt-ads-format-and-measurement/
本文来自微信公众号“APPSO”,作者:发现明日产品的,36氪经授权发布。