Workflow
Codex
icon
搜索文档
OpenAI introduces text watermarking for ChatGPT and Codex outputs in EU
Proactiveinvestors UK· 2026-10-06 23:24
About this content About Angela Harmantas Angela Harmantas is an Editor at Proactive. She has over 15 years of experience covering the equity markets in North America, with a particular focus on junior resource stocks. Angela has reported from numerous countries around the world, including Canada, the US, Australia, Brazil, Ghana, and South Africa for leading trade publications. Previously, she worked in investor relations and led the foreign direct investment program in Canada for the Swedish government. S ...
对话 Tibo:入职第三天就把生产环境弄宕机了,今天他掌管 Codex
AI前线· 2026-10-06 12:10
文章核心观点 - OpenAI的ChatGPT和Codex负责人Tibo Sottiaux承诺未来28天每天要么推出对大多数Codex和Work用户明显有用的改进,要么进行一次完整的额度重置 [2] - 判断权交给用户,产品是否变好不能只看发布功能数量,还要看用户在日常工作中是否真正受益 [4] - Tibo拥有直接按下额度重置按钮的自主权,不需要经过层层审批,这让他能更直接地贴近社区 [5] - 额度重置取决于把东西弄坏多少次,出了问题会重置,有值得庆祝的事情也会重置 [5] - Tibo坦承加入OpenAI第三天就曾把生产环境弄宕机 [5] - Tibo本人也对越来越复杂的选择感到疲惫,称需要拿一个模型选择器博士学位 [5] - 希望尽快摆脱这些负担,让应用本身逐渐退到幕后 [5] - 如今分析业务趋势、研究下一个功能、检查此前发布产品表现所需的大量代码都由Codex编写,手写代码成了周末刷LeetCode题的放松活动 [5] - 随着智能体速度提高,Tibo重新找回了工作的心流,通过语音就能推动构建 [6] - 产品设计需要考虑三个变化:互联网上大多数操作将由智能体完成,模型会迅速变得更便宜更快,不同模态之间交互会更加顺畅 [6] - 28天改进承诺与访谈中反复强调的方向相互呼应:让更强的能力变成更容易使用的产品 [6] 个人工作方式与智能体使用 - Tibo表示为了完成各种分析,大量代码由Codex编写,已不再手写这些代码,唯一亲手写代码的场景是周末手写LeetCode题 [8] - 以前会同时运行更多智能体,后来在超高速能力方面取得突破,一个速度更快的智能体帮助很大,又能保持在工作心流状态里 [10] - 同时运行智能体数量会变化,探索能力边界时会组建越来越大的智能体团队,模型取得下一次突破后一个能力更强的智能体就能完成所有工作,于是又会缩小团队规模 [10] - 这个过程是不断扩张、收缩、再扩张 [11] AI如何继续改变工作 - 搭建循环、反复调整循环可能曾让一些人感到兴奋,但未来不会以这种方式运作 [12] - 未来方式更接近Dots的定位:拥有一个非常聪明的智能体,每周七天每天二十四小时持续工作,理解目标、了解偏好并从反馈中学习 [12] - 长期来看需要一个能根据想实现目标不断学习的系统,不应该非得思考为了得到结果必须让它严格按照某种方式循环 [12] - 根本目标是让人摆脱技术本身的束缚 [12] - 拥有一种持续存在、始终活跃的智能能力,知道自己需要做什么,可以通过任何客户端任何屏幕交互,也可以给它打电话 [13] - 走进会议室它就出现在会议中帮忙记笔记,之后可以通过邮件接着沟通,需要时发消息即可 [13] - 不需要一直守着笔记本电脑或盯着手机,需要它时它就在,不需要时也不会妨碍 [13] - 现在到哪里都要带着笔记本电脑就像随身带着一块砖,被技术拴住了而不是技术在为人工作 [13] - 工作方式还会继续发生相当剧烈的变化 [14] - 语音、多模态输入和输出等技术似乎终于开始结合起来,但使用起来仍然有些笨拙,这种感觉会一直持续直到某一天突然不再笨拙 [14] - 可以设想拥有一块共享白板,人和人之间、智能体和智能体之间都可以共同协作 [14] - 这会超越对话,也会超越今天的许多客户端形态,还会经历一轮重大的新变革 [14] Dots未来发展方向 - 对于Codex和ChatGPT会做整合,现在有聊天模式也有Work模式的切换开关 [16] - 用户反馈喜欢Work的能力但有时也想用聊天模式因为它速度更快用起来更舒服 [16] - 正在把这些体验整合起来降低复杂度,最终也会把Dots的所有能力直接带到聊天模式中,提高12亿用户所能获得的基础能力 [16] - 希望整个体验真正做到无缝衔接,Dots没有模型选择器也不需要各种配置,只需要和它交谈,唯一需要配置的是希望通过哪些渠道与它沟通 [16] - Tibo更多想到的是三四十年前的科幻作品以及它们当时有多么富有远见 [17] - 影响特别大的科幻作品包括《神经漫游者》和最初的《星际迷航》 [18] - 《星际迷航》中技术非常实用,可以直接和计算机说话它就替你做事情,可以和飞船说话它就会行动 [18] - 成为社区的一部分与大家一起构建产品非常重要,某种意义上是在共同探索这项技术以及能一起用它做些什么 [19] - 每次和人交流都会发现原来你在用它做这件事这是之前完全没有想到的 [19] - 要做出真正对人有用的东西这个过程必不可少,如果没有社区不知道该怎么做到这一点 [19] - 产品发布之前并不真正知道自己做出了什么,只有发布之后看到人们如何使用、有哪些新用法涌现出来才会逐渐理解它 [19] - Tibo每天大概花半个小时刷Twitter,受到启发觉得有值得分享的内容时就做点什么,很多内容都是当下想到的 [20] - Tibo有一个专门负责Twitter的Dot [21] - 希望先从一个主Dot开始,它很可能也是会通过消息联系的那个助手,而且会最深入地了解用户偏好 [22] - 想先看看大家会用它做什么,看看系统需要怎样调整,通过与社区共同使用和探索来学习 [23] - 很快就可以添加第二个第三个第四个Dot,按需要创建任意数量的Dot组成虚拟团队并给它们分配具体角色 [23] - 有时一项需要投入大量工作的任务比如持续关注Twitter,工作量可能大到足以占用一整个Dot [23] OpenAI的开放生态与插件收入分成 - 被低估的是生态系统:把整个体系开放出来以及对全面开放的坚定承诺 [24] - 已经签下了16家合作伙伴 [24] - 这件事去年很自然地开始,当时和Pi、OpenCode的开发者交流,觉得用户理所当然应该能使用Codex登录并使用自己的额度 [24] - 相当于在线上握了握手说你们直接用这个认证机制就好我们相信你们不会做什么不当的事情 [24] - 后来这种方式越来越受欢迎,现在把它变成了一项正式支持的机制与许多合作伙伴共同推进 [24] - 也在开放基础设施以及构建ChatGPT的方式,包括插件扩展、插件发现,让任何人都有机会把自己的产品带给大约12亿用户并从这样的分发能力中受益 [24] - 设计了收益分享机制,对于受欢迎使用量大的插件会支付报酬,它们也会获得一部分收入分成 [25] - 当用户把额度用在插件上或者通过使用ChatGPT登录在其他产品里使用额度时,会与相应的合作伙伴分享收益让它们获得报酬 [27] - 对于希望插件脱颖而出的开发者,建议做一个好的插件,系统会看用户留存数据看插件是否成功质量如何再据此开始在对话中向用户推荐 [27] - 如果插件不够好系统就会停止推荐 [27] - 重点并不是做AEO,而是人们是否持续使用你的产品是否愿意留下来 [28] - 这次的方向是对的 [30] Dots背后的研究积累 - 研究层面开展持续运行、长时间跨度任务的研究已经超过两年 [33] - 能够保持连贯一致的记忆系统也研究了差不多同样长的时间 [33] - 很多能力已经直接放进了ChatGPT,用户很喜欢ChatGPT能够了解这么多与自己有关的信息 [33] - ChatGPT的记忆功能已经运作得非常好了,在这方面投入了大量研究 [33] - 这些能力结合以Codex的智能体运行框架harness为基础,再加上能够全天候持续运行有效完成工作的能力就形成了这次发布的Dots [33] - 这是经过很多个月工作积累的成果 [33] - 确保产品的安全性和系统安全也非常重要,选择搭载Astra推出Dots是因为它是最安全最符合对齐目标的模型 [34] - 为了让Dots真正安全可靠投入了更多努力 [34] AI时代人类的价值与技能 - 在OpenAI设计所有东西时都把人放在中心,把技术构建成人的延伸成为意志和品味的延伸,让它真正成为一种赋予人能力的工具 [35] - 只要继续沿着这个方向走让技术帮助实现想做的事情扩展创造力和品味,那么它实际上就是一种创作工具 [35] - 未来可能不再有专门写代码的人,但会有比以往更多的创造者 [35] - 这件事里仍然会保留一些深刻的人性:人们希望学习也希望看看其他人正在创造什么 [35] - 减少配置带来的疲劳是其中一个方向,另一个方向是改变与智能体交互像是一场独自冒险的状态 [37] - 理想的工作方式是让它直接存在于所在的物理空间里,像现在这样交谈它能够观察理解提出的想法 [38] - 可以在纸上写点东西它就能接收这些内容开始在后台构建,然后说还有另一个想法它就开始构建另一件东西 [38] - 可以把结果投到屏幕上直接和它说话,它也能参与人与人之间的对话 [38] - 这样就不需要一直盯着屏幕不断琢磨该怎么写提示词,也就没有了这种疲劳感,整个过程会变得非常自然 [38] - 我们也听到Sam谈过这项技术的承诺:减少噪声让你把注意力放在自己真正想关注的地方 [41] - 希望降低这些干扰让你能够专注于真正需要关注的事情 [41] - 每次度假用一周时间彻底断开与工作的联系后就会开始用不同的更有创造力的方式思考 [41] - 非常期待看看能否把这种状态带进日常生活,也许需要参加的会议可以更少也许不需要做那么多事情 [41] - 如果休息得更好可能反而更有生产力 [41] - 整个行业都需要一起弄清楚这件事,但这才是AI所承诺的价值而不是让你每秒再多输入一条提示词 [41] - Tibo的Dot知道正在参加DevDay,当时ChatGPT生产环境出了故障它就在最后一场演示开始前五分钟提醒了Tibo [43] - 它说生产环境出故障了你想让我试着修复吗 [43] - 它能够理解这些事情之间的关系:有一场很重要的活动叫DevDay,有一个生产系统,还有一场现场演示很可能会用到这个生产系统,所以这两件事情是有关联的,演示将在五分钟后开始应该提醒他 [43] - 它可以访问部分生产系统但有相应的安全限制 [45] - 专用Dot会在额外的安全限制和监控下运行并使用各自的硬件,有些Dot就运行在Mac mini上 [45] - 构建Dots的方式有一个根本区别:智能体运行框架harness并不运行在它所操作的那台机器上 [45] - 这意味着它可以连接任意数量的设备,有自己的计算机也可以把它连接到笔记本电脑上 [45] - 以后可能会把它连接到十台不同的设备而它可以控制所有这些设备有点像一只章鱼 [45] - 它可能运行在虚拟机里也可能不是,它是一个独立的系统可以连接多台设备 [46] AI时代哪些技能正在变得更重要 - 一个重要性正在下降的技能是打字快,它已经没有那么有用了 [48] - 越来越重要的技能包括出色的品味、从用户的角度思考以及与自己服务的用户建立联系 [48] - 很多曾经创业的人或者连续创业者现在都表现得非常出色 [48] - 目前OpenAI有超过120位曾经参加过YC的创业者,这里就像一家巨型初创公司 [48] - 那种希望做出真正有意义的东西的热情和渴望以及知道什么才是好的东西比以往任何时候都更重要 [48] - 产品经理会在这个时代发展得很好,因为这基本上就是产品经理的工作:判断应该做什么帮助别人把它做出来再判断它是否正确是否足够好然后不断迭代 [49] - 岗位之间的界限也正在变得模糊,以前可能只做设计或者只做工程而且总觉得自己被这样的角色限制着有些不自在,现在正是发挥的时候 [49] - 有一段时间确实很怀念做工程的部分,但现在随着速度变得非常快又找回了这种感觉 [50] - 非常希望尽可能让更多人都能获得这样的体验 [50] - 要让它真正普及让超过十亿用户都能用上还需要一段时间,但速度已经很惊人了 [50] - 与使用Astra有关,发现可以把它的能力推得很远 [50] - 有了这样的速度尤其是能够通过语音控制之后,会重新进入一种非常有创造力的思考状态重新进入心流 [50] - 这种心流和过去不一样,但已经不再怀念过去的那种状态了 [50] OpenAI内部如何开发和发布产品 - 有很多曾经创业的人,大家会自下而上提出许多令人兴奋的想法 [52] - Decisions API就是在很短时间内做出来的,意识到Luna是一个非常好的模型可以做一些约束采样,再通过一种不同于Responses API的接口形式把它发布出去 [52] - 这样做速度更快,在一些场景下的使用体验也很好 [52] - 最初是建了一个Slack频道四个人在一个周末动手尝试,之后被开放给公司内部使用大家开始感到兴奋围绕它构建东西 [52] - 有人发现可以支持视觉输入这甚至比外面已有的东西更好,大家越来越兴奋开始加入进来 [52] - 整个过程看起来完全没有固定的组织结构,但大家会一路把它推进下去最后发布成产品 [52] - 同时也努力维持较高的质量标准,如果某些东西还不够好就会在发布之前叫停或者让它再打磨一段时间 [53] - 原本还有更多东西可能在DevDay发布,但觉得今天已经很多了先留下一些把发布节奏分散开 [53] - 接下来还会有更多发布,这里有一种非常强烈的自下而上的活力,人们会主动承担相应角色把这些力量引导到能够产生实际成果的方向上 [53] - 会获得很大的自主权但也必须为自己的决定负责,我们信任大家能够做出好的选择 [53] - 如果出了问题就迅速修复或者从错误中学习,到目前为止效果很好,这是一个能充分激发个人能力的环境 [53] - 只要有必要而且认为合适就可以按下额度重置按钮,这是一种特权也让Tibo能够以其他情况下很难做到的方式贴近社区 [53] - 不需要让这件事经过层层审批 [53] - 有些时候本可以更好地激励团队去构建复杂度更低的东西持续朝着更简单的方向努力 [54] - Codex早期也有几次由Tibo造成的服务故障 [54] - 刚加入OpenAI的第三天就把生产环境弄宕机了,不过出了这件事之后还留在公司也从中吸取了教训 [54] - 额度重置取决于把东西弄坏多少次 [55] - 出了问题会重置,有值得庆祝的事情也会重置 [56] 未来发展方向与行业影响 - 还有很多事情没有被充分考虑进去 [56] - 第一互联网上的大多数操作将由智能体完成 [56] - 第二模型会以相当惊人的速度变得更便宜更快 [56] - 第三终于能够以真正无缝的方式把所有模态整合起来 [56] - 这三点让Tibo经常在看到外界正在开发的东西时觉得你们还没有真正理解这件事 [56] - 如果认真设想一年后这些能力大致会比今天强十倍,就会用不同的方式来构建产品 [56] - 在大多数操作都由智能体完成的世界里大多数流量都会来自智能体 [57] - 如果希望自己的产品在智能体用户中取得成功就必须按照相应的规模来构建它 [59] - 和Notion有非常紧密的合作,当他们构建了MCP接口后突然之间所有这些能够真正执行工作的智能体都可以访问并使用它 [59] - 他们看到了大量涌入的流量,这显然会给系统带来很大压力而且必须弄清楚背后的成本和收益关系 [59] - 开发产品时究竟要不要提供这样的接口可以暂时推迟但这个趋势不可避免 [59] - 大多数产品和服务都会由智能体来使用,所以为这样的未来做好准备非常重要 [59] - 对面向人的全新体验投入还不够,这些体验应该充分利用所有模态真正让人用起来感到愉快 [59] - 模型的能力已经接近那个水平了但还差一点:让应用本身几乎完全退到幕后 [60] - 迫不及待地想真正实现极致的简单 [60] - 就连Tibo自己也会被模型选择器、推理强度以及到底该用多智能体模式还是Ultra模式这些选项弄得疲惫 [60] - 甚至连这些选项究竟做什么都需要弄清楚 [60] - 简直需要拿一个模型选择器博士学位,只想尽快摆脱所有这些东西 [61]
OpenAI will start watermarking ChatGPT's text in the EU
TechCrunch· 2026-10-06 04:36
核心观点 - OpenAI将在欧盟为ChatGPT和Codex生成的文本添加不可见水印以遵守欧盟人工智能法案 [1] - 欧盟人工智能法案的透明度规则于8月2日生效,要求人工智能公司以其他系统可识别的方式标记人工智能生成内容 [1] - 水印并非实际符号,而是通过微妙调整模型用词选择留下人类读者不可见但检测器可识别的模式 [3] - 水印存在于文字本身,因此当文本被复制粘贴时会随之传播 [3] - OpenAI表示水印不会识别用户身份,且开启后模型性能未见有意义的变化 [3] 水印部署范围与时间 - 水印将在未来几周内向欧盟所有套餐的合格ChatGPT和Codex用户推出,但仅限于欧盟地区 [2] - 全球任何地方使用OpenAI API的开发者可从今日起为选定模型开启水印功能,该功能默认关闭 [2] - OpenAI表示在发布时不会将文本水印设为全球默认 [2] 技术方法 - OpenAI同时发布了名为textGrain的方法技术报告 [4] - 该报告与宾夕法尼亚大学和耶鲁大学的研究人员合著 [4] - 报告展示了使用密钥对下一个词预测进行排序以完成句子的示例 [4] - 将数百个此类微调叠加后,检测器仅使用文本和密钥即可识别人工智能生成内容 [4] 水印局限性 - OpenAI测试表明水印可通过编辑去除 [5] - 在一项测试中,将10%的词语替换为同义词后,检测率从约92%降至66% [5] - 短段落、数学答案和翻译文本更难被检测 [5] - 公司表示这些局限性促使其决定仅向经批准的研究人员和专家组织提供初始检测器访问权限 [7] - OpenAI警告水印缺失不能证明人类作者身份,文本可能过短、被大量编辑或来自其他公司的人工智能 [8] - 水印可表明OpenAI系统生成或处理了段落的一部分,但无法说明其中包含多少人类判断、编辑或创造力 [8] 行业竞争动态 - 该公告发布两个月前,Anthropic表示将为Claude生成的文本添加水印,并在全球范围内应用 [9] - 该决定引发部分Claude用户反对,认为他们提供了指令、上下文和决策,而Claude只是工具 [9] - 据华尔街日报2024年报道,OpenAI此前已构建文本水印但推迟发布,部分原因是担心用户会转向不加水印的竞争对手 [9] - Anthropic、谷歌、Meta、微软和OpenAI等公司已承诺遵守欧盟人工智能生成内容实践准则 [10]