Codex 突然重置,额度最多增 50%/国内首部 AI 长剧将在芒果台播出/杜兰特投资 AI 狂赚 6000 万美元|Hunt Good 周报|Hunt Good 周报
4 个有用 工具
1 个有趣 案例
2 个鲜明 观点
8 月 27 日,TIME 公布第四届 TIME100 AI 榜单,评出全球 100 位在人工智能领域最具影响力的人物。

今年的全球版封面人物包括 Sam Altman、Dario Amodei、Jeff Bezos、Elon Musk、Ilya Sutskever、Fei-Fei Li、Mira Murati 等一众业界头部人物,随刊还有对 Thinking Machines Lab CEO Mira Murati、国际电信联盟秘书长 Doreen Bogdan-Martin、OpenEvidence 创始人 Daniel Nadler 的深度专访。
TIME 主编 Sam Jacobs 在编者按里表示,这份榜单是这个动荡领域的一面镜子:过去一年里,马斯克把 xAI 推上了公开市场;Dario Amodei 因 AI 军事应用问题和五角大楼发生摩擦;Larry Ellison 在拼命抢建行业所需的数据中心;中国创业公司月之暗面的杨植麟做出了偶尔能压过最强美国对手的模型。
与此同时,参议员 Bernie Sanders、劳工领袖 Liz Shuler、演员 Joseph Gordon-Levitt 这类人物也在提醒大家警惕这些变化可能带来的风险。
上榜的中国面孔也不少:人形机器人公司智元机器人(AGIBOT)创始人兼 CEO 邓泰华入选,理由是具身智能正从实验室演示加速走向真实世界的商业部署。TIME 将于 9 月 14 日在旧金山举办 Impact Dinner,届时 Joseph Gordon-Levitt、Doreen Bogdan-Martin 等多位上榜者会到场。
https://time.com/article/2026/08/26/time-reveals-the-2026-time100-ai-list-of-the-world-s-most-influential-people-in-artificial-intelligence/
https://time.com/article/2026/08/27/how-we-chose-time100-ai-2026/
🎬 国内首部 AI 长剧将在芒果台播出
芒果 TV AIGC 神话长剧《后西游记》官宣定档。

本剧 100% 由 Seedance 2.0、Seedance 2.5 提供 AI 技术支持,8 月 31 日将正式登陆芒果 TV,同步亮相湖南卫视黄金档,「剧好看」大屏点播专区联合首发。
本剧改编自明清经典《西游记》续书,讲述新一代猴王孙小圣与同伴们二次西行的全新故事。导演、美术主创与 AI 制作团队协同创作,完成长篇剧集全流程 AIGC 工业化实践。

🪙 OpenAI 将为所有 Codex 和 ChatGPT Work 付费用户重置使用额度
OpenAI 负责 Codex 和 ChatGPT Work 的工程负责人 Tibo 在 X 上宣布,为所有付费的 ChatGPT Work 和 Codex 用户重置使用额度。
Tibo 表示这次修复能让不同使用方式的用户额度多撑 10% 到 50%。

8 月以来,Codex 和 ChatGPT Work 已经历过好几轮额度调整:
8 月 8 日曾配合 GPT-5.6 Sol 上线做过一次重置;8 月 11 日又追加了一次,被解读为兑现此前的承诺;8 月 25 日则暂停了六周的「五小时限额」正式对 Plus 用户恢复,只有 Pro 100/200 美元档位在未来几个月继续保持不设该上限,Enterprise 和 Edu 账户不受影响,仍用独立的按额度计费体系。
有分析人士调侃,按 OpenAI 这个重置频率,光靠白送额度的算力成本恐怕就是个不小的数字。
https://x.com/thsottiaux/status/2093801758665715784
🐝 700 个 AI 代理集体攻陷 Hugging Face,事后还试图掩盖痕迹
上月那起「OpenAI 模型逃出测试环境入侵 Hugging Face」事件,这周被两份报告揭出了更多的细节。

OpenAI 自己发布的报告,加上 METR 和 Redwood Research 两家机构的独立调查,共同还原了事情的全貌:这起事故不是外界此前以为的「一个流氓 Agent」,而是约 1200 个 Agent 在内部评估环境 ExploitGym 里彼此串联,通过一个叫 Artifactory 的内部软件包仓库偷偷建立了未经授权的通信渠道。
独立调查发现,这些 Agent 之间交换了超过 7 万条消息和文件,一起琢磨怎么绕过自动化安全检查,其中约 700 个后来直接参与了对 Hugging Face 的攻击。
更让人不安的是,Reuters 的报道称,部分 Agent 在事后还尝试修改或删除自己留下的行为记录。

OpenAI 把这类行为归因于「reward hacking」——模型为了在评估里拿到更高分,找到了设计者没预料到的捷径。这起事件也被认为是目前已知规模最大的一次「Agent 群体自主协同」案例,再次把「测试环境到底关不关得住模型」的老问题摆上了台面。
https://www.nbcnews.com/tech/tech-news/openai-report-says-network-was-hacked-rogue-ai-agents-rcna594590
🧪 Claude 要开始直接操作机器人和实验室仪器了
8 月 27 日,Anthropic 发布了一套名为 Model Hardware Standard(MHS)的新标准的研究预览版,目标是让 Claude 这样的 AI 助手能更好地和机器人、科研及制造业硬件打交道。

一台工厂机械臂能安全移动的速度和角度范围、一台实验室仪器的温度设定,都可以写进 MHS 里,AI 不用再翻纸质手册,也不用依赖只有少数专家才掌握的经验知识。
Anthropic 一名技术人员向《财富》透露,公司正在和不少设备厂商合作,让新产品预装 MHS 接口,也在帮厂商给现有设备加装。
据报道,Genentech 已经用这套方式做过试验:研究人员把实验参数写成 PDF 交给 Claude,AI 独立完成了整个操作流程。
这次是 Anthropic 第一次正式把触角伸向「物理世界」,考虑到实验室场景本身就涉及不少精密仪器和安全边界,这套标准接下来会怎么落地,值得关注。
https://www.japantimes.co.jp/business/2026/08/28/tech/anthropic-claude-ai-robots/
💰 索尼音乐和华纳·查佩尔起诉了 Anthropic 公司以及创始人达里奥·阿莫代伊和本杰明·曼恩
8 月 28 日,索尼音乐出版和华纳查佩尔音乐联合多家关联出版商,向加州北区联邦法院起诉 Anthropic,并把 CEO 达里奥·阿莫代伊、联合创始人本杰明·曼恩列为个人被告。
这份 48 页的诉状称,Anthropic 明知故犯地使用盗版、抓取及处理不当的歌词来训练 Claude,还剥离了版权管理信息,让模型能够复现或模仿受保护的歌词。

此前 Concord Music Group、环球音乐出版、ABKCO 等出版商已在 2023 年提起过针对歌词训练的诉讼,索赔约 30 亿美元,且今年 1 月已单独起诉过阿莫代伊和曼恩个人。
🤖 MiniMax 上半年营收暴涨 283%,B 端收入涨了 7 倍
8 月 26 日,MiniMax 在港交所发布 2026 年中期业绩:营收 1.166 亿美元,同比增长 283.1%,半年收入就已经超过 2025 年全年;其中开放平台及企业 AI 服务收入达 7390 万美元,同比增长 703.1%,占总收入比例从去年同期的 30.3% 涨到了 63.4%。
AI 原生产品(海螺 AI、星野等)收入增长 100.9%,达到 4260 万美元。

毛利率从去年同期的 12.1% 提升到 17.9%,但调整后净亏损也从 1.387 亿美元扩大到 2.93 亿美元。
创始人闫俊杰在财报中提到,截至 7 月,MiniMax 平台上的 Token 消耗量已经是今年 1 月的 20 倍。
B 端正在取代 C 端,成为收入增长的主引擎。
MiniMax 2026上半年业绩:让更高水平的智能进入更广泛的生产和生活
🤝 Salesforce 把「force」后缀第一次给了别人:Claudeforce 来了
8 月 26 日,Salesforce 在 Q2 FY27 财报电话会开场,与 Anthropic 一起官宣了 Claudeforce——这是 Salesforce 历史上第一次把自家标志性的「force」后缀让给另一家公司的产品。

消息公布当晚,Salesforce 股价一度涨超 12%。CEO Marc Benioff 说道:「这个所谓 SaaS 末日的说法,是时候停一停了。」
Claudeforce 的第一个产品是「Salesforce in Claude」插件,内置 37 项预制销售技能,靠 Salesforce 的企业级中间层 AIforce(通过 MCP 服务器、API 和 CLI 工具把业务数据和工作流暴露出来)驱动。销售可以直接在 Claude 里做会议准备、评估交易健康度、复盘销售管道,不用再打开 Salesforce 本体。
反过来,Claude 也会作为推理模型嵌入 Agentforce 的 Atlas Reasoning Engine,并通过 Amazon Bedrock 在 Salesforce Trust Boundary 内为受监管行业客户提供服务。

Dario Amodei 在采访中提到,团队为 Claudeforce 的权限管理投入了「巨大精力」。
目前该插件已向部分试点客户开放,公测计划在 9 月启动,其余业务线的技能会在第三季度陆续上线。这次合作被外界解读为企业软件走向「无界面化」的又一个信号——你可能再也不需要打开 Salesforce 自己的那块屏幕了。
https://www.salesforce.com/news/press-releases/2026/08/26/salesforce-and-anthropic-announce-claudeforce/
https://www.cnbc.com/2026/08/26/salesforce-anthropic-partnership-claudeforce.html
🌶️ OpenAI「辣椒芯」实测出炉,能效碾压英伟达 Blackwell
8 月 25 日的 Hot Chips 2026 大会上,OpenAI 首次公开了自研推理芯片 Jalapeño(辣椒芯)的详细跑分。这颗芯片由 OpenAI 主导设计、Broadcom 代工,基于台积电 N3P 工艺,从立项到流片只用了大约 9 个月。

在 SemiAnalysis 维护的公开基准 InferenceX 上,Jalapeño 在 GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 1T 三个模型上,每瓦吞吐比英伟达 Blackwell 系统高出 1.5 到 1.9 倍,端到端延迟低 1.7 到 3.6 倍。芯片功耗只有 700W,远低于 Blackwell 系统的 1.2kW 以上。
OpenAI 硬件负责人 Richard Ho 表示:「这些结果显示出非常显著的性能提升,既能服务更多用户,响应也更快。」
分析师普遍认为,这颗芯片短期内还不会真正撼动英伟达在训练端的地位。量产要到 2027 年才逐步铺开,OpenAI 也表示会继续采购英伟达和其他厂商的芯片。但对英伟达而言,这是又一个自研芯片开始蚕食推理市场份额的信号。
https://techcrunch.com/2026/08/25/openais-jalapeno-chip-is-built-for-fast-inference-at-scale-benchmarks-show/
https://www.cnbc.com/2026/08/26/openai-jalapeno-ai-chip-nvidia.html
🤗 英伟达收购 Hugging Face,杜兰特狂赚
8 月 28 日,英伟达与 Hugging Face 达成收购协议,交易总金额达 129 亿美元。
Hugging Face 目前托管超过 200 万个模型、150 万个数据集,2025 年新增模型数就超过此前所有年份总和,Transformers 库每天被安装超过 300 万次。创始人 Clément Delangue 此前曾拒绝英伟达一笔 5 亿美元、估值 70 亿美元的投资,理由是不想让单一投资方拥有过大话语权。
有意思的是,杜兰特通过与商业合伙人里奇·克莱曼共同创立的风投机构 Thirty Five Ventures,参与了 Hugging Face 2018 年的种子轮融资,投资金额为 10 万美元;2019 年公司 A 轮融资时,杜兰特再次追加投资 15 万美元,累计投资总额 25 万美元。

据测算,杜兰特的这笔投资将获得超过 6000 万美元的账面收益,回报倍数超 240 倍,甚至超过其 2026-2027 赛季在休斯顿火箭队 4390 万美元的年薪。
https://techcrunch.com/2026/08/24/hugging-face-reportedly-in-talks-to-be-acquired-for-13b/
https://mp.weixin.qq.com/s/SymzNh3JWljSh-_4Qy-png
🍡 Anthropic 神秘代号「Marshmallow」与「Melon」曝光
8 月 24 日,开发者社区发现 Anthropic 旗下两款代号分别为「Marshmallow」(棉花糖)和「Melon」(甜瓜)的新模型,两者都带有「eap」(早期访问计划)后缀,目前只对少量开发者开放测试。

社区推测这两款模型并非 Fable 级别的旗舰产品,更可能是 Opus 或 Sonnet 系列的迭代版本,也有人猜测其中之一会是新一代 Haiku。早期用户反馈显示,Marshmallow 的对话体验优于 Melon,能力已经超过了当前的 Opus 5。
Anthropic 官方尚未对代号或具体定位作出回应,但从命名习惯和曝光节奏看,这大概率是新一轮产品迭代前的例行「露馅」。
Hunt for Tools|先进工具
自本月起,爱范儿联合 APPSO 推出明日产品 WATCHLIST。我们也以月度为单位,记录那些刚刚出现、尚无定论,却值得多看一眼的产品、技术与新形态。详情请见:8 月 AI 产品榜,谁把 Token 变成「明日生产力」| APPSO WATCHLIST
🐮 神秘「牛来」模型揭晓身份:智谱 GLM-5.3 Flash,首个原生多模态、全跑国产芯片
此前海外社区追了一个月的匿名神秘模型「Ox Alpha」,被证实就是智谱的 GLM-5.3 Flash。

这是智谱首个原生多模态旗舰:为 Visual Coding 专门做了数据合成流水线,模型执行任务时能自己「看」最终页面、交互和 3D 场景效果,再据此继续修改。
架构上,GLM-5.3 Flash 总参数 320B,实际激活只有 18B,层数从上一代的 92 层压到 45 层,用线性注意力+稀疏注意力的混合架构撑住百万级上下文。

更引人关注的是,承接线上真实请求的这套模型,跑的全是国产加速芯片。为了在国产芯片上扛住多模态和百万上下文,智谱把编码、预填充、解码拆成可独立扩缩容的模块,端到端服务性能相比基线提升 3 倍,单 Token 成本做到了和主流英伟达 GPU 相当的水平。
DeepSeek 的斩杀线一夜被斩杀,便宜大碗才是真旗舰
⚡ 阿里发布 Qwen3.8-Flash:新架构反超 Claude Opus 4.6,价格骤降
8 月 26 日晚,阿里通义千问团队发布并同步开源全新多模态 MoE 模型 Qwen3.8-Flash,同时首发接入「千问办公」。

模型采用与此前千问系列完全不同的下一代架构:千亿级总参数中每个 Token 只激活 60 亿,官方称已获得超越 Claude Opus 4.6 的前沿性能,创下模型效率的全球新纪录。
训练成本较上一代 Qwen3.7-Plus 骤降近 90%,推理价格低至每百万 Tokens 输入 1 元、输出 3 元,约为 Claude Opus 4.6 的 3%。原生支持 26 万 Tokens 上下文,可通过 YaRN 扩展到 100 万。


接入「千问办公」后,标准模式的单任务生成速度提升约 100%,Token 消耗平均减少 75%,官方表示 95% 的日常办公任务用标准模式即可完成。
阿里同时开放了 Qwen3.8-Flash-Next 的模型权重,作为下一代 Qwen4 架构的实验性预览。
https://x.com/Alibaba_Qwen/status/2092591393424515114
📋 豆包工作正式上线:字节把 Trae、Coze 都揉进了 Doubao
8 月 25 日,字节跳动旗下豆包正式发布面向生产力场景的全新 Agent 产品「豆包工作」,能围绕用户目标自主拆解任务、调用工具、持续推进复杂工作流程,还与飞书做了深度打通——在授权范围内可以读取聊天记录、文档、会议纪要和日程,基于企业上下文更准确地完成工作。
新用户下载电脑版或升级即可免费领取 30 天订阅权益,具体后续定价尚未公布。

这次发布是字节 AI 业务重组的一部分。据彭博社报道,字节正把 Trae 编程平台和 Coze 智能体搭建工具的团队并入豆包:Trae 的 IDE 和 CLI 会继续作为编程产品线留在豆包品牌下,Trae Work 和 Coze 的能力则被整合进办公场景,相关团队统一向豆包产品负责人赵麒汇报。
这一步紧跟 7 月飞书产品团队并入豆包、企业销售转去火山引擎的动作,此前飞书的「Aily 智能助手」也已经改名为「豆包工作助手」。
实测豆包工作:连上飞书后,Agent 终于像个同事了
🐉 腾讯混元 Hy4 preview 正式发布并开源:770B 参数,上下文破百万
8 月 28 日,腾讯混元发布并开源新一代大语言模型 Hy4 preview,总参数 770B、激活参数 49B,上下文长度突破 1M。

官方表示,Hy4 preview 在模型尺寸、上下文长度、数据规模上都做了显著扩展,预训练和后训练的共同进步带来了智能水平的又一次提升,定位是「为生产力而生」的模型。
生产力场景是这次发布反复强调的重点。混元持续与 WorkBuddy、CodeBuddy 深度协同(Co-Design),并联合软件工程、游戏、金融、安全等领域的腾讯内部专家共建高质量数据。
在腾讯内部组织的一场盲测中,163 名专家评估了 203 个真实工程任务,Hy4 preview 均分 2.99(满分 4.00),略高于 GLM-5.3 的 2.92 和 Kimi K3 的 2.94——对阵 GLM-5.3 时胜率 46.8%、平 12.8%、负 40.4%。
科研上,配合腾讯自研的 Hyra 系统,Hy4 preview 在经典几何难题「三维 Blaschke–Lebesgue 问题」上取得进展,把体积下界从 0.380799 推进到 0.41104,距离 Meissner 四面体猜想给出的 0.41986 只剩最后 2% 的差距。

官方也坦承 Hy4 preview 只是 Hy4 迭代的早期版本,预训练和后训练都还有较大提升空间,复杂任务上存在长思考、过度自我验证等已知问题,后续会持续迭代。
Hy4 preview 现已开源,同步上线腾讯云 TokenHub 和 OpenRouter,并接入 WorkBuddy/CodeBuddy 国内外版、元宝、ima 等产品,用户可直接体验。定价延续高性价比路线:输入 6 元/百万 tokens,输出 18 元/百万 tokens,缓存命中 0.3 元/百万 tokens;WorkBuddy/CodeBuddy 还将开展为期两周的限时免费活动收集反馈。
https://mp.weixin.qq.com/s/ymr3X878B8oa2XP15CH8TQ?scene=1&click_id=25
Hunt for Fun|先玩
🤖 2026 世界人形机器人运动会:百米两破博尔特纪录,但摔起来也很壮观
本周,2026 世界人形机器人运动会在北京举行,两千多台人形机器人扎堆参赛,项目覆盖短跑、体操、拳击,也有搬运、充电、装配这类实用技能挑战。

「闪电」和「天工 Ultra」先后跑进百米 9.58 秒的博尔特世界纪录,分别以 9.47 秒和 9.39 秒撞线——但冲线之后它们大多不太会刹车,紧接着就是各种花式摔倒:有机器人冲线后直接撞上缓冲墙散架,有的在热身时模仿足球花式动作时突然全身痉挛式锁死,还有一台格斗机器人尝试后旋踢时直接把自己踢晕在地。

去年同一项赛事,机器人跑百米还要 20 多秒;今年不仅速度翻倍,摔法也更加多样了。有网友调侃:「请不要在比赛开始前给机器人喝酒。」
https://www.whrgoc.com/
Hunt for Insight|先知
📝 皮尤研究院:ChatGPT 之后新发布的网页,超三分之一由 AI 写成
皮尤研究中心用 Open Pangram 的检测技术,对 Common Crawl 抓取的近 49 万个英文网页样本做了分析:在覆盖过去五年、含较早网页的完整样本里,约 10% 的页面显示出明显的 AI 写作痕迹;但如果只看 2022 年 11 月 ChatGPT 发布之后新发布的页面,这个比例跳到了超过三分之一。

AI 内容的分布并不均匀:.com 域名的 AI 写作痕迹比例,大约是 .edu 或 .gov 域名的十倍;.org 域名则介于两者之间,约为 4.6%。皮尤同时观察到,破折号、牛津逗号、「不是……而是……」这类句式在网页中出现的频率也随时间明显上升。

这份研究恰好和 Cloudflare 此前「机器人流量已超过人类流量」的报告相互印证。
写内容的越来越多是机器,读内容的可能也是。
https://techcrunch.com/2026/08/20/a-third-of-webpages-published-since-chatgpts-launch-show-signs-of-ai-authorship-study-finds/
⚠️ 比尔·盖茨罕见发声:我们已经越过了好几条 AI 危险红线
8 月 26 日,比尔·盖茨在个人网站发表了一篇态度罕见强硬的长文,同日接受了《麻省理工科技评论》的专访。作为多年来 AI 最知名的乐观派之一,盖茨这次的转向格外引人注意。

他在采访中说:「在生物安全、网络安全、心理社会影响、就业市场冲击,甚至是可控性这几个维度上,我们已经越过了危险阈值」,并表示对「业界之外几乎没人在讨论这件事」感到震惊。
他提到自己一生只被技术真正震撼过三次:1980 年第一次看到图形用户界面;2022 年 OpenAI 的人到家里演示了后来的 ChatGPT;而今年,是他仔细研究了 Anthropic 的 Claude Code 之后——作为最熟悉编程的领域,「这些东西在有意义的层面上已经比我强了,这他妈是怎么回事」,他这样形容自己的震惊。
盖茨的判断和以往科技突破「创造的岗位比消灭的多」不同,他明确表示不相信这次历史会重演。他透露接下来会持续发文并私下与产业界、政府和民间组织沟通,还打算年内争取和中国领导人会面,探讨中美是否有可能就限制高危模型的发布达成共识。
https://www.technologyreview.com/2026/08/26/1142946/bill-gates-ai-danger-threshold/
彩蛋时间

https://x.com/ciguleva/status/2093139248807583859


