一周AI丨ChatGPT、Claude、Grok集体宕机近4小时;美四大AI巨头同周更新;豆包手机9月上市;李飞飞发布全球首个多模态世界模型……
发布时间:2026-09-06来源:世界人工智能大会
ChatGPT、Claude、Grok“集体宕机”近4小时
国内首部AIGC长剧《后西游记》开播
OpenAI最强模型GPT-6 Astra发布,公司总裁称AGI时代到来
Anthropic发布Claude Fable 5.1,编码成本降低45%
谷歌Gemini 3.8 Flash模型上线,适用软件工程、智能体任务等场景
Meta发布Muse Spark 1.3模型,编码与代理能力大幅跃升
“豆包手机”获入网许可,9月上市销售
李飞飞World Labs发布全球首个多模态世界模型AI数据中心新贵Crusoe融资30亿美元:估值300亿,刚签下130亿美元大单
AI独角兽Wonderful斩获5.5亿美元C轮融资,估值直冲50亿美元
ChatGPT、Claude、Grok“集体宕机”近4小时
9月3日,美国所有头部AI服务集体出现故障,ChatGPT、Claude、Grok宣布服务出现异常,谷歌Gemini、微软Copilot也收到大量中断报告。此次大规模“宕机”事件持续约3小时40分。
故障最早于美东时间9月3日上午9点23分左右集中爆发。据海外故障监测平台Down Detector数据显示,Anthropic的Claude系列模型率先出现错误率飙升,涵盖Mythos 5.1、Opus、Fable5.1等核心模型,网页端、API接口及ClaudeCode等关联工具同步中断。
仅两分钟后,xAI的Grok服务全端下线,网页、移动应用、API接口均出现访问超时;约一个半小时后,OpenAI的ChatGPT与编程工具Codex也出现大规模访问错误。
事件峰值期间,全球针对OpenAI服务的故障报告超过3.7万份,其中80%集中于ChatGPT。谷歌Gemini、微软Copilot同期也收到大量用户中断反馈,AI编程工具Cursor则直接公告,其部分服务因上游大模型故障而被迫中断。
OpenAI发言人表示,故障源于太平洋时间早7点43分出现的路由错误,导致部分用户无法访问ChatGPT和Codex,公司已部署修复方案并持续监控恢复情况。
Anthropic技术部门员工则在社交媒体上表示,事件由“基础设施问题”引发,公司正在全力排查但暂无法给出预计恢复时间。截至美东时间当日中午11点16分,Claude主要服务率先恢复;随后ChatGPT、Grok也逐步恢复正常运行。
值得关注的是,宕机事件发生时,OpenAI刚计划发布GPT-6系列模型,OpenAI此前发布预热视频称:“The stars are almost aligned”。(星星都被点亮了),此事也在社交媒体被调侃“建议先把机房修好。”
海外三大AI模型“集体宕机”近4小时
8月31日,国内首部上星AIGC长剧《后西游记》正式定档,当天18点上线芒果TV,20点登陆湖南卫视黄金档。在定档消息及AI影视概念的共同催化下,芒果超媒在两个交易日累计上涨44.03%。中广天择、欢瑞世纪、中文在线等影视、短剧概念股也随之走强。
当然,资本市场的情绪不等于内容市场的成功。但至少从首播数据来看,《后西游记》也没有遭遇想象中的“AI劝退”。官方数据显示,《后西游记》首播期间实时收视率一度位居省级卫视同时段第一。
作为“广电21条”出台后首部采用创新审核机制落地的剧集,《后西游记》采取的是“边制作、边审核、边播出”模式。据悉,率先上线的是第一季30集中的“花果山篇”(前5集),剩余剧集将随播出进度陆续制作、陆续送审、陆续上线。
也就是说,AI带来的变化已经不只是“少搭几个景、少请几个演员”,而开始触及长剧最核心的生产周期、审核节奏和排播方式,也开始接受收视、用户反馈和商业市场的真实检验。
而几乎在同一时间,内容端也出现了一些信号:出现了一批兼具深度和热度的AI内容。
过去两年,AI影视的卖点一直是“它是AI做的”——能凭空生出战场、末日、外星文明,观众为奇观买单。可当奇观变得跟自来水一样便宜,“像不像真人”就从一个技术奇迹,退化成了一个及格线。
AI影视竞争的主战场,悄悄从工具转移到了内容本身。
与此同时,长视频平台也开始将AI进一步纳入内容生产和商业生态。传统影视公司也开始把AI嵌入既有生产流程。
从上游模型,到中间的创作工作台,再到下游的视频平台和影视公司,AI正在逐步嵌入影视生产链条。
当“生成视频”越来越容易,行业真正要面对的,已经不是“能不能做出来”,而是能不能把一个想法拍成作品,经得住观众、平台和市场的检验,最后真正赚到钱。
OpenAI最强模型GPT-6 Astra发布,公司总裁称AGI时代到来
9月4日,OpenAI正式发布新一代旗舰大模型GPT-6 Astra,公司在开发者社区公告中将其定义为“目前全球最智能、且对齐程度最高的模型”。这是继GPT-5系列之后OpenAI最具分量的一次旗舰更新,也是OpenAI首次将“Astra”作为旗舰模型的后缀命名。OpenAI 联合创始人兼总裁格雷格・布罗克曼在发布电话会议上直言“欢迎来到AGI时代”。按照官方披露的滚动计划,Astra即日起先向“可信访问”(Trusted Access)和Daybreak网络安全项目中的有限企业组织开放,未来几天内陆续覆盖ChatGPT Plus、Pro、Business、Enterprise订阅用户,并通过OpenAI API和亚马逊AWS对外提供服务。
与OpenAI上一代GPT-5.6Sol相比,Astra在数学推理、网络安全、计算机操作和科学研究等领域实现了代际式跃升。根据OpenAI官网发布的技术文档,GPT-6 Astra整合了数年来在预训练、强化学习和对齐领域的研究积累,核心突破集中在智能体执行能力和深度推理两个维度。
OpenAI官方表示,Astra已经帮助解决了数学领域长期存在的开放性问题,包括在素数间隔研究中取得了两个新的理论结果。尤其是ARC-AGI-3测试,这套测试是衡量模型在陌生环境中的抽象推理和学习能力,被视为接近通用智能的核心指标,Astra在此项测试中拿到99.9%的接近满分成绩,而GPT-5.6Sol仅为7.8%,短短一代模型实现了十余倍的提升。
计算机操作与任务自动化能力的提升,则让Astra真正具备了“替代人完成工作”的潜力。在OSWorld2.0测试中,Astra得分72.6%,高于GPT-5.6Sol的65.7%;完成单项任务的平均时间从约75分钟大幅缩短至40分钟,效率提升近47%。此前模型虽然也能完成不少电脑任务,但速度慢到用户宁可自己动手,40分钟的完成时间意味着AI操作电脑开始具备实际的生产效率。
定价方面,GPT-6Astra的API调用价格每百万输入Token为10美元、每百万输出Token为50美元,是GPT-5.6Sol当前价格的2.5倍,与Claude Fable5.1的定价基本持平。缓存读取享受90%折扣,缓存写入加收25%溢价。模型支持五级推理强度调节,从low到max,用户可以根据任务难度灵活权衡成本与深度。上下文窗口方面,Astra总上下文长度为105万Token,最大输出长度为12.8万Token,知识截止时间为2026年4月30日,略晚于Claude Fable5.1的2026年6月。支持的功能包括流式输出、结构化输出、函数调用、文件搜索、网页浏览和提示缓存等。
GPT-6 Astra全面解析 - “欢迎来到AGI时代。”
Anthropic发布Claude Fable 5.1,编码成本降低45%
当地时间9月1日,Anthropic宣布对Claude系列模型进行升级,正式推出全新的Claude Fable 5.1,并同步面向特定用户发布Claude Mythos 5.1。此次更新距离Claude Fable 5发布约三个月,官方表示,新版本重点围绕编程能力、知识处理、复杂问题求解以及成本控制等方面进行了优化,希望进一步提升模型的综合表现。按照Anthropic目前的产品体系,Fable定位为Claude家族中能力最强的模型,高于Haiku、Sonnet和Opus等系列,因此承担着处理复杂任务和高难度推理工作的角色。官方表示,Claude Fable 5.1在代码开发、知识型工作以及长时间、多步骤问题求解等场景中树立了新的性能标准,整体表现相比Claude Fable 5进一步提升。
除了性能升级外,Anthropic此次还重点强调了模型在解决复杂软件问题方面的能力。官方表示,Claude Fable 5.1更加注重从根本原因分析问题,而不是采用影响结果质量的“捷径”完成任务。Anthropic举例称,在投资公司Millennium的测试中,Claude Fable 5.1成功找到了其内部系统一个长期存在的罕见崩溃问题根源,而这一问题此前经过多年排查,包括工程师团队以及其他AI模型都未能给出明确解释。
与Claude Fable 5.1一同发布的还有Claude Mythos 5.1。Anthropic表示,两款模型本质上采用的是同一模型架构,但安全防护级别有所不同。其中,Claude Fable 5.1将面向所有用户开放,而Claude Mythos 5.1仅向获得Mythos访问权限的用户提供,其安全机制主要针对网络安全和生命科学等专业领域进行了专门设计,以满足相关行业的使用需求。
在使用成本方面,Anthropic也对Claude Fable 5.1进行了优化。官方预计,在按Token计费的典型工作负载下,Claude Fable 5.1的整体使用成本较Claude Fable 5预计降低约25%。对于更加依赖智能代理能力的复杂任务,成本降幅最高可达到约45%。
Anthropic介绍,此次成本下降主要来自缓存读取费用的调整。所谓缓存读取,是指模型在执行任务时重新利用已经处理过的上下文内容。官方降低了这部分按Token计费场景下的缓存读取价格,从而有效减少模型运行成本,而除缓存读取费用外,其余计费标准与Claude Fable 5保持一致。
实测完 Fable 5.1,我再也不想被 A 社割了
谷歌Gemini 3.8 Flash模型上线,适用软件工程、智能体任务等场景
当地时间9月2日,谷歌近日正式发布Gemini 3.8 Flash,这是该公司在短短六周内推出的第三款Flash系列模型。与此前版本不同,此次发布包含两个变体:面向通用场景的Gemini 3.8 Flash和专攻网络安全的Gemini 3.8 Flash Cyber,分别定位为谷歌“最智能的主力工作模型”和“最强网络安全模型”。
从性能表现来看,Gemini 3.8 Flash在多个基准测试中展现出超越更大规模模型的能力。在衡量自主解决复杂工程问题能力的DeepSWE v1.1测试中,该模型得分73.7%,略低于Claude Opus 5的74%,但明显优于Gemini 3.7 Flash、Claude Sonnet 5、GPT-5.6 Sol和GPT-5.6 Terra等竞品。此外,在Vals Finance Agent v2金融分析、Harvey法律智能体基准、CharXiv Reasoning信息综合、Terminal-bench 2.1终端编码以及LVBench长视频理解等多项测试中,Gemini 3.8 Flash同样领先于上述对手。谷歌解释称,3.8 Flash之所以表现更优,是因为该模型“工作更努力”。面对复杂任务时,它会主动执行额外的推理步骤以提升输出质量,当然这也意味着在某些情况下会消耗更多token。定价方面,Gemini 3.8 Flash目前处于首发优惠期,输入token价格为每百万0.75美元,输出token为每百万3.75美元,后续将上调至1.50美元和7.50美元。即便如此,其价格仍低于Claude Opus 5和GPT-5.6 Sol等同类产品。Gemini 3.8 Flash Cyber则是一款更为特殊的模型,目前仅通过谷歌新设立的Fairwind计划向特定用户开放,包括可信政府机构、关键基础设施运营商以及软件维护人员。在C/C++漏洞检测的行业标准测试中,该模型得分86.2%,超过前代Gemini 3.5 Flash Cyber以及Mythos 5、GPT-5.5-Cyber等更大规模的模型。在覆盖20多种编程语言的真实漏洞发现场景中,其成功率达到71%,大幅高于Gemini 3.7 Flash的58.9%和Gemini 3.5 Flash Cyber的46.6%。该网络安全模型的另一大亮点在于自动化补丁生成能力。据谷歌公布的数据,Gemini 3.8 Flash Cyber为Chrome浏览器漏洞生成的正确补丁数量,是"规模大得多的最佳商用模型"的2.6倍。对于普通用户而言,虽然不会直接与这一模型交互,但其在防御端和开发端的改进将间接提升日常使用的技术产品的安全性。目前,Gemini 3.8 Flash已向开发者、企业客户以及Google AI Pro和Ultra订阅用户开放。Gemini 3.8 Flash Cyber的访问权限则仅限于Fairwind计划成员。
新闻拓展:
刚刚,谷歌Gemini 3.8登场!姚顺宇:RSI巨大飞跃
Meta发布Muse Spark 1.3模型,编码与代理能力大幅跃升
9月2日,Meta超级智能实验室发布Muse Spark 1.3,当日起在终端编码代理Muse Code和Meta Model API上线。这是五个月内Muse Spark系列的第四次迭代,上一代1.2于8月5日与Muse Code一同推出。新模型权重保持封闭,既有推理档位同步可用,最高推理档(max)仍需完成额外安全测试后才会开放。
首席人工智能官亚历山大 · 王对媒体表示,这是迄今最大的模型性能跃升,编码与代理自动化是主攻方向。他称1.3与Anthropic的Claude Fable 5.1“有竞争力”,编码表现“好于”OpenAI的GPT-5.6 Sol。马克 · 扎克伯格在社交媒体上写道,这是“编码和代理作业上迄今最大的飞跃”,并称其拥有“便宜到几乎不必计量的前沿性能”。相对上一代1.2,公司工程师内部对比显示工具调用减少约20%、token消耗减少约25%,模型“少说废话、少绕不必要的回合”。上下文窗口维持在100万token,输入支持文本、图像和视频。标准API定价未变:每百万token输入1.25美元、输出4.25美元,缓存命中0.15美元。贡献者档价格更低,条件为允许Meta使用提交内容改进模型。独立评测机构Artificial Analysis给公开档1.3(xhigh)的Intelligence Index打出61分,与GPT-5.6 Sol(max)、Grok 4.6(high)并列;面向合作伙伴的1.3(max)为62分,仅次于Claude Fable 5.1与Claude Opus 5。该机构指出,xhigh在59分以上模型里单任务成本最低,约0.55美元,同档对手约0.94至0.95美元。不过,由于代理评测中输入token较1.2增加约57%,单任务成本从约0.40美元升至0.55美元。1.3将在数日内进入Facebook、Instagram和Meta AI应用,但公司未给出精确日期。亚历山大 · 王称定价 “进取”,安全与对齐投入已明显加码,“还没有被迫暂停,但要确保不撞到护栏”。更大代号为Watermelon的模型仍在开发,发布时间未定。扎克伯格此前曾表示会开源某一代Spark权重,但本版仍为闭源收费接口。五个月内四次发布,将Meta从落后一档推到与Claude Fable、GPT-5.6、Grok同场比较的位置。目前公开可用的是xhigh档,而非性能更高的max档。价格锁定在1.2水平,但代理任务导致的token消耗上升,意味着实际使用成本可能增加。下一次可核对的时间点,是max档完成安全测试并开放,以及社交产品中的实际替换进展。新闻拓展:
Meta旗舰模型翻身!比DeepSeek还便宜,华裔掌门人骑脸Gemini
9月2日,中兴通讯终端事业部、努比亚总裁倪飞在社交平台官宣,努比亚NaviX Ultra(俗称豆包手机)已经取得工信部入网许可,这款AI智能体手机计划于9月正式开售。倪飞表示,从去年12月M153原型产品,到NaviX Ultra完成入网,AI智能体手机走完从概念走向量产的关键阶段,整个赛道没有现成方案,需要多方伙伴共同推进。
作为联合字节跳动打造的AI智能体旗舰,该机预装豆包手机助手,主打听得懂、能干活、记得住、够安全四大核心能力,依靠全场景自然语义理解,可跨应用完成比价下单、行程规划等一连串复杂任务。在隐私层面,大模型核心运算在手机本地完成,用户数据无需上传云端,同时拥有生成式AI官方备案资质,降低信息泄露风险。
值得关注的是,该机放弃读取屏幕、模拟点击的GUI技术方案,转而采用MCP协议对接第三方应用;只有应用厂商主动开放MCP服务、输出可控接口,豆包助手才可以实现调用。目前团队正在和各大头部应用厂商推进适配谈判,第三方生态的完善程度将直接决定AI智能体的实际体验上限。
外观上,NaviX Ultra提供蓝境、幻梦、黑、白四款配色,机身侧面配备辨识度很高的橙色实体AI按键,背部采用横向后置摄像模组设计,一键即可唤醒豆包助手。硬件爆料信息显示,新机有望搭载骁龙8 Elite Gen5旗舰芯片,配备7000mAh级别硅碳负极大电池,支持高功率有线与无线充电,后置全焦段三摄,前置5000万像素镜头,整体定位旗舰级别。
李飞飞World Labs发布全球首个多模态世界模型
9月2日,李飞飞旗下创企World Labs发布了“全球首个多模态世界模型”——Atlas,该模型不再满足于生成图片、文字,而是可生成具有像素级精确的图像和视频帧,并将其重建为3D世界。
Atlas的核心能力围绕“理解与模拟3D世界”展开,旨在让AI真正理解3D世界的物理法则和几何结构,而不仅仅是生成看起来合理的2D画面,底层创新在于用“空间上下文”(Spatial Context)替换“文本上下文”。不同于大模型处理文本上下文,Atlas采用多模态自回归扩散Transformer架构,将输入的每一张图片和视频都锚定在三维空间中的一个精确位置,并附有相应的相机位姿和深度信息。这相当于给模型提供了一个带有“坐标轴”和“比例尺”的三维草稿本,让AI在理解世界时有了明确的几何和物理参考。据World Labs官方介绍,其从头开始对Atlas进行预训练,使其能够接受多模态输入,并将其转化为3D视图。Atlas展现出的关键能力包括:像素级相机控制:只需1到6张图片,就能生成最长1分钟的1440p视频。更重要的是,用户可以像真正的导演一样,精确规划相机的运动轨迹,让AI生成连续、一致的新画面。“少即是多”的空间重建:传统3D重建需要成百上千张照片,而Atlas在稀疏视角下表现卓越。在DTU等公开数据集测试中,其重建误差(25.3‰)优于多个专用模型。在一个案例中,它仅凭2到25张地面拍摄的照片,就重建了斯坦福大学的整个主方庭,并生成了高空俯瞰的飞行路径。“子弹时间”与时空模拟:Atlas能处理普通手机拍摄的视频,组成一套多视角拍摄系统,创造出《黑客帝国》般的“子弹时间”特效,让时间“冻结”并转换视角。图像生成:Atlas可根据文本描述生成图像及360°全景图,不仅能遵循复杂指令,精准呈现文字,还能驾驭丰富多样的视觉风格。Atlas更深远的意义,在于打通那条通往“具身智能”的路。该模型被李飞飞本人视为其团队的一个“里程碑式”成果,“这是迄今为止最优秀的相机控制世界模型,为从视觉特效到机器人等众多应用场景打开了大门。”不过,值得注意的是,尽管Atlas展现了强大的能力,但它仍存在明显的技术边界,并非成熟的通用世界模拟器。比如它擅长构建几何连贯的静态空间,对于物体碰撞、复杂动力学的通用物理模拟能力仍待验证。当镜头转向完全未拍摄的区域时,模型依然需要进行“想象”,依靠先验知识补全画面,生成的画面可能并非真实世界的精确复刻,随着生成路径变长,也可能出现局部几何漂移或纹理闪烁。目前,Atlas已进入早期访问阶段,仅向部分合作伙伴开放,未来它将用于驱动World Labs自家的Marble等产品。
AI数据中心新贵Crusoe融资30亿美元:估值300亿,刚签下130亿美元大单
9月4日,据知情人士透露,数据中心初创企业Crusoe已与交易机构Jane Street Group签署一份价值约130亿美元的云服务协议。Crusoe此前已与Meta Platforms Inc.(META.US)和甲骨文(ORCL.US)等公司签订合同,为其提供AI算力支持。
知情人士表示,该协议为期五年,将通过Crusoe的云平台,向Jane Street提供先进的AI芯片集群(即GPU)及AI训练和推理所需的其他基础设施。上周曾有报道称,Crusoe正寻求一笔芯片贷款,背后担保正是来自Jane Street的相关业务合同。知情人士表示,Jane Street是Crusoe云业务迄今签署的最具分量的客户,该交易也显著提升了投资者对Crusoe最新融资轮次的兴趣。周四还有报道称,Crusoe在新一轮融资中筹集了超过30亿美元,估值约为300亿美元。Crusoe对此不予置评,Jane Street也未回应置评请求。Crusoe成立于2018年,最初专注于从油气田捕获废弃天然气,用于为加密货币挖矿供电。此后,公司转型切入AI基础设施赛道,并因开发大型数据中心项目而声名鹊起,其中最具代表性的包括OpenAI与甲骨文在得克萨斯州合作的“星际之门”(Stargate)旗舰项目。今年3月,微软(MSFT.US)同意租赁Crusoe“星际之门”项目的扩建部分——该扩建最初为甲骨文和OpenAI开发,但后两者最终退出了相关谈判。尽管Crusoe此前主要将资金投入实体数据中心建设,但公司自身也在销售AI云计算服务。随着对冲基金等大型企业争相获取AI算力,GPU即服务(GPU-as-a-service)类云业务——即所谓的“新云厂商”(neoclouds)——正迅速崛起。Jane Street此前已宣布,计划向新型云服务商CoreWeave(CRWV.US)的AI云平台投入约60亿美元用于采购服务,并额外以股权投资形式向这家上市云服务商注资10亿美元。4月曾有报道指出,Jane Street正洽谈共同领投Crusoe竞争对手Fluidstack的一轮融资,后者当时估值约为180亿美元。新闻拓展:
AI数据中心Crusoe完成30亿美元融资,估值达300亿,10个月估值翻三倍丨News
AI独角兽Wonderful斩获5.5亿美元C轮融资,估值直冲50亿美元
当地时间9月2日,以色列-荷兰AI初创公司Wonderful完成5.5亿美元C轮融资,估值达到50亿美元,较近六个月前上一轮融资时获得的20亿美元估值实现逾倍数增长。
Insight Partners再次领投本轮融资,现有投资者Index Ventures、IVP、Vine Ventures、9Yards和Bessemer Venture Partners也再次参投。Salesforce则是首次投资该公司。Wonderful于2025年初成立,发展速度极快。该公司最初凭借其客户服务AI Agent平台获得强劲增长势头,该平台专为多个非英语市场量身打造和定制销售。其派遣工程团队(有时直接入驻客户现场)协助客户部署和整合其AI技术到工作流程与系统中的策略也证明极为成功。该公司表示,目前业务已覆盖35个以上国家。不过,过去几个月里,这家初创公司的核心产品已发生演变。Wonderful正逐渐摆脱其客户服务起家的业务根基,现推出一个名为“Wonderful AI OS”的平台,据称该平台能够协调和连接各类Agent、工作流与AI应用程序,并将其与企业的数据、业务场景及现有集成系统对接。该公司表示,该平台兼容任何AI模型,并与现有技术栈相兼容。Wonderful首席技术官兼联合创始人Roey Lalazar在声明中表示:“客户可以采用平台中最适合自己的部分,将其与现有系统集成,为每个工作负载选择最佳模型,并保留他们所构建一切的所有权。”该公司仍依靠其FDE工程师(forward-deployed engineers)帮助将其产品快速嵌入企业中——鉴于市场对精通AI服务和产品实施的专业人才的需求,这似乎是一个不错的策略。Wonderful表示,将利用这笔新增的5.5亿美元资金加快产品开发速度、扩大其前线部署工程师团队规模,并满足对其产品的需求。给企业当“AI管家”,以色列初创成立一年估值50亿美金
转载说明:本文系转载内容,版权归原作者及原出处所有。转载目的在于传递更多行业信息,文章观点仅代表原作者本人,与本平台立场无关。若涉及作品版权问题,请原作者或相关权利人及时与本平台联系,我们将在第一时间核实后移除相关内容。