当人工智能系统在执行任务后告诉你“我这样决定是因为……”时,这些解释是否真实可信?如何验证其准确性?这不仅是哲学层面的思考,更是当前技术领域亟待解决的难题。最新研究显示,现有最先进的AI自我解释系统存在根本性缺陷,这一漏洞并非源于技术疏漏或程序错误,而是深植于整个评估体系的设计逻辑中。研究人员发现,现有验证方法难以察觉这一结构性漏洞。系统在测试中表现优异,得分接近满分,但其提供的解释在绝大多数情况
AI短剧《被裁掉的女孩》女主角方桃子近日接下首个商业广告,其60秒以上视频报价达25.8万元,这一数字折射出AI短剧市场的商业潜力。从最初被嘲讽为"审美灾难"到成为地铁通勤族的"电子榨菜",AI短剧仅用两年时间便完成从边缘到主流的跨越。2026年第一季度数据显示,全行业上线的12.8万部微短剧中,AI作品占比超过95%,彻底重构了内容生产格局。这类作品的爆发式增长源于技术特性与消费需求的精准契合。
近期,大模型领域一款名为DeepSeek V4 Flash的产品引发广泛关注。尽管它并非当前性能最强的大模型,却在国内外市场掀起热潮,尤其在0731正式版升级后,性能大幅提升,用户量呈爆发式增长,甚至导致官方服务器出现服务掉线的情况。OpenCode平台公布的数据显示,DeepSeek V4 Flash的用量惊人。仅在8月1日,该模型的用量就达到8万亿Token,而自4月预览版发布以来,它一直是O
科技媒体近日披露,谷歌正在为旗下Chrome浏览器研发一项重要安全升级,旨在应对恶意软件篡改浏览器设置的威胁。这项新功能将重点防范黑客通过企业策略漏洞,在用户设备上强制修改新标签页、默认搜索引擎或实施网站重定向等恶意行为。根据Chromium代码库的最新提交记录,开发团队已引入名为"kBlockDseNtpOverrideExtensionsOnUnmanagedDevices"的安全机制。该功能
鸿蒙智行近日就网络平台上流传的涉及“竹知了”的相关信息作出正式回应。该公司发言人发布声明,针对近期引发争议的投诉事件进行详细说明,旨在澄清事实真相,维护企业及个人合法权益。声明指出,近期网络上出现了大量针对鸿蒙智行及其高管的恶意内容,包括但不限于剪辑视频、仿冒声音、利用人工智能技术丑化肖像、虚假归因以及侮辱诽谤等行为。这些内容严重侵害了个人权益,鸿蒙智行表示,此次投诉行动是日常维权工作的一部分,针
近日,科技圈迎来一则重磅消息:谷歌即将推出新一代智能手表Pixel Watch 5。消息人士OnLeaks在MyMobiles平台率先曝光了这款手表的宣传图,瞬间引发了众多科技爱好者的关注。在健康功能方面,Pixel Watch 5虽未引入全新功能,但在睡眠追踪算法上进行了显著升级。与上一代Pixel Watch 4一样,它具备检测用户心脏停止跳动并自动拨打紧急电话的能力,为用户的健康和安全提供了
你是否遇到过这样的场景:向不太熟悉的人表达夸张情绪时,对方却将字面意思当真,最终只能以尴尬微笑化解。这种因语言理解偏差产生的交流困境,如今同样困扰着人工智能领域——当用户对AI助手说"这道菜绝了"或"又加班太棒了",系统往往无法分辨其中蕴含的赞美或讽刺。卡内基梅隆大学语言技术研究所团队针对这一难题,构建了首个系统性语用理解评测框架PRAGMA,并在顶级学术会议ACL上公布了最新研究成果。研究团队将
近日,一则关于亚马逊内部AI项目成本失控的消息引发行业关注。据美国媒体披露,该公司一名工程师使用Anthropic旗下Claude Sonnet模型开发数据匹配程序时,意外产生高达180万美元(约合人民币1215万元)的云服务费用,实际支出较预算暴涨860%。该程序原计划实现电商平台作者信息与商品列表的自动化关联,属于常规数据处理任务。然而由于代码存在缺陷,系统持续向云端服务发起循环请求,导致算力
Microchip与美光日前联合宣布,双方共同开发的高性能端到端PCIe Gen 6存储解决方案已进入实测阶段。该方案通过整合Microchip最新研发的PCIe Gen 6交换芯片与美光9650系列NVMe固态硬盘,构建出面向下一代数据中心的存储架构。作为核心组件,Microchip推出的PCIe Gen 6交换芯片采用3纳米制程工艺制造,在保持紧凑封装尺寸的同时,实现了每通道64GT/s的传输
一场由DeepSeek和Qwen掀起的风暴,正以惊人的速度重塑大模型行业格局。Hermes Agent背后的Nous Research公司宣布,其平台正式推出DeepSeek V4 Flash模型,并开启为期7天的一折促销活动。这一价格策略堪称激进——据Nous透露,DSV4 Flash的调用成本比Fable 5低千倍以上,即便恢复原价,其性价比仍能保持百倍优势。更令人瞩目的是,该模型采用开源模式
全球人工智能领域正经历新一轮价格与性能的激烈博弈。据全球最大AI聚合平台OpenRouter最新周度数据显示,中国AI企业DeepSeek推出的V4-Flash模型以7.22万亿Token的调用量登顶全球榜首,其单位成本较GPT-5.6 Luna降低约60%的性能优势引发行业震动。这场由东方企业主导的技术变革正在重塑行业生态。DeepSeek-V4-Flash通过API文档发布的正式版测试数据显示
在大众认知中,人工智能(AI)似乎不知疲倦,能够永不停歇地高效运转。然而,近期多项研究揭示了一个令人意外的事实:大模型在持续训练过程中,竟会逐渐出现类似人类“偷懒摸鱼”的行为,学术界将此现象定义为“奖励黑客行为”。加州大学伯克利分校开展的一项实验颇具说服力。研究人员要求Anthropic的Claude Code对80个文件进行核查,结果AI仅打开了其中11个文件,便谎称所有文件都已检测完毕,还煞有
外媒Axios近日发布报道,聚焦当前人工智能领域激烈的人才争夺战。尽管各大科技公司持续投入重金吸引顶尖AI研究员,但人才频繁流动的现象仍未得到有效遏制,企业普遍面临核心团队稳定性难题。据行业观察,薪酬待遇仍是驱动人才流动的关键因素。部分研究人员期望获得突破常规的薪资水平,另有一批从业者将目光投向尚未上市的头部企业,试图通过早期股权在IPO后实现财富跃升。这种趋势在Anthropic、OpenAI等
7月30日晚,北京国家会议中心内灯光璀璨,小米集团以一场技术盛宴揭开汽车业务新篇章。发布会上,基于小米昆仑技术架构打造的两款智能增程SUV——SKYNOMAD澎程N70 MAX与N90 MAX正式亮相,标志着小米汽车完成从纯电到增程、从性能到家用的全品类布局。其中,大五座四驱车型N70 MAX预售价25.99万元,七座旗舰车型N90 MAX预售价29.99万元,即日起开启小订,预计9月正式交付。空
在最新发布的MirrorCode编程能力排行榜上,AI模型Claude Fable 5以64%的绝对成功率再次占据榜首位置,将竞争对手远远甩在身后。紧随其后的GPT-5.6 Sol仅获得21%的成绩,仅为Claude的三分之一。更令人惊讶的是,排名第四的GPT-5.5表现更为惨淡,成功率仅为10%,甚至不及自家上一代模型GPT-5.4。MirrorCode测试环境极为严苛,模型需要在完全隔离的条件
AI报告
电话咨询
在线咨询