盼了好久今天上午,「DeepSeek-V4」 发布并开源DeepSeek V4 分两档Pro 是 1.6T 总参、49B 激活Flash 是 284B 总参、13B 激活两档都支持 1M token 上下文、都开源,并给出了技术报告V4 一图看懂:Pro 1.6T/49B、Flash 284B/13B,两档都给 1M 上下文能干什么V4-Pro 在四个方向上都跨过了一个台阶Agent 能力Agen
专注AIGC技术的专业社区,关注大语言模型(LLM)的发展和应用落地,聚焦LLM及AI技术的市场研究和开发者生态,欢迎关注!AI Agent 正在成为企业效率新引擎,如何低代码、快速搭建、稳定落地,是当下团队最关心的问题。4月26日20:00,上海AIGCOPEN社区负责人、Power Platform 中文社区讲师、Copilot讲师李德洋,带你了解微软 AI Agent Copilot Stu
不要再拿“聊天模型”的框架来理解它了。作者|硅谷Tech news编辑|秦聪慧本文首发于钛媒体APP4月24日凌晨,OpenAI发布了GPT-5.5——这是自GPT-4.5以来首个完全重训练的基础模型。总裁Greg Brockman没有用“升级”来描述它,而是称之为“新型智能类别”(a new class of intelligence for real work)。这个措辞的潜台词是:不要再拿“
作者|冬梅刚刚,DeepSeek 在官方公众号发文宣布,全新系列模型 DeepSeek-V4 的预览版本正式上线,并同步开源!DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能三大维度上均实现了国内与开源领域的领先。秉承 DeepSeek 一贯的开放精神,本次发布的模型按大小分为两个版本,欢迎开发者、研究者和企业用户前往体验和下载。模型按大小分为两个版本:Dee
刚刚,期待已久的 DeepSeek-V4 终于更新了。DeepSeek 正式上线并开源了 DeepSeek-V4 的预览版,分为 Pro 和 Flash 两个版本。DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。这次的更新力度不小,有两个核心变化:一是,V4 拥有 1M 的超长上下文,1M 上下文已经成为了标配;二是,Agent
图片由AI生成文丨李海伦编辑丨苏扬当地时间4月23日,OpenAI正式发布新一代旗舰模型GPT-5.5,官方将其定位为“面向真实工作的全新智能层级”,也是迈向全新计算机工作方式的重要一步。这次发布核心关注的有两点:一是效率层面的突破:同等延迟下,模型更大了,速度却没慢。GPT-5.5上下文窗口达到100万Token,但它不是GPT-5.4简单能力升级,而是在效率上做到了同等延迟下的更高智能。二是G
DeepSeek创始人梁文锋。图片经过AI处理文丨晓静、李海伦编辑丨苏扬4月24日消息,DeepSeek V4预览版官宣上线。根据DeepSeek的官方介绍,V4系列包含两个MoE模型:DeepSeek-V4-Pro总参数1.6T、激活参数49B,DeepSeek-V4-Flash总参数 284B、激活参数13B,两者均原生支持100万token上下文。在1M上下文设置下,V4-Pro的单toke
转自 | 新智元【导读】就在刚刚,奥特曼深夜掷出GPT-5.5!全方位暴击Claude Opus 4.7,重新夺回地表最强王座。从写代码到搞科研,AI独立接管电脑的时代真的来了!硅谷今夜未眠!就在刚刚,GPT-5.5震撼登场——OpenAI迄今最强、最全能的新一代旗舰模型。它是一种全新级别的智能,彻底进化为Agent时代的「原生大脑」。没错,就是那个万众期待的「土豆」(Spud),终于在今天杀出来
作者:王兆洋 + DeepSeek V4 专家模式V4 终于终于终于终于是来了。而且它不在假期,不在深夜,而是突然就发了。模型,开源权重,技术报告和官方的文章同时发给所有人。官方给出的亮点是“百万上下文的普惠”。但显然,这个模型里DeepSeek做的创新工作还是非常的多。一如既往的,它的技术报告是今天比读任何新闻都过瘾的存在。这一次V4最让人欣喜的是,它的架构依然在进化,且依然极度聪明。它告诉整个
将 ScienceAI 设为星标第一时间掌握新鲜的 AI for Science 资讯编辑丨&在当前的数字病理学研究中,虽然 AI 在辅助癌症诊断上展现了巨大潜力,但仍面临一个严峻的现实:传统的 AI 模型极其依赖海量的标注数据。对于每一种新的疾病或每一个不同的医院,模型往往需要进行繁杂的重新训练。这种「一病一训」的模式不仅耗时耗力,更限制了技术在基层医疗机构的普及。针对这一痛点,香港科技大学及其
DeepSeek V4 模型以 CUDA + Tilelang 组合方式使用了数十个算子。为了能在多种 AI 芯片上运行 DeepSeek V4,众智 FlagOS 采用 Triton/Triton-TLE 重写了全部新增算子,并基于 Triton-TLE 实现了 TopK Selector 等高难度算子,在“算子全覆盖”的基础上,进一步提升性能。同时,通过 C++ Wrapper 和 FlagO
DeepSeek是中国AI跻身全球一流的起点,但不会是终点。文|周鑫雨资料整理|钟楚笛编辑|苏建勋 杨轩靴子终于落地。被调侃“Next Week”近3个月的DeepSeek V4,终于显露真身。1.6T的最大参数量、1M的上下文窗口、针对Agent的性能优化,以及基于MoE(混合专家模型)和稀疏注意力机制DSA,降低计算和显存需求——这些曾被外界纷纷猜测的参数和性能,随着V4的官宣,一锤定音。姗姗
出门问问重构“超级组织”:AI效率革命迎来“Aha Moment”。1911年,弗雷德里克·泰勒(Frederick Taylor)在他的《科学管理原理》中,将人视作工业流水线上精确的零件。此后一百余年,金字塔式的科层制统治了现代商业文明。然而,当AI时代的算力狂飙撞上工业时代的管理架构,裂痕开始显现。许多企业在斥巨资引入生成式AI工具后,陷入了一种诡异的“幽灵效率”:个体的能力呈指数级提升,但组
整理 | 褚杏娟 OpenAI 今天发布了 GPT-5.5,称其为公司迄今“最聪明、最直觉化”的模型,也是面向真实工作的全新智能形态。相比上一代,GPT-5.5 的重点是进一步承担复杂任务中的规划、工具调用、结果检查和跨工具执行,被 OpenAI 定位为推动“用 AI 在电脑上完成工作”的关键一步。赢了 Opus 4.7 和 Mythos?在与 Anthropic 矛盾日益激烈的放下,GPT-5.
作者|猫猫头邮箱|cathy@pingwest.comGPT-5.5来了。API定价$5/$30每百万token,GPT-5.4的两倍。但它并不更烧token。Sam Altman在公布定价的同一条推文里补了一句:"Remember, you will need less tokens per task than 5.4!" 贵一倍,但每个任务token更少——"其实更划算"。OpenAI总裁Gr
AI报告
电话咨询
在线咨询