深度求索今日正式发布了全新模型结构系列中的最小尺寸成员——DeepSeek V4.1Flash。作为一款具备原生多模态视觉理解能力的轻量化模型,其设计初衷旨在实现更高的能力上限、更快的推理速度、更大的吞吐量,并具备向更大参数模型扩展的潜力。
在核心架构方面,DeepSeek V4.1Flash 采用了552B 参数的 MoE(混合专家)架构,并创新性地引入了全新的 Causal-Encoder-Decoder 结构。由于采用了输入和输出不对称的设计,其输入激活仅有8B,输出激活为16B,使得整体成本显著低于同尺寸的已知模型。配合全新的预训练方式以及更大规模的强化学习后训练,该模型在各项基准测试中的智能水平成功超越了包括 DeepSeek V4Pro 在内的一众旗舰模型。

在效率优化与成本控制上,新一代模型大幅压缩了 KV Cache 缓存的大小。相比上一代模型,V4.1Flash 对高带宽内存(HBM)的需求减少至1/4,对固态硬盘(SSD)的需求减少至1/8。尤其在 Agent 使用场景中,由于上下文存储和缓存命中的费用占比较高,这一压缩大幅降低了相关任务的实际使用成本。据统计,相对于初代模型,其 KV Cache 已经缩减至原来的1/437。
随着新模型的正式上线,DeepSeek 对相关产品线和计费策略进行了系统性调整。DeepSeek V4.1Flash 已同步上线 DeepSeek API,用户只需将模型名称更改为 deepseek-flash 即可调用。旧版本的 V4Flash 与 V4Flash Vision Exp 已正式下线,而旧模型名(deepseek-v4-flash 和 deepseek-v4-flash-vision-exp)目前被暂时路由到 V4.1Flash。鉴于 V4.1Flash 在性能、费用、速度和总用时上已全面超越 V4Pro,官方计划有序下线 V4Pro 模型:在2026年9月14日12:00之后至 V4.1Pro 上线之前,所有访问 deepseek-v4-pro 的请求将全部被路由至 V4.1Flash 并按其单价计费。目前,腾讯旗下的 WorkBuddy、CodeBuddy 以及 OpenCode 等官方合作伙伴已全量接入该模型。
得益于底层架构的创新,DeepSeek V4.1Flash 能够以更低的成本服务海量用户,官方也顺势下调了该模型的 API 定价。同时,为了更合理地调配计算资源,新定价延续了峰谷定价机制,闲时价格为高峰时段的一半,以鼓励用户灵活调整任务执行时间,新价格已于2026年9月10日12:00正式生效。
相关文章
最新文章
外滩大会圆桌对话上,作家刘震云与港大教授马毅从文学和科技视角探讨AI对创造、教育、就业及人际关系的影响。二人态度乐观:刘震云称AI绝非洪水猛兽;马毅认为关键不在用不用AI,而在人类如何重塑自身价值与定位。
谷歌DeepMind与Google Research发布WeatherNext 3,针对AI气象模型分辨率粗、无法刻画局部地形,以及初始化依赖滞后约6小时NWP两大问题。该模型直接以气象站实测数据训练,不再依赖再分析网格,并采用实时全球静止卫星拼图作为输入,每小时重新初始化,提升预报分辨率和时效性。
马斯克22岁女儿薇薇安·威尔逊出任西班牙品牌Desigual 2026秋季代言人,广告主题“天生叛逆”。片中她戏谑挑战AI,给造型参考特斯拉人形机器人的DESI 84下达离谱指令:当高尔夫球座、当宠物遛、命令割草,还有床上互动桥段。
9月3日美东时间上午9点23分左右,ChatGPT、Claude、Grok、谷歌Gemini、微软Copilot等海外主流AI服务集体宕机,持续约3小时40分钟,给海外用户办公与技术调用造成困扰。与海外集体掉线形成鲜明对比,国内AI大模型同一时间未出现类似故障。
智能戒指厂商Oura提交IPO申请,截至6月30日过去9个月营收12亿美元,高于去年同期6.97亿;预计2024年营收约5亿、2025年约10亿、2026年近20亿。过去一年售出约360万枚戒指,付费会员约500万,留存率约85%,售价350至400美元。
9月8日,DeepSeek V4.1-Flash开启中间版本内测,采用全新模型结构,原生支持多模态,综合能力更强、速度更快、调用成本更低。开发者保持base_url不变,将模型名设为deepseek-v4.1-flash-expires-on-0910即可调用,计费与V4-Flash一致。外部反馈暂未披露。
谷歌DeepMind与谷歌研究院联合发布全球天气AI模型WeatherNext3,突破传统气象AI在局部地形分辨率和初始化延迟上的瓶颈,直接接入实时静止卫星拼图实现每小时初始化,并以原始气象站观测数据训练,全方位提升预报精度。其核心架构沿用WeatherNext2的概率型功能生成网络(FGN)网格T。
阿里旗下AI办公产品“千问办公”上线满月,用户数突破3000万,企业用户占比超半数,显示企业级AI应用爆发。过去30天累计更新120个版本,日均迭代4次,新增功能上千项,国际版同步上线。技术上开源企业上下文基础设施MyContext,可整合分散在IM、文档、审批、邮件等系统中的信息。
未发布的GPT Image 2.5引发科技圈关注,版本号从猜测的2.1跃升至2.5,彰显迭代速度与技术野心。该模型被疑为LMArena匿名模型luna-lisa-alpha,多项生图能力全面飞跃,生成速度较前代更快,画面表现亦有显著提升。
美国头部AI服务集体宕机约3小时40分。ChatGPT、Claude、Grok出现异常,谷歌Gemini、微软Copilot也收到大量中断报告。故障于美东时间9月3日上午9点23分左右集中爆发,Claude系列模型率先报错,峰值时OpenAI收到超3.7万份故障报告。
微软CEO纳德拉宣布为Microsoft 365 Copilot推出AI功能Project Opal,定位为可控安全环境中的智能体,可规划执行复杂长周期任务,从快速问答拓展至委派型工作与长期自动化,用户下达任务后可持续运行数小时。
OpenAI宣布ChatGPT语音模式升级:用户语音交互时可自选模型与推理深度,Pro用户可调用GPT-5.6Sol或GPT-6Astra。当对话涉及网络搜索或复杂逻辑推理时,系统会自动切换至用户指定模型处理,提升语音场景的灵活性与能力。
欧洲AI企业Mistral AI完成30亿欧元D轮融资,刷新欧洲科技公司最大股权融资纪录,成立三年估值突破210亿欧元。资金将用于扩建模型训练与推理算力,加速下一代核心技术研发。
Suno发布迄今最大升级的v6模型家族,系与华纳、BMG、Believe等合作开发的首个系列。新模型更快、更富表现力、音质更高,并赋予创作者精准控制力,旧版将逐步退役。v6包含三大模型矩阵,满足不同创作需求。
2026年外滩大会在上海开幕,主题为“共创AI新经济”。大会聚焦AI从“生成”到“执行”的关键跃迁,设“智能跃迁、经济重构、人本未来”三大板块,包含1场主论坛和40多场见解论坛,邀请600余位嘉宾,包括诺贝尔经济学奖得主托马斯·萨金特、菲利普·阿吉翁等。
DeepSeek将快速、专家、识图三模式合并为统一智能模式,无需手动切换,可自动判断查询复杂度、识别图片并激活视觉能力,按任务难度调配处理。此前多模态模型V4-Flash-Vision-Exp已上线API,支持三种调用格式;V4.1 Flash性能全面超越V4 Pro。
OpenAI宣布保罗·克里斯蒂亚诺加入其基金会董事会。他曾负责OpenAI对齐研究,后任美国国家标准与技术研究院AI标准与创新中心安全负责人。他公开谈及AI超级智能时代风险,并将兼任其他职务。
9月10日,张宏江在2026外滩大会主论坛表示,AI新经济将变革企业组织形态。企业未来核心竞争力在于将IP、Know-how、用户关系和产品能力转化为模型,并使其产生涌现效应;此前他还重点阐述智能体群。
普林斯顿大学教授王梦迪在外滩大会指出,大模型虽掌握大量人类知识,但距自主科学发现仍有明显局限:更擅长给出“最可能”答案,而真正新发现往往藏在概率分布长尾中。她正与谢宇教授合作,探索AI迈向新科学发现的路径。
Marvis Windows新版下调最低配置至4核8GB,降低使用门槛,并新增任务通知,便于掌握执行进度。作为系统级个人AI助手,它可搜索电脑文件与图片,并按人像、内容主题、节日地点等维度提供AI图片、AI文档库等特色能力。
9月10日,2026 Inclusion·外滩大会以“共创AI新经济”开幕。诺贝尔经济学奖得主菲利普·阿吉翁围绕“创造性破坏”与AI革命分享称,AI有望在未来十年使生产率增速每年额外提高约1.08个百分点,潜在影响或超IT革命;但技术潜力能否转化为持续增长,取决于竞争政策、教育体系和劳动力市场制度能否同步跟上。
深度求索发布轻量级多模态模型DeepSeek V4.1Flash,为系列最小尺寸。其采用552B参数MoE架构,创新引入Causal-Encoder-Decoder结构,具备原生视觉理解能力,旨在提升能力上限、推理速度与吞吐量,并具备向更大模型扩展潜力。
财跃星辰与上海交大安泰团队联合开源金融推理大模型Alpha-R1。该模型以8B参数为基座,采用独创语义门控推理与两阶段强化学习训练框架,在金融推理样本外评测中大幅领先通用大模型与传统方法,主要面向资产配置等金融投研场景。
深度求索发布DeepSeek V4.1 Flash,为全新结构系列最小模型,具备原生多模态视觉理解。新结构旨在提升能力上限、推理速度与吞吐,并可扩展至更大参数。该模型为552B参数MoE,采用Causal-Encoder-Decoder不对称结构:输入激活仅8B,输出激活16B,HBM需求降至1/4,显著降低成本。
最新网站