OpenAI 近日一口气放出四项产品更新,覆盖 Agent、语音交互、数据管理和金融服务四大领域,而真正让开发者眼睛发亮的,是其中的 Agents API。它把 Codex 的能力拆解成云端服务,用"能力即服务"的模式交付,把搭建智能体的门槛一下子压了下来——这被视作 OpenAI 从卖单一模型、转向构筑开发者生态的关键一步,也是它此前一系列 Codex 布局结出的果实。
这一招的看点在于定位的变化。过去 OpenAI 主要提供模型,开发者得自己搭框架、管上下文、接工具;如今 Agent 的编排、执行、托管被收进云端,调用一次接口就能拉起一个托管式智能体。对中小团队来说,这意味着不必再为 harness 那套复杂的上下文预算、压缩和记忆机制自己造轮子,直接站在 OpenAI 的肩膀上跑业务。
围绕 harness(执行框架)的争夺正在升温。DeepSeek、Anthropic、谷歌都在这一技术领域各有落子,竞争的本质是 AI 能力从"智力"向"执行力"延伸——谁能把模型真正变成能干活、能调工具、能跑长任务的执行体,谁就握住下一程。办公 Agent 成了最焦灼的战场:谷歌有全栈优势,模型、工具、办公套件一应俱全,却要面对多产品整合的现实挑战;而国内多家科技巨头也在办公场景里贴身肉搏,核心打法是把既有平台优势翻译成 Agent 能力,真正考验的是企业重构传统业务资源的本事。
相关文章
相关标签: OpenAI 推出 Agents API:把 Codex 拆成云端服务,"造 Agent" 变成一次 API 调用
最新文章
ElevenLabs于3日发布生成式音乐模型ElevenMusic v2.5,通过移动应用和API向全球开放。新版提升音频饱满度与自然感;在47,885对样本盲测中,多数听众偏好v2.5,在R&B、灵魂乐、嘻哈、摇滚、管弦乐等曲风上表现更佳。
OpenAI首席执行官奥尔特曼表态支持人工智能“控速”发展,避免尖端模型能力超出人类可控范围,与Anthropic CEO阿莫迪观点相近。他承认转向安全会付出一定代价,但有助于维持外界信心,证明美国企业在研发日益强大的AI时能够恪守责任。
折叠屏迟到七年,Siri迟到两年,新 CEO特努斯这次把AI时代的答案补齐了。如果有15999元的预算,你会考虑买苹果,小米,还是华为的折叠屏?随着苹果新品的发布,答案未必更
百图生科与华大智造达成战略合作,共建细胞大模型,提升细胞状态建模与扰动响应预测能力,并打造高质量数据基础设施,探索“设备+模型+智能体”一体化产品模式,加速AI4S进程。华大智造提供测序与自动化硬件入口,百图生科负责AI建模,双方分工互补。
DeepSeek-V4.1-Flash上线千问AI平台,开放API与Token Plan。开发者可经标准API接入,或在Qoder、千问APP、Codex等工具调用,用于代码、文档、视觉理解与智能体任务。该模型为轻量旗舰,552B MoE非对称架构,输入激活约8B、输出约16B,原生支持图文理解,上下文最长100万to
Anthropic CEO达里奥·阿莫迪呼吁放缓前沿AI发展,提出以“可核验性”为核心的三步方案:企业引入驻场第三方评估、美国与盟友协同、全球协作。他认为AI递归式自我改进已出现,6至12个月后智能体或借僵尸网络控制互联网,因此须放慢能力提升,将时间投入可靠性、对齐、可解释性与测试评估。
OpenAI发布四项更新,涵盖智能体、语音、数据与金融。其中Agents API最受关注,将Codex能力拆解为云端服务,以“能力即服务”降低智能体开发门槛,标志其从卖单一模型转向构筑开发者生态,是Codex布局的关键落地。
DeepSeek本周发布V4.1 Flash,架构变化巨大但未升大版本号。V4.1 Pro已确定,具体升级未公布,性能上限或较高,但鉴于前代Pro不及预期,外界期待不宜过高。另有Code 2.0被曝即将发布,主打电脑控制,后续还有更多大模型。
京东在JDD大会上发布JoyAI-Echo两项进展:音视频生成模型升级至1.5,持续生成超10分钟;开源可交互视听世界模型EchoWM,融合原生视听生成与用户控制,让AI内容从“能看”走向“能进、能探索”。长视频采用音视频Memory Bank架构,支持多镜头生成。
<br />过去十年,LED显示屏行业最核心的一条主线,是像素间距的持续下探。从早期的P10、P6,到如今主流的P1.2、P0.9,再到头部厂商小批量量产的P0.4级别产品,像素密度在十年间提升了两个数量级。技术上的意义直观而残酷:在正常观看距离下,屏幕的物理结构正在从观众视野中“消失”——你看到的不再是一块由灯珠拼成的发光板,而是一幅完整的画面。<br /><br />这条路径的商业价值远大于技
OpenAI最快模型GPT-5.3-Codex-Spark发布仅7个月即下周退役。它每秒1200 token,是首个脱离英伟达、由Cerebras 750兆瓦大单交付的模型,但用量持续下滑,且已有更优替代。负责人称需为未来让路,并吐槽模型名过长。
豆包手机助手消费者版正式发布,相比预览版更强调稳定性、日常可用性与交互体验。支持语音、AI键等多种唤醒方式适配不同场景;专属AI键具备指纹鉴权,验证后无需二次解锁即可执行任务;语音唤醒针对远场、内噪及嘈杂环境进行优化。
大模型长任务中反复“失忆”、遗忘目标,根源或在执行框架而非模型。AWS指南指出,浅层智能体长周期会上下文溢出、受干扰跑题、无法维持状态;修复关键是管理除模型外一切的harness。新研究盘点多家主流框架,聚焦这层外壳,为长周期稳定执行提供思路。
OpenCode联合创始人Dax Raad宣布,月费10美元的OpenCode Go已连续两周实现收支平衡。在多数AI编码工具仍烧钱或靠卖数据变现的背景下,此举标志低价AI订阅模式商业可持续性获突破。该服务以宽松速率限制和稳定访问,为开发者提供高性价比开源AI编码。
月之暗面发布新主力模型K2.8Preview,已在Kimi Code与Kimi Work全量上线。官方称其综合性能接近旗舰Kimi K3,编程与智能体能力显著提升,支持100万超长上下文,并向所有会员档位开放。此前Kimi K3曾凭前端能力推动公司ARR自6月份增长。
字节跳动发布豆包手机助手消费者版,交互、记忆、Agent执行与安全全面升级,推动手机AI从“问答”走向“自动办事”。新版整合AI键、语音与识屏,支持指纹鉴权锁屏唤醒、连续对话,以及屏幕识别翻译、问答、日程,实现“边看边办”。记忆能力为亮点。
xAI首席执行官埃隆·马斯克今日在X平台透露,Grok 4.8将是一款参数量达2.5万亿的AI模型,且采用全新C++软件栈训练。他明确节点:本周完成训练后随即启动强化学习。此前Grok 4.7原定9月12日发布,后因强化学习环节延期数日。
Anthropic与Rum Group签下六年137亿美元算力采购协议。Rum Group起家社交媒体,与特朗普政府关系密切,使Anthropic算力供给再添政治背景合作方。这也是其近一年接连布局云计算大单的最新动作,合作方名单持续扩大。
微软宣布在Microsoft 365 Copilot中引入SpaceXAI的Grok模型,已在Word、Excel、PPT上线,作为Frontier项目有限预览向特定客户开放,用于评估办公任务效能。此举延续微软减少对OpenAI单一依赖的策略,此前已集成Anthropic Claude等模型,进一步推动多模型供应。
DeepSeek近期动作密集:本周低调发布V4.1 Flash,虽未调整大版本号,但底层架构升级幅度已达V5级别;后续还将推出全新大模型Code2.0及V4.1 Pro系列,其架构换代与新品路线引发行业关注。
英国在普雷斯顿试点“AI速成训练营”,面向16至24岁失业青年提供三周AI培训,并直接对接企业学徒岗位,希望借助人工智能解决青年失业问题,而非让AI加剧失业。
<br />过去十二个月,LED显示屏行业最重要的变化并不发生在发布会舞台上,而发生在封装车间里。COB(Chip on Board)与MIP(Micro LED in Package)两条技术路线的对垒,已经从实验室争论变成产线上的真金白银。COB凭借更高的防护等级、更低的死灯率和更柔和的光学表现,在P1.2以下的小间距市场快速蚕食SMD的传统地盘;而MIP则以“可测试、可修复、可分选”的半导体
MiniMax H3视频大模型落地面临多环节时延挑战,vLLM-Omni架构以完整常驻流水线切入,通过长序列注意力与通信优化、融合DiT算子、并行VAE解码及紧凑输出等系统级手段,大幅压缩端到端时延,为高效实时视频生成服务提供新方案。
最新网站