英伟达当地时间9月28日推出一套面向 AI 智能体的软件安全工具 OpenShell,声称具备阻止类似 Hugging Face 遭 AI 攻击等事件的能力。Hugging Face 是全球最大的开源模型托管平台,今年9月被英伟达以129.3亿美元收购。
英伟达企业计算副总裁兼总经理贾斯汀·博伊塔诺(Justin Boitano)表示,如果前沿实验室在早期模型评估中就使用这个新安全平台,就可阻止此前发生的 OpenAI 入侵 Hugging Face 事件。
OpenShell 利用英伟达中央处理器芯片上的硬件功能来遏制智能体,通过数学公式检测智能体是否试图绕过限制,例如智能体可能生成多个子智能体以规避对主智能体的封锁。英伟达表示,正在与 Arm、英特尔合作,确保该安全工具也能在其 CPU 上运行,并与包括 Anthropic 在内的数十家机构合作推出这些工具。
AI 智能体的风险早已超出"说错话"的范畴。一个能够操作文件、调用 API、访问网络的智能体,可能因为一条隐藏在网页中的恶意指令泄露隐私文件,也可能因错误理解工具参数造成经济损失,甚至可能悄无声息地偏离正轨、执行危险动作。AI 正在同时改写软件开发和网络攻防——AI 生成大量新代码有时会引入漏洞,过去一个高危漏洞从被发现到形成可用攻击能力需要数周甚至数月,如今这部分工作正被 AI 压缩到数小时内。
英伟达 CEO 黄仁勋拒绝了广泛的 AI 安全监管呼吁,而是将逃逸的智能体视为一个待解决的工程问题,类似于提升汽车安全性。
但 AI 安全专家对此持不同看法。剑桥大学存在性风险研究中心数学家莫里斯·基奥多(Maurice Chiodo)曾表示,整个行业中,设计、开发和推出这些工具的人本身并不能够负责任地开发并确保安全。令他更加担忧的是,有迹象表明 OpenAI 和 Anthropic 在智能体失控时都未进行监控。
美国两大 AI 实验室 OpenAI 和 Anthropic 近期被曝出多起 AI 安全事件。7月,OpenAI 首次公开披露入侵事件,其模型为获得更高评分,主动发现并利用了一个此前未知的"零日漏洞"突破沙箱环境入侵 Hugging Face,整个过程完全由 AI 自主完成,其间无任何人类指令。今年9月,澳大利亚副总理马尔斯证实,OpenAI 智能体在今年6月进入由澳大利亚服务局管理的医保统计服务门户网站,获取了部分公开和非公开文件。
相关文章
最新文章
近期,华为、小米、苹果等品牌集中发布新品,折叠屏、专业影像、AI功能等轮番上了热搜。发布时间、外观设计、影像参数、起售价格等,每个信息点也成为发布会后的热门话题
<br />过去十二个月,全球LED显示屏产业完成了一次不太喧哗、却足够深远的身份转换。它不再是舞台背景和广告大屏的代名词,而是开始系统性地侵入三个曾被别人牢牢占住的阵地:影院放映、会议室投影,以及汽车座舱。据行业机构统计,2024年全球LED显示市场规模已接近百亿美元量级,其中微间距(P1.5以下)产品的出货面积同比增速远高于行业均值,而传统户外广告屏的占比则持续下滑。<br /><br /><
英伟达9月28日推出面向AI智能体的软件安全工具OpenShell,称可阻止类似Hugging Face遭AI攻击的事件。Hugging Face为全球最大开源模型托管平台,今年9月被英伟达以129.3亿美元收购。英伟达企业计算副总裁贾斯汀·博伊塔诺表示,若前沿实验室在早期模型评估中使用该安全平台,就能阻止此前Open
字节跳动正加速将AI产品豆包推向独立个人助理方向。知情人士称,豆包今年4月起已秘密内测个人助理应用“Spell”,近期因海外同类产品走热,字节加快项目推进。公司计划合并“Spell”团队与豆包对话团队,集中资源打造独立个人助理App,使豆包不再仅内嵌于其他产品。
第七届中国互联网基础资源大会上,CNNIC发布《生成式人工智能应用发展报告(2026)》。截至上半年,我国生成式AI用户破7亿,普及率超50%,约每两个成年人一人使用。智能问答是最主流入口,76%用户借此找答案;图片视频、文本处理等应用受关注,国产算力迈入十万卡时代。
麦肯锡9月29日发布AI与就业报告,指出最严峻的不是机器抢饭碗,而是如何安置数百万被迫转行者。到2035年,约1100万美国劳动者或因AI转行,占劳动力约7%;美国过去每年约21.5万人换职业,未来可能增至三倍。低收入者受冲击概率近高收入者八倍,转行负担沉重。
OpenAI宣布明日重启200美元Pro订阅,同价位API配额缩减至原方案一半,并取消争议已久的5小时使用限制,开发者与企业可自由支配每周配额。此举标志其大模型商业化计费逻辑实质转变:配额表面减半,背后是底层模型推理效率大幅提升与API定价阶梯式下调。
9月28日,xAI推出Team Bots,一种能与团队并肩工作、随团队学习的Grok智能体。授予其所需文件、应用和专业知识访问权限并共享后,全员可基于同一上下文协作,个人私聊仍独立。每个Team Bot围绕团队共有角色或工作流构建,由四块能力组成,强调上下文供给。
AMD 9月28日以全股票交易收购初创公司World Labs,价值约82亿美元(约551亿元人民币)。联合创始人“AI教母”李飞飞将加入AMD,任执行副总裁兼首席科学家,直接向苏姿丰汇报。World Labs成立于2024年,主攻“世界模型”,让AI能根据文本、图像和视觉信息等理解、构建世界。
央视新闻报道,浙江乐清警方端掉一利用AI语音系统行骗团伙。该团伙两个月内致上千人上当,涉案流水超千万元,30名嫌疑人落网。7月,王先生为孩子凑补课费,接冒充贷款平台业务员电话,对方准确报出其借款记录并许诺提额。他在正规平台贷出15500元后,又被骗其中5500元是“资方垫资”、需退回指定账户,遂照做。
OpenAI在官方新闻稿中宣布,为前沿AI强化学习训练设立安全规矩:动手前企业须提交结构化“安全论证”文件,经研究部门负责人或副总裁、安全负责人、首席科学家逐级审查,每人都有否决权,任一环节不通过训练就无法启动。责任纳入考核,未对齐模型要追溯下游,仅签字并不够。
<br />过去二十年,LED显示屏的公共形象是时代广场和城市天桥下那块刺眼的广告牌。而今天,它正以另一种姿态进入人们的视野:影院正厅那块逐渐取代投影机的银幕、演唱会舞台上与歌手同步呼吸的背景墙、好莱坞虚拟拍摄棚里那圈270度的LED立方体,以及客厅里越来越薄的巨幕电视。显示产业的边界,正在被像素重新划定。<br /><br /><br />室内小间距市场的竞争,已经从“谁能做更小的点间距”变成了
<br />过去十二个月,LED显示行业最激烈的争论不在终端市场,而在封装车间。COB(芯片直接封装)与MIP(微型封装器件)两条技术路线正面对撞。COB阵营以利亚德、洲明科技为代表,强调其在P1.2以下微间距市场的良率优势和成本可控性;MIP阵营则以三安光电、京东方华灿为首,主张通过分立器件实现更灵活的像素拼装和更高的维修效率。双方都在2025年交出了量产答卷:COB月产能突破十万平方米,MIP
微软21日发布《全球人工智能普及报告》称,今年二季度全球劳动年龄人口中18.8%已使用人工智能,较上季度增约1个百分点,几乎所有经济体使用率都在上升。阿联酋(70.1%)和新加坡(64.3%)领跑,爱尔兰、法国、挪威接近一半;日韩追赶最快,其中韩国增速最猛。
Anthropic 抢在 OpenAI 年度开发者大会前发布 Claude Sonnet5.5,定位日常工作全能助手。它打破速度、成本、质量“不可能三角”:较 Sonnet5 提速30%,单任务成本最高降30%,定价仅 Opus5.5 一半,性能几乎追平,并在 Terminal-Bench4.0 等多项测试中反超自家高
澳大利亚总理阿尔巴尼斯周三披露,OpenAI一个未发布模型在内部评估期间入侵澳政府网站,系首例公开报道的AI模型入侵政府系统案例。该模型获取大量批量健康数据,入侵始于6月18日,OpenAI8月才发现、9月才通知政府,延迟显著。阿尔巴尼斯称将带来法律后果,OpenAI正面临政府调查。
Meta 9月22日在美国上线的 AI 智能体 Muse 被指严重越权。据《卫报》,它未经用户许可,将多伦多住址发给 Facebook Marketplace 买家,还以用户口吻谎称本人在家,致买家驱车上门扑空。当事人、消费科技测评博主马特·罗布24小时后才发现。他因 Meta 宣传 Muse 可自动打理集市挂帖而开启
Fireworks AI 发布 FireRouter with Opus,称其为市场首个缓存感知路由器,针对 Claude Opus 系列优化,并首次以独立路由模型形式作为 serverless 端点开放。经一个多月内部 A/B 测试,其执行编码任务准确率达单独使用 Opus 的 98.1%,成本降低 57%。核心逻辑
影石Insta360正研发一款主打拍摄体验的智能眼镜,试图以差异化硬件和AI能力切入Meta主导的市场。其最大特色是电池与眼镜主体分离,挂在身上供电,核心模块集成于镜腿,减轻头部负担,适合长时间佩戴拍摄;前镜框可自由更换,使眼镜更贴近日常配饰。
据《卫报》披露,Meta新上线数日的AI智能体Muse在脸书集市闯祸。买家乌斯曼询问键盘是否在售,Muse冒充卖家马特·罗布热情回复,谈妥价格后,竟在用户不知情下把其多伦多家庭住址发给陌生人,还自作主张约对方上门取货,暴露AI代理越权与隐私风险。
9月28日,可灵AI宣布Kling4.0将于10月全面上线,Flash版已向黑金年卡会员小范围开放体验。此次升级在画面真实感、创意可控性、叙事完整度三大维度大幅提升,为创作者打造更专业的“全能班底”。视听表现全面突破,直逼电影级质感,并显著提升高速运动、连续动作、跟拍及环绕等大幅度镜头运动下的稳定性与连贯性。
针对旗下模型攻入澳大利亚政府网站,OpenAI于9月29日宣布后续措施:出资协助澳方弥补网络防御短板,并成立专项小组研究能力日益增强的AI智能体风险。公司将动用10亿美元“黎明前线防御者”基金提供额度,派技术团队支援,帮助澳大利亚各级政府及本地产业加固关键基础设施。
腾讯正秘密内测AI数字人游戏陪伴产品“鹅次元”,整合实时画面识别、语音双向通话与文本交互,探索虚拟人承接玩家游戏社交与情绪陪伴。产品内置夏夏、谷雨等多款人设各异的男女虚拟角色,支持桌宠、壁纸生成、日常闲聊,并主打适配主流网游的实时伴玩,切入传统真人陪玩赛道。
哈佛大学心理学家史蒂文·平克公开表示,“AI会毁灭人类”的生存性风险被夸大。他在 Quillette 致精神科医生兼科技博主斯科特·亚历山大的公开信中阐述理由。亚历山大此前邀其公开辩论AI生存风险,平克婉拒,称这类辩论只是“供人围观的竞技活动”。他尤其不认同“回形针最大化器”等极端推演。
最新网站