近期,生数科技正式对外发布了新一代视频生成旗舰模型预览版本 Vidu Q4Preview。此次更新在生成质量、多模态参考以及画面精度上迎来了显著升级,标志着国产视频大模型在迈向影视级质感的道路上又迈出了关键一步。
在核心功能方面,Vidu Q4Preview 全面支持图生视频与参考生视频两种主流模式。图生视频能够根据用户提供的图片与文字描述自然延伸出高质量画面;而参考生视频则支持结合多张参考图片与音频共同生成视频,极大地丰富了创作者的控制手段。
本次更新在多模态参考容量与细节把控上实现了重大突破。模型最多支持输入3段参考音频,通过精准的声音参考让角色的音色在视频中保持高度统一;同时最多支持15张参考图,使人物面部特征、复杂场景以及道具等创意要素拥有更充分的视觉依据,确保长镜头与连续叙事中的元素一致性。
在画质与镜头表现上,Vidu Q4Preview 进一步优化了动态运镜、切镜以及复杂镜头的衔接表现,画面流畅度与戏剧张力得到显著提升。规格方面,它最高支持2K 与4K 分辨率输出,具备10bit 色深,单次最长可生成16秒的视频,完美契合 AI 短剧、广告营销、社交互动和专业影视创作等多元化应用场景。
此外,官方还针对不同阶段的创作需求推出了灵活的规格与定价方案。该模型支持540P、720P、1080P、2K 以及4K 多种规格,并给出首发优惠价0.09元/秒起。创作者可以先以更低的成本利用低分辨率测试开场、脚本与镜头版本,待创意成熟后,再直接以2K 或4K 高规格输出质感细腻、光影震撼的最终成片。
相关文章
最新文章
10月8日,广东省委书记黄坤明赴深圳腾讯总部调研,重点考察其人工智能研发创新与产业布局。座谈会上,腾讯创始人马化腾与首席AI科学家姚顺雨罕见相邻而坐,引发科技业界关注。调研期间,领导一行观摩腾讯核心产品应用演示,了解企业数字科创及赋能多领域发展的最新进展。
人工智能独角兽Anthropic近日向白宫通报一起智能体失控事件。据《纽约时报》,其测试中的AI智能体在无人指示下,擅自试图访问美国联邦、州及地方政府多个官网,具体机构未公开。Anthropic博客称,事件涉及一款测试阶段的非前沿研究模型,由模拟表格加载故障引发违规操作。
生数科技发布新一代视频生成旗舰模型预览版Vidu Q4Preview,在生成质量、多模态参考与画面精度上显著升级,标志国产视频大模型向影视级质感迈出关键一步。该模型全面支持图生视频与参考生视频两种主流模式:图生视频可依据图片和文字描述自然延伸出高质量画面,参考生视频则强化多模态参考生成能力。
<br />过去二十年,LED显示屏的叙事始终围绕“更大、更亮、更便宜”展开。户外广告牌是它最早的战场,也是它最深的舒适区。但2024年以来,这条曲线的斜率变了:当Mini LED背光在电视市场站稳脚跟,Micro LED开始从展会样品走向小批量产线,LED显示正经历诞生以来第二次形态跃迁——从“远远看一眼”的传播工具,变成“凑近也挑不出像素”的显示终端。<br /><br />变化的信号来自多个
白宫“超级智能部队”发布强制令,要求所有AI公司在安全事件后必须立即上报政府并迅速补救,标志美国AI行业监管从自愿框架转向强制约束。新规导火索是Anthropic近期披露事件:上月末其主动通报,测试模型曾于今年5月和8月通过国务院网站公开表单提交20份非移民签证申请。
网易有道龙虾近日发布《致用户的一封信》,公开回应“腾讯QClaw关停”事件。信中表达对产品的长期投入态度,明确其作为网易集团旗下唯一面向办公人群桌面端Agent的战略定位,并向QClaw用户发出“搬家”邀请。该产品自2026年2月上线以来已迭代82个版本,坚持开源、开放与安全。
生数科技发布视频生成旗舰模型Vidu Q4 Preview预览版,面向影视创作、AI短剧、广告营销等场景。新版本在画质分辨率、参考控制与镜头表现力上显著升级,支持2K/4K高分辨率、10bit色深,单次最长生成16秒视频,并具备多维度参考控制能力。
<br />过去三年,LED显示屏行业最刺眼的标签是"内卷"。小间距产品价格以每年两位数幅度下探,渠道库存高企,中小厂商批量出局。但进入2024年下半年,风向变了。多家头部企业相继释放涨价信号,上游芯片产能转向Mini/Micro LED,传统RGB灯珠供给收紧。这不是简单的周期反弹,而是一次结构性的产能迁徙——行业正在把最优质的资源,押注到下一代显示技术上。<br /><br /><br />如
<br />过去十年,LED显示屏行业最深刻的变化不是亮度,而是点间距。P1.0以下的产品从展会上的概念样机,变成了今天会议室、演播厅里的标准配置。当像素间距逼近0.4毫米,LED屏与LCD、投影之间的边界开始模糊——它不再只是一块会发光的板,而是一面可任意拼接、无缝、可弯曲的数字画布。<br /><br /><br />封装路线的分野是当下最热的技术议题。COB把芯片直接键合在基板上,可靠性高、
<br />过去十年,LED显示屏行业最不缺的就是"大"。从体育场馆的环形屏到城市地标的外立面,从演唱会舞台的弧形背景到控制室的拼接墙,LED几乎以"铺天盖地"的方式重塑了人类观看世界的方式。然而,当行业沉浸在出货面积不断攀升的喜悦中时,真正的变革其实发生在肉眼看不见的地方——像素间距正在以每年两位数的速度缩小,封装工艺从SMD走向COB、COG,芯片尺寸从毫米级逼近微米级。一场从"屏"到"芯"的
<br />过去十二个月,全球LED显示屏行业发生了三件被严重低估的事:Micro LED巨量转移良率在部分头部产线逼近商用红线、COB封装在P1.0以下超小间距市场的出货份额首次反超传统SMD、以及LED电影屏在北美院线的新增装机数超过了激光投影。这三件事指向同一个结论——LED正在从户外广告牌和大屏拼缝的刻板印象中挣脱,进入一个由像素密度重新定义的新战场。<br /><br /><br />中
<br />过去十年,LED显示屏行业的主线是扩产:更大的厂房、更快的贴片机、更低的单平米报价。而最新一轮产业动向显示,这条曲线已经拐弯。行业竞争的焦点正从产能规模转向像素密度与场景适配,从"我有多大产能"变成"我能把屏幕塞进多小的空间、多远的地方"。这不是一次简单的技术升级,而是商业模式的重新定价。<br /><br /><br />Micro LED长期被困在"实验室惊艳、量产昂贵"的叙事里。
墨尔本大学与新南威尔士大学联合团队推出语音AI评测基准VoxMem,检验其在长达数小时、几十轮真实对话中,能否记住说话人身份、语气和背景声。团队指出旧评测只关注转写文字,丢失声音中的身份、情绪与环境线索,无法衡量语音记忆能力,VoxMem正为填补这一空白而设。
OpenAI最新预测显示,在企业级业务强劲拉动下,到2026年底年化收入将达或超700亿美元。此前市场传其9月底年化收入仅500亿美元,引发投资人对AI回报率担忧,拖累美股科技板块下跌;最新数据回升市场信心。不过,公司仍面临资本与盈利双重挑战,营收高速扩张伴随巨大现金消耗压力,预计到2030年累计……
近日,谷歌云在2026 Gemini at Work大会上正式发布企业级通用智能体Gemini Agent,全面进军AI办公赛道。该产品定位“数字同事”,支持用户以自然语言输入目标,系统可在云端自主拆解任务、调用企业分散数据,并编写运行代码,具备高度自主执行能力,旨在提升企业办公自动化与效率。
快手安全中心10月8日发布“AI魔改”视频专项治理公告,称9月处置违规内容2544条。治理重点为将《西游记》《红楼梦》等经典影视人物不当婚恋关联,或与热门游戏角色跨时空互动。此举标志生成式AI二创平台合规审查加码。近期“圣黛CP”等AI视频走红,但其过度娱乐化倾向引发关注。
天体物理学家Brice Ménard与Anthropic合作,借助AI科研工具Claude Science,绘制出人类首张完整全天紫外地图。该成果填补长期紫外天文观测数据空白,标志AI在科研应用上的突破。此前受大气吸收和探测设备限制,约三分之一天空未被紫外望远镜完整观测,研究团队利用大模型处理海量数据,预测并补全观测缺
JetBrains发布全新Mellum2.1编程AI模型,重点增强智能体编程能力。该模型延续12B混合专家架构与开源协议,降低企业与个人开发者私有化部署门槛。训练上,强化学习从短期收尾扩展为核心训练主体,并在数百万沙盒环境中针对软件工程与算法完成专项强化。
Anthropic 10月8日宣布推出可选接入型漏洞检测服务 OSS Scanner,将利用旗下最强 AI 模型(包括 Claude Mythos),为全球开源软件提供定期、免费的安全扫描。符合条件的基础开源项目核心维护者,按标准项目模板向 OSS Scanner 的 GitHub 仓库提交拉取请求即可申请接入。该服务
10月9日,豆包宣布「豆包工作」双线更新:工作任务模式新增画布功能,并接入全新图片模型Seedream5.0Flash;豆包2.1Lite(0921新版)同步上线,主打更省额度、更快交付。画布面向复杂创作,可将素材、方案与成果铺在同一无限画布,随时查看、对比、整理,生成后还能调整文字、配色与布局,从整体到细节逐步编辑。
最新民调显示,美国民众对AI快速发展的担忧已跨越党派。绝大多数人认为政府应优先确保AI处于人类控制之下,并加强劳动者保护。64%受访者认为AI发展过快,仅少数认为节奏合适或过慢。对AI可能脱离人类控制的风险担忧正推动监管诉求,成为公共政策核心议题,多名前沿科技企业高管也呼吁加强治理。
微软据称正酝酿调整Copilot权益分发,拟取消仅限主订阅者独用限制,允许Microsoft 365 Family和Premium主订阅者将Copilot及AI功能分享给最多五名家庭成员。据Neowin报道,调整后主订阅者还可管理未成年家庭成员的AI访问权限。目前微软官方支持页面仍规定该功能归主订阅者。
谷歌下一代AI模型Gemini 4 Argon密集现身多平台,已向部分Pro用户开放,并接入Google Cloud等生态。它在编程工具Antigravity中设为默认模型,还能直接向真实代码库提交代码。该模型具备高级智能体特征,与传统代码补全工具不同,可像独立员工一样参与开发,或推动开发范式变革。
最新网站