综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
今日凌晨,Xmax AI全球首发实时交互视频模型X2.0,带来全球首个“可玩”的实时交互体验。模型主打实时渲染、次元交互、触屏交互及Free模式,用户可通过摄像头实时换人换装、在现实中召唤互动虚拟角色,或触控唤醒静态图像。技术上,X2.0采用流式生成实现毫秒级响应,单张消费级显卡即可满血运行,更是全球首个支持iPhone本地运行的同类模型。目前Xmax已开放API,成本仅为海外头部模型的十分之一,未来将深度赋能电商试穿、虚拟陪伴、直播互动等千行百业,全面重构视频交互范式。
原文链接
7月9日,蚂蚁灵波科技开源新一代实时交互世界模型LingBot-World 2.0。该模型在业界首次实现“小时级”实时生成,一小时不间断测试中画面清晰连贯;支持720p/60fps高清输出,边生成边显示,操控近乎无延迟。同时,它在业界首次引入双Agent机制,支持攻击、施法等丰富动作与天气变化等事件触发,并开创性支持AI原生多人同世界交互。该模型将赋能游戏生成、影视预演及具身智能训练等场景。用户现已可通过Reactor平台和灵光APP在线体验。
原文链接
近日,魔芯科技联合浙大、华为等正式发布首个全栈基于国产NPU的实时交互世界模型MoWorld。该模型突破“实时交互”瓶颈,推理速度超50FPS,部署成本直降70%,仅为同规模GPU方案的30%。通过全链路优化,MoWorld支持2000帧超长训练,可作为“空间模拟引擎”赋能游戏互动、具身智能、自动驾驶、影视创作及数字孪生等产业场景。资本端,魔芯科技近期已完成亿元美金融资,此前曾获华为、联想等投资。MoWorld近期将开源权重与代码,并基于国产NPU超节点向公众开放服务,引领世界模型迈入产业化时代。
原文链接
只需一张照片,就能生成一个能聊、能唱跳、24小时不下线的AI主播?虎牙最新推出的VAM 1.0实时多模态数字人模型做到了。与以往“照本宣科”的AI不同,它自带“直播基因”,能像朋友一样自然聊天、接梗,被随时打断也能巧妙接话,甚至还能陪你玩塔罗牌和狼人杀。
这背后,虎牙VAM 1.0成功翻越了行业的“...
原文链接
近日,阿里ATH正式推出开放式世界模型产品HappyOyster 1.0(快乐生蚝)。区别于传统文生视频的单向生成,该产品打造了可实时构建、探索与交互的数字世界。其主打“世界探索”与“实时导演”两大模式:用户既可化身主角在AI场景中自由行动、触发隐藏互动,也能作为导演通过自然语言实时掌控剧情走向,并支持剧情回溯与多线分支。技术上,依托闭环状态建模与内生一致性等核心突破,有效解决了长时序画面崩坏与角色变形痛点。目前该产品已正式上线,注册即可体验,API计划于近期开放,未来将深度赋能游戏、互动影视及文旅等行业,开启AI双向实时交互新纪元。
原文链接
正文:2026年5月,北京大学、香港中文大学、上海AI Lab等机构联合推出VGGT-Edit,一种原生3D编辑框架,可在约5秒内完成复杂3D场景编辑,最高实现120倍加速。该方法直接在3D空间中操作,避免传统2D编辑的视角不一致问题,在语义一致性、多视角稳定性和推理速度上表现优异。研究团队还构建了规模近10万组的DeltaScene数据集,用于训练和测试。VGGT-Edit通过残差场预测和深度同步文本注入等创新技术,能够精准修改局部区域并保持整体稳定性,甚至对未见过的指令也展现出良好泛化能力。这一突破为机器人、AR/VR等领域带来实时交互可能性,标志着3D编辑从概念走向实用。
原文链接
2026年3月,AI视频生成企业爱诗科技完成3亿美元C轮融资,由鼎晖领投,刷新亚洲AI视频领域单次融资纪录。公司技术实力获国际认可,PixVerse V5.6模型在图生视频与文生视频赛道位列全球第二。创始人王长虎表示,爱诗正从生成视频迈向实时交互的“可玩现实”,其发布的PixVerse R1实现用户指令驱动视频走向。目前,爱诗科技全球用户突破1亿,MAU超1600万,并与上万家企业合作。本轮融资将用于深耕通用视频模型及推动API商业化落地,助力全球创作者跨越技术鸿沟,开启AIGC数字内容新纪元。
原文链接
2026年2月,面壁智能开源全模态模型MiniCPM-o4.5,支持边看边听、主动抢答,实现即时自由对话。该模型采用全双工多模态实时流机制,可同步处理视频、音频输入与输出,突破传统AI的‘一问一答’模式,适用于复杂场景如超市导购、电梯提醒等。MiniCPM-o4.5以9B参数规模,在多模态理解、语音生成等领域达领先水平,专为端侧设计,强调隐私保护与低延迟。面壁智能计划推出配套硬件松果派开发板,预计年内上市,助力开发者快速构建端侧智能应用。公司聚焦端侧AI,致力于将端侧能力做到极致,推动端侧生态发展。
原文链接
2025年10月,百度蒸汽机模型推出重大升级,率先实现AI视频的实时流式生成与交互功能。用户只需上传一张图片和简单指令,即可生成高质量长视频,并支持随时暂停、修改与续写,打破传统生成时长限制。此次更新采用自回归扩散模型等技术,解决了生成效率与成本问题,推理延迟几乎实时。从5月登顶VBench-I2V榜单,到10月迈入实时交互时代,百度蒸汽机在短短5个月内完成了从图生视频到音画一体生成的技术演进。新功能不仅降低创作门槛,还推动AI视频能力向教育、影视等领域扩展,标志着AI内容创作从单向输出转向共创时代。
原文链接
10月15日,百度宣布其视频生成模型“百度蒸汽机”(文心专精)完成重大升级。此次升级突破了传统AI视频生成时长限制,行业首次实现AI长视频实时交互生成,生成速度超越国内主流模型。用户只需上传单张图片与提示词即可启动视频生成,并实时预览全部推理内容。在生成过程中,用户可随时暂停或修改提示词,动态调整视频剧情、画面及转场效果,实现全程干预。这一创新技术为视频创作提供了更高自由度和效率,展现了AI在长视频领域的全新可能性。
原文链接
加载更多
暂无内容