综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
8月31日,SkyProduction(天工工作台)全新版本正式上线,致力于为精品短剧创作提供从剧本到成片的一站式生产流程。新版本推出剧本翻译、评分及小说转剧本三大功能,并支持出海转绘。通过导演Agent,系统可自动拆解剧本生成分镜与视频,结合Seedance 2.5大幅降低试错成本。此外,工作台支持“片段重拍”与10分钟超长视频生成,实现局部精准修改。其无限画布支持多人实时协作,并配备完善的团队权限与成本明细管理系统。天工工作台将AI短剧从单次生成升级为可持续的标准化生产流程,助力创作者高效产出完整作品。
原文链接
给AI一张陶罐碎裂的图片,它能像侦探一样还原案发过程吗?近期,我们对比测试了开放权重的MiniMax H3与闭源模型Seedance 2.0 Fast。
实验中,我们输入一张动漫中陶罐碎裂的截图,并辅以“猫咪闯入撞碎陶罐”的文字提示,让AI反向生成事件视频。
本地部署的H3成功还原了“猫咪闯入、陶罐...
原文链接
近日,MiniMax发布全新一代开源视频模型MiniMax H3,登顶Artificial Analysis榜单。针对本地部署门槛高、硬件要求严等痛点,秘塔AI于8月5日正式上线MiniMax H3,实现网页端开箱即用。用户无需配置环境即可体验文生、图生视频等功能,几分钟即可生成大片。其价格更具颠覆性:768P方案低至0.09元/秒,2K版本0.15元/秒,5秒视频成本不到5毛,AI视频迈入“几分钱时代”。此外,平台同步开放API与ComfyUI工作流。此举大幅降低创作门槛与试错成本,让高质量视频生成普惠大众。
原文链接
#Sand.ai开源首个千亿MoE视频模型# 近日,清华系团队Sand.ai开源全球首个千亿MoE视频生成模型MAGI-2-preview。模型总参数114B,单次仅激活约6B,生成10秒1080P视频成本仅5毛钱,降至行业主流的十分之一。凭借自研单流架构与底层infra优化,其在AA视频生成榜单排名第六,音画同步与运镜表现媲美闭源第一梯队。此举打破了视频模型Scaling的“不可能三角”,为学界和企业的私有化部署提供新选项,被李开复誉为“AI视频生成界的DeepSeek”。目前代码权重已全面开源,视频生成行业迎来千亿级新变量!
原文链接
今日,字节跳动正式发布自研视频模型Seedance 2.5,“即梦AI”同步接入。此次升级实现多项行业突破:一是支持30秒视频原生直出,最长可生成3分钟超长视频,保障角色一致性与长镜头能力;二是新增视频编辑功能,支持局部修改与元素增删替换;三是参考生成能力跃升,最高支持50个素材参考,兼容绿幕与白模素材,并接入Maya和Blender插件,无缝对接专业生产线;四是实现1秒内精准时间戳指令控制。Seedance 2.5正从创意工具向专业生产力工具演进,全面赋能影视、广告及游戏行业,用户现可前往即梦AI官网抢鲜体验。
原文链接
标题:CVPR 2026 世界模型论文全景梳理:从生成到建模的关键转变
正文:
近年来,视频生成技术在视觉质量上取得了显著进展,但传统方法多基于2D图像空间逐帧建模,存在相机运动控制难、多物体交互不一致等问题。这些问题的根源在于模型缺乏对“世界本身”的建模能力。在此背景下,“世界模型”逐渐成为研...
原文链接
正文:4月27日,MuleRun(骡子快跑)首发灰测阿里巴巴视频生成模型HappyHorse 1.0,支持用户通过官网全天候调用。该模型具备文生视频、图生视频等能力,适用于广告、电商、短剧等场景。MuleRun为每位用户分配独立云端虚拟机,提供7×24小时服务,并主动学习用户偏好以优化体验。此外,HappyHorse 1.0支持15秒多镜头叙事、1080P输出及多种艺术风格还原。MuleRun还接入OpenAI的GPT-Image-2模型,支持一站式内容生产流程,包括图片处理、视频编辑等。用户可通过开放的Agent网络生态实现内容共享与共创。
原文链接
4月27日,千问APP率先开启阿里视频模型HappyHorse的灰度测试,用户可通过首页‘HappyHorse’按钮体验。内测期间,创作者利用该模型生成大量TVB港风、央视三国风及老电影风格短片,并发布于千问APP社区,其他用户也可通过Prompt一键制作同款视频。根据官网信息,720P和1080P视频生成刊例价分别为0.9元/秒和1.6元/秒,专业会员包月叠加限时折扣后为0.44元/秒和0.78元/秒。(记者 黄心怡)
原文链接
2026年4月,西湖大学AGI Lab张驰团队在CVPR 2026上发表论文《Taming Video Models for 3D and 4D Generation via Zero Shot Camera Control》,提出视频生成技术新方向。研究通过WorldForge模型,在不改变模型参数的情况下实现精确相机控制,解决了视角变化中几何一致性问题,将视频生成从二维视觉合成转向三维空间建模。实验显示,WorldForge在FID、CLIPsim等指标上显著优于现有方法,轨迹误差降低2到5倍,适用于3D静态场景与4D动态视频生成任务。该技术有望降低高质量视频制作门槛,赋能普通用户和创作者。研究团队由张驰教授领衔,一作宋晨曦为博士后研究员,成果入选CVPR Highlight,标志着视频AI从生成能力竞争迈向空间一致性与可控性竞争的关键转折点。
原文链接
4月14日,火山引擎宣布正式上线Seedance 2.0系列API服务,全面开放视频生成能力。企业和个人用户现可调用该服务,支持文字、图片、音频、视频四种模态输入。据悉,Seedance 2.0特别建立了肖像与版权安全标准,覆盖视频生成涉及的多种模态及创作全流程,保障用户在使用中的合规性与安全性。这一升级服务为内容创作者和企业提供了更高效、灵活的视频生成解决方案,进一步推动多模态内容创作的发展。
原文链接
加载更多
暂无内容