《科创板日报》6日,字节跳动提出一种名为OmniHuman的多模态数字人视频生成框架。该框架基于一张图片和运动信号(如音频、视频或两者)生成逼真视频。据科技媒体TechSpot称,这是目前最逼真的深度仿真算法之一。不过,该技术目前尚未向公众开放。
原文链接
本文链接:https://kx.umi6.com/article/12712.html
转载请注明文章出处
相关推荐
换一换
字节跳动发布新一代形式化数学推理专用模型 Seed Prover 1.5
2025-12-24 12:36:08
张一鸣门徒的AI战争:不做通用大模型,专攻“大厂缝隙”
2025-08-01 15:06:59
Nano Banana爆火背后,深聊谷歌多模态五大主线布局
2025-09-10 15:36:58
美团发布并开源 LongCat-Flash-Omni 模型:支持实时音视频交互,达到 SOTA 水平
2025-11-03 11:17:00
刚刚,全球视频模型新王诞生了!
2026-03-19 16:05:16
字节跳动发布 Seedance 1.5 pro 模型,支持音视频联合生成
2025-12-16 21:00:49
最强开源大模型除夕登场!397B参数千问3.5超越Gemini 3,百万Tokens低至8毛
2026-02-16 19:34:51
字节推出形式化数学推理专用模型Seed Prover 1.5
2025-12-24 12:40:34
视频理解霸榜!快手Keye-VL旗舰模型重磅开源,多模态视频感知领头羊
2025-11-28 17:39:28
字节跳动启动“豆包股”回购 回购价比授予价上浮约30%
2026-04-16 10:55:51
字节跳动正推进与多家厂商的AI手机合作
2025-12-19 11:50:22
中兴通讯:正与字节跳动等生态伙伴深化合作 推进新一代豆包AI手机研发与落地
2026-03-31 11:43:26
DeepSeek识图模式是个新模型?!一手实测在此(没错我被灰度到了)
2026-04-30 15:28:30
755 文章
835511 浏览
24小时热文
更多
-
2026-07-24 00:15:46 -
2026-07-24 00:14:08 -
2026-07-24 00:12:30