综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
DeepSeek V4 最近开源了多模态权重,它不仅能“看图”,还将视觉深度融入了AI大脑。
图片如何变成模型懂的“语言”?图片先被切成小块提取特征,保留空间位置。接着,“秘书”(Aligner)将相邻的9个特征打包压缩,把庞大的图像精炼成最多384个“视觉词(Token)”送入主干。这既保留了画面...
原文链接
加载更多
暂无内容