综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
2026年3月2日,阿里巴巴集团宣布将AI品牌统一为“千问”,以解决此前千问、通义千问、Qwen等多个名称带来的混淆问题。千问大模型(Qwen)覆盖基础大模型和专业领域模型,千问APP则作为C端旗舰AI应用。统一后,品牌中文名为“千问大模型”,英文名为“Qwen”,而“通义实验室”仍为阿里巴巴旗下AI机构的组织名称。此举旨在强化品牌认知,推动AI技术在更多场景的应用落地。
原文链接
阿里通义实验室于9月2日推出智能体开发框架AgentScope 1.0。该框架以开发者为核心,专注于多智能体开发,包含三层技术架构:核心框架负责构建与编排,Runtime提供安全沙箱环境,Studio支持可视化监控。其强化了实时介入控制、智能记忆管理和工具调用优化三大能力,兼容主流框架如LangGraph和AutoGen。GitHub已发布示例应用代码,包括文献研究助手等。项目地址详见多个GitHub仓库及技术报告链接。
原文链接
7月4日,阿里通义实验室宣布开源首个音频生成模型ThinkSound。该模型首次将思维链(CoT)技术应用于音频生成领域,能够像专业音效师一样“听懂画面”,实现高保真、强同步的空间音频生成。研究团队构建了支持链式推理的多模态音频数据集AudioCoT,包含2531.8小时高质量样本,覆盖动物鸣叫、机械运转等真实场景,并通过严格筛选保障数据质量。ThinkSound由多模态大语言模型和统一音频生成模型组成,分三阶段解析画面内容并生成精准音频效果。这一技术突破解决了传统视频到音频生成中动态细节与空间关系不足的问题,满足专业创意需求。项目已开源,详情可参考GitHub、Hugging Face及ModelScope平台。
原文链接
加载更多
暂无内容