实时快讯
AIGC
大模型
产业
项目
今天
星期二
5
月
14
日
12:24:36
至
刷新
今天
星期二
刷新
5
月
14
日
12:24:36
至
近日,至知创新研究院联合牛津、斯坦福及清华等机构,提出大模型机制可解释性新路线——“稀疏权重分解”(SWD)方法。传统研究常需训练替代网络来理解模型,而SWD直接从现有预训练权重中“拆”出可独立干预的稀疏计算路径。实验表明,在GPT-2、Qwen系列及27B参数规模模型上,SWD仅需不到传统方法1%的数据成本,便能以更少的瓶颈单元精准抽取任务回路,且支持全模型替换与零数据版本。该研究大幅降低了大模型“黑箱”解析成本,为理解大模型内部机制提供了轻量、高效的新方案。相关论文与代码已开源。
原文链接
8月14日,国产AI音乐黑马“音潮”重磅上线音乐大模型V4.0,正面挑战全球标杆SUNO!此次迭代直击AI“读不懂人类情绪”的行业痛点,大幅提升语义解读与场景适配能力,精准还原细分曲风、多乐器融合与细腻情感,让AI真正“懂你所想”。同时,音潮APP新增五大语种,实现全球十大主流语种全覆盖,并向C端全面开放专业纯音乐生成。此外,面向B端的音潮API开放平台同步上线,提供歌曲生成等四大核心能力,目前限时免费试用。音潮V4.0以底层技术质变,彻底打破国产AI音乐跟随局面!
原文链接
【Qwen3.8-27B正式开源!单张消费级显卡即可运行】2026年8月,备受期待的Qwen3.8-27B正式开源。该模型参数量270亿,量化后单张RTX 4090等消费级显卡即可本地运行。其在SWE-bench Pro等多项代码和Agent评测中反超Claude Opus 4.6 Max。模型具备原生多模态能力,支持262K原生上下文(可扩展至100万Token),重点强化编程与长程Agent任务。此外,新增“推理档位”调节与思考保留功能,底层采用线性注意力架构提升长序列处理效率。目前已接入vLLM等主流框架并提供量化版本,开发者可轻松部署体验。
原文链接
近日,DeepSeek Harness在GitHub上迅速爆火,相关公开仓库已突破700+个。秉承“万物皆插件”理念,社区开发者为其打造了海量插件。实用类涵盖多Agent协作、侧边栏IDE化、跨会话长期记忆、Claude数据迁移及视觉模型接入等,大幅提升开发效率。同时,画风清奇的娱乐插件也层出不穷,包括电子宠物、2005年复古网页广告UI、内置18款经典小游戏,甚至有自动回复“谢谢你,鲸鱼大人”的礼貌插件。DeepSeek Harness正被网友改造成兼具硬核生产力与赛博趣味的万能工作台。
原文链接
8月13日晚,深度求索(DeepSeek)正式发布首款智能体产品Harness。开源仅12小时,其代码仓库星标便突破5万,创下惊人增速。该产品被喻为“智能体界的安卓”,核心理念是“一切皆插件”,将模型、工具、界面等组件全面开源,赋予开发者极高的自定义自由度。实测显示,它能高效完成网页重构、数据抓取与绘图等复杂任务,单次任务算力消耗不到3元,并具备全程留痕优势。尽管目前仍是面向开发者的预览版,对普通用户不够友好,但官方意在通过开源生态构建智能体底座,推动大模型从按字收费向交付结果转型。
原文链接
今日,通义千问正式开源Qwen3.8系列模型,备受瞩目的270亿参数模型Qwen3.8-27B同步上线。该模型采用Apache2.0协议,所有人可免费下载部署及商用。作为原生多模态稠密模型,它支持262K原生上下文,较前代在编程和办公场景性能大幅提升,表现超越Qwen3.7-Plus。此外,新增的思考深度控制功能可大幅节省算力,让家用显卡也能轻松运行复杂任务。截至目前,千问已累计开源460余个模型,全球下载总量超30亿次,持续领跑全球AI开源社区,助力开发者创造更多新应用。
原文链接
8月14日,曾传闻以1亿美元天价年薪加盟Meta的AI大牛余家辉官宣离职,准备创业。2025年6月底,余家辉加入Meta超级智能实验室核心的TBD Lab,担任多模态负责人。在职一年多期间,他带领团队交出亮眼答卷,接连推出Muse Spark、Voice Mode等多模态重磅产品。谈及创业新方向,余家辉表示将被一个“对人类未来非常重要且尚未被充分探索”的问题吸引,具体细节待日后公布。他的离开也引发外界对Meta人才流失的关注,数据显示目前已有超900名曾在Meta任职的研究员离职,Meta AI的未来面临考验。
原文链接
8月6日,谷歌正式“肢解”DeepMind,数个非技术团队被划归总部,旨在打破部门壁垒,加速Gemini产品化。权力格局也随之洗牌:Koray Kavukcuoglu掌握DeepMind重大决策最终决定权,成为Gemini发展核心;联合创始人谢尔盖·布林则重返AI权力中心,强力推动资源向“AI自进化”等前沿方向倾斜。重组背后是Gemini掉队的焦虑。新版模型已推迟两月,3.5 Pro疑被取消。算力争夺、高管内讧与官僚主义被视为落后主因。面对外部激烈竞争,谷歌正试图通过这场大刀阔斧的组织手术,让Gemini重回AI第一梯队。
原文链接
8月14日消息,苹果联合阿里训练中国专属自研AI大模型,采用“自研模型+通义千问”双轨策略落地Apple Intelligence。若属实,苹果将成首家在国内落地自有大模型的海外科技企业。新方案中,端侧AI由苹果自研模型承载,通义千问负责云端复杂任务,兼顾合规与体验主导权。双方合作于2025年启动,阿里提供算力与数据等支撑。目前,相关服务已于上月完成国内备案审批。预计未来数月,完整功能将随系统更新推送至国行iPhone、iPad、Mac及Vision Pro等设备,助力苹果缩小与国内竞品的AI差距。
原文链接
8月13日晚,智谱正式上线GLM-5.3大模型,主打“最强安全、最强编程、最强开源”三大标签。在基座不变的情况下,得益于IndexShare、SAO及Slime等极致后训练技术,其编程能力体感暴涨50%,在复杂工程等评测中逼近甚至反超Claude Fable 5,且算力节省一半。安全方面更是重头戏,累计挖出2436个漏洞,包含1097个中高危漏洞,不仅成功狙击AI黑客攻击,还揪出潜伏40年的互联网底层DNS协议世界级隐患。目前,官方编程工具ZCode、AutoClaw及GLM Coding Plan已全面开放订阅。
原文链接
加载更多
暂无内容
AI热搜
更多
本周大事件
更多
1/2