3月26日,科技媒体NeoWin报道,数据智能公司Databricks推出大语言模型微调新方法TAO(Test-time Adaptive Optimization)。该方法通过无标注数据和强化学习技术,在降低成本的同时提升模型性能。测试表明,经TAO微调后的Llama 3.3 70B模型,在金融文档问答和SQL生成任务中的表现甚至超越传统标注微调方式,并接近OpenAI顶级闭源模型。在三大企业基准测试中,TAO微调的Llama模型表现优异:FinanceBench(7200道SEC文档问答)得分85.1,优于标注微调(81.1)和GPT-4o(82.2);BIRD-SQL测试中得分56.1,接近GPT-4o(58.1);DB Enterprise Arena测试中得47.2分,GPT-4o得53.8分。TAO技术利用测试时计算自动优化模型,无需人工标注,且随着使用量增加,模型可进一步自我优化。目前,该技术已在Llama模型上开启私测,企业可申请参与。
原文链接
本文链接:https://kx.umi6.com/article/16224.html
转载请注明文章出处
相关推荐
换一换
Llama核心团队“大面积跑路”,14人中11人出走
2025-05-27 16:23:08
扎克伯格押注 AI:Meta 正推动美国政府使用其 Llama 模型
2024-10-31 08:40:36
扎克伯格:Meta 的 Llama 模型下载量已达 10 亿次
2025-03-19 17:42:07
TUM 黎子玥:模型这么大这么强,为什么还是「上不了路」?| IJCAI 2026
2026-09-01 11:33:26
严查!网信办处置一大批用AI生成数字泔水、儿童邪典视频账号
2026-09-02 11:27:30
谷歌AI硬气一回:Gemini 3.8仅用15%价格接近Opus5 斩获8项编程第一
2026-09-03 00:58:51
这个世界模型训练完就“退场”,机器人反而更能干了
2026-09-05 13:11:38
AI 读过一切,却没经历过任何事:Ropedia 发布 HOMIE Gen2,给具身智能补「经验」这一课
2026-09-01 13:39:02
连尚集团入选上海市首批算力生态合作伙伴名单
2026-09-03 11:19:32
SkyProduction天工工作台:从剧本到成片,一套工作台把精品短剧创作真正跑起来
2026-09-02 17:38:53
黄仁勋140亿美元豪赌一只鸭
2026-09-04 17:33:09
DeepSeek V4 多模态开源,我们把它的视觉链路拆了一遍
2026-09-01 18:52:06
马斯克:AI将令全球经济规模增长20%-30% 十年内人形机器人达10亿台
2026-09-02 10:27:24
732 文章
931003 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47