1
免责声明:Al优秘圈所有资讯仅代表作者个人观点,不构成任何投资理财建议。请确保访问网址为(kx.umi6.com) 投诉及建议
综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%
2025年9月,智谱开源模型GLM-4.5在伯克利工具调用榜单上超越Claude Opus 4.1,运行成本仅为1.4%。该模型采用MoE架构,在前端开发、跨文件修改等场景表现优异,编程能力接近Claude 4。通过CC-Bench评测体系对比,GLM-4.5在任务完成效果和工具调用可靠性方面表现出色。研究科学家Tim Dettmers称其推理速度比Opus 4.1快3倍、比GPT-5快5倍。此外,智谱推出Claude Code套餐,价格为Claude的1/7,适用于GLM-4.5及GLM-4.5-Air,进一步降低使用门槛。GLM-4.5已接入多款主流编程工具,支持全面开发流程,为开发者提供高性价比选择。
量子思考者
09-02 12:30:05
Claude Opus
GLM-4.5
工具调用
分享至
打开微信扫一扫
内容投诉
生成图片
腾讯混元推出首款开源混合推理模型,擅长Agent工具调用和长文理解
6月27日,腾讯混元推出首款开源混合推理模型Hunyuan-A13B,该模型参数总量为80B,激活参数仅13B,具备强大的通用能力,在多个权威数据测试集中表现优异。Hunyuan-A13B支持Agent工具调用和长文理解,拥有256K原生上下文窗口,适用于多种复杂任务。模型已在GitHub和Huggingface开源社区上线,并提供API接口供开发者快速接入部署。此外,腾讯混元还开源了两个新数据集ArtifactsBench和C3-Bench,用于评估大语言模型在代码生成和Agent场景中的能力。
智能视野
06-27 17:11:39
Agent工具调用
混合推理模型
腾讯混元
分享至
打开微信扫一扫
内容投诉
生成图片
苹果大模型新成果:GPT-4o扮演用户,在场景中考察大模型工具调用,网友:Siri也要努力 | 开源
苹果团队最新发布的开源成果——名为ToolSandbox的模型工具调用能力评估基准,采用创新的场景化测评方法,旨在更好地展现模型在真实环境中的水平。该基准引入了对话交互、状态依赖等传统标准未覆盖的重要场景,显著提高了评估的全面性和实用性。ToolSandbox通过让GPT-4o扮演用户与模型进行交互...
智慧棱镜
08-15 21:46:05
ToolSandbox
工具调用能力 Benchmark
苹果大模型新成果
分享至
打开微信扫一扫
内容投诉
生成图片
加载更多
暂无内容
AI热搜
更多
扫一扫体验小程序