标题:Anthropic放大招:AI能像人一样操作电脑,你旁边看着就行
Anthropic近日发布了Claude 3.5的两项重大更新,包括Sonnet和Haiku两个版本。
Claude 3.5 Sonnet在编程方面表现突出,并新增了“计算机使用能力”,使AI能像人类一样操作电脑。例如,浏览网页、查找信息、填写表格、进行软件测试和开发等任务,AI都能自动完成。开发者只需下达指令,AI就能自动执行一系列操作,如搜索信息、填写表格和提交表单等。
Sonnet还展示了其在网页构建和本地修改方面的强大功能。它能自动下载文件并在编辑器中打开,分析问题并修复代码,成功启动服务器。此外,Sonnet还能帮助用户规划旅行,搜索合适地点、计算距离和设置日程提醒等。
Claude 3.5 Sonnet的工作原理涉及四个步骤:启动阶段、决策阶段、执行工具操作阶段和持续调用工具直至任务完成。虽然目前仍有一些限制,如鼠标滚轮、拖拽和缩放等操作尚有挑战,但Anthropic团队正不断改进。
Sonnet在多项基准测试中表现出色,包括编程和工具使用任务。它在SWE-bench Verified测试中的编程分数从33.4%提升到49.0%,超越所有公开可用的模型。同时,Sonnet的综合性能也得到了早期用户的高度评价。
Claude 3.5 Haiku是另一款性价比更高的模型,保持了与Claude 3 Haiku相同的成本和速度,但在编程任务上表现更佳,超过了多个前沿公开模型。Haiku还具备低延迟、改进的指令执行能力和更精确的工具使用能力,适用于多种应用场景。
这两项更新展示了Anthropic在AI领域的领先地位,不仅提升了AI的编程能力,还使其能像人类一样操作电脑,开启了新的技术应用前景。
原文链接
本文链接:https://kx.umi6.com/article/7731.html
转载请注明文章出处
相关推荐
换一换
编程权威榜单:千问3.7仅次于Claude,阿里全球第二
2026-05-26 14:30:08
DeepSeek又更新了!化身更强AI设计师、程序员 比肩全球最强代码生成器?
2025-03-25 09:48:08
最强AI也跌落神坛 Claude Opus 4.7被指负升级:国内外都在喷
2026-04-17 15:06:53
实测GPT-5:写作坠入谷底,编程一骑绝尘
2025-08-08 09:11:19
o3来了!编程能力跻身人类全球前200,破解陶哲轩说难的数学测试,北大校友任泓宇现身直播间
2024-12-21 03:44:33
Claude 3.5深夜觉醒,学会模仿人类用电脑!编程干翻o1,Agent一夜变天
2024-10-24 11:06:19
GPT-5来了!人人都能免费用,最强大模型只需最傻瓜式使用
2025-08-08 04:01:37
拜拜Claude!阿里最强万亿模型编程秒了Opus4,实测在此
2025-09-06 12:37:03
DeepSeek V4爆料:春节档GPT/Claude编程危
2026-01-10 10:03:27
OpenAI惊人自曝:GPT-5真「降智」了!但重现「神之一手」,剑指代码王座
2025-08-11 15:02:10
OpenAI GPT-5 编程成绩有猫腻:自删 23 道测试题,关键基准还是自己提的
2025-08-12 13:18:21
实测DeepSeek V3.1,不止拓展上下文长度
2025-08-20 17:21:15
编程能力大幅提升,OpenAI 发布 GPT-5-Codex 新模型
2025-09-16 09:08:45
702 文章
837723 浏览
24小时热文
更多
-
2026-09-06 21:14:00 -
2026-09-06 20:12:34 -
2026-09-06 20:10:47