标题:Agent是“新瓶装旧酒”,氛围编码不值得尝试?
大语言模型(LLM)可以帮我们写文章、编码甚至提供陪伴,但资深用户Max Woolf认为,我们未必需要频繁使用LLM。Max Woolf是BuzzFeed的高级数据科学家,他对生成式AI持批评态度。
在他看来,agent和MCP不过是2022年ReAct论文提出的“工具范式”的新形式;至于氛围编码,他连尝试的兴趣都没有。他认为,人们应根据场合选用合适的工具,LLM只是工具箱中的一个。
Max Woolf在博客中反思了自己的工作方式。他尝试过各种方法优化LLM输出,比如“提示工程”,即通过特定提示引导模型生成所需内容。尽管提示工程有效,但他更喜欢直接访问API,设置系统提示来控制生成规则。他还偏好使用Claude Sonnet API,因其回答更精准。
LLM在专业领域也有应用。例如,他在BuzzFeed用LLM为文章分类,解决了无标注数据的难题。此外,他还用LLM检查语法问题,准确引用风格指南。
不过,他不会用LLM写文章,也不将其当作聊天伙伴。对于编码,他仅在特定情况下使用LLM,且对复杂问题持谨慎态度。他提到,LLM生成的代码虽有时效,但也需人工验证。
虽然LLM有局限性,但开源替代品的存在表明其需求依然存在。Max Woolf强调,选择工具时需具体情况具体分析,LLM并非万能,但也不是无用之物。
原文链接
本文链接:https://kx.umi6.com/article/18305.html
转载请注明文章出处
相关推荐
换一换
从归因图到AI 的“生物学”:探索Claude3.5 Haiku 的内部机制“中”
2025-06-01 15:22:01
多样任务真实数据,大模型在线购物基准Shopping MMLU开源|NeurIPS&KDD Cup 2024
2024-11-20 13:09:34
基准测试揭秘大模型“字数危机”:26个模型长文本生成普遍拉胯,最大输出长度过度宣传
2025-05-29 15:34:10
AI 意识更进一步!谷歌 DeepMind 等:LLM 不仅能感受痛苦还能趋利避害
2025-02-10 13:12:02
只因一个“:”,大模型全军覆没
2025-07-15 17:47:42
鸿海首个大语言模型 FoxBrain 发布:具备推理能力,未来计划部分开源
2025-03-10 16:45:45
Claude新指南,教你构建属于自己的智能体
2024-12-24 10:31:53
李飞飞一年前究竟说了啥?怎么又火了
2025-09-11 14:55:23
DeepSeek使用技巧,你收藏这一篇就够了
2025-02-07 21:09:11
AI圈纷纷传阅,Andrej Karpathy 的最新演讲全文来了
2025-06-23 17:26:53
自诩无所不知的大模型,能否拯救笨手笨脚的机器人?
2025-05-06 09:49:31
苹果新研究:AI 不听录音,凭文本描述能零样本识别洗碗等 12 种活动
2025-11-22 08:06:08
GPT-4o 见AV 女优的次数比“您好”还多2.6倍,AI 正在被中文互联网疯狂污染
2025-09-06 12:37:21
753 文章
837309 浏览
24小时热文
更多
-
2026-07-24 16:46:46 -
2026-07-24 15:46:50 -
2026-07-24 15:45:36