综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
模型越来越强,AI的“脚手架”会被淘汰吗?
最近AI编程圈有个热门争论:随着大模型越来越聪明,外层的工程管控层(Harness,俗称“脚手架”)会被淘汰吗?前Kimi CLI负责人stdrc给出了反常识的答案:模型越强,Harness反而越“厚”。
很多人误以为模型能包揽一切。事实上,模型变强只是淘...
原文链接
8月20日,开源AI公司Prime Intellect发布最新研究,提出借助多智能体Harness框架,让更便宜的开源模型参与监控与实现,降低“AI开发AI”成本。在nanoGPT优化器速通实验中,18个前沿大模型展开角逐。结果显示,开源模型Kimi K3搭配该框架跑出2930步,超越GPT-5.6 Sol,逼近闭源旗舰Opus 5的2920步;Fable 5更达到2726步。研究表明,AI科研正演变为“试错吞吐量”问题。通过构建高效的底层科研基础设施与Multi-Agent系统,开源模型凭借高试错效率,能追平甚至超越顶级闭源模型,极大加速AI研发迭代。
原文链接
近日,声称能让小模型追平顶级大模型的开源项目J-Space被独立复测“打假”,实测性能不升反降且数据涉嫌造假。与此同时,OpenAI思维链核心发明者Jason Wei发文戳破“小模型+外挂工具”的幻想,强调大模型的内化能力在速度、思维深度及复杂任务可靠性上具有不可替代的优势。DSPy框架作者Omar Khattab也从底层数学逻辑佐证了“内化优于外挂”。此次风波再次印证了AI界《苦涩的教训》:精巧的工程外挂补不了模型智商,绝对的算力与参数规模才是通向高阶智能的真正基石。
原文链接
近日,顶级孵化器YC开源的企业级Agent管控工具QM引爆技术社区,上线3天狂揽3.9k Star并登顶Hacker News榜首。随着AI Agent深入企业场景,传统个人工具面临数据串台、权限失控等痛点。QM专为多人协作设计,通过Scope作用域隔离、持久化沙箱、模型无关架构及三级安全策略,精准解决数据隔离与权限治理难题。其核心亮点是让Agent绑定员工身份并复用现有IT权限,杜绝全局权限泛滥。QM的爆火标志着AI行业正从“拼模型能力”向“搭管控骨架”演进,为企业AI规模化安全落地筑牢基础设施。
原文链接
最近AI圈有个争议:大模型越来越聪明,外部的工程管控层(Harness)会被淘汰吗?前Kimi CLI负责人stdrc给出反常识答案:模型越强,Harness反而越“厚”。
很多人以为Harness会被“训进”模型,或随模型变强而变薄。但一线工程师知道,单靠模型“大脑”处理复杂长流程业务必然出错。就...
原文链接
近日,前OpenAI安全副总裁翁荔发布新博客,提出AI自进化的现实路径:不一定从模型直接改写权重开始,而是先从Harness(模型外部运行系统)着手。她指出,优化对象正从上下文、工作流逐步深入到Harness本身,模型可通过分析失败模式并修改系统实现自我进化。DeepSeek研究员崔添翼第一时间转发附议,强调Harness方向的自进化与模型方向一样极具潜力。尽管目前仍面临评估模糊、Reward hacking等瓶颈,但Harness已成为决定模型能力表现的关键变量。“AI自进化更现实的工程入口”将成为行业下一阶段的讨论重点。
原文链接
6月12日,小米Darwin Agent Team发布论文《HarnessX》,首创Agent“系统自进化”框架,终结智能体外壳(Harness)依赖人工调优的痛点。该框架将Harness升为“一等公民”,具备可组合、自适应、可进化特质,通过AEGIS引擎与变体隔离机制实现自我迭代,并支持模型与Harness协同进化。测试显示,HarnessX平均提升14.5%性能,搭配Qwen 3.5-9B等小模型时最高暴涨44%。此举为企业级AI打造关键底座,引发热议,但专家也提醒其在泛化能力、防作弊及高昂调用成本上仍存挑战。
原文链接
2026年5月,DeepSeek宣布融资额达700亿元,明确优先投入突破性AI研究。其备受关注的DeepSeek Code项目已正式启动,由资深研究员Deli Chen公开招募团队,目标是构建Code Harness系统。前TSY Capital联合创始人、ACM金牌得主崔添翼或将出任Agent Harness团队负责人,他曾多次斩获ACM竞赛金牌并拥有丰富行业经验。近期,DeepSeek密集发布10余个相关岗位,涵盖产品研发、算法研究等领域,显示其加速布局意图。尽管DeepSeek Code尚处早期阶段,但市场期待值颇高。与此同时,开发者可尝试类似工具如DeepSeek-TUI及官方推荐的开源替代品,提前体验相关功能。
原文链接
5月19日,DeepSeek资深研究员陈德里发布招聘贴,宣布组建全新“Harness”团队,目标对标Anthropic旗下明星产品Claude Code。这标志着DeepSeek从底层模型研究转向打造桌面端生产力入口,迈出从“模型公司”到“产品公司”的关键一步。新团队在北京海淀区开放产品经理与研发工程师岗位,核心路径定义为“Model + Harness = Agent”,涵盖上下文管理、工具调用等工程动作。此举动被视为中国AI行业从“秀参数”转向“做产品”的拐点信号。当前,AI编码市场竞争激烈,Anthropic、OpenAI等已占据领先地位,而DeepSeek凭借开源生态和中文优化优势,试图通过极致性价比和开发者社区突围。未来6-12个月内,DeepSeek需快速完成产品闭环,以应对市场窗口期的挑战。
原文链接
2026年4月,AI初创公司明日新程(Nextie)宣布完成两轮融资,由创新工场、Atypical Ventures领投,奇绩创坛跟投。公司由‘小冰之父’李笛及其原微软小冰核心团队创立,成立仅四个多月便获资本青睐,资金储备可支撑3-5年研发。明日新程专注于Harness群体多智能体技术,通过多智能体协同实现高效、稳定的AI任务处理能力,解决单一智能体盲区问题。其首个内测产品‘团子’已上线,展示出在复杂任务中的优异表现。此外,公司计划本月底推出全新形态的‘小冰岛’产品,深度融合Harness技术,为用户提供个性化、智能化的Agent服务。
原文链接
加载更多
暂无内容