综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
【不换模型,效果提升104%!上海AI Lab让Agent实现自进化】近期,上海人工智能实验室提出Self-Harness技术,获LangChain CEO等大佬关注。该技术打破人工调参瓶颈,在不换底层模型前提下,让Agent外层运行装置实现自进化。它通过挖掘失败弱点、提出修改提案及回归测试三步闭环自动优化系统。在Terminal-Bench评测中,Qwen3.5、MiniMax和GLM-5效果分别提升104%、28%和24%。该技术为自进化Agent提供清晰优化边界,论文与项目已开源。
原文链接
#WAIC2026# 7月17日,2026世界人工智能大会在上海举行。PPIO正式发布全新Agentic Cloud定位及智能模型网关新品,打造面向Agent时代的智能Token工厂。PPIO CEO姚欣提出Agent生产力公式,推出两大核心产品:智能模型网关通过混合模型与智能调度,可提升20%智能水平并降本50%-60%;Agent Harness层融合沙箱等技术,大幅延长Agent运行时长。目前PPIO日均Token调用量超1.2万亿,居国内独立AI云服务商首位。此外,PPIO同步推出“Token出海”服务,依托全球算力网络助力中国AI企业出海。
原文链接
7月14日凌晨,OpenAI举办GPT 5.6发布会,推出ChatGPT Work、桌面App、Hosted Sites及Soul/Terra/Luna系列模型。这标志着ChatGPT正从问答工具向“Agent执行系统”全面演进。其技术路线聚焦三大核心:一是构建执行链路,由Work接任务、桌面App接入真实环境、Hosted Sites交付结果;二是优化模型调度,通过分层模型与Ultra Mode多Agent并行,平衡推理成本与性能;三是确立可信边界,引入最小权限、操作分级、过程审计与事务化执行机制,保障企业级操作安全。GPT 5.6的最终价值将取决于其在真实工作流中的执行稳定性。
原文链接
7月14日,DeepSeek更新官方API文档,发布thinking mode与tool call结合使用样例。此次更新的关键在于reasoning_content字段:在工具调用场景下,该字段记录的模型中间推理内容不再是可选的调试信息,必须完整保留并在后续请求中回传,否则将触发400错误。这标志着Agent开发的核心难点正从“模型调用工具”转向复杂的“系统状态管理”。开发者需升级Agent架构,提升对中间状态、上下文及多模型适配的精细化管理能力,增强系统可观测性,以确保Agent在多轮推理与复杂任务中的稳定运行。
原文链接
7月,中国团队研发的Agent专用AI搜索产品AnySearch上线仅两个月,便成功登顶Product Hunt周榜Top 1。与面向人类的传统搜索不同,AnySearch专为AI Agent设计,覆盖代码、金融等20多个垂直数据源。它通过智能意图识别与前置筛选算法,为Agent提供实时、准确的结构化数据,大幅降低Token消耗。在近期基准测试中,其准确率与延迟均领先竞品。目前产品支持API等多种接入方式,注册每日享1000次免费调用,正成为Agent时代的核心基础设施。
原文链接
正文:#WAIC# 世界人工智能大会下周将在上海启动。除了看展,量子位特别策划“真话局”线下活动,追问核心考题:AI聪明够了,行动呢?从“会回答”到“能完成”,AI如何真正落地核心流程?7月17日19:30,上海浦东某咖啡馆,Evomap、VAST等企业高管将围绕Agent是否上岗、模型能否与世界交互等议题分享。关掉PPT,诚邀开发者、研究员与投资人自由交流,提前洞察AI的下一步。
原文链接
7月8日,国际AI顶会ACL 2026公布最佳论文奖,阿里团队凭借Deep Research Agent研究斩获最佳资源论文奖,系国内唯一获奖的中国公司。该论文首次揭示当前Agent在真实复杂规则推理中的缺陷,并提出全新专家评测基准HSCodeComp。测试显示,主流Agent准确率仅约45%,远低于人类专家的95%,且单纯堆算力无法突破此架构瓶颈。基于此,阿里设计了以Qwen为核心的Agent框架,准确率达65%居AI系统首位。目前数据集与代码已开源,该成果为跨境贸易、法律医疗等领域的专业AI系统构建提供了科学评测标杆。
原文链接
【让Agent“长眼睛”!openJiuwen首发多模态Skill-Omni】传统Agent的Skill多为纯文本,难处理修图、GUI等视觉任务。7月7日,openJiuwen正式发布业界首个工程化落地的多模态Skill范式Skill-Omni,让Agent经验从“读得懂”升级为“看得见”。借助JiuwenSwarm,用户仅需提供网页或视频链接,系统即可提取关键截图与操作脉络生成多模态Skill。配合按需读取机制,Agent能在图像编辑、GUI自动化等场景精准调用视觉证据,避免上下文过载。该功能现已开箱可用,未来将探索Physical Skill,推动Agent经验库向多模态全面进化!
原文链接
7月2日,由蚂蚁集团、清华大学等团队发起的开源强化学习基础设施项目AReaL正式发布2.0版本,技术报告与代码同步开源。AReaL 2.0专为真实业务场景的智能体(Agent)打造,提供在线强化学习基础设施。它打通了模型训练与Agent应用链路,能记录Agent在真实任务中的交互与反馈,并转化为持续优化模型的训练数据,解决Agent上线后难以成长的痛点,使其在安全可控前提下“越用越强”。系统还引入数据代理机制保障企业数据安全。今年5月AReaL已独立并加入PyTorch生态,未来将持续推进自演进智能体发展。
原文链接
近日,天工3.2重磅升级,正式推出Skywork Tags功能。与传统Agent要求用户迁移数据不同,Skywork Tags选择“主动上门”,直接接入Slack、飞书、钉钉等主流办公通讯工具。用户只需将机器人拉入工作群,AI便能以“新同事”身份无缝参与协作。该功能打破“一人一助手”模式,打造团队共享Agent,实现任务进度透明、异步可接力,并通过长期沉淀群聊上下文越用越强。内部实验证实,团队共养的Agent成长速度远超个人定制版。目前Skywork Tags已全面上线,用户可登录天工或Skywork官网体验,让AI真正融入团队日常工作流。
原文链接
加载更多
暂无内容