文章
(772)
8月26日晚,千问办公首发上线全新Qwen3.8-Flash模型并推出标准模式。该模型以千亿级总参数实现了超越Claude Opus 4.6的卓越性能,并针对多步规划等办公场景进行专项调优。真实场景测试显示,标准模式下单任务生成速度提升约100%,Token消耗平均减少75%。未来,千问办公模型供给将仅保留标准与高级两种模式,95%的日常任务通过标准模式即可完成。此次Agent与模型的深度协同优化,成功打破了性能、成本和速度的“不可能三角”,标志着AI办公正式告别Token焦虑,迎来“量大管饱”的高效新时代。
原文链接
【Top级视频AI免费!Agnes Video 2.5系列上线】今日,明星AI实验室Agnes正式发布Agnes Video 2.5系列并上线Pavo创作平台。其Flash版完全免费,标准版每日送200积分,性能已达全球主流水平。Pavo平台创新推出“无限画布”与“剧情短片”模式,结合3D导演台等功能,支持精细化控制人物与场景,轻松制作短剧、广告及MV等完整作品。此次免费策略极大降低了试错成本,让创作者能大胆尝试。业内指出,视频AI竞争正从单一镜头画质转向完整作品的可控性与一致性,当技术门槛被打下来,核心将回归用户的创意本身。
原文链接
8月20日,匿名大模型Ox Alpha(昵称“牛来大模型”)上线OpenRouter,凭借百万级上下文、多模态能力及免费不限量使用引发AI圈热议。近日,网友通过Tokenizer、视频token消耗及API报错等技术“指纹”深度扒皮,推测其大概率为智谱旗下GLM系列模型,因智谱今年2月曾有类似匿名测试先例。同时,因模型特性相似及DeepMind员工社媒暗示,也有人猜测其为谷歌尚未发布的Gemini 3.5 Pro,甚至有调侃称是Cursor基于智谱开源模型微调。目前该模型在代码任务表现亮眼但评测存分歧,其真实身份即将揭晓。
原文链接
近日,Generalist AI公司正式发布新一代机器人基础模型GEN-1.5,引发业界惊呼机器人界的“GPT-3时刻”已至!该模型主打“物理版提示工程”,机器人只需观看3到12秒的动作示范,在零微调、零梯度更新的条件下,就能快速学会全新任务并举一反三。它甚至能拼接多段不同演示进行连续学习,或将虚拟世界的演示一比一完美复现到现实物理世界,零训练平均成功率高达59%。最令人震撼的是,这种强大的上下文学习能力并非人工专门设计,而是在大规模真实物理数据预训练过程中自然涌现的。这标志着机器人向通用智能迈出颠覆性一步。
原文链接
在2026世界机器人大会(WRC)上,千寻智能重演了月前WAIC的“整理客厅”Demo。这并非“炒冷饭”,短短30天内其机器人Moz1实现量化跃迁:物品收纳成功率升至99%以上,导航耗时降低近50%。跃迁背后是千寻首创的“时间密度”概念及全栈技术底牌,涵盖数据管线、Spirit v1.6基座模型与Agent决策等。目前,Moz1已在宁德时代等工业产线落地,成功率超99%;Moz2则拓展至商超等公域场景。千寻正以快速迭代、自我生长的全栈技术系统,加速具身智能的真实场景落地。
原文链接
近日,曾被PI里程碑论文π0引用的中国团队Current Robotics(创始人祝毅晨)重磅发布交互式世界仿真器新作CurrentWorld-0。该系统首次将跨本体、多视角及力-触觉预测融入同一框架,在虚拟环境中真实还原物理反馈。与传统模型不同,它具备严格的动作可控性,绝不替机器人策略“纠错”,确保评测不失真。此外,系统支持人类随时接管与状态回滚,生成的多模态纠错轨迹可直接用于策略后训练。CurrentWorld-0为各类机器人提供了统一的虚拟演练场,助力具身智能在步入真实世界前完成高效验证与迭代。
原文链接
今日凌晨,AI圈迎来巅峰对决!梁文锋正式发布DeepSeek V4 Pro,马斯克同期推出旗舰Grok 4.6。两大模型同日发布,性能直逼Fable 5等顶尖模型。实测显示,两者在3D建模、前端设计等编程任务中表现不相上下。DeepSeek在网络安全等测试中拔得头筹,Grok 4.6则在知识工作中反超竞品。更震撼的是“价格战”:DeepSeek每百万输出Token仅需0.87美元,成本仅为Grok的1/7、Fable 5的1/57!这场“高能低价”的对轰让顶尖智能不再高不可攀,正彻底改写AI竞争格局,属于所有人的AI应用大爆发已然开启!
原文链接
8月11日,戴盟机器人宣布完成数亿元战略轮融资,蚂蚁集团领投,这是蚂蚁首次投资机器人触觉感知层。同日,戴盟发布全球首个“物理交互脑”——触觉锚定世界模型Daimon-TWM,以原生触觉贯通理解与推理,推动具身智能迈向“交互世界”。戴盟由CMU与港科大顶尖团队创立,目前已在视触觉设备出货量、数据集下载量等8项指标斩获全球第一,服务OpenAI等200余家头部客户。此次融资与新品发布,标志着资本正加速从具身本体涌向触觉感知层,物理智能迎来寒武纪大爆发。
原文链接
在语音交互中,哪怕卡顿零点几秒,也会让人瞬间出戏。为了让AI说话不再“结巴”,OpenAI耗时半年重构了语音系统GPT-Live,让原本最慢的音频帧,跑出了旧系统最快速度的流畅感。它靠什么打破延迟魔咒?
第一,给AI“分工”并“换底座”。过去AI听、想、搜挤在一条道上,容易堵车。现在,GPT-Liv...
原文链接
7月31日,DeepSeek更新DeepSeek-V4-Flash模型并在API端公测。此次更新在架构与参数规模不变的前提下,仅通过重新后训练便大幅提升Agent能力。新版模型在多项代码Agent测试中表现优异,能连续完成读取文件、调用终端等复杂任务。同时,模型原生支持Responses API并适配Codex,降低了开发者接入Agent工具的适配成本。此举验证了通过后训练与接口适配提升模型实际任务能力的务实路线。具体后训练细节尚未公开,实际表现待第三方测试验证。
原文链接
加载更多
24小时热文
更多
-
2026-09-05 23:32:44 -
2026-09-05 23:31:11 -
2026-09-05 15:16:02