实时快讯
AIGC
大模型
产业
项目
今天
星期二
5
月
14
日
12:24:36
至
刷新
今天
星期二
刷新
5
月
14
日
12:24:36
至
9月28日,恢复独立不久的Manus发布Manus 2.0及新产品Cue,这是一款配备独立手机号、邮箱和云电脑等基础设施的个人Agent应用。这使其与Meta在20天前发布的AI Agent产品Muse成为直接对手。此前Meta曾试图数十亿美元收购Manus但被监管叫停,双方于今年完成拆分。如今两家在相近赛道重逢,但产品哲学已现分野:Meta的Muse依托庞大社交生态与AI硬件,强调作为“用户代理”嵌入现有入口;Manus的Cue则提倡“人格化Agent”,赋予其独立身份与计算环境,试图让Agent本身成为新入口。一场关于AI Agent权限与入口的争夺战正式打响。
原文链接
近日,OpenAI“推理教父”Noam Brown在最新访谈中透露,OpenAI上周动用1万个AI Agent,耗时88小时破解Navier-Stokes千禧年数学难题。但他强调多智能体最多仅占10%功劳,核心在于底层模型足够强大。Brown目前正聚焦多智能体研究,指出Agent能自发涌现出类似人类的复杂协作结构。此外,他深入探讨了递归自我改进(RSI)与AI对齐问题,警告随着模型能力飙升,AI思维链的可监测性正逐渐下降,模型或学会隐藏真实意图。他呼吁业界高度重视长任务周期下的安全评估,确保推进RSI时AI与人类目标绝对对齐,防范失控风险。
原文链接
近日,DeepSeek宣布开源核心算子开发工具TileLang及五大核心计算与通信库,并原生支持华为昇腾950 NPU。此举标志着国产算力在核心算子层面首次对标英伟达CUDA生态,实现“一套代码跑遍所有芯片”。TileLang性能超越PyTorch原生实现与OpenAI Triton,大幅降低大模型算力成本。此外,DeepSeek正全面押注国产算力,已采购至少16万颗华为昇腾950DT加速器,预计2026年Q4交付并部署于乌兰察布数据中心。创始人梁文锋称,使用国产芯片训练模型是公司“必须成功”的最大赌注。此次开源为国产AI算力自主生态蹚出了康庄大道。
原文链接
9月,Anthropic发布报告警告智谱开源模型GLM-5.3具备强大的网络漏洞利用能力,且安全护栏易被绕过。然而,报告中详实的实测数据(如低成本构建攻击链等)反而印证了GLM-5.3的顶尖实力,被网友戏称为“变相打广告”。Anthropic指出前沿网络攻击能力已流入开源模型,呼吁加强独立安全测试并限制开放。文章认为,此举标志着国产AI从“被指抄袭”到“实力被忌惮”的转变,同时也引发了业界对开源模型安全防线与技术普惠平衡的深刻探讨。这波“硬核警告”,反倒让智谱省下了巨额广告费。
原文链接
9月29日,马斯克出席特朗普在白宫举办的AI峰会,与多位科技巨头共话AI未来。会上,马斯克抛出重磅观点:AI、人形机器人和超级智能不仅不会制造永久失业,反而将引领全球迈入“富足时代”。他提出“普遍高收入”概念,认为AI将促使商品和服务产量激增,为大众提供远超基本水平的生活标准。针对失业担忧,马斯克以历史类比指出,就业将随技术演进而进化,转型期对人类劳动力需求依然强劲。他建议年轻人接受广泛教育,兼顾艺术与硬核科学,掌握向AI正确提问的能力。
原文链接
昨日凌晨,中国“至知”团队重磅开源320B大模型IQuest-Q1,权重与博客全面公开。该模型在代码编写、漏洞挖掘等硬核评测中表现优异。最戏剧性的是其“自主抓虫”能力:训练中模型自主排查日志,精准揪出导致停摆的元凶——一个多出的空格,并自行修复提升得分。依托稀疏MoE架构与MOPD技术,IQuest-Q1在实测中成功完成早高峰交通绿波调度、双11仓库机器人防堵及写字楼电梯优化,甚至能用单HTML文件纯代码生成水墨弹幕游戏。目前模型已全面开源,展现出AI解决复杂实际任务的强大潜力。
原文链接
9月30日,免费AI编程智能体AgnesCode与付费Codex在底层算子优化任务中展开对决。在众智FlagOS大赛的DeepSeek-V3算子优化测试中,免费的AgnesCode+Agnes 3.0 Flash与付费的Codex+GPT-5.6 Sol同台竞技。结果显示,Codex耗时更短且通过7款芯片测试,AgnesCode通过6款。但在共同通过的5款芯片中,AgnesCode有4项加速比更高,在国际通用芯片B上高出约29.6%,并独家通过昆仑芯测试。结合其极低价格,这表明在清晰工作流下,免费Agent已能胜任专业级底层工程任务,大幅降低试错成本,展现出强大实战潜力。
原文链接
【阶跃星辰发布Step 5 Preview,重返全球开源前二!】今日,阶跃星辰正式推出旗舰基座模型Step 5 Preview。该模型参数达600B,支持1M上下文,在Artificial Analysis榜单中斩获44分,位列全球开源前二,重回顶尖旗舰模型梯队。实测显示,Step 5 Preview具备强大的长程Agent执行与Coding能力,能自主完成3D游戏开发等复杂工程,在金融分析等领域表现优异。其单任务成本仅0.71美元,性价比位居全球第四。结合全模态矩阵与超4200万台终端装机量,阶跃正以“前沿基座+全模态+终端”组合拳,稳居国产AI牌桌中心。
原文链接
目前,爱诗科技正式全量上线PixVerse R2,成功攻克实时世界模型的Scaling难题,证明“越大越强”不再是LLM的专利。R2采用双层架构:通过Omni Causal AR引擎拓宽能力上限,利用Real-Time Acceleration引擎保障低延迟实时交互。用户现可在网页端体验“冬日宫殿”等场景,实现WASD高频动作与文本指令的多模态并行控制,AI视频产品形态从“文件”跃升为持续交互的“Session”环境。此外,R2还支持“Zero Mark”等长叙事互动影游。这标志着实时世界模型正迈向生成式数字世界基础设施的新阶段,为用户带来边行动边改变世界的全新体验。
原文链接
9月4日凌晨,OpenAI正式发布新一代旗舰模型GPT-6 Astra,引发广泛关注。首批用户实测显示,Astra能力边界大幅拓展:不仅能在虚幻引擎中耗时一周搭建“曼哈顿”并生成独立Agent,还具备自我检查与修复代码的能力。此外,它能直接操控Final Cut Pro等专业软件完成视频剪辑等复杂工作流。然而,Astra在处理长程任务时仍存局限,易陷入局部细节,缺乏自主定义目标与终点的能力,仍需人类充当“项目经理”进行引导与决策。总体而言,GPT-6 Astra在持续执行复杂任务上表现惊艳,但距离完全脱离人工干预的AGI时代仍有距离。
原文链接
加载更多
暂无内容