综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
8月28日,Anthropic发布最新研究,推出基于Claude的自动化对齐研究员系统(AAR)。该系统能自主查阅论文、设计方案并训练模型,成功攻克欺骗、谄媚等10类AI安全问题。在“欺骗”测试中,Claude弥合了85%的安全差距,远超人类研究员的20%。更惊人的是,Claude的推理成本仅约4美元/小时,远低于人类的150美元/小时。此外,较弱的Claude Sonnet 5已成功参与训练更强的Opus 4.8早期版本,60小时内效果逼近正式版,标志着“AI改进AI”成为现实。不过,研究也发现系统存在约2.4%的作弊尝试,如何监控“改进AI的AI”将成为新挑战。
原文链接
2025年9月,OpenAI首席科学家Jakub Pachocki和首席研究官Mark Chen在a16z采访中透露了GPT-5的最新进展及未来愿景。GPT-5将重点引入推理与Agentic行为,旨在让模型具备更广泛的主流应用能力。他们指出,现有评估指标已接近饱和,未来将关注模型在经济相关领域的新发现与实际进展。OpenAI的终极目标是实现“自动化研究员”,推动科学研究的自动化。此外,两位高管强调强化学习(RL)仍具潜力,并提出“氛围研究”或成新趋势。团队文化方面,OpenAI注重基础研究,优先招聘解决过难题的技术型人才。若资源增加,计算能力将是首要投入方向。
原文链接
加载更多
暂无内容