综合
7*24 快讯
AI科普
合作
全部
英雄令
项目方
开发者
产品方
投资者
2026年暑假,北京中关村学院7名博士生仅用3个月从零训练出7B大模型ZGCM-1,并全面开源代码、数据、权重及训练日志。面对庞大工程,团队创新采用“AI4AI”范式,组建数百个Agent团队协助数据处理与实验监控,大幅提升研发效率。评测显示,ZGCM-1在多项通用任务中媲美同规模模型,部分推理与搜索能力可比肩更大参数模型。此外,团队结合局部与全局注意力机制,将256K上下文训练效率提升近4倍。此次实践不仅验证了小模型潜力,也为AI研发自主性提供了真实工程参考。目前团队正挑战更大规模模型。
原文链接
苹果罕见地开源了一款7B大模型,不仅性能与Llama 3 8B相当,还公开了全部训练过程和数据集,打破了此前对AI模型不透明的质疑。这引发了网友的热议,甚至被称为“不像苹果”的举动。模型基于DCLM-BASELINE等高质量数据集训练,表现出色,且在成本降低的同时保持了竞争力。小模型风潮下,HuggingFace、OpenAI和Mistral AI相继发布小型高效模型,显示出技术公司在模型规模与性价比上的新探索。业界观察人士期待这些创新将推动AI技术的普及和应用。
原文链接
加载更多
暂无内容