马斯克在社交平台X上宣布,其旗下AI团队研发的Grok 4.8模型已完成关键技术升级。这款采用全新C++软件栈训练的模型参数量达2.5万亿,预计本周内结束训练阶段并启动强化学习流程。该消息引发科技界对AI模型规模突破的广泛关注。
此前计划于9月12日发布的Grok 4.7版本出现技术调整。马斯克解释称,团队发现强化学习模块存在回复长度惩罚机制缺陷,导致模型在处理复杂任务时过早终止运算。同时验证流程的严谨性不足,需要额外时间优化验证标准。这些技术问题迫使原定发布计划推迟数日。
根据公开技术参数,Grok 4.7本应成为2.1万亿参数量的里程碑式产品。该版本在继承前代优势基础上,通过优化Token使用效率实现计算资源更高效分配。尽管运算速度较4.6版本有所下降,但马斯克曾公开宣称其综合性能将超越所有现役AI模型。
技术文档显示,Grok系列模型持续采用渐进式升级策略。从4.6到4.7版本的技术跃迁中,研发团队重点改进了多模态处理能力与长文本生成稳定性。此次4.8版本在软件架构层面进行重构,采用C++替代原有框架,理论上可提升训练效率并降低内存占用。
强化学习阶段的调整成为当前研发重点。工程师团队正重新设计奖励机制,通过动态权重分配解决任务完成度与计算资源消耗的平衡问题。这种技术路线修正反映出大型AI模型开发中,算法优化与工程实现的深度耦合特性。





