综述精选2026年7月15日2024 大语言模型年度综述模型规模竞赛降温 2024 年,业界从"越大越好"转向"更聪明地训练"。小型模型通过更好的数据和训练策略开始超越更大的模型。 MoE 架构成为主流 从 Mixtral 到 GPT4(传闻),MoE 混合专家模型解析 中介绍的 MoE 架构在...LLM年度综述技术趋势