1
MiniMax:M3 Pro 模型参数规模预计提升至约 3T,大规模国产算力集群将很快上线
IT之家 8 月 26 日消息,据证券时报消息,MiniMax 在中期业绩电话会上透露, M3 Pro 的参数规模预计提升至约 3T ,并进一步扩大强化学习和长程任务训练,以提高模型的泛化能力和智能上限。 MiniMax 创始人、CEO 闫俊杰表示,下一阶段将继续推进模型智能、推理效率和基础设施能力…
IT之家 8 月 26 日消息,据证券时报消息,MiniMax 在中期业绩电话会上透露, M3 Pro 的参数规模预计提升至约 3T ,并进一步扩大强化学习和长程任务训练,以提高模型的泛化能力和智能上限。 MiniMax 创始人、CEO 闫俊杰表示,下一阶段将继续推进模型智能、推理效率和基础设施能力…
字节跳动豪掷10万亿参数练兵,AI军备竞赛再升级,看巨头如何叫板Anthropic。
TikTok owner training a model with 10 trillion parameters.
从Transformer到LLM的关键一步:堆叠层、参数量与训练细节,用同一示例直观看懂模型如何进化。
Article URL: https://bharad.dev/blog/from-transformer-to-llm Comments URL: https://news.ycombinator.com/item?id=48705350 Points: 1 # Comments: 0
两千亿参数原生全模态图像大模型HiDream-O1-Image-Pro发布,刷新多项SOTA记录,多模态统一建模再进一步。
向世界模型进发。