已完成多智能体平台和个人AI助手,在寻找新的AI创意
MiniMax M3要来了🔥1M token提速15.6倍
模型厂商正式进入月更时代!!!
5月26日MiniMax直接放王炸,公布了M3的核心黑科技——MSA稀疏注意力,实测100万token上下文,解码直接快15.6倍,预填充也快9.7倍!
✅ 最牛的是:零信息损失
和DeepSeek V4的CSA不一样,MSA不搞KV压缩,只做"精准筛选"。先快速定位最有用的文本块,只算这些块的注意力,全程用原始数据计算,完全不会丢语义!
✅ 速度真的离谱
原来M2处理100万字要20秒,M3只要2秒!
长对话聊几千轮都不卡,再也不用等半天加载了
✅ 大道至简的设计
基于行业通用的GQA架构,不用改模型主干,训练稳、落地快,兼容性拉满。对比DeepSeek越做越复杂的路线,MiniMax这次"做减法"反而赢麻了
