8月5日,美国独立AI研究实验室DeepGrove发布预览版轻量模型Maple-Preview。该模型参数总量202亿,采用三值权重与混合专家(MoE)架构,激活参数仅14.9亿。在iPhone上推理速度达127 tokens/s,约为Bonsai 27B的13倍;MacBook Pro(M5 Pro)上处理IMO 2024 P1题得满分,速度281.5 tokens/s。其长上下文能力突出,处理131,000 tokens时内存占用仅7.69GB。目前处于preview阶段,目标是实现对话自适应与用户个性化优化。
免责声明:本文内容由开放的智能模型自动生成,仅供参考。

扫一扫关注微信