8月5日,AI初创公司Liquid AI宣布正式发布专为智能体工作流设计的端侧模型LFM2.5-2.6B。该模型拥有26亿参数,无需依赖云端API即可在智能手机等终端设备上完全本地运行,为开发者提供了低成本、低延迟且兼具隐私保护的端侧智能体解决方案。
在技术架构与训练路径上,LFM2.5-2.6B基于约34万亿词元进行预训练,词表扩展至128K。其后训练流程整合了监督微调、教师特化、多领域在策略蒸馏以及智能体强化学习四个阶段,赋予了模型出色的规划、工具调用与复杂多步骤任务处理能力。基准测试显示,该模型在指令遵循和工具使用上的表现可媲美规模近四倍的大模型。
此外,该模型在硬件适配与推理性能上表现亮眼,在M5Max芯片上推理速度达220token/秒,手机端亦可稳定维持30token/秒的响应速度。目前,LFM2.5-2.6B及其基础版本已在Hugging Face全面开源,并原生支持llama.cpp、MLX、vLLM等主流推理框架,标志着高能效端侧智能体迈入实用化阶段。