语音识别基准优化问题研究
来源: Hugging Face Blog | 📅 2026年8月21日
研究发现多个开源 ASR 模型在公共基准测试中存在过度优化现象,即使音频内容与参考文本矛盾,模型仍会复现基准的错误转录。研究提出三种测试方法量化此问题,建议使用完全保留的评估集和基准无关的测试方法,对语音识别系统的真实性能评估具有重要意义。
阅读原文 →
ASR
Benchmark
Research
LFM2.5-DSpark: 推理速度提升3.2倍
来源: Liquid AI / Hugging Face | 📅 2026年8月20日
Liquid AI 发布 LFM2.5-DSpark 推测解码模型检查点,通过轻量级 draft 模型在不改变输出质量的前提下实现高达3.18倍吞吐量提升。支持 GPU 和设备端推理,在 M4 Max MacBook 上可达139 tok/s,显著降低函数调用延迟57%。集成 llama.cpp 和 SGLang,适用于边缘计算和 Agent 场景。
阅读原文 →
Inference
Speculative Decoding
Edge AI
2026年夏季开源模型状态报告
来源: Hugging Face Blog | 📅 2026年8月14日
报告显示中国实验室在开源大模型领域持续领先,多个万亿参数级模型采用宽松许可发布。Qwen 成为社区首选基础模型,衍生项目超15万个。小型模型仍占实际下载量83%,llama.cpp 使万亿参数模型可在消费级设备运行。Agent 成为 Hugging Face Hub 最大用户群体,占7月流量的44.4%。
阅读原文 →
Open Source
Trends
Agent
Meta Muse Glimmer: 本地多模态 Agent 模型
来源: Meta / Hugging Face | 📅 2026年8月10日
Meta 发布 Muse Glimmer 30B 参数多模态模型,专为本地 Agent 用例设计,采用 Apache 2.0 许可。支持图像、视频理解和工具调用,在多个 Agent 基准测试中表现优异。集成 DFlash 推测解码,在编码等结构化内容生成场景提速显著。支持 transformers、llama.cpp、vLLM 等主流框架,适合隐私敏感应用。
阅读原文 →
Multimodal
Agent
Local LLM
ICML 2026 论文复现: 2200篇论文的验证
来源: Hugging Face Blog | 📅 2026年8月13日
Hugging Face 组织的 ICML 2026 开放复现挑战赛,1212名参与者使用编码 Agent 尝试复现会议34%的论文(2226篇)。结果51%的论文至少一项声明被验证,23%存在被证伪的声明。发现多篇论文理论证明错误、实验评估缺陷等问题,展示了 Agent 辅助科研验证的可能性与局限性,强调人机协作的重要性。
阅读原文 →
Reproducibility
Agent
Research