跳到正文

#推理

今日 0 条
9月16日周三
8月25日周二
  1. Hugging Face Blog62

    Multiverse Computing 提出 Quantization-Aware Healing:4-bit 压缩模型在 9 项基准中 7 项超过其全精度版本

    Multiverse Computing 发布论文《Quantization-Aware Healing: A Practical Recipe for Recovering Compressed, 4-Bit LLMs》,提出 QAH 方法:对结构压缩并量化的模型,直接从压缩前的原始全精度模型蒸馏,而非从恢复出的 bfloat16 checkpoint 蒸馏。

    推荐理由:论文给出压缩加量化后从原始教师蒸馏的恢复配方,并附与 QAT 的稳定性对比数据。

8月24日周一
8月17日周一
8月13日周四
  1. Microsoft Research41

    MindTopo:微软研究院推出评估多模态模型拓扑推理能力的新基准

    微软研究院推出 MindTopo 基准,用于评估多模态大语言模型在连通性、封闭、顺序、分离和绳结等拓扑关系上的推理与规划能力。测试显示,当前模型在静态图像识别上表现明显优于交互式规划任务,失败多发生在规划阶段而非感知阶段,模型难以在场景变化中持续保持对拓扑结构的理解。图像与视频生成工具在维持拓扑关系上同样不可靠。

7月26日周日
6月25日周四
6月8日周一
5月8日周五
  1. Berkeley AI Research45

    自适应并行推理:高效推理扩展的下一个范式

    自适应并行推理(Adaptive Parallel Reasoning)允许模型自主决定何时分解子任务、生成并发线程数量及协调方式,以解决顺序推理导致的上下文膨胀与延迟问题。该范式旨在克服现有固定并行结构无法根据问题复杂度动态调整计算资源的局限,实现更高效的大语言模型推理扩展。

4月20日周一
  1. Berkeley AI Research42

    GRASP 提出基于梯度的长时程世界模型规划方法

    GRASP 是一种针对学习动态(世界模型)的基于梯度的规划器,通过提升轨迹至虚拟状态实现时间并行优化,并在状态迭代中引入随机性以增强探索。该方法通过重塑梯度,使动作获得清晰信号,同时避免通过高维视觉模型计算脆弱的“状态输入”梯度,从而解决长时程规划中优化病态及局部极小值问题。

4月16日周四
3月13日周五
  1. Berkeley AI Research42

    SPEX 和 ProxySPEX 算法实现 LLM 大规模交互识别

    Berkeley AI Research 提出 SPEX 和 ProxySPEX 算法,利用稀疏性和低阶性在大规模下识别 LLM 的关键交互。ProxySPEX 利用层级结构特性,在保持性能的同时将所需的消融次数减少约 10 倍。SPEX 在特征归因任务中,当上下文扩展至数千个特征时,仍能保持与 Faith-Shap 等现有方法相当的高忠实度。

1月10日周六
11月1日周六

© 2026 SI·Hot · Super Intelligence Hot · 超级智能热点 · 网站数据均来源于网络公开资料,版权归来源方所有