跳到正文
10月7日周三
  1. Hugging Face Blog66

    Nemotron 微调后在 IOI 2026 与 IMO 2026 双双达到金牌水平

    英伟达团队从 Nemotron 3 出发,用 SFT、RL 和生成-验证-改进的推理流程,让 Nemotron-3-Ultra-CC 在 IOI 2026 取得 535.4/600,超过 361.12 的金牌线,也高于人类最高分 498.27;IMO 2026 系统则拿到 30/42,超过 29 分的官方金牌线。

    推荐理由:原文公开了从 Nemotron 3 微调到 IOI、IMO 金牌级成绩的完整配方与数据集,可据此复现领域专家模型。

9月24日周四
  1. Microsoft Research62

    微软研究院:将物理 AI 推理卸载到边缘或云端可提升机器人性能与续航

    微软研究院对移动操作机器人工作负载做了首次系统性研究,发现把物理 AI 推理从机器人端侧 GPU 卸载到边缘或云端 GPU,可提升任务成功率、支持更大模型并延长续航。

    推荐理由:微软研究院系统测量了机器人端侧 GPU 推理的瓶颈,并给出可复用的 Kubernetes 卸载工具链,读者可据此判断物理 AI 的部署取舍。

9月21日周一
9月19日周六
  1. Google Research22

    Google Research 发布 MilleMiglia:面向中段物流的真实实例生成器

    Google Research 推出 MilleMiglia,一个用 C++ 编写的实例生成器,用于为中段物流配送问题生成真实且保护隐私的基准数据,源码与文档已在 GitHub 公开。中段物流承担区域乃至洲际配送中心之间的大批量货物运输,成本占比高却长期缺乏公开高质量数据,学术研究因此受限。该工作将中段物流建模为时空图上的多商品流问题,以刻画货物在多辆车辆间转运、需在时间窗内赶上接驳班次等约束。

7月29日周三
  1. Berkeley AI Research62

    从 CUDA 到 MLX:K-Search 如何把数十年内核经验带到 Apple Silicon

    Berkeley AI Research 与 IBM Research 将演化式内核搜索框架 K-Search 扩展到 MLX 后端,并加入结构化 CUDA-to-MLX 翻译层,让已有 CUDA 内核作为知识库适配到 Apple Silicon。

    推荐理由:展示了把 CUDA 内核优化经验结构化迁移到 Apple Silicon 的方法,读者可据此判断跨硬件内核迁移的可行路径。

3月13日周五
1月10日周六
  1. Berkeley AI Research24

    加州伯克利提出信息驱动的成像系统设计框架,登 NeurIPS 2025

    加州伯克利团队提出直接以互信息评估和优化成像系统的框架,仅用带噪测量和噪声模型即可量化信息量,在彩色摄影、射电天文、无透镜成像和显微成像四个领域验证其能预测解码器性能。该方法优化出的设计可媲美端到端 SOTA 方法,同时占用更少内存和算力,且无需任务专用解码器设计。