Skip to content

2026-07-15

论文提出Engram条件记忆模块,通过可规模查找实现静态记忆与MoE神经计算互补,在知识检索、推理、代码数学和长上下文任务上显著提升性能,揭示U型缩放律。 小米发布380亿参数多模态自回归模型Xiaomi-Robotics-U0,统一具身合成任务,在场景生成和迁移上超越GPT-Image-2.0,开源代码。 腾讯混元Hy3旗舰模型发布量化版,1bit版本单卡…

Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models 88

  • Tags: 大模型 模型架构 推理优化

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
论文提出Engram条件记忆模块,通过可规模查找实现静态记忆与MoE神经计算互补,在知识检索、推理、代码数学和长上下文任务上显著提升性能,揭示U型缩放律。


小米发布Xiaomi-Robotics-U0:380亿参数多模态自回归模型统一具身合成 85

  • Tags: 模型发布 多模态 智能体 开源生态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
小米发布380亿参数多模态自回归模型Xiaomi-Robotics-U0,统一具身合成任务,在场景生成和迁移上超越GPT-Image-2.0,开源代码。


腾讯混元 Hy3 量化版发布:1bit 版本单卡可部署,4bit 版本接近满血性能 85

  • Tags: 模型发布 推理优化 开源生态 大模型

  • Source: AI HOT 精选 | 阅读原文

[摘要]
腾讯混元Hy3旗舰模型发布量化版,1bit版本单卡部署,4bit版本接近满血性能,解码速度提升50-60%,已开源适配llama.cpp。


FedMosaic: Federated Retrieval-Augmented Generation via Parametric Adapters 85

  • Tags: 研究 RAG 联邦学习 隐私保护

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
FedMosaic提出首个基于参数化适配器的联邦RAG框架,通过多文档适配器和选择聚合提升准确率10.9%,并降低存储78.8%和通信91.4%,解决隐私保护下知识孤岛问题。


HyperSafe: Inference-Time Safety Recovery for Fine-Tuned Language Models 85

  • Tags: AI安全 大模型 推理优化

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
HyperSafe提出推理时安全恢复方法,为微调模型生成安全侧网络,无需梯度更新或修改权重,将有害响应率从19-31%降至1%以下,代码已开源。


REAL: Reading Out Transformer Activations for Precise Localization in Language Model Steering 85

  • Tags: 模型发布 推理优化 大模型 AI安全

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出REAL框架,通过向量量化自编码器精确定位Transformer中行为相关模块,实现更有效的推理时模型操控,在多个任务上平均提升20%。


Spectral Origins of the Self-Correction Blind Spot in Autoregressive Generation 85

  • Tags: AI研究 大模型 自回归生成 推理优化

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出SPARC光谱代数理论,用谱半径揭示自回归模型自我修正盲点,推导出激活阈值和收敛保证,实验验证误差低于3.2% RMSE,为理解模型纠错机制提供理论框架。


MJ: Multi-turn LLM Jailbreaking via Decomposed Credit Assignment 85

  • Tags: AI安全 大模型 红队测试

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出DC-GRPO方法,通过分解信用分配实现多轮越狱攻击,攻击成功率近98%,显著超越现有方法,凸显大模型安全挑战。


UNIBROWSE: A Data-to-Agent Framework for Multimodal BrowseComp 85

  • Tags: 智能体 多模态 模型发布 数据构建

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出UNIBROWSE框架,统一多模态浏览训练数据生成,在五个基准上平均54.4,超越GPT-5、Gemini-2.5等闭源模型,显著提升智能体多模态浏览能力。


Can a Language Model Learn Facts Continually in Its Weights? 85

  • Tags: 大模型 持续学习 模型训练 研究动态

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
新研究揭示大模型通过权重更新持续学习新事实时,知识保留效果差,后续写入会覆盖旧知识,可靠的知识存储渠道仍是上下文而非权重。


Diagnosing and Mitigating Thinking Collapse in On-Policy Self-Distillation 85

  • Tags: 大模型 训练优化 推理能力

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
发现大模型在策略自蒸馏中的思维崩溃问题并提出AD-OPSD框架,在数学推理任务上提升准确率4.1%,对模型训练优化有重要参考。


Recursive Multi-Agent Systems 82

  • Tags: 智能体 推理优化 递归计算 多智能体系统

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出RecursiveMAS递归多智能体框架,通过RecursiveLink模块实现跨智能体潜状态传递与内-外循环联合优化,在9个基准上平均准确率提升8.3%,推理加速1.2-2.4倍,token使用减少34.6%-75.6%。


Tool-Adaptive LLM Reranker 82

  • Tags: 大模型 推理优化 信息检索 智能体

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出TALRanker框架,将重排序建模为智能体马尔可夫决策过程,通过两阶段训练实现工具自适应调用,兼顾效率与准确性,在检索基准上达到SOTA。


Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译 80

  • Tags: 模型发布 产品发布 大模型 语音翻译

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Google发布Gemini 3.5 Live Translate,支持70+语言近实时语音到语音翻译,保留语调节奏音高,开发者可通过API集成,如Grab探索用于跨语言沟通。


纽约州暂停所有新建大型数据中心项目 80

  • Tags: 政策监管 算力基础设施 数据中心

  • Source: AI HOT 精选 | 阅读原文

[摘要]
纽约州暂停50兆瓦以上新建数据中心审批,为期一年,可能影响AI算力部署和成本,凸显AI基础设施的能源与政策挑战。


Bonsai 27B:首款可在手机上运行的27B级多模态模型 80

  • Tags: 模型发布 推理优化 开源生态 多模态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Bonsai 27B基于Qwen2.7B,通过量化变体首次在iPhone 17 Pro上运行27B级多模态模型,保留90%-95%性能,支持多步推理、工具调用及视觉任务,Apache 2.0开源。


Google 在 I/O Connect India 展示由 Tensor SoC 和 TPU 驱动的 Pixel 10 端侧 AI 未来 80

  • Tags: 模型发布 端侧AI 芯片算力 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Google在I/O Connect展示Pixel 10端侧AI,推出轻量级Gemma 4 E2B模型支持离线多模态,并发布Tensor SDK beta,推动端侧智能体应用。


Anthropic commits $10 million to Canadian AI research 80

  • Tags: 公司动态 AI研究 AI安全 产业合作

  • Source: Anthropic News | 阅读原文

[摘要]
Anthropic 承诺向加拿大 AI 研究机构捐赠1000万加元,并与 Amii、Mila、Vector 等顶级机构合作,提供 Claude 信用额度支持 AI 研究、安全及应用,展现对加拿大 AI 生态的长期投入。


Anthropic 推出 Claude for Teachers 80

  • Tags: 产品发布 教育 公司动态 AI应用

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Anthropic面向美国K-12教师免费推出Claude for Teachers,提供高级功能、教学资源库并集成第三方工具,强调数据隐私与学术标准对齐,加速AI在教育领域的落地。


马斯克承认 Grok Build 上传用户代码,SpaceXAI 承诺彻底删除数据 80

  • Tags: AI安全 产品发布 公司动态 智能体

  • Source: AI HOT 精选 | 阅读原文

[摘要]
SpaceXAI旗下AI编程agent Grok Build被曝在关闭隐私开关后仍上传用户代码,马斯克承认并承诺彻底删除数据,推出隐私命令。