2026-07-15
论文提出Engram条件记忆模块,通过可规模查找实现静态记忆与MoE神经计算互补,在知识检索、推理、代码数学和长上下文任务上显著提升性能,揭示U型缩放律。 小米发布380亿参数多模态自回归模型Xiaomi-Robotics-U0,统一具身合成任务,在场景生成和迁移上超越GPT-Image-2.0,开源代码。 腾讯混元Hy3旗舰模型发布量化版,1bit版本单卡…
Conditional Memory via Scalable Lookup: A New Axis of Sparsity for Large Language Models 88
Tags:
大模型模型架构推理优化Source:
arXiv Computation and Language| 阅读原文
[摘要]
论文提出Engram条件记忆模块,通过可规模查找实现静态记忆与MoE神经计算互补,在知识检索、推理、代码数学和长上下文任务上显著提升性能,揭示U型缩放律。
小米发布Xiaomi-Robotics-U0:380亿参数多模态自回归模型统一具身合成 85
Tags:
模型发布多模态智能体开源生态Source:
AI HOT 精选| 阅读原文
[摘要]
小米发布380亿参数多模态自回归模型Xiaomi-Robotics-U0,统一具身合成任务,在场景生成和迁移上超越GPT-Image-2.0,开源代码。
腾讯混元 Hy3 量化版发布:1bit 版本单卡可部署,4bit 版本接近满血性能 85
Tags:
模型发布推理优化开源生态大模型Source:
AI HOT 精选| 阅读原文
[摘要]
腾讯混元Hy3旗舰模型发布量化版,1bit版本单卡部署,4bit版本接近满血性能,解码速度提升50-60%,已开源适配llama.cpp。
FedMosaic: Federated Retrieval-Augmented Generation via Parametric Adapters 85
Tags:
研究RAG联邦学习隐私保护Source:
arXiv Computation and Language| 阅读原文
[摘要]
FedMosaic提出首个基于参数化适配器的联邦RAG框架,通过多文档适配器和选择聚合提升准确率10.9%,并降低存储78.8%和通信91.4%,解决隐私保护下知识孤岛问题。
HyperSafe: Inference-Time Safety Recovery for Fine-Tuned Language Models 85
Tags:
AI安全大模型推理优化Source:
arXiv Computation and Language| 阅读原文
[摘要]
HyperSafe提出推理时安全恢复方法,为微调模型生成安全侧网络,无需梯度更新或修改权重,将有害响应率从19-31%降至1%以下,代码已开源。
REAL: Reading Out Transformer Activations for Precise Localization in Language Model Steering 85
Tags:
模型发布推理优化大模型AI安全Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出REAL框架,通过向量量化自编码器精确定位Transformer中行为相关模块,实现更有效的推理时模型操控,在多个任务上平均提升20%。
Spectral Origins of the Self-Correction Blind Spot in Autoregressive Generation 85
Tags:
AI研究大模型自回归生成推理优化Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出SPARC光谱代数理论,用谱半径揭示自回归模型自我修正盲点,推导出激活阈值和收敛保证,实验验证误差低于3.2% RMSE,为理解模型纠错机制提供理论框架。
MJ: Multi-turn LLM Jailbreaking via Decomposed Credit Assignment 85
Tags:
AI安全大模型红队测试Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出DC-GRPO方法,通过分解信用分配实现多轮越狱攻击,攻击成功率近98%,显著超越现有方法,凸显大模型安全挑战。
UNIBROWSE: A Data-to-Agent Framework for Multimodal BrowseComp 85
Tags:
智能体多模态模型发布数据构建Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出UNIBROWSE框架,统一多模态浏览训练数据生成,在五个基准上平均54.4,超越GPT-5、Gemini-2.5等闭源模型,显著提升智能体多模态浏览能力。
Can a Language Model Learn Facts Continually in Its Weights? 85
Tags:
大模型持续学习模型训练研究动态Source:
arXiv Computation and Language| 阅读原文
[摘要]
新研究揭示大模型通过权重更新持续学习新事实时,知识保留效果差,后续写入会覆盖旧知识,可靠的知识存储渠道仍是上下文而非权重。
Diagnosing and Mitigating Thinking Collapse in On-Policy Self-Distillation 85
Tags:
大模型训练优化推理能力Source:
arXiv Computation and Language| 阅读原文
[摘要]
发现大模型在策略自蒸馏中的思维崩溃问题并提出AD-OPSD框架,在数学推理任务上提升准确率4.1%,对模型训练优化有重要参考。
Recursive Multi-Agent Systems 82
Tags:
智能体推理优化递归计算多智能体系统Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出RecursiveMAS递归多智能体框架,通过RecursiveLink模块实现跨智能体潜状态传递与内-外循环联合优化,在9个基准上平均准确率提升8.3%,推理加速1.2-2.4倍,token使用减少34.6%-75.6%。
Tool-Adaptive LLM Reranker 82
Tags:
大模型推理优化信息检索智能体Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出TALRanker框架,将重排序建模为智能体马尔可夫决策过程,通过两阶段训练实现工具自适应调用,兼顾效率与准确性,在检索基准上达到SOTA。
Google AI 发布 Gemini 3.5 Live Translate,支持 70+ 语言近实时语音到语音翻译 80
Tags:
模型发布产品发布大模型语音翻译Source:
AI HOT 精选| 阅读原文
[摘要]
Google发布Gemini 3.5 Live Translate,支持70+语言近实时语音到语音翻译,保留语调节奏音高,开发者可通过API集成,如Grab探索用于跨语言沟通。
纽约州暂停所有新建大型数据中心项目 80
Tags:
政策监管算力基础设施数据中心Source:
AI HOT 精选| 阅读原文
[摘要]
纽约州暂停50兆瓦以上新建数据中心审批,为期一年,可能影响AI算力部署和成本,凸显AI基础设施的能源与政策挑战。
Bonsai 27B:首款可在手机上运行的27B级多模态模型 80
Tags:
模型发布推理优化开源生态多模态Source:
AI HOT 精选| 阅读原文
[摘要]
Bonsai 27B基于Qwen2.7B,通过量化变体首次在iPhone 17 Pro上运行27B级多模态模型,保留90%-95%性能,支持多步推理、工具调用及视觉任务,Apache 2.0开源。
Google 在 I/O Connect India 展示由 Tensor SoC 和 TPU 驱动的 Pixel 10 端侧 AI 未来 80
Tags:
模型发布端侧AI芯片算力公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
Google在I/O Connect展示Pixel 10端侧AI,推出轻量级Gemma 4 E2B模型支持离线多模态,并发布Tensor SDK beta,推动端侧智能体应用。
Anthropic commits $10 million to Canadian AI research 80
Tags:
公司动态AI研究AI安全产业合作Source:
Anthropic News| 阅读原文
[摘要]
Anthropic 承诺向加拿大 AI 研究机构捐赠1000万加元,并与 Amii、Mila、Vector 等顶级机构合作,提供 Claude 信用额度支持 AI 研究、安全及应用,展现对加拿大 AI 生态的长期投入。
Anthropic 推出 Claude for Teachers 80
Tags:
产品发布教育公司动态AI应用Source:
AI HOT 精选| 阅读原文
[摘要]
Anthropic面向美国K-12教师免费推出Claude for Teachers,提供高级功能、教学资源库并集成第三方工具,强调数据隐私与学术标准对齐,加速AI在教育领域的落地。
马斯克承认 Grok Build 上传用户代码,SpaceXAI 承诺彻底删除数据 80
Tags:
AI安全产品发布公司动态智能体Source:
AI HOT 精选| 阅读原文
[摘要]
SpaceXAI旗下AI编程agent Grok Build被曝在关闭隐私开关后仍上传用户代码,马斯克承认并承诺彻底删除数据,推出隐私命令。