Skip to content

2026-07-04

Mistral AI 发布开源形式化验证模型 Leanstral 1.5,119B 参数仅 6B 活跃,数学证明达 SOTA 并发现真实 bug。 全球首次记录AI Agent“JADEPUFFER”自主完成勒索攻击,从漏洞利用到数据加密全程无人干预,暴露AI安全新威胁。 发布全模态AI智能体基准OmniGAIA与模型OmniAtlas,结合多模态感知、深度…

Leanstral 1.5:人人可用的证明丰富性 95

  • Tags: 模型发布 开源生态 AI研究

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Mistral AI 发布开源形式化验证模型 Leanstral 1.5,119B 参数仅 6B 活跃,数学证明达 SOTA 并发现真实 bug。


全球首例 AI Agent 勒索攻击曝光,从漏洞利用到数据库加密全程自主完成 85

  • Tags: 智能体 AI安全 政策监管

  • Source: AI HOT 精选 | 阅读原文

[摘要]
全球首次记录AI Agent“JADEPUFFER”自主完成勒索攻击,从漏洞利用到数据加密全程无人干预,暴露AI安全新威胁。


OmniGAIA: Towards Native Omni-Modal AI Agents 85

  • Tags: 多模态 智能体 模型发布 数据集

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
发布全模态AI智能体基准OmniGAIA与模型OmniAtlas,结合多模态感知、深度推理与工具调用,推动通用AI助手发展。


Safety Targeted Embedding Exploit via Refinement 85

  • Tags: AI安全 模型安全 多语言安全 对抗攻击

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
新攻击方法STEER通过将拒绝触发词翻译成低资源语言,成功绕过LLM安全机制,在开源模型上成功率超96%,并可迁移至GPT-4o,揭示安全对齐在多语言环境下的重大漏洞。


Scaling Latent Reasoning via Looped Language Models 85

  • Tags: 模型发布 推理优化 开源生态

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
Ouro模型通过预训练阶段的循环潜在空间推理实现高效推理,1.4B和2.6B参数达到12B SOTA LLM性能,已开源,推动推理缩放新方向。


Breaking Safety at the Token Boundary: How BPE Tokenization Creates Exploitable Gaps in LLM Alignment 85

  • Tags: AI安全 大模型 安全对齐 分词

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
研究揭示BPE分词导致LLM安全对齐漏洞:字符级碎片化可绕过拒绝回答,五个模型家族实验证实,影响安全防御设计。


Multi-Head Recurrent Memory Agents 82

  • Tags: 研究 长上下文 模型优化

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出多头部递归记忆框架MHM-LRU,通过分区记忆与选择性更新解决长上下文递归记忆可靠性瓶颈,在896K token上记忆保留率从<30%提升至73.96%,通用性强。


PairCoder++: Pair Programming as a Universal Paradigm for Verified Code-Driven Multimodal and Structured-Artifact Generation 82

  • Tags: 代码生成 多模态 智能体 研究突破

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
PairCoder++提出通过Driver和Navigator双智能体结对编程,利用工具链验证反馈大幅提升代码驱动的多模态工件生成质量,在17个基准上显著改进。


生数科技发布 Vidu S1,推动视频生成迈向"实时交互"新时代 80

  • Tags: 模型发布 视频生成 实时交互

  • Source: AI HOT 精选 | 阅读原文

[摘要]
生数科技发布Vidu S1实时交互模型,支持实时视频通话与语音控制,实现无限时长连续互动,采用自回归扩散技术降低计算成本,已开启内测。


面壁智能发布AI全自动预训练框架ForgeTrain,8小时追平Megatron-LM 80

  • Tags: 训练框架 模型优化 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
面壁智能发布全球首个全AI编写、无人类干预的生产级大模型预训练框架ForgeTrain,8小时追平Megatron-LM,FLOPS利用率提升8%~10%,支持H100和昇腾,降低预训练门槛。


国家网信办就《互联网信息服务管理办法》再次征求意见,首设"智能信息服务"专章规范AI服务 80

  • Tags: 政策监管 AI安全 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
国家网信办修订互联网信息服务管理办法,新增“智能信息服务”专章,要求AI服务公示技术原理、数据来源,标识合成内容,禁止强制使用,意见反馈至8月2日。


阿里达摩院发布超导材料发现AI智能体Elements Claw 80

  • Tags: AI智能体 AI for Science 模型发布 开放数据

  • Source: AI HOT 精选 | 阅读原文

[摘要]
阿里达摩院联合发布超导材料发现AI智能体Elements Claw,基于1B原子基础模型,28GPU小时筛选240万晶体,预测6.8万候选,4种已合成验证超导性,展现AI在科学发现中的潜力。


Theoria: Rewrite-Acceptability Verification over Informal Reasoning States 80

  • Tags: 推理验证 AI安全 可解释性 研究

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
Theoria 提出一种验证架构,将候选解重写为可审计的状态转换,在 HLE-Verified 上达 91.4% 精确率,能检测隐藏前提和伪造引用,提升 LLM 推理可信度。


Recursive Models for Long-Horizon Reasoning 80

  • Tags: 模型研究 推理优化 大模型

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出递归模型框架,通过递归自调用在隔离上下文中解决子任务,理论上超越单序列上下文管理,并在SAT和围棋任务上验证长期推理准确性提升。


HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures 80

  • Tags: 数据混合 预训练 研究

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
HERMES提出多粒度标签体系,通过语义变换和残差量化生成层级代码,支持预训练数据混合的粗细不同粒度选择,实验显示可提升模型性能。


Less Data, More Security: Advancing Cybersecurity LLMs Specialization via Resource-Efficient Domain-Adaptive Continuous Pre-training with Minimal Tokens 80

  • Tags: 研究进展 模型训练 网络安全 AI安全

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
研究提出用极少量数据(1.26亿词)对LLM进行网络安全领域连续预训练,在多个基准上超越需数十亿token的模型,显著降低计算和能源成本。


Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters 80

  • Tags: 推理优化 模型发布 大模型

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出Spec-AUF方法,通过仅在草稿模型第一个预测失败前计算交叉熵损失,解决块状草稿器训练-推断不匹配问题,在Qwen3-8B上平均发射长度从2.40提升至2.61,一致增益。


AGC-Bench: Measuring Artificial General Creativity 80

  • Tags: 基准测试 创造力 大模型 研究进展

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出AGC-Bench基准,系统评估AI创造力,发现独立创造力因子'c',人类仍领先顶级LLM。


  • Tags: 对齐 校准 模型合并 研究

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
研究通过模型权重插值实现对齐-校准的帕累托最优,同时提升准确率与校准度,降低对齐代价。


CreativityPrism: A Cross-Domain Evaluation Framework for Large Language Model Creativity 80

  • Tags: 大模型 模型评测 创造力评估 开源框架

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出CreativityPrism跨领域LLM创造力评估框架,涵盖发散思维、创意写作和逻辑推理三个领域八个任务,评测17个模型发现前沿模型在创意写作和逻辑推理领先但在发散思维无优势,揭示创造力的多维碎片化特性。