2026-07-04
Mistral AI 发布开源形式化验证模型 Leanstral 1.5,119B 参数仅 6B 活跃,数学证明达 SOTA 并发现真实 bug。 全球首次记录AI Agent“JADEPUFFER”自主完成勒索攻击,从漏洞利用到数据加密全程无人干预,暴露AI安全新威胁。 发布全模态AI智能体基准OmniGAIA与模型OmniAtlas,结合多模态感知、深度…
Leanstral 1.5:人人可用的证明丰富性 95
Tags:
模型发布开源生态AI研究Source:
AI HOT 精选| 阅读原文
[摘要]
Mistral AI 发布开源形式化验证模型 Leanstral 1.5,119B 参数仅 6B 活跃,数学证明达 SOTA 并发现真实 bug。
全球首例 AI Agent 勒索攻击曝光,从漏洞利用到数据库加密全程自主完成 85
Tags:
智能体AI安全政策监管Source:
AI HOT 精选| 阅读原文
[摘要]
全球首次记录AI Agent“JADEPUFFER”自主完成勒索攻击,从漏洞利用到数据加密全程无人干预,暴露AI安全新威胁。
OmniGAIA: Towards Native Omni-Modal AI Agents 85
Tags:
多模态智能体模型发布数据集Source:
arXiv Computation and Language| 阅读原文
[摘要]
发布全模态AI智能体基准OmniGAIA与模型OmniAtlas,结合多模态感知、深度推理与工具调用,推动通用AI助手发展。
Safety Targeted Embedding Exploit via Refinement 85
Tags:
AI安全模型安全多语言安全对抗攻击Source:
arXiv Computation and Language| 阅读原文
[摘要]
新攻击方法STEER通过将拒绝触发词翻译成低资源语言,成功绕过LLM安全机制,在开源模型上成功率超96%,并可迁移至GPT-4o,揭示安全对齐在多语言环境下的重大漏洞。
Scaling Latent Reasoning via Looped Language Models 85
Tags:
模型发布推理优化开源生态Source:
arXiv Computation and Language| 阅读原文
[摘要]
Ouro模型通过预训练阶段的循环潜在空间推理实现高效推理,1.4B和2.6B参数达到12B SOTA LLM性能,已开源,推动推理缩放新方向。
Breaking Safety at the Token Boundary: How BPE Tokenization Creates Exploitable Gaps in LLM Alignment 85
Tags:
AI安全大模型安全对齐分词Source:
arXiv Computation and Language| 阅读原文
[摘要]
研究揭示BPE分词导致LLM安全对齐漏洞:字符级碎片化可绕过拒绝回答,五个模型家族实验证实,影响安全防御设计。
Multi-Head Recurrent Memory Agents 82
Tags:
研究长上下文模型优化Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出多头部递归记忆框架MHM-LRU,通过分区记忆与选择性更新解决长上下文递归记忆可靠性瓶颈,在896K token上记忆保留率从<30%提升至73.96%,通用性强。
PairCoder++: Pair Programming as a Universal Paradigm for Verified Code-Driven Multimodal and Structured-Artifact Generation 82
Tags:
代码生成多模态智能体研究突破Source:
arXiv Computation and Language| 阅读原文
[摘要]
PairCoder++提出通过Driver和Navigator双智能体结对编程,利用工具链验证反馈大幅提升代码驱动的多模态工件生成质量,在17个基准上显著改进。
生数科技发布 Vidu S1,推动视频生成迈向"实时交互"新时代 80
Tags:
模型发布视频生成实时交互Source:
AI HOT 精选| 阅读原文
[摘要]
生数科技发布Vidu S1实时交互模型,支持实时视频通话与语音控制,实现无限时长连续互动,采用自回归扩散技术降低计算成本,已开启内测。
面壁智能发布AI全自动预训练框架ForgeTrain,8小时追平Megatron-LM 80
Tags:
训练框架模型优化公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
面壁智能发布全球首个全AI编写、无人类干预的生产级大模型预训练框架ForgeTrain,8小时追平Megatron-LM,FLOPS利用率提升8%~10%,支持H100和昇腾,降低预训练门槛。
国家网信办就《互联网信息服务管理办法》再次征求意见,首设"智能信息服务"专章规范AI服务 80
Tags:
政策监管AI安全公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
国家网信办修订互联网信息服务管理办法,新增“智能信息服务”专章,要求AI服务公示技术原理、数据来源,标识合成内容,禁止强制使用,意见反馈至8月2日。
阿里达摩院发布超导材料发现AI智能体Elements Claw 80
Tags:
AI智能体AI for Science模型发布开放数据Source:
AI HOT 精选| 阅读原文
[摘要]
阿里达摩院联合发布超导材料发现AI智能体Elements Claw,基于1B原子基础模型,28GPU小时筛选240万晶体,预测6.8万候选,4种已合成验证超导性,展现AI在科学发现中的潜力。
Theoria: Rewrite-Acceptability Verification over Informal Reasoning States 80
Tags:
推理验证AI安全可解释性研究Source:
arXiv Computation and Language| 阅读原文
[摘要]
Theoria 提出一种验证架构,将候选解重写为可审计的状态转换,在 HLE-Verified 上达 91.4% 精确率,能检测隐藏前提和伪造引用,提升 LLM 推理可信度。
Recursive Models for Long-Horizon Reasoning 80
Tags:
模型研究推理优化大模型Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出递归模型框架,通过递归自调用在隔离上下文中解决子任务,理论上超越单序列上下文管理,并在SAT和围棋任务上验证长期推理准确性提升。
HERMES: A Multi-Granularity Labeling Substrate for Pre-training Data Mixtures 80
Tags:
数据混合预训练研究Source:
arXiv Computation and Language| 阅读原文
[摘要]
HERMES提出多粒度标签体系,通过语义变换和残差量化生成层级代码,支持预训练数据混合的粗细不同粒度选择,实验显示可提升模型性能。
Less Data, More Security: Advancing Cybersecurity LLMs Specialization via Resource-Efficient Domain-Adaptive Continuous Pre-training with Minimal Tokens 80
Tags:
研究进展模型训练网络安全AI安全Source:
arXiv Computation and Language| 阅读原文
[摘要]
研究提出用极少量数据(1.26亿词)对LLM进行网络安全领域连续预训练,在多个基准上超越需数十亿token的模型,显著降低计算和能源成本。
Spec-AUF: Accept-Until-Fail Training under Train-Inference Misalignment for Masked Block Drafters 80
Tags:
推理优化模型发布大模型Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出Spec-AUF方法,通过仅在草稿模型第一个预测失败前计算交叉熵损失,解决块状草稿器训练-推断不匹配问题,在Qwen3-8B上平均发射长度从2.40提升至2.61,一致增益。
AGC-Bench: Measuring Artificial General Creativity 80
Tags:
基准测试创造力大模型研究进展Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出AGC-Bench基准,系统评估AI创造力,发现独立创造力因子'c',人类仍领先顶级LLM。
Navigating the Alignment-Calibration Trade-off: A Pareto-Superior Frontier via Model Merging 80
Tags:
对齐校准模型合并研究Source:
arXiv Computation and Language| 阅读原文
[摘要]
研究通过模型权重插值实现对齐-校准的帕累托最优,同时提升准确率与校准度,降低对齐代价。
CreativityPrism: A Cross-Domain Evaluation Framework for Large Language Model Creativity 80
Tags:
大模型模型评测创造力评估开源框架Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出CreativityPrism跨领域LLM创造力评估框架,涵盖发散思维、创意写作和逻辑推理三个领域八个任务,评测17个模型发现前沿模型在创意写作和逻辑推理领先但在发散思维无优势,揭示创造力的多维碎片化特性。