Skip to content

2026-07-09

美国商务部全面批准OpenAI大规模发布GPT-5.6(Sol),标志此前国家安全管控结束,新AI行政令即将出台。 中国计划限制外国访问其最强AI模型,包括闭源和开源权重,属出口管制,可能进一步分裂全球AI市场。 字节发布多模态图像生成模型Seedream 5.0 Pro,支持复杂信息可视化、像素级编辑、真实影像质感,已上线豆包、即梦等平台。

美国商务部批准OpenAI大规模发布GPT-5.6,Sol明日亮相 95

  • Tags: 大模型 模型发布 公司动态 政策监管

  • Source: AI HOT 精选 | 阅读原文

[摘要]
美国商务部全面批准OpenAI大规模发布GPT-5.6(Sol),标志此前国家安全管控结束,新AI行政令即将出台。


中国拟限制外国访问最强AI模型 88

  • Tags: 政策监管 AI安全 模型发布 开源生态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
中国计划限制外国访问其最强AI模型,包括闭源和开源权重,属出口管制,可能进一步分裂全球AI市场。


Seedream 5.0 Pro 发布:不止"生成",更懂"设计" 85

  • Tags: 模型发布 多模态 产品发布

  • Source: AI HOT 精选 | 阅读原文

[摘要]
字节发布多模态图像生成模型Seedream 5.0 Pro,支持复杂信息可视化、像素级编辑、真实影像质感,已上线豆包、即梦等平台。


黑客可利用9款最流行的AI工具组装大规模僵尸网络 85

  • Tags: AI安全 提示注入 网络安全

  • Source: AI HOT 精选 | 阅读原文

[摘要]
研究人员提出HalluSquatting新型提示注入攻击,可规模化利用9款流行AI工具构建僵尸网络并执行DDoS,标志着提示注入从单点转向规模化威胁。


MIRA:可玩多人世界模型,20 FPS实时生成"火箭联盟的梦" 85

  • Tags: 世界模型 模型发布 开源生态 多模态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
MIRA:可玩多人世界模型,20 FPS实时生成游戏画面,基于10k小时数据训练,演示、技术报告及开源代码已公开,值得关注。


Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding 85

  • Tags: 模型发布 推理优化 训练方法

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
Nemotron推出三模态语言模型Nemotron-Labs-Diffusion,统一自回归、扩散与自我推测解码,8B模型吞吐量比Qwen3-8B高4倍,准确率相当。


When Does Tool Use Increase the Expressive Power of Finite-Precision Recurrent Models? 85

  • Tags: 理论分析 序列模型 模型表达力 智能体

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
本文严格分析了工具使用对有限精度循环模型表达能力的影响:无限状态工具(如磁带)可使系统达到图灵完备,而有限状态工具不增加表达能力,并表明选择性是构造的关键。


Pluralis v0.1: Towards a Multicultural, Multimodal, Multilingual Benchmark for AI Risk and Reliability 82

  • Tags: AI安全 数据集 评估基准 多模态

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出Pluralis v0.1多文化多模态基准,覆盖亚太六国八种语言,揭示视觉语言模型在全球部署中的文化敏感失效模式,推动AI安全评估多元化。


Sparse but Wrong: Incorrect L0 Leads to Incorrect Features in Sparse Autoencoders 82

  • Tags: 研究 可解释性 稀疏自编码器 大模型

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
研究表明稀疏自编码器(SAE)中L0超参数设置错误会导致特征混杂,主流SAE普遍L0偏低,并提出代理指标指导正确设置。


PyTorch 2.13 Release Blog 80

  • Tags: 框架发布 开源生态 推理优化

  • Source: PyTorch Blog | 阅读原文

[摘要]
PyTorch 2.13 发布,FlexAttention 登陆 Apple Silicon (MPS),推理性能提升,影响开发者生态。


Introducing GPT-Live 80

  • Tags: 模型发布 语音生成 公司动态

  • Source: OpenAI News | 阅读原文

[摘要]
OpenAI发布新一代语音模型GPT-Live,用于ChatGPT语音交互,提升自然对话体验,是语音AI领域重要进展。


Robostral Navigate:Mistral AI 首个具身导航模型 80

  • Tags: 具身智能 模型发布 导航 Mistral AI

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Mistral AI 发布首个具身导航模型 Robostral Navigate(8B),仅用单 RGB 摄像头在 R2R-CE 验证集上取得 76.6% 未见过场景成功率,超越最佳方法,支持多种机器人。


加拿大不列颠哥伦比亚省拟起诉OpenAI:未上报ChatGPT暴力对话致校园枪击惨案 80

  • Tags: 政策监管 AI安全 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
加拿大不列颠哥伦比亚省因OpenAI未上报ChatGPT暴力对话,致用户制造校园枪击案,拟起诉OpenAI。该事件凸显AI安全与平台责任问题,可能影响全球AI监管。


GitLost:Noma Labs 发现 GitHub AI 代理提示词注入漏洞 80

  • Tags: AI安全 智能体 公司动态 漏洞

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Noma Labs 发现 GitHub AI 代理存在提示词注入漏洞 GitLost,攻击者可借公共 Issue 诱使 Claude 或 GitHub Copilot 泄露私有仓库内容,影响 AI 安全生态。


智能免费,然后呢?--Data Systems for, of, and by Agents 80

  • Tags: AI推理成本 数据系统 智能体 产业趋势

  • Source: AI HOT 精选 | 阅读原文

[摘要]
AI推理成本急剧下降,GPT-4级能力每百万token从30美元降至不足1美元,知识工作级智能即将近乎免费,引发数据系统为智能体变革。


Claude开发者分享两种多智能体模式:Advisor和Orchestrator 80

  • Tags: 智能体 多智能体 工程实践 成本优化

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Claude开发者分享两种多智能体模式(Advisor与Orchestrator),通过组合不同模型在SWE-bench和BrowseComp上实现性能和成本平衡,最高达92%性能节省63%成本。


Liquid AI 开源 Antidoom:基于最终 Token 偏好优化的推理模型死循环修复方法 80

  • Tags: 推理优化 开源生态 模型训练 AI安全

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Liquid AI开源Antidoom,基于最终Token偏好优化解决推理模型死循环问题,循环率从10%-23%降至约1%,代码和数据集已开源。


蚂蚁集团旗下Robbyant开源LingBot-Vision:1B参数边界中心视觉基础模型,用于密集空间感知 80

  • Tags: 模型发布 开源生态 视觉基础模型 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
蚂蚁集团旗下Robbyant开源LingBot-Vision,1B参数视觉基础模型,在密集空间任务中匹配7倍大模型性能,Apache-2.0许可证发布,推动视觉感知开源生态。


A Function-Space Dichotomy for Compositional Learning: Exponential Sub-Optimality of the Neural Tangent Kernel 80

  • Tags: 研究 深度学习理论 神经正切核

  • Source: arXiv Statistics - Machine Learning | 阅读原文

[摘要]
该论文在理论上证明了神经网络在组合学习任务上指数级优于神经正切核,解释了深度学习的关键优势。


No Subspace to Track: Non-Identifiability and Optimizer State in Low-Rank Training 80

  • Tags: 模型训练 优化器 低秩方法

  • Source: arXiv Statistics - Machine Learning | 阅读原文

[摘要]
研究揭示低秩训练中梯度子空间不可追踪,提出LDAdam优化器,通过合理迁移优化器状态提升大模型训练效果,挑战了GaLore等方法的假设。