2026-07-09
美国商务部全面批准OpenAI大规模发布GPT-5.6(Sol),标志此前国家安全管控结束,新AI行政令即将出台。 中国计划限制外国访问其最强AI模型,包括闭源和开源权重,属出口管制,可能进一步分裂全球AI市场。 字节发布多模态图像生成模型Seedream 5.0 Pro,支持复杂信息可视化、像素级编辑、真实影像质感,已上线豆包、即梦等平台。
美国商务部批准OpenAI大规模发布GPT-5.6,Sol明日亮相 95
Tags:
大模型模型发布公司动态政策监管Source:
AI HOT 精选| 阅读原文
[摘要]
美国商务部全面批准OpenAI大规模发布GPT-5.6(Sol),标志此前国家安全管控结束,新AI行政令即将出台。
中国拟限制外国访问最强AI模型 88
Tags:
政策监管AI安全模型发布开源生态Source:
AI HOT 精选| 阅读原文
[摘要]
中国计划限制外国访问其最强AI模型,包括闭源和开源权重,属出口管制,可能进一步分裂全球AI市场。
Seedream 5.0 Pro 发布:不止"生成",更懂"设计" 85
Tags:
模型发布多模态产品发布Source:
AI HOT 精选| 阅读原文
[摘要]
字节发布多模态图像生成模型Seedream 5.0 Pro,支持复杂信息可视化、像素级编辑、真实影像质感,已上线豆包、即梦等平台。
黑客可利用9款最流行的AI工具组装大规模僵尸网络 85
Tags:
AI安全提示注入网络安全Source:
AI HOT 精选| 阅读原文
[摘要]
研究人员提出HalluSquatting新型提示注入攻击,可规模化利用9款流行AI工具构建僵尸网络并执行DDoS,标志着提示注入从单点转向规模化威胁。
MIRA:可玩多人世界模型,20 FPS实时生成"火箭联盟的梦" 85
Tags:
世界模型模型发布开源生态多模态Source:
AI HOT 精选| 阅读原文
[摘要]
MIRA:可玩多人世界模型,20 FPS实时生成游戏画面,基于10k小时数据训练,演示、技术报告及开源代码已公开,值得关注。
Nemotron-Labs-Diffusion: A Tri-Mode Language Model Unifying Autoregressive, Diffusion, and Self-Speculation Decoding 85
Tags:
模型发布推理优化训练方法Source:
arXiv Computation and Language| 阅读原文
[摘要]
Nemotron推出三模态语言模型Nemotron-Labs-Diffusion,统一自回归、扩散与自我推测解码,8B模型吞吐量比Qwen3-8B高4倍,准确率相当。
When Does Tool Use Increase the Expressive Power of Finite-Precision Recurrent Models? 85
Tags:
理论分析序列模型模型表达力智能体Source:
arXiv Computation and Language| 阅读原文
[摘要]
本文严格分析了工具使用对有限精度循环模型表达能力的影响:无限状态工具(如磁带)可使系统达到图灵完备,而有限状态工具不增加表达能力,并表明选择性是构造的关键。
Pluralis v0.1: Towards a Multicultural, Multimodal, Multilingual Benchmark for AI Risk and Reliability 82
Tags:
AI安全数据集评估基准多模态Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出Pluralis v0.1多文化多模态基准,覆盖亚太六国八种语言,揭示视觉语言模型在全球部署中的文化敏感失效模式,推动AI安全评估多元化。
Sparse but Wrong: Incorrect L0 Leads to Incorrect Features in Sparse Autoencoders 82
Tags:
研究可解释性稀疏自编码器大模型Source:
arXiv Computation and Language| 阅读原文
[摘要]
研究表明稀疏自编码器(SAE)中L0超参数设置错误会导致特征混杂,主流SAE普遍L0偏低,并提出代理指标指导正确设置。
PyTorch 2.13 Release Blog 80
Tags:
框架发布开源生态推理优化Source:
PyTorch Blog| 阅读原文
[摘要]
PyTorch 2.13 发布,FlexAttention 登陆 Apple Silicon (MPS),推理性能提升,影响开发者生态。
Introducing GPT-Live 80
Tags:
模型发布语音生成公司动态Source:
OpenAI News| 阅读原文
[摘要]
OpenAI发布新一代语音模型GPT-Live,用于ChatGPT语音交互,提升自然对话体验,是语音AI领域重要进展。
Robostral Navigate:Mistral AI 首个具身导航模型 80
Tags:
具身智能模型发布导航Mistral AISource:
AI HOT 精选| 阅读原文
[摘要]
Mistral AI 发布首个具身导航模型 Robostral Navigate(8B),仅用单 RGB 摄像头在 R2R-CE 验证集上取得 76.6% 未见过场景成功率,超越最佳方法,支持多种机器人。
加拿大不列颠哥伦比亚省拟起诉OpenAI:未上报ChatGPT暴力对话致校园枪击惨案 80
Tags:
政策监管AI安全公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
加拿大不列颠哥伦比亚省因OpenAI未上报ChatGPT暴力对话,致用户制造校园枪击案,拟起诉OpenAI。该事件凸显AI安全与平台责任问题,可能影响全球AI监管。
GitLost:Noma Labs 发现 GitHub AI 代理提示词注入漏洞 80
Tags:
AI安全智能体公司动态漏洞Source:
AI HOT 精选| 阅读原文
[摘要]
Noma Labs 发现 GitHub AI 代理存在提示词注入漏洞 GitLost,攻击者可借公共 Issue 诱使 Claude 或 GitHub Copilot 泄露私有仓库内容,影响 AI 安全生态。
智能免费,然后呢?--Data Systems for, of, and by Agents 80
Tags:
AI推理成本数据系统智能体产业趋势Source:
AI HOT 精选| 阅读原文
[摘要]
AI推理成本急剧下降,GPT-4级能力每百万token从30美元降至不足1美元,知识工作级智能即将近乎免费,引发数据系统为智能体变革。
Claude开发者分享两种多智能体模式:Advisor和Orchestrator 80
Tags:
智能体多智能体工程实践成本优化Source:
AI HOT 精选| 阅读原文
[摘要]
Claude开发者分享两种多智能体模式(Advisor与Orchestrator),通过组合不同模型在SWE-bench和BrowseComp上实现性能和成本平衡,最高达92%性能节省63%成本。
Liquid AI 开源 Antidoom:基于最终 Token 偏好优化的推理模型死循环修复方法 80
Tags:
推理优化开源生态模型训练AI安全Source:
AI HOT 精选| 阅读原文
[摘要]
Liquid AI开源Antidoom,基于最终Token偏好优化解决推理模型死循环问题,循环率从10%-23%降至约1%,代码和数据集已开源。
蚂蚁集团旗下Robbyant开源LingBot-Vision:1B参数边界中心视觉基础模型,用于密集空间感知 80
Tags:
模型发布开源生态视觉基础模型公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
蚂蚁集团旗下Robbyant开源LingBot-Vision,1B参数视觉基础模型,在密集空间任务中匹配7倍大模型性能,Apache-2.0许可证发布,推动视觉感知开源生态。
A Function-Space Dichotomy for Compositional Learning: Exponential Sub-Optimality of the Neural Tangent Kernel 80
Tags:
研究深度学习理论神经正切核Source:
arXiv Statistics - Machine Learning| 阅读原文
[摘要]
该论文在理论上证明了神经网络在组合学习任务上指数级优于神经正切核,解释了深度学习的关键优势。
No Subspace to Track: Non-Identifiability and Optimizer State in Low-Rank Training 80
Tags:
模型训练优化器低秩方法Source:
arXiv Statistics - Machine Learning| 阅读原文
[摘要]
研究揭示低秩训练中梯度子空间不可追踪,提出LDAdam优化器,通过合理迁移优化器状态提升大模型训练效果,挑战了GaLore等方法的假设。