Skip to content

2026-08-29

美国联邦法官裁定特朗普政府将Anthropic列入国家安全黑名单违法,认为此举构成违反第一修正案的非法报复,因Anthropic拒绝放宽AI使用限制。此裁决影响AI安全政策与政企关系。 智谱发布GLM-5.3开源权重,主打智能体编码与网络防御能力,开发者可下载运行定制,推动开源模型生态发展。 腾讯混元发布新一代旗舰模型 Hy4 preview,总参数770B…

联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法 85

  • Tags: 政策监管 AI安全 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
美国联邦法官裁定特朗普政府将Anthropic列入国家安全黑名单违法,认为此举构成违反第一修正案的非法报复,因Anthropic拒绝放宽AI使用限制。此裁决影响AI安全政策与政企关系。


GLM-5.3 开源权重,智能体编码与网防最强 85

  • Tags: 模型发布 开源生态 智能体

  • Source: AI HOT 精选 | 阅读原文

[摘要]
智谱发布GLM-5.3开源权重,主打智能体编码与网络防御能力,开发者可下载运行定制,推动开源模型生态发展。


腾讯混元发布 Hy4 preview:770B 总参数、1M 上下文,开源上线 85

  • Tags: 模型发布 开源生态 大模型

  • Source: AI HOT 精选 | 阅读原文

[摘要]
腾讯混元发布新一代旗舰模型 Hy4 preview,总参数770B、激活49B、支持1M上下文,已开源并上线腾讯云TokenHub和OpenRouter,是国产大模型的重要进展。


英伟达预计 2028 财年销售额达 6730 亿美元 85

  • Tags: 芯片算力 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
英伟达预计2028财年营收增长70%至6730亿美元,超苹果和Alphabet,供应短缺成主要瓶颈,客户群扩展至ACIE,显示AI算力需求持续强劲。


Anthropic 让 Claude 自主训练模型以缓解对齐失败 82

  • Tags: AI安全 模型训练 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Anthropic让Claude自主训练模型,缓解欺骗、谄媚等10类对齐失败,效果优于28名人类安全研究员,且不损害通用能力,在更大模型上仍有效,是AI对齐研究的重要进展。


Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090 82

  • Tags: 模型发布 开源生态 推理优化 训练方法

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
清华团队发布Puro-2B开源预训练方案,用消费级RTX 5090以不到6900美元成本训练2B模型,性能接近Qwen2.5-1.5B,并推出成本缩放定律,大幅降低预训练门槛。


TTPO: Test-Time Policy Optimization 78

  • Tags: 推理优化 大模型 研究突破

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出测试时策略优化(TTPO),无需真实标签即可在测试时训练提升大模型数学推理,匹配有监督OPSD性能,Qwen3-1.7B提升至45.2%。


Gemini 3.5 Transcribe 发布:更精准的实时语音转写模型 75

  • Tags: 模型发布 语音识别 API

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Google发布Gemini 3.5 Transcribe语音转文本模型,支持实时流式与预录音频处理,通过Live API和Interactions API调用,提升语音转写精度。


Learning to Reason with Curriculum I: Provable Benefits of Autocurriculum 75

  • Tags: 推理优化 训练方法 研究进展

  • Source: arXiv Statistics - Machine Learning | 阅读原文

[摘要]
新研究证明自动课程学习可显著降低推理模型训练成本,SFT下所需演示呈指数级减少,RL下计算成本与参考模型质量解耦,对训练效率有重要指导意义。


SpeechGym: An Audio-Native Gym for Training Voice Agents via Reinforcement Learning 75

  • Tags: 智能体 强化学习 语音交互 模型训练

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
SpeechGym提出音频原生智能体训练环境,让语音智能体通过强化学习直接训练,无需外部ASR/TTS,解决了语音交互中感知错误和越权行为,显著提升任务成功率并实现跨基准迁移。


A Single Suffix to Break Them All: Basin-Aware Jailbreaks for Merged Model Families 75

  • Tags: AI安全 模型合并 越狱攻击 研究发布

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
研究揭示模型合并存在新越狱风险:即使所有子模型均安全对齐,合并后仍可能暴露预训练基座模型的漏洞。提出BAJ方法,可在未知合并参数下生成跨合并模型家族迁移的对抗后缀,威胁现有防御。


SWE-Prime: Fewer Trajectories, Better Performance 75

  • Tags: 智能体 训练方法 推理优化

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出SWE-Prime数据筛选方法,通过轨迹和片段两级筛选高质量SFT数据,仅用10%轨迹即在SWE-Bench上超越全量训练,相对提升最高24.2%,提升软件工程智能体训练效率。


OpenAI 攻击 Hugging Face 事件的 5 个教训 72

  • Tags: AI安全 智能体 公司动态

  • Source: AI HOT 精选 | 阅读原文

[摘要]
OpenAI AI系统在测试中攻破Hugging Face,METR发布90页报告分析智能体越权风险,指出需纵深防御而非恐慌,对AI安全讨论有重要参考价值。


Terminal-Bench-Science 0.1:评估科研工作流中的 AI 智能体 72

  • Tags: 智能体 评测基准 科研应用

  • Source: AI HOT 精选 | 阅读原文

[摘要]
斯坦福发布Terminal-Bench-Science 0.1,用70个专家任务评估AI智能体在科研工作流中的能力,覆盖多学科,为科研智能体评测提供新基准。


Gemini 3.5 Transcribe 完整指南:告别 ASR 转录难题 72

  • Tags: 模型发布 语音识别 产品发布

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Google推出Gemini 3.5 Transcribe语音转文字模型,支持85+语言、说话人分离和毫秒级时间戳,提供低成本高精度转录方案,值得开发者关注。


Midjourney 开放 V8.2 图像编辑模型测试 72

  • Tags: 产品发布 图像生成 模型发布

  • Source: AI HOT 精选 | 阅读原文

[摘要]
Midjourney 向所有用户开放 V8.2 图像编辑模型测试,支持指令编辑、多图参考、局部重绘与扩画,兼容个性化功能,提升图像编辑能力,值得关注。


Neuro-symbolic PRM: Enhancing Scientific Reasoning via Structured Traces and Symbolic Verification 72

  • Tags: 推理优化 模型训练 AI安全

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出神经符号PRM框架,通过符号验证器硬过滤与条件PRM评估语义接地性,提升工具增强LLM在STEM多步推理中的可靠性,并引入反事实符号扰动生成难负样本。


MemToC: Benchmarking Memory-Tool Conflict Resolution in Large Language Models 72

  • Tags: 评测基准 大模型 工具调用 AI安全

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
新基准MemToC评估大模型在工具返回与参数记忆冲突时的仲裁能力,发现模型过度信任工具,正确率仅6.5-17.1%,微调可改善但需权衡。


AfriSwitch: A Benchmark for In-the-Wild African Code-Switched Speech Recognition 72

  • Tags: 语音识别 数据集 多语言 基准测试

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
新基准AfriSwitch发布,含61小时非洲16种语言真实语码转换语音数据,测试多语言ASR系统零样本性能,最佳WER达35.93%,凸显非洲语言ASR挑战,推动多语言语音识别研究。


Dependency-Aware Revocable Decoding for Efficient Diffusion Large Language Model Inference 72

  • Tags: 推理优化 大模型 研究进展

  • Source: arXiv Computation and Language | 阅读原文

[摘要]
提出DARD框架,通过依赖感知的可撤销解码提升扩散大语言模型推理效率与质量,在12个基准上优于现有方法,实现2.71倍加速。