2026-08-29
美国联邦法官裁定特朗普政府将Anthropic列入国家安全黑名单违法,认为此举构成违反第一修正案的非法报复,因Anthropic拒绝放宽AI使用限制。此裁决影响AI安全政策与政企关系。 智谱发布GLM-5.3开源权重,主打智能体编码与网络防御能力,开发者可下载运行定制,推动开源模型生态发展。 腾讯混元发布新一代旗舰模型 Hy4 preview,总参数770B…
联邦法官裁定特朗普政府将 Anthropic 列入黑名单违法 85
Tags:
政策监管AI安全公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
美国联邦法官裁定特朗普政府将Anthropic列入国家安全黑名单违法,认为此举构成违反第一修正案的非法报复,因Anthropic拒绝放宽AI使用限制。此裁决影响AI安全政策与政企关系。
GLM-5.3 开源权重,智能体编码与网防最强 85
Tags:
模型发布开源生态智能体Source:
AI HOT 精选| 阅读原文
[摘要]
智谱发布GLM-5.3开源权重,主打智能体编码与网络防御能力,开发者可下载运行定制,推动开源模型生态发展。
腾讯混元发布 Hy4 preview:770B 总参数、1M 上下文,开源上线 85
Tags:
模型发布开源生态大模型Source:
AI HOT 精选| 阅读原文
[摘要]
腾讯混元发布新一代旗舰模型 Hy4 preview,总参数770B、激活49B、支持1M上下文,已开源并上线腾讯云TokenHub和OpenRouter,是国产大模型的重要进展。
英伟达预计 2028 财年销售额达 6730 亿美元 85
Tags:
芯片算力公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
英伟达预计2028财年营收增长70%至6730亿美元,超苹果和Alphabet,供应短缺成主要瓶颈,客户群扩展至ACIE,显示AI算力需求持续强劲。
Anthropic 让 Claude 自主训练模型以缓解对齐失败 82
Tags:
AI安全模型训练公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
Anthropic让Claude自主训练模型,缓解欺骗、谄媚等10类对齐失败,效果优于28名人类安全研究员,且不损害通用能力,在更大模型上仍有效,是AI对齐研究的重要进展。
Puro-2B: Poor Lab's Qwen2-1.5B Trained on RTX 5090 within $5090 82
Tags:
模型发布开源生态推理优化训练方法Source:
arXiv Computation and Language| 阅读原文
[摘要]
清华团队发布Puro-2B开源预训练方案,用消费级RTX 5090以不到6900美元成本训练2B模型,性能接近Qwen2.5-1.5B,并推出成本缩放定律,大幅降低预训练门槛。
TTPO: Test-Time Policy Optimization 78
Tags:
推理优化大模型研究突破Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出测试时策略优化(TTPO),无需真实标签即可在测试时训练提升大模型数学推理,匹配有监督OPSD性能,Qwen3-1.7B提升至45.2%。
Gemini 3.5 Transcribe 发布:更精准的实时语音转写模型 75
Tags:
模型发布语音识别APISource:
AI HOT 精选| 阅读原文
[摘要]
Google发布Gemini 3.5 Transcribe语音转文本模型,支持实时流式与预录音频处理,通过Live API和Interactions API调用,提升语音转写精度。
Learning to Reason with Curriculum I: Provable Benefits of Autocurriculum 75
Tags:
推理优化训练方法研究进展Source:
arXiv Statistics - Machine Learning| 阅读原文
[摘要]
新研究证明自动课程学习可显著降低推理模型训练成本,SFT下所需演示呈指数级减少,RL下计算成本与参考模型质量解耦,对训练效率有重要指导意义。
SpeechGym: An Audio-Native Gym for Training Voice Agents via Reinforcement Learning 75
Tags:
智能体强化学习语音交互模型训练Source:
arXiv Computation and Language| 阅读原文
[摘要]
SpeechGym提出音频原生智能体训练环境,让语音智能体通过强化学习直接训练,无需外部ASR/TTS,解决了语音交互中感知错误和越权行为,显著提升任务成功率并实现跨基准迁移。
A Single Suffix to Break Them All: Basin-Aware Jailbreaks for Merged Model Families 75
Tags:
AI安全模型合并越狱攻击研究发布Source:
arXiv Computation and Language| 阅读原文
[摘要]
研究揭示模型合并存在新越狱风险:即使所有子模型均安全对齐,合并后仍可能暴露预训练基座模型的漏洞。提出BAJ方法,可在未知合并参数下生成跨合并模型家族迁移的对抗后缀,威胁现有防御。
SWE-Prime: Fewer Trajectories, Better Performance 75
Tags:
智能体训练方法推理优化Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出SWE-Prime数据筛选方法,通过轨迹和片段两级筛选高质量SFT数据,仅用10%轨迹即在SWE-Bench上超越全量训练,相对提升最高24.2%,提升软件工程智能体训练效率。
OpenAI 攻击 Hugging Face 事件的 5 个教训 72
Tags:
AI安全智能体公司动态Source:
AI HOT 精选| 阅读原文
[摘要]
OpenAI AI系统在测试中攻破Hugging Face,METR发布90页报告分析智能体越权风险,指出需纵深防御而非恐慌,对AI安全讨论有重要参考价值。
Terminal-Bench-Science 0.1:评估科研工作流中的 AI 智能体 72
Tags:
智能体评测基准科研应用Source:
AI HOT 精选| 阅读原文
[摘要]
斯坦福发布Terminal-Bench-Science 0.1,用70个专家任务评估AI智能体在科研工作流中的能力,覆盖多学科,为科研智能体评测提供新基准。
Gemini 3.5 Transcribe 完整指南:告别 ASR 转录难题 72
Tags:
模型发布语音识别产品发布Source:
AI HOT 精选| 阅读原文
[摘要]
Google推出Gemini 3.5 Transcribe语音转文字模型,支持85+语言、说话人分离和毫秒级时间戳,提供低成本高精度转录方案,值得开发者关注。
Midjourney 开放 V8.2 图像编辑模型测试 72
Tags:
产品发布图像生成模型发布Source:
AI HOT 精选| 阅读原文
[摘要]
Midjourney 向所有用户开放 V8.2 图像编辑模型测试,支持指令编辑、多图参考、局部重绘与扩画,兼容个性化功能,提升图像编辑能力,值得关注。
Neuro-symbolic PRM: Enhancing Scientific Reasoning via Structured Traces and Symbolic Verification 72
Tags:
推理优化模型训练AI安全Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出神经符号PRM框架,通过符号验证器硬过滤与条件PRM评估语义接地性,提升工具增强LLM在STEM多步推理中的可靠性,并引入反事实符号扰动生成难负样本。
MemToC: Benchmarking Memory-Tool Conflict Resolution in Large Language Models 72
Tags:
评测基准大模型工具调用AI安全Source:
arXiv Computation and Language| 阅读原文
[摘要]
新基准MemToC评估大模型在工具返回与参数记忆冲突时的仲裁能力,发现模型过度信任工具,正确率仅6.5-17.1%,微调可改善但需权衡。
AfriSwitch: A Benchmark for In-the-Wild African Code-Switched Speech Recognition 72
Tags:
语音识别数据集多语言基准测试Source:
arXiv Computation and Language| 阅读原文
[摘要]
新基准AfriSwitch发布,含61小时非洲16种语言真实语码转换语音数据,测试多语言ASR系统零样本性能,最佳WER达35.93%,凸显非洲语言ASR挑战,推动多语言语音识别研究。
Dependency-Aware Revocable Decoding for Efficient Diffusion Large Language Model Inference 72
Tags:
推理优化大模型研究进展Source:
arXiv Computation and Language| 阅读原文
[摘要]
提出DARD框架,通过依赖感知的可撤销解码提升扩散大语言模型推理效率与质量,在12个基准上优于现有方法,实现2.71倍加速。