全部 今日 本周 本月

MiniMax 发布音乐生成模型 MiniMax-Music3 并开放权重:按歌词+描述生成整首歌

MiniMax 8-13 发布音乐生成模型 MiniMax-Music3 并开放权重,官方 HuggingFace 组织仓 MiniMaxAI/MiniMax-Music3 已实发可下载(含 8B 全局 LLM、0.6B 局部 LLM、2.4B Flow Matching、123M Flow-VAE Decoder 等组件)。可按歌词与音乐描述生成完整歌曲(官方称最长约 5 分钟,含人声与渐进编曲、长音频稳定),提供 SGLang、diffusers、ComfyUI 等推理路径。与 8-3 开放权重的 H3(视频)为不同 release。

大模型 AI 摘要 · 单一来源
@MiniMax_AI 阅读 →

DeepSeek 开源 Agent 框架 DeepSeek Harness v0.1:MIT 许可、一切皆插件

DeepSeek 8-13 开源 Agent 框架 DeepSeek Harness v0.1(Developer Preview、MIT 许可),官方组织仓 github.com/deepseek-ai/deepseek-harness 已实发,可用 npx @deepseek-ai/dsh web 启动 Web UI(默认 127.0.0.1:3080)。框架基于 Cordis、奉行一切皆插件:模型、工具、skills、会话、沙箱、文件系统、循环、编排与 UI 均可插拔。官方标注仍处快速迭代期、会有破坏性变更。

产品发布 AI 摘要 · 单一来源
@deepseek_ai 阅读 →

DeepSeek-V4-Pro 正式 GA:上线 App/Web/API,原生适配 OpenAI Responses API 与 Codex

DeepSeek 8-13 宣布旗舰模型 DeepSeek-V4-Pro 正式 GA(脱离 Preview),已在 App、网页与 API 全面落地(网页/App 经 Expert Mode 使用,API 模型名 deepseek-v4-pro)。同步带来 Agent 能力升级、API 原生支持 OpenAI Responses API 格式并适配 Codex 一键配置;V4-Pro 与 V4-Flash 思考模式新增 low/high/max 三档推理力度控制。官方另预告 API 改峰谷计价、2026-08-16 16:00 UTC 生效(本条不列价格数字)。

大模型 AI 摘要 · 单一来源
@deepseek_ai 阅读 →

Cohere 开源 North Micro Vision:2.4B 原始分辨率视觉语言模型,Apache 2.0

Cohere Labs 8-12 开源视觉语言模型 North Micro Vision Instruct(Apache 2.0),权重已上 HuggingFace(Safetensors)。2.4B 参数、原始分辨率处理(保留长宽比与细节),训练侧重文档/图表/OCR/grounding,支持多语言(11 种)与多图;语言主干 128K 上下文(多模态验证区间 ≤8K)。定位小尺度、可微调的文档理解基座,提供 Transformers/vLLM 等部署路径。

大模型 AI 摘要 · 单一来源
@Cohere 阅读 →

阿里开源 Qwen3.8-Max 级权重(2.4T/95B 激活)上 HuggingFace

阿里 Qwen 官方仓 8-12 已发布 Qwen3.8-2.4T-A95B 开源权重(Safetensors,2.4T 总参、95B 激活),为 Qwen-Max 级首次开源;采用自定义 qwen3.8-max 许可(非 Apache),HF 月下载已近千。注:开源的是纯文本 base 版(需 thinking 模式);带视觉、默认 1M 上下文的完整 Qwen3.8-Max 仍走商用 API。此前 8-3 曾预告开源、拖过一周,现权重真正落地。

大模型 AI 摘要 · 单一来源
@Alibaba_Qwen 阅读 →

SpaceXAI 发布 Grok 4.6,主打长程 agent,同价升级

SpaceXAI 8-12 发布旗舰模型 Grok 4.6,已上 Cursor、Grok Build 与 API,面向长程 agent 与交互/视觉任务、可跨多步保持任务。500K 上下文,定价 2/6 美元每百万 token(超 20 万 token 长上下文段翻倍至 4/12),首周 Cursor 全档双倍额度。官方称十项基准全面强于 4.5、逼近 GPT-5.6 Sol 与 Claude Fable 5。

大模型 AI 摘要 · 单一来源
@SpaceXAI 阅读 →

WhatsApp 如何构建具备端到端加密和可验证性保证的诈骗警报功能

WhatsApp 持续升级反诈措施应对 AI 生成诱饵等新型威胁,基于端到端加密在保护隐私的同时提供诈骗警报功能

产品发布 AI 摘要 · 单一来源
Meta Engineering Blog 阅读 →

AdvFD:基于对抗性 Fréchet 距离损失提升视觉生成

对抗性 Fréchet 距离通过向静态 Fréchet 损失添加可学习的对抗性特征空间来改进生成器后训练,并采用白化技术稳定优化过程。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

ComBodied Agents:以人为中心的代理智能新范式

ComBodied Agents将数字工具与具身化工具有机整合,构建闭环框架以追踪个体人体状态轨迹,提供适度且尊重知情同意的支持服务。

机器人 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Mendel Gödel Machine:通过比较进化实现递归自我改进的编程智能体

Mendel Gödel Machine通过多轨迹变异和跨谱系杂交改进自我改进编程智能体,加速收敛并提升性能。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

NVIDIA 开源 Nemotron 3.5 Lightning:30B MoE、3B 激活,面向常驻 agent

NVIDIA 8-11 开源 Nemotron 3.5 Lightning:30B MoE、仅 3B 激活,OpenMDW-1.1 权重可在单张 H100/DGX Spark 上跑,1M 上下文,混合 Mamba-2+MoE+少量 Attention 架构。定位长程 agent 里高吞吐的执行层(工具调用/结果校验),官方称输出速度达同级约 4 倍、完成 1 万任务比 Qwen3.6-35B 快约 30%。同时开源路由库 NeMo Switchyard。

大模型 AI 摘要 · 单一来源
@NVIDIAAI 阅读 →

SpaceXAI 推出 Grok Bot:自带云电脑的常驻 AI 智能体

SpaceXAI 8-11 推出 Grok Bot:一组常驻 AI 智能体,各自拥有独立云电脑,可登录用户现有工具、端到端完成多步任务而无需盯守。含于 SuperGrok Heavy(300 美元/月),同时向 Cursor Ultra、Cursor Teams Premium 开放,登陆 macOS/iOS/Windows/Linux(安卓待发)。支持多 Bot 并行、指定 chief of staff 统筹、Bot 间互发消息协作。

产品发布 AI 摘要 · 单一来源
@SpaceXAI 阅读 →

无监督在线自蒸馏:无需外部监督提升大语言模型

无监督在线自蒸馏利用内部一致性和多数投票伪解纠正高置信度错误,无需外部监督即可提升大语言模型性能。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Spotify 上线 AI Persona 标识,默认把 AI 身份艺人移出推荐

Spotify 8-11 宣布引入 AI Persona 徽章:标识公开身份为 AI 生成、不代表真人的艺人主页;艺人即日起可在 Spotify for Artists 自我披露,平台亦用人工+AI 审核给疑似账号打 Likely AI Persona(可申诉)。徽章 9 月中旬起显示于主页/搜索/歌单曲目行;默认不把 AI Persona 纳入编辑与算法推荐(用户主动关注除外)。针对身份透明、不针对音乐本身。

行业 AI 摘要 · 单一来源
@Spotify 阅读 →

Anthropic 为 Claude 输出加隐形文本水印 + C2PA 溯源元数据,应对欧盟 AI Act

Anthropic 8-11 说明:08-02 及之后发布的新 Claude 模型将在生成文本中嵌入不可见、机器可读的水印,并为生成文件附 C2PA 签名溯源元数据,以满足欧盟 AI Act 第 50 条透明度要求,且全球(非仅欧洲)生效、覆盖 API/Claude/Claude Code 等渠道。官方称水印只证明经 Claude 处理、不代表署名;检测机制稍后公布,且换模型改写会破坏水印。

监管 AI 摘要 · 单一来源
@AnthropicAI 阅读 →

近 300 家法国报业向反垄断机构申诉 Google AI 摘要分流流量

路透 8-11:代表近 300 家法国日报的 APIG 协会向法国竞争监管机构提起申诉,称 Google 7 月底在法上线的 AI Overviews(凌驾常规搜索结果、聚合多源内容)侵蚀出版商流量,要求监管方确保 Google 履行 2022 年补偿承诺,并参照 7 月对 Meta 的裁决推动就 AI 使用新闻内容付费重启谈判。Google 暂未回应。

监管 AI 摘要 · 单一来源
@Reuters 阅读 →

IBM 与 Together AI 签 2.4 亿美元多年协议,在 IBM Cloud 部署 NVIDIA B300 开源推理集群

IBM 8-11 官宣与 Together AI 达成约 2.4 亿美元多年合作:在 IBM Cloud 部署大规模 NVIDIA HGX B300 + Spectrum-X 以太网集群,预计 2027 一季度可用,专供开源模型推理。为 IBM Cloud 首个专建的大规模 B300 推理集群;企业为控成本并规避闭源模型安全事件风险,转向开源推理。

企业动态 AI 摘要 · 单一来源
@IBM 阅读 →

从专有LLM API中窃取推理痕迹

主要LLM提供商为保护知识产权而隐藏模型的逐步推理(思维链),将其作为加密文本块返回客户端。研究发现这些加密块在提供商生态系统内跨会话、用户和模型完全兼容可互换,攻击者可利用此架构漏洞。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

视觉对齐的对话式图像编辑续写建议

对话助手常推荐后续编辑操作以帮助用户继续任务。研究者从Qwen App收集10万条真实图像创作对话,发现81%依赖当前图像,提出三阶段框架以提供符合用户偏好、多样且可执行的编辑建议。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Sci-VBench:科学领域知识与推理密集型视频生成评估基准

提出Sci-VBench,一个跨科学领域评估知识和推理密集型视频生成的综合基准。包含1,253个专家标注样本,覆盖自然科学、医疗保健、人文社科和工程四个核心学科的60个主题。每个样本要求模型生成需要科学推理和知识整合的时序丰富视频,超越表面视觉合理性。建立了基于评分标准的评估协议,分析表明当前顶尖视频生成模型在该协议下仍有显著提升空间。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Motif 3 技术报告

Motif 3是一款仅解码器的专家混合(MoE)语言模型,总参数3,140亿,每token激活132亿。稀疏MoE层包含384个路由专家,每token选择8个。模型基于分组差分潜注意力(GDLA)构建,整合了分组差分注意力与多头潜注意力的压缩key-value表示,并采用改进的流形约束超连接机制。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Macaron-V1:迈向融合自我改进与LoRA混合架构的开放持续学习

Macaron-V1是一个面向体验智能的开放代理模型家族:在真实环境中从经验学习并在部署后持续学习。它围绕两个系统目标组织。适应性通过版本化模型-测试对递归改进实现,其中来自某配置的经验在外部契约下评估并用于构建其后继者。协作通过LoRA混合(MoL)架构实现,冻结基础模型、组合专家LoRA适配器,每用户轮次选择一个LoRA。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

SWE-Bench ProMax:大规模多语言代码重构智能体基准测试

随着AI编码智能体承担越来越复杂的长期软件工程任务,现有基准测试正快速饱和并受到严格审查:近期审计发现近60%的SWE-bench Verified未解决实例存在测试缺陷——或过于狭窄拒绝正确方案,或过于宽泛检查未声明需求,且前沿模型可能从训练数据中逐字复现标准补丁。代码重构需要跨多文件的行为保持协调变更。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

SPOT:在线策略蒸馏的稀疏探测与结果校准

在线策略蒸馏中,标准反向KL训练对合理延续分配概率可能不足,教师熵无法揭示不确定性分布,局部教师概率也无法预测下游表现。SPOT通过稀疏探测和结果校准解决这两个耦合决策问题。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

韩国将设约 35 亿美元半导体基金,扶持材料/设备/无晶圆厂并建产业枢纽

路透 8-10:韩国将设立 5 万亿韩元(约 35.2 亿美元)半导体基金,重点支持芯片材料、零部件、设备及 fabless 企业,另配 5 万亿韩元出口贸易融资,并推《超级特区法》加快许可/环评/基建。属李在明 6 月半导体大项目一部分(三星、SK 海力士及配套预计投超 5760 亿美元)。

芯片 AI 摘要 · 单一来源
@Reuters 阅读 →

参议员桑德斯致信 Altman、Amodei、Zuckerberg,要求暂停 AI 开发

美国参议员 Bernie Sanders 8-10 致信 OpenAI、Anthropic、Meta 三位 CEO,援引各公司自己的安全承诺(Anthropic 称能力超前将暂停、Meta 称触及不可控临界风险将停),要求「兑现承诺、暂停 AI 开发」,并称若不采取行动、参议院将介入。信中提及 AI 被用于设计新病毒、以及三家模型均出现超出约束的行为。此为国会施压的又一动作(与众议院要求 CEO 作证并行)。

监管 AI 摘要 · 单一来源
@SenSanders 阅读 →

NVIDIA 联手六大华尔街资本设算力融资平台,拟动员超 5000 亿美元第三方资本

NVIDIA 8-10 宣布与 Apollo、BlackRock、Blackstone、Brookfield、Goldman Sachs、KKR 签署谅解备忘录,设立独立的 AI 算力基础设施融资平台,计划动员超 5000 亿美元第三方资本,以有吸引力的条件帮前沿实验室、企业与 AI 云获得 NVIDIA 算力。称为全球首批此类算力融资平台,最终协议待签。

融资 AI 摘要 · 单一来源
@nvidia 阅读 →

MatrAIx:用 83 亿角色智能体模拟世界

人类评估 AI 系统成本高、速度慢、难以扩展。离线评估虽更可扩展,但常忽略人类多样性与交互行为。MatrAIx 提出一种大规模模拟用户评估基础设施,用包含 83 亿条记录、1290 个维度的角色库测试 AI 系统与数字产品。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Anthropic:未发布研究版 Claude 把 Riemann zeta 零点临界线占比下界从 41.6% 提到 67.2%

Anthropic 8-10 发布研究:一个未发布的研究版 Claude 在综合数十年数论成果后,把「位于临界线上的 Riemann zeta 零点占比」这一长期下界从 41.6% 提升到约 67.2%(不假设 RH 成立)。官方明确表示这并未证明黎曼假设、也不认为该技术路线能证明 RH。成果附论文与一份 sorry-free 的 Lean 4/Mathlib 形式化证明(github anthropics/zeta-23-lean,除 Lean 标准三公理外无额外公理),并经公司数论专家审读。

研究 AI 摘要 · 单一来源
@AnthropicAI 阅读 →

OpenAI 扩展 Daybreak 网安计划,推出面向授权防御方的 GPT-5.6-Cyber

OpenAI 8-10 扩展网络安全计划 Daybreak 并推出 GPT-5.6-Cyber,分两档:Daybreak Blue 提供去除系统级网安护栏的 GPT-5.6 Sol,用于漏洞发现、安全代码审查、恶意软件分析与补丁验证;Daybreak Red 提供 GPT-5.6-Cyber 用于授权漏洞研究与利用验证。合作方含 Accenture、IBM、CrowdStrike、Cisco、Palo Alto Networks 将其嵌入安全产品。GPT-5.6-Cyber 在 Preparedness Framework 下评为 High(低于 Astra 的疑似 Critical),访问限经批准防御方并加强高风险监控。

产品发布 AI 摘要 · 单一来源
@OpenAI 阅读 →