全部 今日 本周 本月

ABot-Earth 0.5:生成式3D地球模型

ABot-Earth 0.5利用3D高斯泼溅技术从卫星图像生成逼真的3D环境,实现快速合成和实时可视化,服务于具身AI应用。

机器人 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

MemDreamer:基于分层图记忆与智能检索的长视频理解方法

MemDreamer通过分层图记忆和智能探索将感知与推理解耦,以更低计算开销实现长视频理解最优性能。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

利用稀疏自编码器解释和引导文本转语音语言模型

在语言模型表示上训练的稀疏自编码器揭示了语音合成中可解释的特征,这些特征可被操控以控制语言学和韵律属性

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

数据记者 Agent:将数据转化为可验证的多模态新闻报道

一个多 Agent 框架通过生成基于证据的多模态新闻报道来自动化数据新闻流程,同时确保透明度和可验证性。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

美团AI浏览器正式上线,聚合多个大模型、强调Agent能力

6月9日,美团旗下GN06团队宣布AI原生浏览器Tabbit 1.0正式上线。雷峰网获悉,当天Windows、macOS版本的Tabbit已同步上架,移动端也已开启测试。 从0.23版本到1.0版本,Tabbit嵌入了更多的Agent能力,目前内置多款头部大模型可供用户调用选择。在发布现场,Tabbit 负责人刘炯强调,标准版永久免费,用户一周大概可以使用1000次模型对话、50张AI生成配图、1

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

Role-Agent:通过双角色演化引导 LLM 智能体

Role-Agent 框架通过引导式协同演化,使 LLM 智能体同时扮演智能体和环境角色,通过环境感知推理和定向实践提升性能。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

会写字、懂排版、能分镜:HiDream-O1-Image-1.5 全能图像生成能力解析

近日,智象未来(HiDream.ai) 全新推出的商用版图像生成模型 HiDream-O1-Image-1.5 再次实现 SOTA,在全球知名独立 AI 模型评测与分析平台 Artificial Analysis的文生图榜单(Text to Image Leaderboard)上,一举登上中国图像生成模型第一,成为评分仅次于OpenAI的中国大模型公司,超越Google Nano Banana 2

大模型 AI 摘要 · 单一来源
雷锋网 阅读 →

重磅首发!奥尼AI Agent OS、Token工厂正式上线,构建智能体运行新生态

“智能体AI已经到来。”NVIDIA创始人兼CEO黄仁勋在近期的GTC 2026台北演讲中宣告。一个新的共识正在形成:个人和企业都将拥有自己的智能体,社会生产力将被重塑。 面对这场浪潮,如何让智能体安全部署、高效运行并持续创造价值?作为NVIDIA的合作伙伴,奥尼给出了具体的落地答案。 6月9日,奥尼集中发布多项重磅成果,从硬件底座、操作系统、算力网络到开放生态,为智能体规模化落地提供一条全新的实

芯片 AI 摘要 · 单一来源
雷锋网 阅读 →

超越统一Token级信任域的LLM强化学习方法

CPPO通过引入位置加权阈值和累积前缀预算机制,解决了可验证奖励强化学习的局限性,以更好地应对自回归生成难题。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

Lip Forcing:用于实时唇形同步的少步自回归扩散模型

一种自回归扩散方法,通过知识蒸馏和优化推理调度实现视频到视频的实时唇形同步。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

快手可颜-VL-2.0 技术报告

Kwai Keye-VL-2.0-30B-A3B 是一款开源混合专家多模态基础模型,通过 DeepSeek 稀疏注意力和专用训练基础设施,实现长视频理解与代理智能能力。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

OpenClaw适配Claude Fable 5 API密钥配置指南

Garry Tan提供OpenClaw配合Claude Fable 5的API密钥配置说明(2026年6月Anthropic将Fable 5调整后需相应参数)。

大模型 AI 摘要 · 单一来源
@garrytan 阅读 →

Replit联合Socket推出Package Firewall,从源头阻断恶意包

Replit发布Package Firewall,与Socket合作开发,在恶意软件安装到应用前就将其阻断,区别于传统发布前的安全扫描。

产品发布 AI 摘要 · 单一来源
@Replit 阅读 →

DeepMind研究:AI作为教师伙伴扩大教育覆盖面

在塞拉利昂,教师资源有限、覆盖面不足,Google DeepMind发布随机对照试验结果,探索AI(Gemini引导学习)如何在不替代教师核心专业的前提下扩大教育覆盖。

大模型 AI 摘要 · 单一来源
@GoogleDeepMind 阅读 →

Mistral CTO谈企业部署开放模型:Forge定制框架与NVIDIA合作

NVIDIA AI Podcast邀请Mistral CTO Timothée Lacroix讨论Mistral的开放模型哲学、Forge定制框架,以及通过Nemotron Coalition与NV…

产品发布 AI 摘要 · 单一来源
@nvidia 阅读 →

斯坦福部署248块Hopper GPU超级计算集群Marlowe

斯坦福大学七所学院500多名研究人员获得大规模算力升级,在NVIDIA和Mark III Systems支持下部署Marlowe DGX SuperPOD,配备248块NVIDIA Hopper G…

芯片 AI 摘要 · 单一来源
@nvidia 阅读 →

Brex CEO:AI是比肩电力的平台级变革,CEO应兼任首席AI官

Brex联合创始人Pedro Franceschi认为AI是构建产品、团队和公司的全新基础,平台变革意义堪比电力的发明,CEO需要成为首席AI官。

观点 · 观点/主张 AI 摘要 · 单一来源
@ycombinator 阅读 →

NVIDIA Vera CPU助力NYSE打造AI就绪市场基础设施

NVIDIA与Redpanda和HPE合作,NYSE采用Vera CPU扩展容量的同时优化延迟,构建高性能、高弹性、面向AI的市场基础设施。

芯片 AI 摘要 · 单一来源
@nvidia 阅读 →

Anthropic发布前沿AI风险治理提案,承诺提供资金支持

Anthropic发布政府应对前沿AI风险的详细提案,以及就业岗位替代政策框架,并表示将为此提供大量资金支持。

产品发布 AI 摘要 · 单一来源
@DarioAmodei 阅读 →

Anthropic:仅靠透明度已不足以监管前沿AI

Dario Amodei指出,Anthropic长期以来一直倡导前沿AI的透明度要求,因为此前风险尚不够清晰,无法进行精确监管。但他强调,如今仅靠透明度已经不够。

行业 AI 摘要 · 单一来源
@DarioAmodei 阅读 →

Anthropic CEO:前沿模型须强制三方测试,危险模型可被阻止部署

Dario Amodei表示,除透明度要求外,前沿模型应在网络安全、生物武器、失控与自动化研发四类风险方面接受强制性第三方审查,政府应有权阻止或撤销存在灾难性风险的模型部署。

观点 · 观点/主张 AI 摘要 · 单一来源
@DarioAmodei 阅读 →

vLLM 祝贺 Google DeepMind 发布 DiffusionGemma,首个原生支持的…

26B 参数基于 Gemma4,支持块级并行去噪,单卡 H200(FP8)吞吐量超 1200 token/s,模型检查点已在 RedHat AI Hub 提供

大模型 AI 摘要 · 单一来源
@vllm_project 阅读 →

NVIDIA CEO 黄仁勋:从台湾到硅谷的逆袭与加速计算信仰

纪录片首集邀请康多莉扎·赖斯对谈,讲述黄仁勋的韧性与创新历程

芯片 AI 摘要 · 单一来源
@nvidia 阅读 →

xAI 推出 Grok Voice:类人语调、情感温度,价格仅为竞品几分之一

Grok Voice 具备先进语音合成性能,可模拟人类节奏和情感,定价极低,详情点击

大模型 AI 摘要 · 单一来源
@xai 阅读 →

eToro 代理 Tori 采用 xAI 与 SpaceXAI 实时数据辅助情绪分析

该代理利用模型和实时数据帮助用户判断市场情绪,详情见链接

大模型 AI 摘要 · 单一来源
@xai 阅读 →

Yann LeCun 呼吁加入 Project Tapestry

他与 Clement Delangue、Dan Jeffries 共同号召开发者参与新项目 Tapestry,详情见链接

行业 AI 摘要 · 单一来源
@ylecun 阅读 →

Perplexity 上线 Claude Fable 5:Computer 专属编排模型,仅限 P…

Anthropic 的最新长任务模型现已通过 Perplexity Computer 提供,帮助处理复杂工作流,需订阅 Pro 或 Max

大模型 AI 摘要 · 单一来源
@perplexity_ai 阅读 →

Cursor 代码审查 Agent 速度提升 3 倍,成本降低 22%,发现更多 Bug

新版 /review 本地运行 Bugbot,可在推送前捕获并修复问题,效率与准确性同步提升

行业 AI 摘要 · 单一来源
@cursor_ai 阅读 →

Chamath 警告企业需防范模型锁机风险

他指出 Anthropic 在提示违规时会自行决定使用权限,虽合法但对企业业务连续性构成潜在威胁,呼吁制定相应策略

观点 · 观点/主张 AI 摘要 · 单一来源
@chamath 阅读 →

Google DeepMind 发布 DiffusionGemma:GPU 上文本生成快 4 倍

DiffusionGemma 通过块同步生成与自校正,可实时处理复杂 Markdown,单卡 H200(FP8)吞吐量超 1200 token/s

芯片 AI 摘要 · 单一来源
@GoogleDeepMind 阅读 →