来自 Twitter · Hacker News · GitHub 的 AI 行业动态
新论文提出 HY-Embodied-0.5,旨在为真实世界智能体提供通用的具身基础模型能力,推动机器人等领域的 AI 应用落地。
HiSparse 通过将不活跃 KV Cache 主动卸载到主机内存解决容量瓶颈,在 8xH200 上 256 并发请求下实现 3 倍吞吐提升,长上下文场景可达 5 倍。
Replit 现已支持在平台上构建应用并直接部署到 Databricks,为企业用户提供安全、可扩展的应用开发部署方案。
Sam Altman 凌晨被投向其住宅的莫洛托夫燃烧瓶惊醒,所幸燃烧弹弹开未造成伤害。Altman 在博客中将此事与近期一篇争议文章关联,呼吁公众理性对待 AI 焦虑。
Claude for Word 以 Word 原生修订模式呈现修改,支持 Skills 工作流复用,与 Excel、PowerPoint 共享上下文,现对 Team 和 Enterprise 用户开放。
NVIDIA CEO 黄仁勋与 Cadence CEO Anirudh Devgan 在 CadenceLIVE 硅谷站进行炉边对话,探讨 Design for AI and AI for Design 如何推动创新。
Claude Code 推出 ultraplan 功能,将规划任务搬到浏览器中审阅批注,支持云端执行或拉回本地,解决终端内审阅复杂方案的痛点。
Runway 分享利用其工具在一天之内将灵感转化为完整品牌宣传片的工作流程。
Y Combinator CEO 指出大模型性能提升的积极效应——小模型也会随之变得更好,智能终将普惠所有人。
MiniMax Music-2.6 可根据文本提示生成完整歌曲或纯器乐,Music-Cover 可将任意歌曲转换为不同风格、声音和编曲。
Anthropic 正利用 CoreWeave 提供的 NVIDIA 算力基础设施进行大规模扩展,支撑先进 AI 模型的训练、推理和全球部署。
NVIDIA 借全国机器人周回顾 GTC 大会亮点——自主人形机器人、高精度手术臂和实时对话配送机器人,标志物理 AI 新时代到来。
Chamath 指出企业部署 AI Agent 时需掌握控制权,避免将核心经验泄露到模型中,否则竞争对手将借此蚕食市场。
Claude for Word 可与 Excel 和 PowerPoint 插件共享对话上下文,实现跨文档协作,用户可在单次对话中操作多个打开的文档。
OpenAI CEO Sam Altman 分享了一篇他清晨写下、一度犹豫是否发布的博客文章。
据 a16z 最新数据图表,AI 推理需求预计将取代训练,成为未来数据中心建设扩张的主要推动力。
Allen AI 发布 MolmoWeb 完整代码库,包含训练代码、评估工具、标注工具、合成数据管线和客户端代码,支持在自定义任务上训练和评估 Web Agent。
Garry Tan 表示自己也遇到过 Agent 使用问题,认为 AI Agent 的下一阶段将聚焦于开箱即用的便捷入门体验和内置安全保障。
MIT CSAIL 分享了一个互动展品,以可视化方式直观展示计算机处理器执行数学运算的底层原理。
Paul Graham 指出后期投资人抱怨估值上涨虽是常态,但如今公司增长速度确实比以前更快,估值上升有现实基础。
据 a16z 数据图表,AI 公司在 2026 年第一季度的融资总额已超过 2025 年全年,资本正加速涌入 AI 赛道。
Y Combinator CEO Garry Tan 呼吁 AI 领域需要开放市场和开放准入,对当前行业某些限制性做法表达不满。
Google 搜索 AI Mode 推出 Agent 式订餐功能,用户只需描述人数、时间和菜系偏好,AI 即可跨平台搜索实时可用餐厅并一键预订,从美国首次扩展至 8 个新地区。
YC 创始人 Paul Graham 分享经验,称运营 Hacker News 虽是巨大负担,但让他每天面对和创始人一样的问题,这正是理解创始人的基础。
Karpathy 认为通过详细视频采访数据加 LLM 微调,可实现一种有损的近似脑上传,比科幻中的全脑扫描模拟更早到来,甚至可以想象一家脑上传创业公司。
Anthropic 推出 Claude for Word 插件,可在 Word 侧边栏直接起草、编辑和修改文档,编辑以修订模式呈现并保留原有格式。Team 和 Enterprise 计划可用。
Musk 宣传 Neuralink 脑机接口技术进展,称其能帮助失去语言能力的患者恢复说话功能。
Musk 发推调侃人类智力与 AI 的差距,暗示当前 AI 能力已远超人类水平。该推文获超 12 万点赞、4200 万浏览。
Runway 的不存在产品广告大赛收到数千份参赛作品,最终评选出 25 部获奖广告,展示 AI 视频生成在创意广告领域的应用潜力。
DMax 针对扩散型大语言模型(dLLMs)提出激进并行解码策略,通过同时生成多个 token 显著提升推理速度。