来自 Twitter · Hacker News · GitHub 的 AI 行业动态
Google 于今年早些时候在 Gmail 中推出 AI Inbox 功能,利用 AI 技术帮助用户更好地管理收件箱、追踪重要信息,提升邮件整理效率。
Garry Tan抱怨Google应用在iOS上体验极差,无法从照片库正常上传图片。作为YC掌舵人,他对主流科技产品的体验表达了不满。
马斯克在回复中声称自己是 OpenAI 的共同创始人,并强调自己理解相关复杂性。该言论针对 @teortaxesTex 的质疑做出回应。
埃隆·马斯克发推强调 Starlink 存在两个不同的系统版本,但推文内容被截断,具体区分尚不明确。
Google推出Daily Brief智能体,定位为“每日第一站”,可自动汇总用户个性化早间要闻。
NVIDIA 公布为 agentic AI 设计的 Vera CPU 第三方 Phoronix 实测:综合性能比头部 x86 处理器高 1.5×,Linux 内核编译快 2×,STREAM TRIAD 内存带宽 4× —— 主打 AI 工厂复杂 agent 负载所需性能。
vLLM 宣布 Rust 前端已合并入主干,作为 Python API server 的 drop-in 替代(设置 VLLM_USE_RUST_FRONTEND=1 启用)。在 preprocess-heavy 工作负载下单进程实测 ~837 req/s vs Python ~162 req/s,提升约 5 倍。
a16z 指出合规官已成为美国增速最快岗位之一,每笔企业资金流动均需合规审核;随着 AI 跨越「足够可信」门槛、销售周期缩短,合规 startup 正迎来真正的机会。
Gemini for Science 是 Google DeepMind 推出的科研AI工具集,旨在协助科学家加速研究突破,帮助科研人员寻找下一个重大发现。
Google DeepMind 宣布 SynthID 水印技术合作扩展,新增 OpenAI、ElevenLabs、Kakao 三家伙伴,继 NVIDIA 后进一步扩大水印行业联盟。该技术已标记超过 1000 亿份内容。
Anthropic 工程博客探讨 AI Agent 授权与权限的演进原则,强调需随能力提升同步调整权限范围,并披露其通过沙箱机制控制 Agent 潜在破坏性动作的设计思路。
Garry Tan 称看似复杂的自动化流程,agents 在 OpenClaw / Hermes Agent 里通过 GBrain 的 skillify 即可零成本实现,建议开发者试一试。
Figure 宣布与拥有 JCPenney、Aéropostale、Brooks Brothers 等品牌的 Catalyst Brands 签订商业部署协议,首批人形机器人将先在内华达州 Reno 上岗。
xAI 优化 Grok Build Beta 的缓存机制,并重置所有账号用量上限,以解决用户反馈的用量触顶过快问题,同时继续征集使用反馈。
Claude 团队展示 6 个均源于「Why not?」之问的内部实验项目,强调通过小实验持续孵化、推动产品迭代的思路。
Campfire 是面向高增长科技公司的 AI 原生 ERP,自 2024Q4 起 ARR 每季度翻倍;继 2025 年 6 月以 12 人完成 3500 万美元 A 轮后,本轮由 Accel、Ribbit Capital 领投,团队已扩至 100+ 人。
宝玉调侃 Moonshot 仍发布了 TypeScript 版 kimi-code,让人想起此前 kimicli 用 Python 是彻底的失败 的网络段子。
YC CEO Garry Tan 援引社区结论指出,阿里通义千问 Qwen2.5-7B Instruct 模型实际能力已接近 GPT-3.5-turbo。
Supabase 建议开发者在多数场景下用 getClaims() 替代 getUser(),可显著降低数据库压力、提升响应速度。
宝玉指出 Agent Harness 很难跑赢模型公司,模型升级常让工作白干;但基于成熟 Harness 构建 AI Native 工作流、重设 HITL 交互、整理垂直领域数据等仍是模型公司无法覆盖的机会。
Paul Graham 表示,由 AI 代写却以人类名义发出的邮件让人感到被欺骗,他从未有耐心读完此类邮件。
Anthropic 联合创始人 Chris Olah 受邀在教皇利奥十四世通谕《Magnifica humanitas》发布会上发言,相关演讲全文已公开。
xAI 推出 Grok Build Beta,集成 Plan 模式、Imagine 图像与视频生成、CLI 自动化等功能,面向 SuperGrok 和 X Premium+ 用户开放。
马斯克透露 xAI 的 Grok Build 还将处于 Beta 阶段约一个月,但目前已能在实际生产任务中发挥作用。
通义千问宣布 Qwen3.7-Max 已默认启用 Implicit Caching,无需任何配置自动生效,开箱即用就能更快更便宜;若需更高、更确定的命中率,可改用 Explicit Caching。
YC CEO Garry Tan 分享他连续构建 4 个 Agent(个人 AI + 公司大脑)的标准化流程:手工执行 → 封装成 Skill → 加入 cron 定时 → 验证可解性 → Evals 与集成测试 → 循环迭代。
Paul Graham 吐槽现在收到的创始人邮件大多写成「硬核新闻体」风格,明显是 AI 生成——以前从没创始人这样写过,一旦意识到是 AI 写的就会本能想忽略它。
宇树科技发布 WVLA 2.0 模型的会议室清理测试视频,单次拍摄完成多任务全自主操作,并能在强外部干扰下保持稳定。
马斯克回复表示,xAI 计划在今年年底前开源当前在线服务的 0.5T 参数 Grok 模型,称其仍会相当有用。
xAI 完成 Grok V9-Medium(1.5T 参数)基础模型训练,评测表现良好,补充训练加入大量 Cursor 数据;微调进行中,几天后开始强化学习,预计 2-3 周后发布,相较当前在线服务的 0.5T V8-small 在困难编码任务上将有重大提升。