来自 Twitter · Hacker News · GitHub 的 AI 行业动态
ElevenLabs 发布 ElevenAgents 中的 Experiments 功能,支持运行 A/B 测试来优化 Agent 配置,涵盖提示词结构、工作流逻辑、语音和个性等维度。
Google DeepMind 展示使用 Gemini 3.1 Pro 构建的城市规划应用,模型能处理复杂地形、规划基础设施并模拟交通,生成高质量可视化效果。
Cursor 在过去三个月陆续上线了全平台 Agent 沙箱功能,允许 Agent 在安全环境中自由运行,仅在需要越界时请求用户批准。
Perplexity 的新应用 Comet 已在 Apple App Store 上线 iOS 预购,用户可提前注册体验。
Google 公布 Gemini 3.1 Pro 在 ARC-AGI-2 基准测试中获得 77.1% 的成绩,是 3 Pro 的两倍以上,在复杂推理任务上实现重大突破。
Gemini 3.1 Pro 在测试新颖逻辑模式的 ARC-AGI-2 基准上得分较 3 Pro 翻倍以上,展现更强的推理与创造力。
Elon Musk 透露 xAI 的代码主要用 Rust 编写,X 平台也在快速将 Twitter 时期遗留的 Scala 代码替换为 Rust。
Anthropic 宣布 Claude 的 PowerPoint 集成现已向 Pro 订阅用户开放,同时新增连接器功能,可将日常工具的上下文直接引入幻灯片。
Google 发布 Gemini 3.1 Pro,将 Gemini 3 Deep Think 的核心推理能力扩展到日常复杂任务中,定位为更智能的实用型模型。
Google DeepMind 正式发布 Gemini 3.1 Pro 模型,在整体智能水平上有显著提升,能够解决更复杂的问题。
Google 通过 Grow with Google 推出全新 AI 专业认证课程,包含 20 多个实践实验,涵盖项目规划、Vibe Code 自定义 AI 应用、营销素材生成和数据驱动市场调研等。
宝玉推荐网易有道开源的 LobsterAI 个人助理,基于 Electron + React + TypeScript,支持本地执行和沙箱 VM 两种模式,数据全本地 SQLite 存储,可对接钉钉、飞书等平台。
Musk 透露 Grok 的多个智能体实际上完全相同,名称和专长在推理开始时随机分配,但可能因读取 X 上关于自身的讨论而产生个性趋同。
vLLM 将于 3 月 10 日在波兰华沙举办技术聚会,主题涵盖推理优化、IDE 集成、全模态和 Kubernetes 规模化部署。
v0 产品负责人将于周三中午(PT)举办直播,演示如何使用 v0 构建 AI Agent、连接代码仓库并部署到现有代码库中。
LMSys 发布 SGLang Cookbook 教程,涵盖从基础配置到推理解析和工具调用的完整流程,以 Qwen3-30B-A3B 为演示模型,支持一键部署到任意硬件。
最新研究提出 SkillsBench 基准测试,用于系统评估 AI Agent 技能在多样化任务上的表现,填补了 Agent 能力评估领域的空白。
Recraft V4 在 Replicate 上线,支持最长 10000 字符的提示词实现极致创意精度,V4 SVG 版本可生成完全可编辑的矢量图形,可直接导入 Illustrator 或 Figma。
宝玉指出 Claude Agent SDK 已不能使用 Claude Code 的 OAuth 登录,对 Anthropic 此举表示遗憾。
Replit 宣布与 Databricks 深度集成,企业团队可通过 Vibe Code 方式在 Databricks 平台上快速构建和部署应用,同时保留治理、安全和可观测性。
Supabase 发布了结合 MCP-use 构建 ChatGPT 应用的完整教程,帮助开发者快速搭建基于大模型的数据驱动应用。
Meta AI 宣布首席 AI 官 Alexandr Wang 将在印度 AI 影响力峰会发表演讲,时间为 2 月 19 日,可通过直播观看。
Runway 展示其预可视化能力,可将故事板和草图在几分钟内转化为高保真预览画面,大幅缩短传统影视制作中需要数月的前期预览流程。
Replicate 发布新技能标准,可教 AI Agent 查找、对比和运行 AI 模型。遵循 Agents Skills 标准,兼容 Claude Code、OpenCode、Codex、Pi 等主流平台,一行命令即可安装。
最新研究论文 AnchorWeave 提出通过检索局部空间记忆来实现视频生成中的世界一致性,解决生成视频在场景切换时的空间连贯性问题。
宝玉认为借助 AI Agent 操作 Git 的成本几乎为零,完全不需要记忆繁琐命令。但提醒注意 GitHub Repo 权限,避免误将私有项目设为公开。
Google 在 Gemini 应用中上线 AI 音乐生成功能,基于 DeepMind 最新 Lyria 3 模型。用户可通过文字描述、照片或视频生成 30 秒完整音轨(含人声和歌词),面向全球 18 岁以上用户开放 Beta。
Latent Space 主理人 swyx 分享了他珍藏的经典梗图,每当有新一轮"加拿大女友式"表演型程序员出现在时间线上时就会拿出来。推文获超 1300 赞,引发广泛共鸣。
Google DeepMind 宣布与印度政府机构和科研院所合作,通过培训、辅导学生和建设创新中心,推动 AI 在科学发现和教育领域的实际应用。
ST Engineering MRAS 利用 Boston Dynamics 的 Spot 机器人自主采集设备健康数据,结合 Leica BLK ARC 生成精确点云用于数字孪生。