来自 Twitter · Hacker News · GitHub 的 AI 行业动态
OrbitQuant 通过归一化旋转基实现 Diffusion Transformer 的高效训练后量化,无需跨时间步和模态重新校准。
7月6日,佑驾创新(2431.HK)正式发布「Combo」全链路无人物流闭环方案,由其旗下曜行动力打造的四轮足式机器人同步亮相。依托自动驾驶底层技术与物理AI能力,佑驾创新首次以“无人车+机器人”打通物流转运到上门配送的完整链路,直击行业长期存在的“最后一米”难题。 本次方案发布,既是曜行动力首款具身智能产品的首秀,也是佑驾创新向全场景物理AI科技企业战略升级的关键一步,助力公司在万亿级赛道抢占发
【韩国仁川,2026年7月5日】 今日,2026年RoboCup(机器人世界杯)在韩国仁川正式落下帷幕。在备受瞩目的人形机器人项目中,中国战队清华火神队搭载加速进化 Booster T1,成功卫冕 Large 组世界冠军。继去年在巴西打破中国战队 28 年冠军荒后,火神队在面对全球顶尖强队的针对性挑战下再次登顶,证明了其在具身智能算法领域的领先水平。与此同时,本届赛场传递出一个更具产业风向标意义的
Open Science — 面向科学家的开源 AI 工作台,Claude Science 的开源替代方案。本地优先、模型无关、可复现,基于 Tauri + MCP + agent skills 构建。
专为科学研究设计的开源AI工作平台
vLLM 团队分享如何高效部署阿里 Qwen3-Omni:它由多模态 Thinker、Talker 到 Code2Wav 多阶段组成,每层瓶颈不同,需逐层优化才能在实时场景榨出性能。
谷歌,去年凭借大模型能力反超逆袭,出尽了风头,甚至一度被投资人喊出“市值能到10万亿”。但奇怪的是,谷歌在AI编程这一关键领域一直籍籍无名。 强大如谷歌,为何在AI coding(AI 编程)上瘸了腿? 更令人惊讶的是,不止谷歌。纵观中美互联网巨头,在AI编程上都表现平平。Cursor、Claude Code、Codex、智谱、MiniMax……这些程序员圈子里耳熟能详的产品中,来自互联网大厂的寥
7月3日,在2026全球数字经济大会人工智能融合应用发展论坛,生数科技创始人朱军发表题为《通用世界模型,推动数字世界与物理世界统一的新范式》的主题演讲,并正式发布面向实时交互场景的新一代模型——Vidu S1 实时交互模型。大会期间,北京软件和信息服务业协会(BSIA)正式发布《2025年北京市数字经济标杆企业评价报告》,生数科技凭借在技术创新与产业应用方面的突出表现,成功入选“新模式新应用标杆企
2026年被业界广泛称为人形机器人“商业化落地元年”,而我们认为,真正跑通的应用场景才是打破“伪落地”质疑的唯一标尺。 浙江人形凭借全栈自主可控的产品体系,已让领航者NAVIAI人形机器人在工业、服务、教育、数采等多领域真正“上手干活”,率先实现了从实验室技术验证到多领域规模化商用的关键跨越。 应用领域 01——工业制造中的“精工巧匠” 浙江人形深耕真实场景,以多源、高质数据体系筑基,自研可泛化、
告别盲目刷榜,28页 PPT 带你摸透 ICML 新风向。 作者丨陈淑瑜 编辑丨岑峰 ICML 2026 的投稿量从去年的 12107 篇直接飙升至 23,918 篇,几近翻倍。 然而,最终的接收率却牢牢钉在 26.56%,与去年几乎持平。 这一数据传递出一个明确的信号:并非竞争变得盲目激烈,而是学术评审标准经历了一次深刻的“重新校准”。 为了拆解这一趋势,我们制作了一份 28 页的深度分析 PP
过去六年,国产GPU公司一路站上AI风口,估值不断刷新,DPU却被忽略了。 这并不符合产业现实。 2020年英伟达完成收购Mellanox后,就已经明确了“GPU+CPU+DPU”的三芯战略。过去几年,英伟达也持续强化网络能力,黄仁勋在2026年CES展示“六芯组合”时,其中四款都与网络相关。 一个越来越清晰的趋势开始浮出水面:AI基础设施的瓶颈,正在从算力本身转向网络与调度。 尤其Agent时代
自主智能体在固定预算内通过迭代编辑评估策略改进,研究表明成功的策略演化需要任务特定机制与反馈约束的协同优化。
该研究提出一种有限契约方法用于长周期 LLM Agent,通过类型化检索组装新鲜提示词,可隔离分析记忆组件,在复杂决策任务中展现更优性能。
MrFlow结合低分辨率生成与像素空间超分辨率及噪声注入,加速文生图扩散模型,实现最高25倍加速,且无需训练或运行时修改。
FlashMorph将混合层选择形式化为预算约束优化问题,通过可变形模型和线性化正则化提升Transformer的长上下文效率。
视觉-语言模型在专业时空视频定位任务中面临领域适应挑战,暴露出零样本泛化和上下文学习能力的局限性。
AI 代码黑盒工具,通过被动决策图追踪每次提交与 Agent 提示词的关联,支持漂移检测、DLP 审计、证据驱动风险评估和签名溯源,一行命令离线运行。
vLLM 社区通过 day-zero 适配 + 对 kernel/调度/serving 的持续优化,一个月内将 DeepSeek V4 推理的 token 成本降低 5 倍,展示开源社区的迭代速度。
xAI 宣布 Grok Build 现已内置于 Railway 的沙箱环境,开发者可在 Railway 平台直接调用 Grok 做 AI 辅助构建。
连接 Talos 账户的 GPU 工作节点客户端,通过 WebSocket 提供开源模型推理服务,并上报在线运行时间以获取收益分成。
NVIDIA(NVDA)向 SEC 提交 8-K 文件:8-K。Accession 0001045810-26-000060。
一张中文测评图把Claude Sonnet 5送上风口浪尖。 作者丨高允毅 编辑丨马晓宁 Claude Sonnet 5才发布了一天,网上已经吵翻天——几乎全是差评。 Anthropic把它定位为“迄今最具 Agent 能力的 Sonnet”,甚至直接说它在大量智能体任务上已经接近旗舰 Opus 4.8,价格只有Opus 的四折。 听起来,这就是来给开发者送温暖的:更强的Agent、更便宜的API
自变量机器人发布跨模态具身动作分词器 X-Tokenizer,将 VLA 中的动作离散化从单一的“压缩-重建”问题,重新定义为“多模态推理与动作之间的语义接口学习”问题。 动作分词器决定了拆分出的动作 Token 是否具有语义,是否能加速预训练模型的收敛,从而最终影响了 VLA 模型输出连续动作的性能。这是自变量机器人的最新发现。 具身智能的 VLA 模型(视觉-语言-动作模型)是将预训练的 VL
雷峰网获悉,6月30日,影智XBOT“2026 XBOT通用餐饮具身机器人发布会”在北京举行,以产品、平台、商业闭环、生态开放为关键节点,正式发布自研具身操作系统XOS 3.0、AI Agent产品“爱宝店长”,以及三款覆盖咖啡、冰淇淋、全场景服务的通用餐饮具身机器人新品。 三者共同构成“一脑多形”的完整智能体系。 XOS 3.0:为“一脑多形”而生的具身操作系统 作为爱宝店长背后的技术底座,XO
由于依赖粗粒度的端口类别特征和类别分布不平衡,用于 IIoT 入侵检测的轻量级机器学习模型在不同网络间泛化能力有限,且对抗鲁棒性与跨网络性能无相关性。
6月,在德国汉堡ISC高性能计算大会的展台上,GPU、液冷、量子计算的声浪依旧汹涌,但今年,会场的主角悄悄换了人。 IO500榜单——全球高性能计算存储领域最权威的评测体系——公布了最新一期结果:中科曙光ParaStor F9000分布式全闪存储系统,同时拿下生产型全节点和10节点两大榜单的第一名。 在这一榜单近十年的历史中,能够同时统领这两个维度的,此前只有少数几家美国厂商,中科曙光成为首家达成
连 AI 的 “外壳” 都学会自我迭代了 作者丨高允毅 编辑丨马晓宁 连Harness都能自我迭代了! 在AI圈,有一个基本共识,即Agent = Model + Harness。 决定智能体表现的,从来不只是底层模型这颗 “脑子”,还有包裹在外的整套 “外壳”——Harness,它包含提示词模板、工具调用规则、记忆管理、控制流、安全护栏等。 过去半年,Claude Code、Manus 这类全自
PerceptionRubrics提出基于评分标准的评估框架,通过原子审计和门控评分机制识别基准性能与实际表现的差距。