来自 Twitter · Hacker News · GitHub 的 AI 行业动态
要闻提示 1.投毒!曝 Meta 雇外包伪装未成年人,大规模给ChatGPT和Gemini下套 2.腾讯大幅减持快手股票,不再是主要股东 3.前华为“天才少年”公开吐槽DeepSeek面试:流程拖沓、被面试官指控抄袭 4.到底谁伺候谁?99万机器人“伴侣”续航撑不过一晚引热议,优必选:属行业普遍情况 5.小米手机部人事调整:原深圳区域总经理葛维严调任手机相机部总经理 6.重磅回归!曝华为 Pura
7月3-5日,2026年数智医学大会(CHINC)在北京召开,本届大会以“智融医学,质筑健康——新质生产力助力健康中国建设”为主题,聚焦AI临床落地、医疗数据治理等核心议题。讯飞医疗总裁陶晓东受邀出席大会主论坛并发表主旨演讲,现场正式发布全新一代AI诊疗助理2.0。此外,讯飞医疗深度参与多场专题分论坛,覆盖医学影像、基层诊疗、患者全周期管理、临床落地应用等核心赛道,多维度展现核心技术积累与规模化落
7月7日,支付宝正式上线 AI 开放平台,面向商家、机构、服务商、智能终端、大模型平台等生态伙伴开放AI接入能力。 记者获悉,作为首批加入支付宝AI生态的出行品牌,高德打车接入支付宝AI开放平台。现在,用户可以在AI版支付宝“阿宝”,一句话指示出行起始点唤起高德地图打车,享受智能、快捷的出行体验。 据了解,通过支付宝AI开放平台,商家除了将服务接入“阿宝”,同时,也可选择跨端互联,通过“阿宝”接入
从 LLM Wiki 到第二大脑,AI 已经实现持续记忆与自进化。 作者丨樊天骄 编辑丨郑佳美 2026 年 4 月,AI 领域最具影响力的学者之一 Andrej Karpathy 提出了一种名为 LLM Wiki 的个人知识编译系统,用来重构他自己的研究知识管理方式。该帖子一经发布便迅速在技术社区引发传播,累计浏览量超过 2000 万级别,直接成为当月最具讨论度的 AI 事件之一。雷峰网 为什么
7月7日,机器学习领域最具影响力的顶级学术会议ICML 2026进入正会第一天。本次大会共接收6352篇论文,其中Spotlight论文536篇(占投稿总数的 2.2%),Oral 论文168篇 (仅占投稿总数的 0.7 %)。今年的论文再次汇聚了从生成模型到隐私保护、从智能体评估到模型压缩、从脉冲神经网络到视觉分词器的多元前沿探索,在投稿量较去年翻倍、评审标准经历深刻“重新校准”的背景下,这些脱
7月7日,蚂蚁集团旗下具身智能公司灵波科技发布空间感知模型 LingBot-Depth 2.0。该模型基于 1.5 亿规模数据进行训练,在边缘清晰度、细小物体识别、远距离深度估计以及复杂场景鲁棒性等方面实现全面升级。 LingBot-Depth是灵波自研的空间感知模型,相当于机器人在物理世界的眼睛,1.0版解决了机器人看清透明、反光等复杂场景的空间感知难题。相比于LingBot-Depth 1.0
网友提出四套可以绕开 Fable 5 三层安全栏的方法,全面! 作者丨樊天骄 编辑丨郑佳美 马晓宁 Claude Fable 5 被曝出内部日志暗藏嘲讽字段,直言用户 “太蠢,用不着 Fable 5”。 事情的经过是,开发者 dax 昨日提交提示词后,发现请求被无故拦截降级。他调取 Fable 5 的调用日志排查原因,结果在降级原因字段里,看到了一行 Anthropic 本没想让用户看见的直白标注
7月7日,ICML 2026在首尔COEX会展中心迎来正会首日。作为机器学习领域的风向标,本届大会最终在数万篇高热度投稿中,严选出6352篇录用论文,其中Spotlight论文536篇(占投稿总数的 2.2%),Oral 论文168篇 (仅占投稿总数的 0.7 %)。在今年全球AI研究井喷、评审机制迎来大刀阔斧“重新校准”的严苛背景下,这些穿越重重审稿关卡脱颖而出的成果,无疑凝聚了过去一年机器学习
过去两年,具身智能常被放进两个熟悉的叙事里理解:它要么是“大模型的下一站”,要么是“自动驾驶向工厂的迁移”。前者强调模型、数据和规模效应,后者强调感知、预测、规划与端到端闭环。两种说法都言之成理,然而在阿米奥机器人创始人刘方看来,它们仍未能回答那个更根本的问题——我们究竟需要具身智能解决什么问题。 刘方坚信:具身不是大模型,不是自动驾驶,是新业态。自动驾驶数字化的是驾驶能力;大模型数字化的是知识;
GPT-5.6 迎战 Fable 5,长任务成胜负手。 作者丨樊天骄 编辑丨郑佳美 这几天,关于 GPT-5.6 的消息层出不穷。从 Polymarket 上的交易数据来看,GPT-5.6 极有可能在 2026 年 7 月 7 日正式发布,概率甚至高达 68%。 X 上也有开发者从代码层面挖出实锤:OpenAI 的 Codex 应用底层代码里,已经提前写入了 GPT-5.6 对应的 Sol、Ter
记忆张量MemTensor WAIC 2026 专题论坛嘉宾阵容正式公布。 7 月 17 日,记忆张量MemTensor 将在 WAIC 2026 现场,上海世博展览馆 9 号会议室举办《从一次性 Agent 到记忆原生智能时代》专题论坛。本次论坛将围绕 Agent、AI 终端与通用基座模型如何走向长期智能展开,邀请到了来自通用基座模型、终端系统、算力基础设施、设备端智能、学术研究与系统层记忆研发
ICML迎来“中国浓度”最高的一年 作者丨吴思梦 编辑丨岑 峰 ICML 2026 将于7月6日至11日在韩国首尔 COEX 召开,本届投稿量达23918篇,录用6352篇,录用率26.6%。AI研究热情并没有因为scaling law的质疑而消退,反而因为多模态、视频生成、Agent等新风口的出现而更加狂热 中国企业也全面出击:快手11篇论文入选(含1篇Spotlight),阿里千问C端团队4篇
对象感知Token合并框架SaMer在压缩图像侧Token的同时保留可查询选择的视觉证据,实现存储空间显著减少并提升检索性能。
“靴子落地了。” 昨晚,有媒体报道孙天祥加入百度,担任基础模型研发部(BMU)负责人后,一名百度内部人士对雷峰网如此表示。 事实上,这一人事变动并不意外,去年下半年起,百度就在持续调整组织架构。 去年 11 月,百度发布设立技术研发组织相关公告,新设基础模型研发部(BMU),负责研发高智能、可扩展的通用人工智能大模型;新设应用模型研发部(AMU),负责业务应用场景需要的专精模型调优和探索。上述部门
OmniOpt 提出统一框架,通过元管道变换、范数约束线性最小化预言机及跨领域基准测试,系统分析不同训练目标和模型规模下优化器族的性能权衡。
上世纪60年代,为了缓冲宇航员升空与返航时的巨大重力冲击,NASA研发出具备慢回弹特性的记忆棉材料。这项诞生于航天工程的尖端技术,最初只为保障极端环境下的人体安全,没人会预料到,半个世纪后它会走进全球亿万家庭的卧室,彻底重构了床垫与枕具的舒适标准。 类似的叙事在今天的消费科技史中层出不穷:手机厂商将航天火箭同源的超临界气凝胶材料用于手机散热,游戏本行业首创了源自航空发动机原理的散热引擎;成熟于新能
EVA-Client是开源框架,通过组件解耦架构和可检查的执行工作流,统一真实机器人策略的部署、数据收集与评估。
Uni-GUI 数据集与 UI-MOPD 方法通过多教师同策略蒸馏,解决数据有限性和平台特定能力退化问题,实现跨平台 GUI 智能体训练。
ResearchStudio-Reel 通过围绕共享论文提取器组合专业技能来自动化研究传播,生成一致且可编辑的海报、视频和博客等成果,并设有严格的通过/失败质量门槛。
Wan-Streamer v0.2 通过优化 thinker-performer 架构并采用 multi-GPU 并行处理,在提升视觉分辨率的同时保持低延迟,增强了音视频交互。
为 AI 编程代理提供的一次性、网络受限的 Linux 虚拟机。
Fable工作流将Claude Fable 5的核心机制提炼为任何模型都能运行的技能,配合评估机制保证效果。思考/行动/验证。
6月29-30日,中力股份第八届629新产品、新技术、新模式创新发布大会,以“从物料搬运到数智移动”为主题在浙江安吉盛大举行。四海宾朋齐聚,行业精英荟萃,共同见证中力以全场景数智移动解决方案,共绘智能物流的全新版图,开启工业搬运的数智新纪元! 璀璨启幕:“质变下的改变” 驱动行业新变革 作为物料搬运行业一年一度的创新盛事,中力 629 已走过八载深耕之路,每一届都成为行业迭代的关键注脚:首届 62
一款零依赖的浏览器端视频编辑器,支持AI代理操控,提供JSON时间轴、MCP+REST接口及实时重载UI界面。
7月5日,阿里巴巴与清华大学合作的论文 The Flexibility Trap: Rethinking the Value of Arbitrary Order in Diffusion Language Models(灵活性陷阱:重新审视扩散语言模型中任意顺序生成的价值)入选AI顶会ICML杰出论文(Outstanding Paper),杰出论文是ICML最高荣誉,代表当年最具影响力的研究工作
2026年7月6日,随着一台叉取机器人走下产线,海康机器人正式宣布,其移动机器人全品类累计下线突破20万台。 从 2024年5月第10万台下线至今,海康机器人仅用两年时间便完成第二个十万台的跨越。根据《移动机器人产业联盟》最新统计,其2025年移动机器人市占率位居全球第一。在制造业智能化转型的背景下,中国移动机器人产业正从示范应用加速迈向规模化普及的新阶段,而海康机器人20万台下线的速度变化,则代
近日,大晓机器人正式开源新一代统一具身基模型 ACE-Brain-0.5,面向 Physical Agentic AI 这一新范式,推动具身智能走向真实物理世界中的自主执行。Physical Agentic AI 指能在真实物理世界中围绕目标自主感知环境、理解任务、规划、行动,并在交互反馈中持续调整和进化的智能体。作为 ACE-Brain-0 的重大升级,ACE-Brain-0.5 以空间智能为底
6月29-30日,中力股份第八届629新产品、新技术、新模式创新发布大会,以“从物料搬运到数智移动”为主题在浙江安吉盛大举行。四海宾朋齐聚,行业精英荟萃,共同见证中力以全场景数智移动解决方案,共绘智能物流的全新版图,开启工业搬运的数智新纪元! 璀璨启幕:“质变下的改变” 驱动行业新变革 作为物料搬运行业一年一度的创新盛事,中力 629 已走过八载深耕之路,每一届都成为行业迭代的关键注脚:首届 62
DataComp for VLMs(DCVLM)建立了综合基准,用于评估视觉语言模型中的数据整理策略,表明数据混合而非过滤可显著提升大规模模型性能。
用户刷视频时,对画质的判断往往发生在几秒之内。同样是短视频、直播、AIGC视频,有的画面清晰、稳定、有质感,人物的眉眼、物品的纹理、运动中的细节都足够自然;有的则模糊、压缩痕迹重,动作一快就闪烁、发虚,让人只想很快划走。 过去,平台解决这些问题的方式相对明确:在生产端做基础美化和编辑;在服务端用超分、去噪、锐化、去压缩等算法,把模糊、发虚的部分逐段修回来;在客户端则通过播放控制和端侧后处理增强,把