来自 Twitter · Hacker News · GitHub 的 AI 行业动态
两家公司在AI前沿展开合作,SpaceX的资源将帮助Cursor提升模型与功能,实现更高效的开发体验
Musk预测AI的编程能力将匹敌Stockfish,并在通用计算机操作上实现质的飞跃
Musk指出,利用太阳能量的极小部分即可让AI拥有远超全人类智能的综合能力,暗示能源是AI发展的关键瓶颈
指 1.5 个月前在 AI 社区掀起的 Goblins Gate 争议或事件,现已淡出视野。
通过关注jason,用户可以获得更多Codex团队的深度技术解析和内部运作细节。
基座模型、数据飞轮与末端执行缺一不可。 作者丨高景辉 编辑丨马晓宁 2026 年 6 月的维也纳,ICRA展厅里挤满了来自全球的机器人公司,三年前还在 PPT 上展示概念的具身智能,如今已经变成了满地跑的人形机器人。 但热闹之下,焦虑正在蔓延。当下的机器人虽然能跑能跳,但依然难以进入真实场景创造价值,形成技术和商业的闭环,其所需要的模型、硬件和数据能力,似乎也只有为数不多的企业具备。以至于业内的感
6月13日,第十二届中国(上海)国际技术进出口交易会(CSITF)在上海圆满闭幕。此次盛会,作为全球具身智能领域的领军企业,魔法原子(MagicLab)携全栈技术矩阵重磅亮相。 展会现场,魔法原子不仅带来了全家族明星产品的沉浸式动态展示,更首次在国内公开发布两大核心技术成果:自研Magic-VLA K02大模型与Magic-Mix世界模型。此次双模型线下首秀,既是魔法原子 "智能大脑" 核心能力的
调用检测器函数诊断代理故障,解读结构化输出(带置信度的分类故障、因果链及修复建议),并集成到评估管道实现自动化诊断。
构建端到端演示研究代理模式,为需要隔离执行环境的多步骤AI工作流开发人员设计,可部署至Bedrock AgentCore Runtime作为托管会话隔离服务。
Google DeepMind开发的Gemma 4系列开放权重模型现已在Amazon Bedrock上线,包含31B、26B-A4B和E2B三个指令调优变体,涵盖密集和MoE架构,提供内置推理和原生函数调用能力。
过去两年,具身智能行业最热的关键词是人形机器人。但未来几年,更重要的关键词或许会变成另一件事:智能生产力。
还能听懂时间戳
大语言模型在面对误导性信息时医学推理准确率下降,表明现有评估方法未能有效检验模型在对抗性条件下的认知韧性。
激活 steering 效果可从早期解码状态预测,使用 GBDT 分类器实现 steering 强度的高效优化,降低计算成本。
可视化代码仓库表示通过提升结构理解并降低问题解决中的 token 消耗,增强基于 LLM 的编码 Agent 能力。
一种多智能体系统监控框架,通过实时检查识别资源约束下的错位行为,在多种条件下有效检测错位类型。
AI审稿系统存在展示层面的漏洞,容易被突出亮点而非解决弱点的策略所欺骗,为对抗性重新包装攻击提供了新的攻击面。
LoSoNA 评估大语言模型在群聊中通过定向提示场景推断和适应隐含本地对话规范的能力。
RepFusion 将多模态大语言模型作为扩散 Transformer 的噪声表示编码器,用于文生图任务,表现优于传统训练新去噪器的方法。
6月15日,健康AI应用"蚂蚁阿福"宣布“拍皮肤”功能升级:可识别皮肤病种类从50种增至100多种,覆盖99%的线上就医常见皮肤问题。同时,阿福还上线了“医生把关”这一新服务:用户获得阿福的解答后,可选择邀请三甲医院的医生对阿福的分析结果进行复核并补充意见。这也是国内首个落地"AI问答+医生把关"协作模式的AI应用,为AI与医生的合作提供了可行路径,打开了“AI+医生”赛道的想象空间。 阿福的测试
一场赛事真正的流量争夺,往往不只发生在直播间,也发生在赛后几分钟的短视频分发链路里。谁能更快把进球、争议判罚、庆祝名场面切出来,谁就更有机会吃到热搜红利。 三分钟高光全网飞,人工剪辑为什么跑不赢热搜? 进球哨音响起的那一刻,观众的第一反应不是回味,而是打开社交平台——有没有人已经把这一刻切出来了?等五分钟还没看到,热情就凉了。仍靠传统回放的团队,往往已经错失第一波流量。 这要求直播和短视频必须同时
自动音视频问答系统通过实体锚定视频脚本和线索引导问答生成,提升跨模态推理和时间一致性。
Pythagoras-Prover 通过课程训练和增强形式化技术,引入计算高效的 Lean 定理证明器,以克服验证数据稀缺和证明搜索代价高昂的局限性。
预训练语言模型可通过灵活的层程序化执行策略动态执行层,相比标准固定深度推理提升准确率并降低计算开销。
司南:个性化 AI 任务总控 Skills 系统 /COMPASS: Personal Alignment Skills OS for AI Agents
雷峰网获悉,6 月 15 日海洋具身智能公司世航智能宣布完成超 10 亿元 A 轮融资,为目前全球海洋机器人领域规模最大的单轮融资。 雷峰网了解到,该轮新投资方包括上河动量基金、新加坡淡马锡旗下 Vertex Growth、中信集团农业产业基金、誉尊资本、上市公司大洋电机;老股东金沙江创投、祥峰中国、华映资本、长石资本等全部大比例超额追投。本轮融资将主要用于核心技术研发、全球化市场拓展及产业链生态
SelectiveRM:从点对点拟合噪声偏好,转向带选择机制的分布对齐,重构奖励模型的训练目标。 作者丨潘黎铖 在大语言模型对齐研究中,一个看似自然、却值得重新审视的问题长期存在: 一方面,RLHF、RLAIF、GRPO等方法不断推动模型对齐能力演进;另一方面,奖励模型训练阶段却普遍默认一个前提——收集到的偏好标注能够准确反映真实人类偏好。 但现实并非如此。无论是人工标注、众包反馈,还是LLM-a
机器人不仅要看得见,还要看得远、看得稳、看得全。 作者丨高景辉 编辑丨马晓宁 当全球具身智能公司都在ICRA 2026的展台上比拼 DEMO 时,一个棘手的问题却被众人所忽视:机器人至今没有一双真正好用的眼睛。 这是整个行业心照不宣的卡点。所有人都在说大模型、VLA带来了通用智能的曙光,但落地时却卡在了最原始的环节——机器人看不准三维世界,做不了精细操作,速度永远赶不上人类。为了弥补传感器的缺陷,
要闻提示 1.网件反诉TP-Link:宣称 “美国公司” 是虚假宣传,本质仍是中国企业 2.百度搜索疑似调整AI结果权重,网页链接重新优先 3.只能第一!余承东:鸿蒙彻底告别安卓、华为突破封锁麒麟芯全面回归 4.携程被罚 1000 万:未落实数据出境安全评估要求、违法出境个人信息 5.山姆客服回应极速达买到临期商品:可以在订单中备注“不要临期” 6.机器人伴侣U1内置养成系专属情感大模型,仅限成人
SelectiveRM:从点对点拟合噪声偏好,转向带选择机制的分布对齐,重构奖励模型的训练目标。 作者丨潘黎铖 在大语言模型对齐研究中,一个看似自然、却值得重新审视的问题长期存在: 一方面,RLHF、RLAIF、GRPO等方法不断推动模型对齐能力演进;另一方面,奖励模型训练阶段却普遍默认一个前提——收集到的偏好标注能够准确反映真实人类偏好。 但现实并非如此。无论是人工标注、众包反馈,还是LLM-a