来自 Twitter · Hacker News · GitHub 的 AI 行业动态
智能已经学会了很多事。 它会推理,会生成,会在海量信息里迅速找到方向。 屏幕之内,一切都在加速。 可屏幕之外,支撑现实世界运转的任务,仍然必须有人到场,必须有人判断,必须有人行动。 所以今年,ATEC向一个更接近未来的问题,发出追问: 如果智能的下一步,不再只是理解世界,而是开始进入世界,开始承担任务—— 那么,我们该对它抱有怎样的期待? 或者说,如果用一场赛事去回应我们的期待,这场赛事应该长什么
让你的 AI 智能体像最懒的高级开发者一样思考。最好的代码是你从未写过的代码。
SpatialClaw 是一个免训练框架,以代码作为动作接口,使视觉-语言模型能够进行灵活且有状态的空间推理,在多种 3D/4D 空间推理任务上表现优异。
多智能体框架通过共享 MLLM 策略和角色专项训练方法,减少视觉推理中的幻觉并实现高效并行处理。
UniCM:揭示极端 El Niño 和 La Niña 背后的跨洋盆信号。 作者丨郑佳美 编辑丨马晓宁 在全球气候风险越来越难以用单一事件解释的今天,气候预测行业正面临一个明显转向:预测对象不再只是某一次 El Niño 或某一个海温指数,而是整个海洋和大气系统中多个气候模态的联动变化。 过去,很多预测方法更擅长处理 ENSO 这样的核心模态,却较难同时理解印度洋、大西洋和太平洋副热带区域之间的
EvoArena基准测试和EvoMem记忆范式通过建模渐进更新和结构化记忆演化,解决LLM智能体在动态环境中的挑战,在演化任务上取得性能提升。
FORT-Searcher 通过识别并缓解数据合成过程中的四个捷径风险,为深度搜索智能体创建抗捷径的训练数据。
近日,大晓机器人开悟世界模型(Kairos)同时在 RoboTwin 2.0、LIBERO-Plus、WorldModelBench Robot、DreamGen等全球针对世界模型视频生成和状态预测的权威具身智能评测中均实现第一,超越 Cosmos3、PI、MotuBrain、being-H0.7、Abot、Fast-WAM、Wan2.2等全球主流世界模型 。凭借首创的原生统一世界模型架构——“多
稳定性,正在成为大模型落地的关键命题。 作者丨郑佳美 编辑丨马晓宁 当 AI 模型从“单次完成任务”走向真实世界部署时,真正的挑战不再只是参数规模和单点性能,而是模型能否在变化中保持稳定。 它要在持续出现的新类别中不遗忘旧知识,要从大规模真实数据中获得更强的泛化能力,要在多客户端、数据分布不断变化的环境下继续学习,也要把图像、视频和 3D 等不同视觉经验组织成统一理解。 这种变化也体现在 CVPR
要闻提示 1.微软中国Azure研发遭“一锅端”:超200人受影响,最高补偿N+7 2.钉钉官宣换帅:无招卸任CEO,92年技术极客陈宇森接任 3.智界称法拉利前首席设计师加盟,法拉利高管质疑:设计师姓甚名谁? 4.李书福卸任极氪董事长 5.曾经落地近90万的神车!路虎揽胜极光L跌至17.98万 6.曝字节豆包手机硬件负责人林夕离职 7.OpenAI拟大幅降价,与Anthropic展开用户争夺 8
PS-SR:兼顾速度、细节与稳定性,让低清画面更可信。 作者丨郑佳美 编辑丨马晓宁 在生成式 AI 进入视频生产链之后,视频增强正在从后期修补工具,变成内容生产、内容分发和机器视觉理解中的基础能力。 现实需求已经不只是让画面变清楚,而是要在电商直播中看清商品质感,在工业巡检中识别裂纹和仪表读数,在远程协作中保留设计细节,在文博数字化中尽量还原影像纹理。 随着 4K 级高清内容逐渐成为视频平台、智能
过去半年,OpenClaw 掀起的“龙虾热”让AI社区陷入一种集体亢奋:AI替你写代码、回邮件、甚至接管设备,仿佛“取代人”的倒计时已经开始。英伟达黄仁勋的那句“迄今发布过的最重要软件之一”的评论,更是为这场狂欢添了一把火。 但当泡沫稍稍退去,IoT行业的沙滩上留下的却是尴尬的裂痕。 某公司实验室的邮件误删、某公司的源代码泄露,以及工信部于今年3月发布的关于防范OpenClaw(“龙虾”)开源智能
解析KV缓存、预填充/解码分离、规模化推理真相;Megakernels通过GPU算子融合逼近解码极限;Parcae揭示循环Transformer膨胀根因及修复方案,还有新扩展定律暗示现有模型仍有余量。
联合创始人Jerry Liu两度登场:解析长时域AI代理的自动化文档工作流程,参与由LangChain、CrewAI等组成的代理技术栈圆桌。Booth #137可体验LlamaParse。6月15-…
诗意对比揭示AI使用哲学:任务自主运行,结果自然到来。一椅一Agent,逍遥自得,恰如坐看云起日头高。
与 Vercel 合作推出特别活动,6 月 16 日上线项目可参与排名,优胜者获 Vercel Ventures 投资机会及超过 3 万美元启动资源。
论文提出实用化单次剪枝方案,可在 LLM 推理中同时启用稀疏与密集矩阵乘法,提升推理效率。
进一步扩展 Agent 能力边界,允许通过 Skills 组合与自定义指令实现更灵活的自动化开发流程。
该模型总计约 428B 参数、23B 活跃参数,60 层架构。MSA 稀疏注意力在 1M 上下文下比 M2 提速 9 倍/15 倍(预填充/解码),Token 计算量降至 1/20,支持 NVIDI…
该框架允许多个机体共享同一视觉-语言-动作策略,兼顾效率与灵活性。
首次观测体内最小蛋白质分子,帮助从分子层面理解疾病机制。
对比历年数据,AI 基础设施正成为美国工业资本支出的核心领域。
目标让探测器自行导航、与其他文明建立联系,实现银河系和谐。
长多步代码任务可靠性提升,推理Token减少30%,与K2.5/K2.6架构兼容,现有部署环境可直接运行。
邀请好友双方各获一次重置机会,Codex通过社交裂变方式重置个人用量限制。
n8n发布生产级检索系统构建指南,详解信息搜索、排序、过滤的优化方法,提升LLM查询质量。
用户Seedily利用MiniMaxHub制作巴西、阿根廷、西班牙、英格兰等队加油视频,展示AI视频创作能力。
a16z指出AI摘要驱动搜索流量下滑、零点击搜索上升的趋势,并附相关数据图表。
Vibecon 将于纽约举办为期两天的艺术、代码与文化盛会,邀请业界最具影响力的创作者参与,活动详情见链接,合作伙伴包括 BrandNewSchool。
训练 LLM 时每次调参或规模扩大都需要重新跑基准测试,olmo‑eval 工作台提供检查点追踪、自动化循环和可视化分析,帮助开发者快速迭代模型。