来自 Twitter · Hacker News · GitHub 的 AI 行业动态
xAI 的 Grok Build 插件市场新增 Firecrawl,支持在终端内一次完成网页搜索、抓取与结构化提取(Grok Build 插件市场 6 月 11 日上线)。
OpenAI DevDay 2026 申请开放,9 月 29 日在旧金山 Fort Mason 举行,7 月 10 日截止申请、注册费 650 美元,开幕主题演讲将直播。
OpenAI 通过 Appia 基金会支持评估框架、安全实践和全球合作,助力建立先进 AI 的共享标准。
研究通过框架量化LLM评委面板的真实信息价值。测试7个模型族共9个前沿LLM在3个自然语言推理数据集上的表现,发现9个评委只提供约2个独立投票的信息量。
过去一年,火山引擎几乎是中国大模型商业化叙事里最受关注的变量之一。 一方面,豆包大模型调用量持续攀升,火山在MaaS市场快速扩大份额;另一方面,围绕火山引擎MaaS 业务的收入目标和增长预期,市场上也不断传出更激进的说法。 到年中这一节点,外界对火山引擎的关注,已经从“Seedance2.0卖得怎么样”,转向了另一个问题:上半年,火山引擎在Seedance2.0的商业化上打出了一场漂亮仗,但下一步
测试87个真实工作负载发现,最强模型也只能解决不足三分之一,但少数生成的核函数超越了公开实现。
介绍如何构建会话式蛋白质研究助手,整合自然语言查询解析、向量化蛋白质搜索和 AI 生成摘要三个能力。
本文介绍使用Amazon Bedrock AgentCore构建生产级多租户系统的最佳实践,并通过医疗AI Agent服务多家诊所和医院的案例进行演示。
Agentic AI爆发的拐点已然来临
标注者意见分歧本身携带信号,捕捉分歧所需人数取决于评估指标。研究在NLI任务上发现,熵相关指标需20-50个标注者才收敛,而KL散度在约10个标注者时已达饱和。
企业AI浪潮初期重在尝鲜,如今转向构建能推理、使用工具并深度融入工作流程的专用AI代理。
我们用 GDPevo,衡量出 AI 自进化的真实价值。 作者丨PrismShadow AI 编辑丨岑峰 01 为什么“自进化”突然成了所有人都在抢的赛道? 想象一下,你有一个新入职的员工。他一开始什么都不会,需要你手把手教。但几周后,他开始自己总结经验、优化工作流程,甚至能独立应对从未见过的新问题。 如果把这个场景里的员工换成AI,这就是眼下人工智能领域最前沿、也最令人兴奋的方向:自进化Agent
日前,大晓机器人官宣完成天使+轮融资。 投资方集齐国家队、产业队、VC 队三股力量: 既有深创投、上海科创基金、临港新片区基金等政府资本,吉利资本与沐曦股份等公司业务强相关的产业资本; 又有达晨财智、盛宇投资、复星锐正、华控基金、豫资涨泉等 VC 资本;而老股东商汤国香资本持续增资。 这轮融资,三重信号值得关注: 第一,上海、深圳政府资本集体入局。世界模型、具身智能已进入国家与地方政府的产业视野,
NVIDIA 技术占据 TOP500 榜单 81% 席位,新上榜系统中占比达 90%;26 套系统采用 NVIDIA Grace CPU,能效榜单 Green500 前 8 名均采用 NVIDIA GPU。
BioMatrix是新型多模态基础模型,将分子序列、结构与自然语言整合进统一解码器架构,用于各类生物学任务。
了解Omio如何利用OpenAI赋能对话式旅行体验,加速产品开发,并转型为AI原生公司。
SkillHarness是一个框架,通过融入安全约束和自适应技能选择机制,使计算机操作智能体能够在动态环境中安全地学习和执行技能。
希望你能找到快乐
当前,人工智能作为培育新质生产力的核心引擎,已上升为国家战略层面。国务院《关于深入实施“人工智能+”行动的意见》明确提出,要加快AI核心技术自主创新、降低产业落地门槛、构建开放共享的国产AI生态,推动人工智能与千行百业深度融合。 在这一战略背景下,网易有道正式推出“子曰4.0”大模型体系TTS语音合成引擎——Confucius4-TTS,并已面向全球用户开放。近日,该引擎凭借全球首个不依赖参考文本
新商标已曝光
英伟达:不造机器人,但要帮具身企业造好机器人
电信运营商已通过生成式 AI 实现网络管理、客服和后台运营的自动化,NVIDIA 正推动从任务自动化向全天候自主运营的转型。
通过多维能力分类和证据引导研究,一个原则性合成引擎生成高质量终端智能体任务,创建蒸馏数据集使大语言模型训练实现显著性能提升。
让大模型只改错的地方,不误伤对的内容。 作者丨李宁 上海交通大学 大语言模型(LLM)在医疗、金融、法律等高风险场景中的部署,始终面临一个核心挑战——幻觉(Hallucination)。模型生成的内容可能包含与事实不符的实体、数字或逻辑关系,而这些错误往往隐藏在大量正确内容之中,极难检测和消除。 如何让大模型在减少幻觉的同时,不丧失回答的信息量和实用性?来自上海交通大学与腾讯的研究团队提出了一种全
PlanBench-XL 评估大语言模型智能体在复杂工具环境中、视野受限且存在动态干扰时的规划与适应能力。
“美股历史上一场充满撕裂的豪赌就要来了,从没见过分歧和争议这么大的。”深圳一家私募基金合伙人周明对雷峰网兴奋道。 美东 6 月 12 日 09:30(北京时间今晚 21:30),SpaceX 将正式登陆纳斯达克,发行价为每股 135 美元,计划募资 750 亿美元。1.75 万多亿美元的起步估值,让它在未上市前就一举超越了老牌巨头 Meta,直逼亚马逊。 这场IPO之所以备受瞩目且充满争议,除了估
TAPO 通过创建显式纠正轨迹来增强大型语言模型推理能力,在保留错误推理的同时融入自然语言诊断和纠正,通过改进的错误纠正能力超越传统自蒸馏方法。
EvoEmbedding 是一个动态嵌入模型,通过维护持续更新的潜在记忆来生成自适应表征,从而在长上下文场景中提升检索性能。
本文介绍如何在 Amazon SageMaker AI 处理作业上部署 ComfyUI 工作流,通过 AWS CDK 搭建基础设施、配置 GPU 加速处理,实现单批次生成数百张高质量图像的自动化流程。
本文介绍 Ampersend 如何在 Amazon Bedrock AgentCore Payments 之上构建按请求付费的智能路由层,AI 代理可自主将任务路由至最优模型、在预算内完成支付,并详解两跳支付模式的完整流程。