全部 今日 本周 本月

AI工程年度调查周末截止,Devin实时分析参会数据

swyx提醒AI工程调查将于本周末结束,优胜者可获Vercel、Notion及AIE门票。Devin被用于分析注册名单并生成动态图表,揭示两周后大会参与者画像,呈现数据驱动社区洞察。

产品发布 AI 摘要 · 单一来源
@swyx 阅读 →

Claude Design新技能:快速生成可交互简历原型

除编程场景外,Claude Design展现惊人实用性。用户只需用自然语言描述简历需求,便可即时生成可交互原型,每个元素都能响应点击操作,模拟真实App体验。

大模型 AI 摘要 · 单一来源
@dotey 阅读 →

Codex为何暂无设计工具?GPT-5.5模型能力是瓶颈

宝玉解析Codex与Claude Design的本质差异:两者属产品层(Harness),整合提示词、工具链与UI流程;而GPT-5.5等模型才是真正执行任务的“大脑”。当前模型能力制约了Codex…

大模型 AI 摘要 · 单一来源
@dotey 阅读 →

约瑟夫·维岑鲍姆警示:计算机服从指令却未必理解意图

MIT CSAIL引用计算机科学家约瑟夫·维岑鲍姆观点,强调人与机器间的根本矛盾:机器会精确执行指令,但这与人类原始意图常存在巨大偏差,引发对AI交互设计的深层思考。

观点 · 观点/主张 AI 摘要 · 单一来源
@MIT_CSAIL 阅读 →

Aster创自主研究实验室纪录:30分钟破ProteinGym世界纪录

Aster Labs通过数千个AI代理并行运行,在ProteinGym基准测试中创下世界纪录,速度提升千倍。目前正将该技术应用于开放式研究自动化,标志AI驱动科研新突破。

研究 AI 摘要 · 单一来源
@ycombinator 阅读 →

Codex浏览器插件vs内置模式:爬虫场景如何选

Codex两种模式差异显著:Chrome插件模式可共享登录态、继承真实浏览器环境,适合需要认证的复杂爬虫;内置浏览器则更轻量。企业应根据是否需要登录态来选择合适的模式。

产品发布 AI 摘要 · 单一来源
@dotey 阅读 →

Google Search推出AI Mode:模仿球星伊布风格问答

Google在搜索中上线AI Mode功能,主打模仿@Ibra_official的独特表达风格,为用户提供趣味化的AI交互体验。

产品发布 AI 摘要 · 单一来源
@Google 阅读 →

Chamath警告:企业押注单一AI实验室风险极高

Fortune 1000企业若将所有模型需求寄托于一家前沿实验室,无异于把现金全存单一大额存单。实验室意图和公开行动愈发不可预测,建议采用模型无关的“控制平面”策略分散风险。

观点 · 观点/主张 AI 摘要 · 单一来源
@chamath 阅读 →

AI时代需要丢弃旧地图,自己绘制新的

大多数人在新领域仍用旧地图摸索。真正的创新需要亲自踏入未知土地,在实践中重新绘制地图,而非依赖既有经验和框架。

行业 AI 摘要 · 单一来源
@garrytan 阅读 →

巨头博弈:Mags借政府监管渗透前沿AI实验室

Google、亚马逊、微软、Meta或利用监管手段限制前沿实验室通过自家云服务(AWS、GCP、Azure)部署模型,并推行严格KYC,将自身定位为AI时代的守门人。前沿实验室或将失去直接触达用户的…

大模型 AI 摘要 · 单一来源
@chamath 阅读 →

MiniMax-M3上线Together AI:开源多模态模型,支持100万上下文

MiniMax原生多模态模型开放权重,含MiniMax稀疏注意力机制,提供思考/非思考双模式。作为MiniMax首选云合作伙伴,Together AI推理吞吐量提升达125%。

大模型 AI 摘要 · 单一来源
@togethercompute 阅读 →

vLLM 社区热情接纳 Day-0 推测解码方案

项目方对社区快速跟进推测解码技术表示感谢,称其为"Day-0 投机者"提供了友好环境。

大模型 AI 摘要 · 单一来源
@vllm_project 阅读 →

Garry Tan 呼吁让模型被真实使用而非仅凭标志认知

他认为大众往往通过抽象符号了解模型,而非亲自体验,导致对模型意义的误解。

观点 · 观点/主张 AI 摘要 · 单一来源
@garrytan 阅读 →

Y Combinator CEO Garry Tan盛赞Datacurve打造DeepSWE行业基准

Datacurve(YC W24)正在构建软件工程领域的权威评测标准,或成为AI代码能力的标杆测试集

研究 AI 摘要 · 单一来源
@garrytan 阅读 →

Kimi K2.7 Code API充值促销:7月2日前满$100额外赠20%-30%配额

充值$100-299赠20%、$300-999赠25%、$1000以上赠30%,每账户限一次优惠,鼓励开发者把握窗口期

行业 AI 摘要 · 单一来源
@Kimi_Moonshot 阅读 →

Ollama云端上线Kimi K2.7 Code模型,采用NVIDIA B300 GPU

模型托管于美国数据中心,数据全程私密、不用于训练,支持Claude、Codex App、OpenCode三种方式启动

芯片 AI 摘要 · 单一来源
@ollama 阅读 →

美国政府以国家安全为由要求Anthropic禁用Fable 5和Mythos 5

出口管制指令覆盖所有外国国籍用户,包括Anthropic海外员工,全面暂停这两款模型访问,其他Claude模型正常运行,Anthropic就服务中断致歉

大模型 AI 摘要 · 单一来源
@AnthropicAI 阅读 →

使用Amazon Quick和Cisco Webex MCP服务器构建会议准备和后续跟进助手

展示如何构建自定义会议助手,从单一提示即可查找Webex会议、回顾历史摘要、搜索未解决跟进事项并创建准备简报;会后自动总结讨论、识别待办并起草后续消息。

产品发布 AI 摘要 · 单一来源
AWS ML Blog 阅读 →

从PDF到洞察:基于AWS生成式AI服务构建智能文档处理管道

本文介绍在AWS上开发经济高效、可扩展的智能文档处理管道,利用Amazon Bedrock的BDA服务提取文档内容,由Strands Agent协调处理任务,Amazon Bedrock知识库支持跨文档上下文理解。

产品发布 AI 摘要 · 单一来源
AWS ML Blog 阅读 →

构建Supercharger:Rocket Close如何用代理AI优化产权操作

探索Rocket Close如何结合Strands Agents、大语言模型、Amazon Bedrock及MCP工具构建解决方案,涵盖技术栈设计考量、经验教训及商业影响。

产品发布 AI 摘要 · 单一来源
AWS ML Blog 阅读 →

NVIDIA Blackwell 在首个 Agentic AI 基础设施基准测试中领先

AgentPerf 是人工智能分析公司推出的业界首个 Agentic AI 基准测试,NVIDIA Blackwell Ultra NVL72 平台在测试中提供领先性能,每兆瓦可运行 20 倍的 Agent。

研究 AI 摘要 · 单一来源
NVIDIA Blog 阅读 →

6月15日上会!燧原科技营收三年高增,盈利拐点渐近

近日,上交所发布公告,将于 2026 年 6 月 15 日召开上市审核会议,审议燧原科技科创板首次公开发行申请,这家国内 AI 算力芯片企业正式迎来上市关键节点。 燧原科技自成立以来始终深耕算力芯片领域,历经八年发展,已成为国内专注云端AI芯片自主研发的领军企业。2023-2025 年,燧原科技营业收入从 3.01 亿元增长至 9.90 亿元,三年营收复合增长率达到 81.32%,增长势头十分强劲

融资 AI 摘要 · 单一来源
雷锋网 阅读 →

N-GRPO:嵌入级邻居混合增强策略优化

N-GRPO 是 GRPO 框架内的一种新型探索策略,通过语义邻居混合增强大语言模型的数学推理能力,在保持语义一致性的同时注入多样性。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

米家空调「冷媒动态调节」等4项技术获评「国际领先」

今年高考季,小米大家电也迎来了一场特殊的“考试”——带着四项核心技术,接受行业权威专家委员会的鉴定。 近日,中国制冷学会、中国节能协会共同在湖北武汉组织召开小米大家电系列科技成果鉴定会。由小米智能家电(武汉)有限公司主导研发的四项关键技术——制冷剂动态调节与虚拟感知融合、出风形态重构的舒适送风、全温域宽频高能效控制、多智能体强化学习的多联机节能——经专家委员会鉴定,全部达到「国际领先」水平。 至此

行业 AI 摘要 · 单一来源
雷锋网 阅读 →

TreeSeeker:深度搜索中的树结构试错与返回机制

TreeSeeker 是一个推理时框架,采用树结构搜索结合分支返回控制来管理深度搜索中的探索与利用,通过系统化的试错决策提升性能。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

WeaveBench:面向混合界面计算机智能体的长时序真实任务基准

WeaveBench 提供综合基准用于评估多界面计算机智能体,揭示了长时序任务编排的重大挑战,并指出传统性能评估方法的局限性。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

HYDRA-X:基于统一视觉分词器的原生多模态模型

HYDRA-X提出统一多模态模型,在单一Vision Transformer内整合图像和视频分词,通过因果时序注意力和分层压缩解决时空重建与语义感知问题。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

VIA-SD:基于模型内路由的推测解码验证

VIA-SD引入多层级推测解码框架,通过模型内路由机制利用轻量子模型验证中等置信度token,从而降低验证成本,显著提升推理速度。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

符号门控在线策略蒸馏:基于符号一致性门控与阶段性教师采样

通过引入二元验证器过滤教师信号,SG-OPD 在标准在线策略蒸馏基础上提升了数学推理任务的表现。

研究 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →

从2D网格到1D标记:重塑多模态图像融合的共享表示

一种多模态图像融合方法利用预训练图像分词器的1D标记接口,通过选择性标记编辑增强全局外观一致性同时保留局部细节。

大模型 AI 摘要 · 单一来源
HuggingFace Daily Papers 阅读 →