来自 Twitter · Hacker News · GitHub 的 AI 行业动态
DiffusionGemma 采用块级同步生成与精炼机制,取代传统逐词预测,生成速度提升四倍,代码采用 Apache 2.0 许可
Anthropic CEO Dario Amodei 论文指出 AI 发展速度超出政策应对能力,公司正推出三大计划以弥补差距
Code with Claude Tokyo 发布,托管 Agent 支持定时运行、安全工具调用及更大任务,Claude Code 动态工作流已普遍可用
Michael Truell 12岁爱上编程,联合创立 Cursor,平台已获大量企业采用,财富500强中逾六成使用
他在文中阐述 AI 进展速度及当前监管缺口,呼吁政策同步加速
Elon Musk 认同 Sowell 的言论,认为相关行为应立即终止
相较Gemini 3 Flash和GPT‑5.5,Fable 5在内容忠实度和语义格式化分别提升至90%与72%,优势明显。
经大量实践,Claude 4.8在界面设计上已足够,Fable 5未展现明显提升。
用户可在搜索中创建婚礼策划、搬家等持续任务的个性化交互界面,随时返回继续推进。
通过Design System避免AI味、分阶段迭代、用Markup局部修改、注意上下文管理、利用Tweaks调风格。
该初创公司利用GPU实现高回报,证明AI推理硬件的商业价值显著。
宇树科技与 BitRobot Network、Lightwheel AI、新加坡理工学院等合作,加入人形机器人 IKEA 组装挑战赛,探索人形机器人在真实场景中的灵巧操作能力。
Result 是一个覆盖创业全流程的平台,帮助用户从创意到产品落地、公司注册、财务管理、报税和营销。Y Combinator 对其正式发布表示祝贺。
GarryTan 表示 Fable 5 是他见过的最大模型能量,但未透露具体参数或性能数据。
OmniCap-IF首个综合基准,用于评估全模态视频描述的指令跟随能力,揭示了多模态推理中显著的性能差距及格式-内容权衡问题。
推出名为CoVEBench的新基准测试,用于评估组合式视频编辑能力,解决了现有模型在处理复杂多步骤编辑任务时保持时空内容方面的局限。
SWE-Explore引入了一个基准测试,通过要求在代码行数限制内提供相关代码区域的排序列表来评估编码智能体的仓库探索能力,结果表明智能体式探索优于传统检索方法。
随着微信正式面向开发者提供AI生态接入能力,滴滴作为首批合作伙伴,已与微信团队合作将核心网约车服务融入微信AI Agent。未来,用户通过微信内AI交互,即可直接唤起滴滴快车、专车、特惠等服务。 当用户在微信中产生出行需求,只需说一句“帮我叫一辆滴滴去机场”,“我要打滴滴回家,要特惠快车或者快车”即可根据行程距离、时效需求与个人偏好,自动推荐最优车型,一键唤起叫车服务,全程不跳转,极速出发。 据了
Agents' Last Exam (ALE) 是一个评估AI智能体的基准测试,聚焦长期、有经济价值的现实世界任务,涵盖13个行业集群、1000+任务,揭示了基准测试表现与实际部署之间存在显著差距。
作者|吴思梦 编辑|岑峰 2026年6月3日,计算机视觉与模式识别顶级会议(CVPR)在美国丹佛举行。在大会特邀演讲环节,前 DeepMind 蛋白质设计团队核心成员、2024年诺贝尔化学奖获奖项目 AlphaFold 核心研究员,Latent Labs 创始人兼 CEO Simon Kohl 发表了题为“Programmable Biology:Generative AI for Molecul
SlimSearcher是一个通过帕累托高效轨迹过滤和自适应奖励塑造来提升深度研究代理效率的框架,在保持准确性的同时降低计算成本。
今年的数据中心采购出现了一个反常情况,CPU开始缺货了。 英特尔市场营销集团副总裁、中国区总经理郭威在发布会上给出了一组数字:2026年一季度,中国AI算力需求同比爆涨417%;与此同时,CPU与GPU的配比已经从过去的1:8,逐步走向1:4、1:2,部分场景甚至达到了1:1。 这不是宏观预测,是正在发生的现实。英特尔数据中心集团副总裁、中国区总经理陈葆立透露,某国内头部大模型厂商从去年到今年,C
Skill-RM提出统一奖励建模框架,将奖励计算作为结构化智能体任务处理,支持动态证据聚合和跨不同应用的一致评估。
提供AI编程智能体循环工程的实用模式、启动器和CLI工具,设计提示与编排智能体的系统。包含loop-audit、loop-init、loop-cost等工具。
要闻提示 1.国际宇航科学院对全球喊话:别擅自回复外星人!“这是全人类的决定” 2.TP-LINK全员转签遭近九成员工抵制,社保突停叠加百人离职,引发人心动荡 3.董事长被曝电梯亲密视频!胜宏科技回应:与生产经营无关 4.Kimi估值飙升至300亿美元,半年猛增6倍 5.微信新功能:朋友圈能搜索了 6.加入仅半年,字节前公关总监据传从理想汽车离职 7.再也不怕调休睡过头!苹果 iOS27 新增工作
人类心理测量问卷无法可靠预测LLM在真实交互中的行为,而基于生成的分析方法在理解模型对日常用户查询的响应方面具有更高准确性。
利用Replit的并行代理功能,在同一会话中生成移动应用、推广视频及pitch deck,提高原型迭代效率。
活动涵盖图像、视频及后期实操,提供AI算力积分,名额有限。
该开源模型具备256K上下文、64K最大生成长度,专为Agent工作流优化,支持推理、工具调用和结构化输出。
微软研究员Lorin Crawford等通过单细胞分析发现癌症个性化治疗新线索。