来自 Twitter · Hacker News · GitHub 的 AI 行业动态
后训练对提升LLM领域能力至关重要,但现有方法将策略探索与分布对齐耦合,导致昂贵探索直接作用于策略模型,阻碍信号复用和跨模型迁移。本文提出PUST,一种将更新信号探索与分布对齐解耦的后训练框架。
近日,通用人形机器人企业逐际动力 LimX Dynamics 宣布完成近 2 亿美元 Pre-IPO 轮融资,投后估值达 150 亿元,跻身超级百亿独角兽行列。公司过去半年累计完成融资 4 亿美元,为后续资本市场运作筑牢基础。 据悉,本轮融资汇聚了中国、欧洲、中东、北美及东南亚的全球头部资本,充分体现了全球市场对具身智能产业长期价值的认可,以及对逐际动力技术路线、产品能力与全球化战略的信心。新投资
模型会调工具之后,状态管理成了新难题。 作者丨郑佳美 编辑丨马晓宁 刚刚,DeepSeek 在官方 API 文档里给出了一个 thinking mode 和 tool call 结合使用的样例。表面上看,这只是一个常规的工具调用演示:用户提出问题,模型判断需要调用工具,工具返回结果后,模型再继续生成答案。 但这个样例真正值得关注的地方,并不是“模型会调用工具”。 今天,模型调用工具已经不是新鲜事。
ChatGPT 和 codex 合二为一。 作者丨郑佳美 编辑丨马晓宁 北京时间凌晨一点,GPT 5.6 亮相 Open AI 发布会。 这场发布会没有只围绕一个模型展开,而是同时推出了 ChatGPT Work、全新的 ChatGPT 桌面 App、Hosted Sites,以及 GPT 5.6 系列模型 Soul、Terra、Luna。 单独看,这些像是几个不同功能;放在一起看,它们其实在补同
技术发现不小,但意识叙事争议更大。 作者丨郑佳美 编辑丨马晓宁 刚刚,Anthropic 发了一个关于 Claude 内部机制的新研究,名字叫 A global workspace in language models。 它不是在研究 Claude 最终回答得好不好,也不是在让 Claude 自己解释“我刚才为什么这么说”,而是直接去看 Claude 在生成回答之前,中间层里已经形成了哪些没有写出
01 一台没有上市的原型机 2022年5月,一座公园里,一台无边界智能割草机原型机正在草坪上来回运行。 从结果看,它跑得不错。彼时,秦岭刚加入团队不久,接手的第一个业务就是割草机。团队从2021年底开始组建,到2022年初核心成员基本就位,经过大约5个月研发,做出了这台样机。而这支团队,正是今天独立运作的全球智能户外庭院公司“耐士劳智能科技”的前身。 这台样机采用的是当时行业里很有想象力的一条路线
7月8日,支付宝“碰一下”公布最新数据,经过两年迭代发展,“碰一下”已有4亿用户、2300余家生态服务商、超3000万线下AI触点。碰一下由此构建全球首个大规模线下AI经营网络。 作为支付宝生态长期深度合作伙伴,企鹅科技率先完成碰一下全校园场景规模化落地,目前也已经走出一条从硬件设备供应商向全域校园数字化服务商转型的发展路径。 校园数字化待破局,企鹅科技推动校园数字化转型 校园人流密集、场景碎片化
大语言模型在高中和奥数级别数学任务上表现优异,但对高等数学能力的理解仍不足。现有基准在学科覆盖和评估粒度上均存在局限。AdvancedMathBench 针对这一缺口设计了评估高级数学推理能力的基准套件,提供核心证明生成与验证功能。
就在 OpenAI 发布办公智能体 ChatGPT Work,冲刺 To B 市场时,它的商业化掌舵人却意外离场。 近日,OpenAI 负责“AGI 部署与应用”的首席执行官 Fidji Simo 在社交平台 X 上公开宣布:由于过去三个月里慢性神经免疫疾病(POTS)的严重恶化,她将卸任全职高管职务,退居二线转任公司的兼职顾问。 在 OpenAI 全力冲刺 IPO、与 Anthropic 贴身肉
尽管 VLM 和 VLA 系统提升了机器人感知与动作预测能力,长时程具身 Agent 仍需通用运行时层来支持推理、记忆、工具调用、验证和跨具身执行。ABot-AgentOS 是通用机器人 Agent 操作系统,提供场景条件规划、上下文隔离技能执行、多阶段验证、多模态记忆及边缘-云协作功能,并推出 EmbodiedWorldBench 基准测试。
移动和可穿戴设备上的个人 AI 助手持续感知用户日常生活,但回答关于过去经历的查询需要轻量级多模态记忆系统。LightMem-Ego 是一个用于日常生活的轻量级流式多模态记忆系统,能持续捕获第一人称视角的视觉和音频流,并在共享时间线上对齐,组织为层级记忆结构。
现有动态人体捕捉在密集相机阵列下可实现高保真度,但实际场景中仅有少量低重叠度相机,导致输出质量下降和大量区域不可观测。最近的4D重建方法虽聚焦低重叠设置,仍在观测不足区域产生明显伪影。视频扩散模型虽为另一选择,但对人体呈现几何不一致结果。为解决这些局限,团队提出StudioRecon管道。
7月13日,阶跃星辰在上海举办发布会,正式发布全球首个智能体原生操作系统Step AOS(Step Agentic-native OS)、基于模型矩阵及Step AOS打造的个人智能体阶跃Amoo,以及大模型原生AI终端品牌STEPX。全球首款大模型原生智能体手机STEPX Neo同场亮相。至此,阶跃构建起从模型、系统到终端的“模软硬”三位一体技术闭环。雷峰网 为智能体从零构建运行环境 历经数年高
要闻提示 1.长鑫近2万员工每人可分超百万!有人因工作强度离开:年薪30万,月加班80小时 2.曝字节跳动入局自动驾驶领域,官方回应:没有做智能驾驶业务的计划 3.内部人士:菜鸟供应链定位独立公司,阿里将继续加大投入 4.篡改代码攻击大模型被字节索赔800万的实习生已创业 5.海南将成中国首个禁售燃油车省份 6.原倍轻松COO郑小亚加盟云鲸智能,任中国区负责人 7.曝iPhone20工艺对标初代A
7月13日,阶跃星辰在上海正式发布面向智能体时代的全球首个大模型原生AI终端品牌STEPX,并同步推出全球首个智能体原生操作系统Step AOS(Step Agentic-native OS)和阶跃新一代个人智能体阶跃Amoo,正式打通了从基座模型、智能体系统到硬件终端的完整链路。发布会现场,全球首款大模型原生智能体手机(Agentic Phone)STEPX Neo同步亮相。雷峰网 全球首个大模
要闻提示 1.成俞敏洪对手?孙东旭拉上前东方甄选主播石明、天权合伙开公司 2.小米回应澎程N90的定价猜测:部分网传价格远低于成本常识,要讲科学 3.腾讯游戏被曝试点不再使用组长、总监管理头衔,取消基干管理职级 4.传字节正推进豆包地图导航,相关人士回应 5.美团回应大规模裁员:近两个月实际离职员工不到2000⼈,占整体员工比例不高 6.MiniMax闫俊杰:不再领取薪酬,个人拿出5%公司股份用于
Google DeepMind 推出「Predicting the Past」Skill(集成于 Google Antigravity):把 Gemini 接入其专家模型 Aeneas 与 Ithaca,让历史学家用自然语言(无需写代码)研究古希腊/拉丁铭文——修复、断代、定位并可视化,已在巴斯拉丁碑、美因茨祭坛等真实案例验证;与杜伦大学合作研发。
OpenAI 推出 ChatGPT Sites 公测:在 ChatGPT Work/Codex 里用自然语言把想法或文件变成交互网站/轻量应用(仪表盘、项目跟踪、原型、内部门户等),预览后可发布并按 URL 分享;面向 Pro/Pro Lite/Edu 起步,Plus 随后,Free/Go 暂不支持。
Anthropic 分析约 30.98 万条匿名真实对话,把 3300+ 价值观归纳为四个维度(顺从↔审慎、温暖↔严谨、深度↔简洁、坦率↔执行),发现同一 Claude 在不同模型与语言下价值观表达差异明显(如 Sonnet 4.6 更温暖、Opus 4.7 更严谨;英语更审慎深入、阿拉伯语更温暖)。
在2026中国互联网大会“网民权益和个人信息保护论坛”上,《智能体个人信息保护自律公约》正式发布,腾讯、百度、美团、连尚集团等31家企业首批签署。作为人工智能行业的重要自律公约,该公约填补了智能体领域专项规范空白,通过头部企业发挥表率带头作用,引领AI行业生态规范发展,回应了“十五五”规划对人工智能安全可控的要求。 工业和信息化部、国家市场监督管理总局、中国信息通信研究院等部门相关负责人出席论坛。
7月13日,2026年机器人领域顶级学术会议RSS(Robotics: Science and Systems)在澳大利亚悉尼正式开幕。 今年的 RSS 2026最终被主会接收并放进官方日程的论文仅仅 160 篇左右,极低的接受率说明了RSS的含金量一如既往的高,每一篇都经得起全场几百位顶尖研究者的严苛推敲。 雷峰网&AI科技评论已派出报道小组抵达会议现场。在简单的开幕式后,紧跟着的是“Manip
作为机器学习领域的顶级学术盛会,“世界模型”这一主题在ICML的接收论文名单中,从绝对数量上看似乎并不占上风。根据MTRI近日发布的一篇报告,在ICML 2026被接收的6341篇论文中,有49篇论文属于“世界模型”分类,占比不到1%。然而,在仔细剖析论文趋势并在大会现场与参会者深入交流后我们发现,今年的ICML世界模型研究正经历一场至关重要的范式革命。 在会场内外,学者们争论的核心焦点早已跳出“
本研究利用全向表征的旋转等变性质处理全景世界模型中的长程记忆挑战,将旋转视为隐式几何变换。在此基础上提出PanoWorld,通过密集全景射线条件化(DPRC)和几何感知记忆增强(GMA)用固定航向简化相机轨迹,实现动作建模与长程记忆,并引入三阶段训练流程逐步优化。
预训练的扩散Transformer可以通过将token映射到任务原生输出而非生成RGB图像,从而适配密集预测任务,以最少的额外参数实现最优结果。
当大模型遇到真实的临床战场 作者丨吴思梦 编辑丨岑 峰 “Transformer 能写诗、能编程、能证明数学定理,为什么迟迟造不出真正上市的 AI 新药?” 7月8日,在 ICML 2026 大会上,Genentech(基因泰克)执行副总裁兼研发负责人 Aviv Regev 登台发表主旨演讲,直面了这个困扰 AI 制药圈已久的核心质疑。 在这场题为Lab in the Loop for drug
随机性是一面镜子,因果推断照见了自己。 作者丨吴思梦 编辑丨岑 峰 7月7日,国际机器学习大会(ICML)在首尔召开。在首日Keynote演讲中,斯坦福大学商学院技术经济学教授、前美国司法部反垄断部门首席经济学家Susan Athey发表了一场跨越经济学、统计学与机器学习边界的演讲,题为“Causal Inference with Transformer Models”(基于 Transforme
Anthropic 宣布把 Claude Fable 5 在所有付费计划(Pro/Max/Team/企业)上的访问延长至 7 月 19 日,同时 Claude Code 周用量上限继续保持上调 50%;Fable 5 与其他模型共用同一周用量池,超额后可用 usage credits 继续或切换模型。
vLLM 发布 0.25.0(据 GitHub Releases,232 位贡献者、558 次提交):Model Runner V2 成为稠密模型默认引擎;新增 LLaVA-OneVision-2、Unlimited OCR 等模型;统一流式解析引擎(含 Kimi parser);投机解码与多硬件(NVIDIA/ROCm/XPU/CPU)优化。
A practical, open-source guide to mastering WorkBuddy through real-world workflows.开源的 WorkBuddy 实战蓝皮书:教程、真实工作流、Skills、MCP、自动化与多智能体实践。
NVIDIA 与 Emerald AI 联合 AES、Constellation、NextEra 等能源公司,打造可作为电网灵活资产的新一代 AI 工厂(基于 Vera Rubin DSX 参考设计 + DSX Flex 软件),让 AI 数据中心更快接入电网并反哺电网。