来自 Twitter · Hacker News · GitHub 的 AI 行业动态
Google Maps 宣布十余年来最大规模升级,结合 Gemini 模型实现对话式搜索 Ask Maps、沉浸式 3D 导航和智能路线规划等全新功能。
Musk 在推特上公开呼吁让 ChatGPT 远离儿童和心理状况不佳的人群,再次表达对 OpenAI 产品安全性的担忧。
宝玉拆解一则关于 Amazon 大裁员的热门推文,区分已确认事实与未经核实的内部爆料,指出推文混入大量耸动说法制造恐慌。
Google DeepMind 揭晓伦敦新大楼名称 Platform 37,既致敬当地交通遗产,也纪念 AlphaGo 下出人类从未想到的第 37 手。
Musk 预测,当 AI 和机器人驱动的商品服务产出增长远超货币供应增长时,将出现大规模通货紧缩,建议直接从国库发放支票。
宝玉爆料腾讯推出了 SkillHub 平台,被发现在抓取 ClawHub 的数据,引发社区热议。
Latent Space 主播 swyx 高度评价 Replit,称其已从编程学习工具进化为比 Google 和微软更强大的 AI 生产力套件,支持幻灯片、视频等功能。
宝玉分享了一套爆款文章拆解框架,涵盖核心观点、说服策略、情绪触发点、金句提炼、情感曲线等维度,适合制作为自动化分析工具。
Musk 宣布 Grok Imagine 图像生成功能将大幅放宽内容限制,只要是 R 级电影中允许的内容都可以生成,进一步区别于竞品的保守策略。
研究人员提出 Omni-Diffusion 框架,基于掩码离散扩散方法实现多模态理解与生成的统一,为多模态大模型提供新思路。
LMSys 宣布 SGLang 首日支持 Nemotron 3 Super,该模型吞吐量提升 5 倍,支持多 Token 预测、思考预算控制和 100 万 Token 上下文。
新论文提出 MM-Zero 框架,无需任何训练数据即可让多模态视觉语言模型实现自我进化,探索零数据多模型协作新范式。
Together AI 上线 NVIDIA Nemotron 3 Super,120B 混合 MoE 模型仅 12B 活跃参数,专为多 Agent 系统优化,支持专属推理部署。
新论文研究推理过程如何解锁大语言模型的参数化知识,揭示思维链推理能有效激活模型内部存储的知识。
ElevenLabs 在 ElevenCreative 平台上线 Flows 功能,将图片生成、视频、TTS、口型同步、音乐和音效整合到单一创作画布中。
Replit 发布 Agent 4,并预告将于 3 月 12 日直播演示在一个工作区内从零构建跨 Web 和移动端的实时聊天应用。
新论文提出 Geometry-Guided RL 方法,通过强化学习引导多视角一致的 3D 场景编辑,解决传统方法视角不一致的问题。
swyx 观察到 Sourcegraph 接连孵化出 Amp Code 和 Steve Yegge 领导的新项目,同一家公司诞生两个 Agent 创业团队。
LlamaIndex 发布基于 Rust 的 CLI 工具 semtools v3.0.0,统一文档解析、本地多语言语义搜索和 AI Agent 问答功能。
Inworld AI 推出 Mini 和 Max 两款 TTS 模型,在 Artificial Analysis 排名第一。Mini 专为实时语音 Agent 设计,Max 主打极致音质,均支持 15 种语言和情感控制。
Mistral AI 宣布将参加 NVIDIA GTC 大会,将展示最新前沿模型并分享企业 AI 愿景,预告有重大新闻发布。
Replit 为庆祝 Agent 4 发布推出激励活动,前 100 名分享作品的用户可获得 100 美元 Replit 积分。
Browserbase 发布 Fetch API,号称最快最便宜的方式从整个互联网提取网页内容,解决传统 fetch 无法处理的动态网站问题。
Replit 宣布将加大投资,致力于帮助数百万构建者将他们的创意付诸实践,团队对未来发展充满信心。
vLLM 宣布 v0.17.1 首日支持 Nemotron 3 Super,相比上代吞吐量提升 5 倍、准确率翻倍,支持多 Token 预测和可配置思考预算。
NVIDIA CEO 黄仁勋与汽车业务副总裁吴新周在旧金山亲自乘坐自动驾驶汽车,讨论 NVIDIA 为下一代自动驾驶提供动力的技术。
Google 发布最新图像生成模型 Nano Banana 2,具备专业级能力和高级世界知识理解,生成速度极快。
Anthropic 宣布 Claude for Excel 和 Claude for PowerPoint 插件扩展至 Amazon Bedrock、Google Vertex AI 和 Microsoft Foundry,Mac 和 Windows 均已支持 beta 版。
LeCun 回顾世界模型的历史渊源,指出最优控制领域在 1960 年代已使用基于模型的规划方法,关键在于如何将理论付诸实践。
Ollama 第一时间支持 NVIDIA Nemotron 3 Super 模型,120B 混合专家架构仅 12B 活跃参数,支持 1M 上下文长度,专为多智能体应用设计,完全开源。