全部 今日 本周 本月

Anthropic:用 Claude 访谈了 159 个国家的用户,覆盖 70 种语言

Anthropic 使用 Claude Interviewer 版本进行大规模对话式访谈研究,覆盖 159 个国家、70 种语言的用户反馈。

研究 AI 摘要 · 单一来源
@AnthropicAI 阅读 →

Midjourney:举办每周 Office Hours 直播

Midjourney 于 3 月 18 日举办每周例行 Office Hours 直播活动,讨论产品最新进展。

活动 AI 摘要 · 单一来源
@midjourney 阅读 →

新论文:MiroThinker 通过验证机制构建重型研究 Agent

研究人员发布 MiroThinker-1.7 和 H1 模型,通过验证机制提升研究 Agent 在复杂任务中的可靠性和准确性。

研究 AI 摘要 · 单一来源
@_akhaliq 阅读 →

新论文 V-Co:通过协同去噪改进视觉表征对齐

研究人员提出 V-Co 方法,通过协同去噪技术改进视觉表征对齐,为多模态理解提供新思路。

研究 AI 摘要 · 单一来源
@_akhaliq 阅读 →

Hugging Face Papers 为 AI Agent 推出 Markdown 版本和搜索技能

Hugging Face Papers 页面现在自动为 AI Agent 提供 Markdown 版本,并新增论文搜索技能,支持按标题、作者或语义相似度检索。

研究 AI 摘要 · 单一来源
@_akhaliq 阅读 →

微软考虑就亚马逊-OpenAI 500 亿美元云计算协议提起诉讼

微软正考虑对亚马逊和 OpenAI 采取法律行动,因 OpenAI 与 AWS 的 500 亿美元合作可能违反与微软的 Azure 独家云服务条款。

大模型 AI 摘要 · 单一来源
@dotey 阅读 →

InCoder-32B:面向工业场景的代码基座模型发布

新论文发布 InCoder-32B 代码基座模型,专为工业应用场景设计优化。

研究 AI 摘要 · 单一来源
@_akhaliq 阅读 →

Browserbase 完成 3 亿美元 B 轮融资,成立仅 18 个月

浏览器自动化平台 Browserbase 在成立 18 个月内完成 3 亿美元 B 轮融资,正在扩大企业销售团队。

企业动态 AI 摘要 · 单一来源
@browserbase 阅读 →

千帆 OCR:统一端到端文档智能模型发布

百度发布 Qianfan-OCR 统一端到端文档智能模型,支持复杂文档理解和信息提取,已提供在线演示。

研究 AI 摘要 · 单一来源
@_akhaliq 阅读 →

LlamaIndex:LlamaParse 新增 Agentic Plus 模式,支持精确视觉定位

LlamaParse Agentic Plus 模式新增边界框视觉定位功能,可精确解析复杂 LaTeX 公式、手写文字识别、多栏布局和信息图表。

产品发布 AI 摘要 · 单一来源
@llama_index 阅读 →

LlamaIndex:上下文工程是新的提示工程,构建 AI Agent 的核心

LlamaIndex 引用 Karpathy 观点指出,上下文工程正取代提示工程成为构建 AI Agent 的关键,核心在于为 LLM 填充恰当的上下文信息。

观点 · 观点/主张 AI 摘要 · 单一来源
@llama_index 阅读 →

Browserbase:支持 Stripe 机器支付协议 MPP,AI Agent 可按次付费搜索和浏览

Browserbase 宣布支持 Stripe 推出的机器支付协议 MPP,AI Agent 现可通过新端点按搜索和浏览次数进行自动支付。

行业 AI 摘要 · 单一来源
@browserbase 阅读 →

n8n:树莓派部署指南发布,支持 Docker 搭建轻量自托管自动化

RaspberryTips 发布在树莓派上运行 n8n 的完整指南,涵盖 Docker 配置、核心节点、项目实例和常见问题,适合轻量级自托管自动化场景。

行业 AI 摘要 · 单一来源
@n8n_io 阅读 →

新论文 WorldCam:用相机位姿作为统一几何表示实现交互式 3D 游戏世界

研究者提出 WorldCam,以相机位姿为统一几何表示,实现自回归交互式 3D 游戏世界生成。

研究 AI 摘要 · 单一来源
@_akhaliq 阅读 →

英伟达:开源 10 万亿语言 Token、50 万机器人轨迹和 100TB 车辆传感器数据

英伟达发布大规模开源模型和数据集,涵盖 Agent AI、机器人、自动驾驶和研究领域,旨在加速专业 AI 开发。

产品发布 AI 摘要 · 单一来源
@nvidia 阅读 →

推荐开源终端视频剪辑工具,支持标记时间点和可控宽高比导出

宝玉推荐了一款终端运行的开源视频剪辑工具,可标记起始时间点并导出可控宽高比的剪辑片段,设计非常简洁。

行业 AI 摘要 · 单一来源
@dotey 阅读 →

英伟达:GTC 直播汇聚科技、基础设施和工业领袖探讨 AI 转型

英伟达 GTC 直播节目汇聚科技、基础设施和工业领域顶级领袖,共同探讨加速计算和 AI 如何变革芯片设计、数据中心、制造业和机器人等领域。

产品发布 AI 摘要 · 单一来源
@nvidia 阅读 →

英伟达:CUDA 平台迎来 20 周年,全球开发者已达 600 万

英伟达回顾 2006 年推出的 CUDA 并行计算平台,20 年后已服务全球 600 万开发者,呼吁开发者加入下一波创新浪潮。

活动 AI 摘要 · 单一来源
@nvidia 阅读 →

微软:MicroLED 数据中心网络新方案,能耗比激光光缆降低约 50%

微软研发的 MicroLED 数据中心网络系统通过数千个并行通道传输数据,比主流激光光缆约节省 50% 能耗,同时支持 AI 和云服务的大规模数据流。

研究 AI 摘要 · 单一来源
@Microsoft 阅读 →

英伟达 GTC 主题演讲:黄仁勋描绘 AI 工厂、Agent AI 和物理 AI 愿景

英伟达 GTC 大会主题演讲中,黄仁勋阐述了 AI 工厂的兴起、Agent AI 系统及驱动机器人和工业的物理 AI,以及新一代加速计算平台。

机器人 AI 摘要 · 单一来源
@nvidia 阅读 →

Runway:推出不存在的产品广告创意大赛,最高奖金 10 万美元

Runway 推出 Big Ad Contest,参赛者可从 7 个创意简报中选择,为虚构产品制作广告,无客户限制,为期两周,最高奖金 10 万美元。

产品发布 AI 摘要 · 单一来源
@runwayml 阅读 →

Replit:启动 Agent 4 内容挑战赛,总奖金 2 万美元

Replit 推出为期 4 周的 Agent 4 内容挑战赛,每周评选一位获胜者,参赛者需构建作品并拍摄分享,总奖金池 2 万美元。

产品发布 AI 摘要 · 单一来源
@Replit 阅读 →

Ollama:MiniMax-M2.7 模型上线 Ollama 云端,专为编程和 Agent 任务设计

MiniMax-M2.7 现可通过 Ollama 云端使用,专注编程和 Agent 任务,支持在 Claude Code 和 OpenClaw 中直接调用。

产品发布 AI 摘要 · 单一来源
@ollama 阅读 →

回忆 GTC 2015,黄仁勋早在十年前就预见深度学习是下一个大事件

Karpathy 分享黄仁勋签名照背后故事,回忆 2015 年 GTC 上黄仁勋向游戏和科学计算观众宣告深度学习将改变一切,并引用了他的博士论文作为案例。

大模型 AI 摘要 · 单一来源
@karpathy 阅读 →

Perplexity:Comet iOS 版本正式上线 App Store

Perplexity 宣布 AI 浏览器 Comet 的 iOS 版本正式登陆 App Store,用户可即刻下载使用。Comet 此前已上线企业版,此次移动端版本的发布进一步扩展了其多端覆盖能力。

产品发布 AI 摘要 · 单一来源
@perplexity_ai 阅读 →

Ollama:NVIDIA Nemotron 3 Nano 4B 模型上线

Ollama 宣布 NVIDIA Nemotron 3 Nano 4B 模型现已可通过 Ollama 运行。该模型是 Nemotron 家族新成员,专为资源受限硬件上的 Agent 构建与运行场景设计,可与 Pi 轻量级 Agent 运行时配合使用。

大模型 AI 摘要 · 单一来源
@ollama 阅读 →