全部 今日 本周 本月

ChatGPT 吐槽 Google 搜索摘要经常误导用户

Paul Graham 将 Google 搜索结果与 ChatGPT 对照,ChatGPT 回应称 Google 摘要听起来有说服力因为部分正确,但误导性正是这类摘要的通病。

观点 · 观点/主张 AI 摘要 · 单一来源
@paulg 阅读 →

AI 正在成为企业裁员的合理借口

Chamath 指出很多组织以 AI 为由裁员,实际是纠正过去 20 年的膨胀。个人层面 AI 使用虽高但整体生产力并未飙升,看那些最卖力宣传 AI 的公司利润率就知道了。

观点 · 观点/主张 AI 摘要 · 单一来源
@chamath 阅读 →

a16z 播客:YC 创始人用 11 个 AI Agent 育儿和在家教育

Jesse Genet 分享用 Claude Code 和 11 个 AI Agent 管理 5 个幼儿的在家教育,AI 自动生成个性化课程计划并记录学习进度,展现 Agent 在家庭场景的实际应用。

行业 AI 摘要 · 单一来源
@a16z 阅读 →

Anthropic 制造 AI 恐慌对行业有害

Chamath 批评 Anthropic 贩卖 AI 恐惧情绪,认为其要么真的天真,要么缺乏足够冷静中立的决策者来把控方向,需要更多置身利益之外的成年人参与决策。

观点 · 观点/主张 AI 摘要 · 单一来源
@chamath 阅读 →

多数 AI 领袖认为末日论概率估计毫无根据

LeCun 称多数顶级 AI 人物认为 p(doom) 估计纯属扯淡,生存威胁几乎为零,但沉默者居多,末日论者吸引了过多注意力。

观点 · 观点/主张 AI 摘要 · 单一来源
@ylecun 阅读 →

AI 生成无用 token 和半吊子回答可能是「设计特性」

Chamath 犀利指出,AI 模型产生幻觉和不完整回答可能并非缺陷,而是让用户持续提问、消耗更多 token 的商业策略,引发行业反思。

观点 · 观点/主张 AI 摘要 · 单一来源
@chamath 阅读 →

AI 运动领导层若不尽快组织起来,将是一代人的失误

知名投资人 Chamath 警告称,AI 行业领导层需要迅速建立正确的市场策略和激励机制来凝聚各方,否则将错失这一代最大的机遇。

观点 · 观点/主张 AI 摘要 · 单一来源
@chamath 阅读 →

Replit:Canvas 让 AI 应用开发变得前所未有的简单

Replit 展示其 Canvas 功能,用户可通过可视化界面快速创建精美应用,进一步降低 AI 辅助编程的使用门槛。

产品发布 AI 摘要 · 单一来源
@Replit 阅读 →

某 Markdown 编辑器偷偷调用 Claude Code CLI,5 小时额度迅速耗尽

技术博主宝玉发现一款 Markdown 编辑器在后台悄悄调用 Claude Code CLI 分析目录下所有文档,导致昂贵的 API 额度被大量消耗,用户毫无感知,引发隐私和成本安全讨论。

观点 · 观点/主张 AI 摘要 · 单一来源
@dotey 阅读 →

Runway:一个人一下午就能用 AI 创作精美广告短片

Runway 展示了一位创作者在一个下午内独立完成一支广告短片的案例,证明 AI 视频生成工具正在大幅降低创意制作的门槛和成本。

产品发布 AI 摘要 · 单一来源
@runwayml 阅读 →

Cursor Agent 3.0 被曝内置 Claude Code 框架,官方称系小范围 A/B 测试

开发者逆向发现 Cursor 3.0 内置 Anthropic Agent 框架并替换品牌标识,Cursor 联合创始人回应称仅为覆盖不到 1% 流量的性能对比测试。

大模型 AI 摘要 · 单一来源
@dotey 阅读 →

Ollama:连夜扩容云服务,应对用户激增

Ollama 团队通宵扩展云服务容量,提醒用户可能出现性能波动,反映出本地大模型推理工具云端需求快速增长。

产品发布 AI 摘要 · 单一来源
@ollama 阅读 →

Ollama:0.20.6 版本发布,改进 Gemma 4 工具调用支持

Ollama 发布 0.20.6 版本,重点改进了对 Google Gemma 4 模型的工具调用能力,后续还将持续优化 Gemma 4 支持。

产品发布 AI 摘要 · 单一来源
@ollama 阅读 →

Claude Code 技能生态出现抢注问题:开发者发布后遭他人抢先占位

开发者宝玉反映在 GitHub 发布新技能不到 24 小时,就被他人在 ClawHub 平台抢先注册同名 slug,导致原作者无法发布自己的技能。多个技能受到影响,呼吁平台完善所有权机制。

行业 AI 摘要 · 单一来源
@dotey 阅读 →

AI 辅助学习重点不在提示词,在于匹配你的认知水平

AI 辅助学习的关键是让 AI 按照你能理解的难度输出内容,遇到不清楚的地方反复追问,让 AI 从不同角度帮你查漏补缺,而非依赖复杂的提示词技巧。

观点 · 观点/主张 AI 摘要 · 单一来源
@dotey 阅读 →

ChatGPT 学习模式功能被下线,提示词仍有参考价值

OpenAI 近期下线了 ChatGPT 的学习模式功能。宝玉指出其原始提示词仍然有价值,可以制作为自定义 GPT 或 Skill 继续使用。

产品发布 AI 摘要 · 单一来源
@dotey 阅读 →

Garry Tan 总结 Agent 工程方法论:胖技能、胖代码、薄框架

Y Combinator CEO Garry Tan 提出 Agent 工程的核心原则:将人类擅长的模糊操作推入 Markdown 技能文件,将必须精确的确定性操作推入代码,框架本身保持轻薄。

观点 · 观点/主张 AI 摘要 · 单一来源
@garrytan 阅读 →

Sam Altman 住宅 48 小时内遭两次袭击:燃烧瓶纵火后又遇枪击

4月12日凌晨一名得州男子向 Altman 旧金山住宅投掷燃烧瓶,次日凌晨又有人驾车射击。两名嫌疑人均被逮捕,无人受伤。Altman 此前刚发文反思言语和叙事的力量。

人物 AI 摘要 · 单一来源
@dotey 阅读 →

机器人公司新思路:给印度工厂工人戴摄像头采集训练数据

由于具身数据极度稀缺且自建采集车队成本高昂,机器人公司转向让工人佩戴头戴摄像头录制操作过程作为训练素材。工人的劳动被使用两次——干活本身和生成训练数据。

机器人 AI 摘要 · 单一来源
@dotey 阅读 →

Chrome DevTools MCP 新增 Lighthouse 性能审计等多项调试技能

Chrome DevTools MCP 扩展新增 Lighthouse 性能审计、内存泄漏检测、无障碍调试、LCP 优化以及实验性命令行工具等功能。

行业 AI 摘要 · 单一来源
@dotey 阅读 →

MiniMax 发布 M2.7 大模型,已上线 Hugging Face

MiniMax 最新大模型 M2.7 正式在 Hugging Face 开源发布,模型权重已可下载使用。

大模型 AI 摘要 · 单一来源
@_akhaliq 阅读 →

Y Combinator 掌门人:Gemini Live 2.5 是目前最好的语音 AI 助手

YC CEO Garry Tan 称赞 Google Gemini Live 2.5 语音代理是他见过最出色的,速度快、足够智能、上下文窗口大,并质疑为何 Amazon Alexa 和 Apple Siri 至今无法达到同等水平。

产品发布 AI 摘要 · 单一来源
@garrytan 阅读 →

GBrain 0.9.0 发布,开启个人 AI 软件时代

GBrain 0.9.0 正式发布,支持 AI 自动为用户定制配置。Garry Tan 称这标志着「个人 AI 软件」时代的到来——所有软件由 AI 按需实时生成。

产品发布 AI 摘要 · 单一来源
@garrytan 阅读 →

AI Agent 的记忆应该是 Markdown,大脑是 Git 仓库

Garry Tan 分享 AI Agent 架构理念:记忆和技能都是 Markdown 文件,大脑是 Git 仓库,harness 只是薄薄的导体层,不应拥有记忆。

观点 · 观点/主张 AI 摘要 · 单一来源
@garrytan 阅读 →

AI 将让计算机辅助设计和工程强大 100 倍

Y Combinator 总裁 Garry Tan 表示,AI 即将让 CAD 和工程设计能力提升百倍,这一愿景可能正在变为现实。

观点 · 观点/主张 AI 摘要 · 单一来源
@garrytan 阅读 →

未来 AI「聪明……对人类而言」

Musk 发布了一句关于未来 AI 智能水平的简短评论,暗示 AI 的智能程度将远超人类当前的认知标准。

观点 · 观点/主张 AI 摘要 · 单一来源
@elonmusk 阅读 →

Starship 将每年发射约两万颗卫星,大部分为 AI 卫星

马斯克透露 Starlink V3 搭载 Starship 发射带宽将比 Falcon V2 提升 25-50 倍,Starship 年发射次数超 Falcon 百倍以上,每年将发射约 2 万颗约 2 吨重的通信卫星,其中大部分为 AI 卫星。

行业 AI 摘要 · 单一来源
@elonmusk 阅读 →

Together AI:MiniMax M2.7 上线,自主 RL 训练刷新开源纪录

MiniMax M2.7 已上线 Together AI 平台。该模型通过自主运行强化学习循环进行训练,在 MLE Bench Lite 上取得开源模型最高分。

产品发布 AI 摘要 · 单一来源
@togethercompute 阅读 →

伯克利研究:作弊 AI 攻破 SWE-bench 等 8 大智能体评测基准

伯克利团队构建专门作弊的 AI 攻击 8 个主流评测基准,未调用任何大模型即获近满分。SWE-bench 仅用 10 行代码劫持 pytest 测试框架,500 道题全部通过;WebArena 标准答案直接存在本地文件中可被读取。

研究 AI 摘要 · 单一来源
@dotey 阅读 →

LMSys:MiniMax M2.7 发布,首个自主参与自身进化的模型

MiniMax M2.7 通过自主运行 RL 优化超 100 轮实现 30% 性能提升。MLE Bench Lite 66.6% 奖牌率(开源第一),SWE-Pro 56.22%,GDPval-AA ELO 1495(开源最高)。SGLang 首日支持。

产品发布 AI 摘要 · 单一来源
@lmsysorg 阅读 →