来自 Twitter · Hacker News · GitHub 的 AI 行业动态
Paul Graham 将 Google 搜索结果与 ChatGPT 对照,ChatGPT 回应称 Google 摘要听起来有说服力因为部分正确,但误导性正是这类摘要的通病。
Chamath 指出很多组织以 AI 为由裁员,实际是纠正过去 20 年的膨胀。个人层面 AI 使用虽高但整体生产力并未飙升,看那些最卖力宣传 AI 的公司利润率就知道了。
Jesse Genet 分享用 Claude Code 和 11 个 AI Agent 管理 5 个幼儿的在家教育,AI 自动生成个性化课程计划并记录学习进度,展现 Agent 在家庭场景的实际应用。
Chamath 批评 Anthropic 贩卖 AI 恐惧情绪,认为其要么真的天真,要么缺乏足够冷静中立的决策者来把控方向,需要更多置身利益之外的成年人参与决策。
LeCun 称多数顶级 AI 人物认为 p(doom) 估计纯属扯淡,生存威胁几乎为零,但沉默者居多,末日论者吸引了过多注意力。
Chamath 犀利指出,AI 模型产生幻觉和不完整回答可能并非缺陷,而是让用户持续提问、消耗更多 token 的商业策略,引发行业反思。
知名投资人 Chamath 警告称,AI 行业领导层需要迅速建立正确的市场策略和激励机制来凝聚各方,否则将错失这一代最大的机遇。
Replit 展示其 Canvas 功能,用户可通过可视化界面快速创建精美应用,进一步降低 AI 辅助编程的使用门槛。
技术博主宝玉发现一款 Markdown 编辑器在后台悄悄调用 Claude Code CLI 分析目录下所有文档,导致昂贵的 API 额度被大量消耗,用户毫无感知,引发隐私和成本安全讨论。
Runway 展示了一位创作者在一个下午内独立完成一支广告短片的案例,证明 AI 视频生成工具正在大幅降低创意制作的门槛和成本。
开发者逆向发现 Cursor 3.0 内置 Anthropic Agent 框架并替换品牌标识,Cursor 联合创始人回应称仅为覆盖不到 1% 流量的性能对比测试。
Ollama 团队通宵扩展云服务容量,提醒用户可能出现性能波动,反映出本地大模型推理工具云端需求快速增长。
Ollama 发布 0.20.6 版本,重点改进了对 Google Gemma 4 模型的工具调用能力,后续还将持续优化 Gemma 4 支持。
开发者宝玉反映在 GitHub 发布新技能不到 24 小时,就被他人在 ClawHub 平台抢先注册同名 slug,导致原作者无法发布自己的技能。多个技能受到影响,呼吁平台完善所有权机制。
AI 辅助学习的关键是让 AI 按照你能理解的难度输出内容,遇到不清楚的地方反复追问,让 AI 从不同角度帮你查漏补缺,而非依赖复杂的提示词技巧。
OpenAI 近期下线了 ChatGPT 的学习模式功能。宝玉指出其原始提示词仍然有价值,可以制作为自定义 GPT 或 Skill 继续使用。
Y Combinator CEO Garry Tan 提出 Agent 工程的核心原则:将人类擅长的模糊操作推入 Markdown 技能文件,将必须精确的确定性操作推入代码,框架本身保持轻薄。
4月12日凌晨一名得州男子向 Altman 旧金山住宅投掷燃烧瓶,次日凌晨又有人驾车射击。两名嫌疑人均被逮捕,无人受伤。Altman 此前刚发文反思言语和叙事的力量。
由于具身数据极度稀缺且自建采集车队成本高昂,机器人公司转向让工人佩戴头戴摄像头录制操作过程作为训练素材。工人的劳动被使用两次——干活本身和生成训练数据。
Chrome DevTools MCP 扩展新增 Lighthouse 性能审计、内存泄漏检测、无障碍调试、LCP 优化以及实验性命令行工具等功能。
MiniMax 最新大模型 M2.7 正式在 Hugging Face 开源发布,模型权重已可下载使用。
YC CEO Garry Tan 称赞 Google Gemini Live 2.5 语音代理是他见过最出色的,速度快、足够智能、上下文窗口大,并质疑为何 Amazon Alexa 和 Apple Siri 至今无法达到同等水平。
GBrain 0.9.0 正式发布,支持 AI 自动为用户定制配置。Garry Tan 称这标志着「个人 AI 软件」时代的到来——所有软件由 AI 按需实时生成。
Garry Tan 分享 AI Agent 架构理念:记忆和技能都是 Markdown 文件,大脑是 Git 仓库,harness 只是薄薄的导体层,不应拥有记忆。
Y Combinator 总裁 Garry Tan 表示,AI 即将让 CAD 和工程设计能力提升百倍,这一愿景可能正在变为现实。
Musk 发布了一句关于未来 AI 智能水平的简短评论,暗示 AI 的智能程度将远超人类当前的认知标准。
马斯克透露 Starlink V3 搭载 Starship 发射带宽将比 Falcon V2 提升 25-50 倍,Starship 年发射次数超 Falcon 百倍以上,每年将发射约 2 万颗约 2 吨重的通信卫星,其中大部分为 AI 卫星。
MiniMax M2.7 已上线 Together AI 平台。该模型通过自主运行强化学习循环进行训练,在 MLE Bench Lite 上取得开源模型最高分。
伯克利团队构建专门作弊的 AI 攻击 8 个主流评测基准,未调用任何大模型即获近满分。SWE-bench 仅用 10 行代码劫持 pytest 测试框架,500 道题全部通过;WebArena 标准答案直接存在本地文件中可被读取。
MiniMax M2.7 通过自主运行 RL 优化超 100 轮实现 30% 性能提升。MLE Bench Lite 66.6% 奖牌率(开源第一),SWE-Pro 56.22%,GDPval-AA ELO 1495(开源最高)。SGLang 首日支持。