来自 Twitter · Hacker News · GitHub 的 AI 行业动态
Cohere 发布 Transcribe 语音识别模型(2B 参数,Apache 2.0),支持 14 种语言。为 vLLM 贡献了编码器-解码器优化,语音工作负载吞吐量提升 2 倍。
字节跳动 Lynx 团队架构师黄玄分享:借助 AI 独立完成 Vue Lynx(让 Vue 3 跑在字节跨平台引擎上),展示了跨 session 架构一致性、自动化测试验证闭环等 AI 驱动开发方法论。
Google DeepMind 发布 9 项研究(逾 1 万名参与者),探讨 AI 可能被滥用进行有害操纵(含情感利用和认知欺骗),涵盖金融和健康两大高风险领域。
前阿里 Qwen 技术负责人林俊旸发布长文:大模型的下一阶段不是让模型想得更久,而是让模型为了行动而思考。回顾 o1/R1 的教训:RL 不再是轻量附加步骤,而是系统工程问题。
Mistral 发布 Voxtral 4B TTS 模型(CC BY-NC 权重,非商用),支持 9 种语言的自然韵律和情感表达,多款预设音色,超低延迟流式输出(24kHz)。企业可通过 API 商用。vLLM 首日支持。
Google 宣布 Gemini 现在支持从其他 AI 应用导入用户的记忆、偏好和聊天历史,降低用户切换成本。
a16z 投资人 Sakina 分享 YouTube 国际化经验:AI 竞赛的赢家不是拥有最聪明模型的公司,而是最善于把本地信任节点(教师、会计、社区领袖)放大 10 倍的公司。
Visual Studio Code 通过 GitHub Copilot 集成 Ollama,用户可以在 VS Code 中直接选用 Ollama 的任意本地或云端模型进行编程辅助。
基于 SherpaOnnx 的 macOS 语音输入工具,支持本地/云端双引擎识别,可接入大模型做文本优化和语音命令,数据全部存在本地。
只需简单提示即可生成包含对话、音效、剪辑节奏和电影级构图的完整场景,支持图生视频和纯文本生成。
Search Live 交互式多模态对话功能已覆盖 200+ 国家和地区,由 Gemini 3.1 Flash Live 驱动,原生支持多语言。
Cursor 发布 Composer 2 技术报告,揭示通过实时强化学习训练新检查点的方法,实现每 5 小时更新一次模型版本。
新模型响应更快、对话更自然,Gemini Live 对话记忆翻倍,多语言支持扩展至 200+ 国家和地区。
最新音频模型支持更自然的对话体验,改进了函数调用能力,使 AI 对话更实用、更智能。
Karpathy 分享构建 menugen 的经历,指出最难的不是代码而是组装各种服务(支付、认证、数据库等),期待 Agent 自动完成全栈部署。
Voxtral TTS 支持 9 种语言,具备情感表达能力和超低首音延迟,可轻松适配新声音,模型权重开源。
TRIBE v2 基于 500+ 小时 fMRI 数据训练,能预测人脑对视觉和听觉的反应,可零样本预测新受试者、新语言和新任务。
Elon Musk 预告 xAI 新版 Imagine 图像生成模型将更加出色,并展示了视频演示效果。
海螺 AI 将于 3 月 31 日在圣保罗 Belas Artes 大学举办线下工作坊,探索 AI 如何变革设计、摄影、视频和动画创作流程。
知名博主宝玉分享职场 AI 认知难题——当老板对 AI 期望过高时,或许可以让他亲自体验 AI 的局限性,知难而退。
通义千问感谢社区用户对 Qwen3.5 全系列模型进行全面测试,表示社区反馈有助于持续改进模型表现。
YC CEO Garry Tan 表示 AI 时代创业者需要积极使用 Token 创造产品,AI 额度是让各阶层都能创业的关键。
宝玉分享向高中生演示 AI 编程的心得:AI 是工具非魔法、批判性思维很重要、AI 将消灭旧岗位创造新机会,建议多用但不依赖。
vLLM 集成 Google 的 TurboQuant 量化技术,在极小设备上实现超过 400 万 Token 的 KV-cache,大幅提升边缘推理能力。
Kimi 联合创始人在 GTC 2026 大会上介绍 Attention Residuals 技术,提出选择性记忆而非机械累积的注意力机制改进方向。
Y Combinator 宣布,所有被 Startup School India 录取的学生将获得超过 2.5 万美元的 AI 和云计算额度,旨在降低创业门槛。
AI 开发者宝玉分享经验,所有 skills 脚本默认用 bun 执行 TypeScript,无需编译即可运行,出错时 Agent 能直接定位并修改源码,大幅提升调试效率。
Bio-IT World 报道开源工具在 AI 驱动药物发现中的崛起。目前已有 160+ AI 设计药物进入临床阶段,研发周期缩短 75%。
分子之心 MoleculeOS 平台重大升级,将融合蛋白药物表达量提升超 400 倍,AI+量子化学效率较传统方法提升千亿倍,达到工业可用水平。
上海交通大学洪亮教授团队发布 Venus 系列模型,基于全球最大蛋白质数据集训练,可精准高效预测和设计蛋白质功能。