全部 今日 本周 本月

Cohere 开源 Transcribe:2B 语音识别模型,Apache 2.0,14 种语言

Cohere 发布 Transcribe 语音识别模型(2B 参数,Apache 2.0),支持 14 种语言。为 vLLM 贡献了编码器-解码器优化,语音工作负载吞吐量提升 2 倍。

大模型 AI 摘要 · 单一来源
@vllm_project 阅读 →

黄玄:两周用 AI 独立完成 Vue Lynx,完整方法论

字节跳动 Lynx 团队架构师黄玄分享:借助 AI 独立完成 Vue Lynx(让 Vue 3 跑在字节跨平台引擎上),展示了跨 session 架构一致性、自动化测试验证闭环等 AI 驱动开发方法论。

行业 AI 摘要 · 单一来源
@dotey 阅读 →

Google DeepMind 研究:AI 有害操纵风险上升,覆盖情感利用与认知欺骗

Google DeepMind 发布 9 项研究(逾 1 万名参与者),探讨 AI 可能被滥用进行有害操纵(含情感利用和认知欺骗),涵盖金融和健康两大高风险领域。

研究 AI 摘要 · 单一来源
@GoogleDeepMind 阅读 →

林俊旸离职后首文:从推理思维到智能体思维,大模型的下一个阶段

前阿里 Qwen 技术负责人林俊旸发布长文:大模型的下一阶段不是让模型想得更久,而是让模型为了行动而思考。回顾 o1/R1 的教训:RL 不再是轻量附加步骤,而是系统工程问题。

大模型 AI 摘要 · 单一来源
@dotey 阅读 →

Mistral 发布 Voxtral 4B TTS:9 种语言、20 种预设音色、企业级语音合成

Mistral 发布 Voxtral 4B TTS 模型(CC BY-NC 权重,非商用),支持 9 种语言的自然韵律和情感表达,多款预设音色,超低延迟流式输出(24kHz)。企业可通过 API 商用。vLLM 首日支持。

产品发布 AI 摘要 · 单一来源
@vllm_project 阅读 →

Google Gemini 支持从其他 AI 应用导入记忆、偏好和聊天历史

Google 宣布 Gemini 现在支持从其他 AI 应用导入用户的记忆、偏好和聊天历史,降低用户切换成本。

产品发布 AI 摘要 · 单一来源
@Google 阅读 →

a16z Sakina:AI 竞赛赢家不是最聪明的模型,而是最会让本地人变强的公司

a16z 投资人 Sakina 分享 YouTube 国际化经验:AI 竞赛的赢家不是拥有最聪明模型的公司,而是最善于把本地信任节点(教师、会计、社区领袖)放大 10 倍的公司。

观点 · 观点/主张 AI 摘要 · 单一来源
@a16z 阅读 →

VS Code 现在可以直接用 Ollama 本地模型了

Visual Studio Code 通过 GitHub Copilot 集成 Ollama,用户可以在 VS Code 中直接选用 Ollama 的任意本地或云端模型进行编程辅助。

产品发布 AI 摘要 · 单一来源
@ollama 阅读 →

开源推荐:Type4Me——Typeless 平替,本地语音输入+大模型后处理

基于 SherpaOnnx 的 macOS 语音输入工具,支持本地/云端双引擎识别,可接入大模型做文本优化和语音命令,数据全部存在本地。

产品发布 AI 摘要 · 单一来源
@dotey 阅读 →

Runway:推出 Multi-Shot App 多镜头视频生成应用

只需简单提示即可生成包含对话、音效、剪辑节奏和电影级构图的完整场景,支持图生视频和纯文本生成。

产品发布 AI 摘要 · 单一来源
@runwayml 阅读 →

Google:AI 搜索语音对话 Search Live 全球上线 200+ 国家

Search Live 交互式多模态对话功能已覆盖 200+ 国家和地区,由 Gemini 3.1 Flash Live 驱动,原生支持多语言。

产品发布 AI 摘要 · 单一来源
@Google 阅读 →

Cursor:公开 Composer 2 技术报告,每 5 小时迭代一次模型

Cursor 发布 Composer 2 技术报告,揭示通过实时强化学习训练新检查点的方法,实现每 5 小时更新一次模型版本。

产品发布 AI 摘要 · 单一来源
@cursor_ai 阅读 →

Google:Gemini 3.1 Flash Live 带来语音交互全面升级

新模型响应更快、对话更自然,Gemini Live 对话记忆翻倍,多语言支持扩展至 200+ 国家和地区。

产品发布 AI 摘要 · 单一来源
@Google 阅读 →

Google DeepMind:发布 Gemini 3.1 Flash Live 音频模型

最新音频模型支持更自然的对话体验,改进了函数调用能力,使 AI 对话更实用、更智能。

产品发布 AI 摘要 · 单一来源
@GoogleDeepMind 阅读 →

期待 AI Agent 能一句话完成从代码到部署的全流程

Karpathy 分享构建 menugen 的经历,指出最难的不是代码而是组装各种服务(支付、认证、数据库等),期待 Agent 自动完成全栈部署。

观点 · 观点/主张 AI 摘要 · 单一来源
@karpathy 阅读 →

Mistral AI:发布 Voxtral TTS 开源语音合成模型

Voxtral TTS 支持 9 种语言,具备情感表达能力和超低首音延迟,可轻松适配新声音,模型权重开源。

产品发布 AI 摘要 · 单一来源
@MistralAI 阅读 →

Meta AI:发布 TRIBE v2 三模态脑编码器基础模型

TRIBE v2 基于 500+ 小时 fMRI 数据训练,能预测人脑对视觉和听觉的反应,可零样本预测新受试者、新语言和新任务。

产品发布 AI 摘要 · 单一来源
@AIatMeta 阅读 →

xAI:新一代 Imagine 图像模型即将发布

Elon Musk 预告 xAI 新版 Imagine 图像生成模型将更加出色,并展示了视频演示效果。

大模型 AI 摘要 · 单一来源
@elonmusk 阅读 →

海螺 AI 联合巴西 Belas Artes 大学举办创意 AI 工作坊

海螺 AI 将于 3 月 31 日在圣保罗 Belas Artes 大学举办线下工作坊,探索 AI 如何变革设计、摄影、视频和动画创作流程。

活动 AI 摘要 · 单一来源
@Hailuo_AI 阅读 →

如何让老板理解「AI 是工具不是魔法」

知名博主宝玉分享职场 AI 认知难题——当老板对 AI 期望过高时,或许可以让他亲自体验 AI 的局限性,知难而退。

观点 · 观点/主张 AI 摘要 · 单一来源
@dotey 阅读 →

通义千问:Qwen3.5 全系列获社区测试认可

通义千问感谢社区用户对 Qwen3.5 全系列模型进行全面测试,表示社区反馈有助于持续改进模型表现。

大模型 AI 摘要 · 单一来源
@Alibaba_Qwen 阅读 →

AI 时代创业核心是大胆使用 Token,降低创业门槛

YC CEO Garry Tan 表示 AI 时代创业者需要积极使用 Token 创造产品,AI 额度是让各阶层都能创业的关键。

观点 · 观点/主张 AI 摘要 · 单一来源
@garrytan 阅读 →

给高中生演示 AI Coding 的三个核心建议

宝玉分享向高中生演示 AI 编程的心得:AI 是工具非魔法、批判性思维很重要、AI 将消灭旧岗位创造新机会,建议多用但不依赖。

观点 · 观点/主张 AI 摘要 · 单一来源
@dotey 阅读 →

vLLM:集成 Google TurboQuant 技术,USB 充电器大小设备可缓存 400 万+ Token

vLLM 集成 Google 的 TurboQuant 量化技术,在极小设备上实现超过 400 万 Token 的 KV-cache,大幅提升边缘推理能力。

大模型 AI 摘要 · 单一来源
@vllm_project 阅读 →

Kimi:GTC 大会发布 Attention Residuals 新架构

Kimi 联合创始人在 GTC 2026 大会上介绍 Attention Residuals 技术,提出选择性记忆而非机械累积的注意力机制改进方向。

研究 AI 摘要 · 单一来源
@Kimi_Moonshot 阅读 →

YC:印度 Startup School 录取学生可获 2.5 万美元 AI 及云服务额度

Y Combinator 宣布,所有被 Startup School India 录取的学生将获得超过 2.5 万美元的 AI 和云计算额度,旨在降低创业门槛。

行业 AI 摘要 · 单一来源
@ycombinator 阅读 →

Agent 时代开发首选 bun 执行 TypeScript

AI 开发者宝玉分享经验,所有 skills 脚本默认用 bun 执行 TypeScript,无需编译即可运行,出错时 Agent 能直接定位并修改源码,大幅提升调试效率。

观点 · 观点/主张 AI 摘要 · 单一来源
@dotey 阅读 →

开源 AI 药物发现崛起:Open Source Floats All Boats

Bio-IT World 报道开源工具在 AI 驱动药物发现中的崛起。目前已有 160+ AI 设计药物进入临床阶段,研发周期缩短 75%。

AI4Science AI 摘要 · 单一来源
@BioIT 阅读 →

分子之心 MoleculeOS 升级:融合蛋白药物表达量提升 400 倍

分子之心 MoleculeOS 平台重大升级,将融合蛋白药物表达量提升超 400 倍,AI+量子化学效率较传统方法提升千亿倍,达到工业可用水平。

AI4Science AI 摘要 · 单一来源
@分子之心 阅读 →

上海交大 Venus 模型:全球最大蛋白质数据集,精准预测蛋白质功能

上海交通大学洪亮教授团队发布 Venus 系列模型,基于全球最大蛋白质数据集训练,可精准高效预测和设计蛋白质功能。

AI4Science AI 摘要 · 单一来源
@上海交大 阅读 →