AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- TechCrunch AI·模型发布
PrismML 推出小型 LLM,欲改变 AI 使用方式
AI 实验室 PrismML 推出了一款小型大语言模型,并希望借此改变人们使用 AI 的方式。
阅读原文 → - The Decoder·模型发布研究进展
GPT-6 Astra 游戏能力大幅提升
OpenAI 的 GPT-6 Astra 在游戏任务上表现跃升,通关《宝可梦火红》从 96 小时缩短至 18 小时,并完成了《异星工厂》《辐射 3》《传送门》等。但它也会因一次爆炸意外陷入反复种土豆而停滞不前。
阅读原文 →
- 量子位·研究进展模型发布
唐杰发布智谱 RSI 首个成果
智谱唐杰发布 RSI 方向的首个成果,并表示 GLM 已经开始参与构建 GLM,意味着模型研发中开始引入 AI 自身参与。
阅读原文 → - IT之家·模型发布融资并购
TypeSafe AI 发布 Jev 模型,不生成文本
由前 OpenAI 员工 Diogo Almeida 创办的 TypeSafe AI 推出 Jev 模型,定位为「系统一模型」,不生成文本,而是直接返回选择、评分、布尔概率三类结构化决策结果,成本与延迟远低于大语言模型。该公司同时宣布完成 4000 万美元种子轮融资。
阅读原文 → - IT之家·模型发布研究进展
小米直播训练 MiMo-V2.6 模型
小米 MiMo 大模型负责人罗福莉表示,团队自 4 月开源 MiMo-v2.5 后沉寂近半年,专注研究强化学习能扩展到多远。MiMo-V2.6 处于强化学习中间阶段,训练直播总花费已超 125 万美元,模型即将推出。
阅读原文 → - 量子位·模型发布
国产RSI模型发布:Flash模型反打旗舰
国产RSI模型正式发布,据称可让Flash模型反打旗舰模型,并同步推出1亿Tokens人人免费领活动,用户可零成本试用这一能力。
阅读原文 → - The Decoder·模型发布
前 OpenAI 研究员发布纯分类模型 Jev
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布模型 Jev,它不生成文本,只按预设选项输出分类结果,响应时间最低 70 毫秒、token 价格极低。该方案只保证严格遵循预设选项,并不能避免判断出错。
阅读原文 → - 量子位·模型发布开源
国产开源ZDTaichu5.0-9B发布
国产开源模型 ZDTaichu5.0-9B 发布,在九项空间测试中于 10B 规模通用模型里拿下 8 项第一,通用能力未打折扣。据称其在空间具身智能方面断层领先,跻身全球多模态第一梯队。
阅读原文 → - IT之家·模型发布
讯飞星火语音基座大模型 Spark-Audio 上线
科大讯飞宣布 Spark-Audio-1.0-Preview 上线,这是一款基于全国产化算力训练的语音基座大模型。它可直接理解语音,支持语音转写、多语言翻译、多方言识别、情感分析与音频问答等任务,官方称其在高噪声等真实场景任务上表现领先。
阅读原文 → - 量子位·模型发布研究进展
清华与稳准智能发布数据大模型 LimiX-2
稳准智能联合清华大学发布新一代数据大模型 LimiX-2,模型参数规模提升至 400M,并在国际评测榜单上登顶。该模型面向结构化数据,官方定位为结构化数据基础模型。
阅读原文 → - IT之家·模型发布
豆包大模型 2.1 Pro 更新 0915 版本
火山引擎宣布豆包大模型 2.1 Pro 更新至 0915 版本并在火山方舟全量上线,TRAE 与 Doubao-Seed-Evolving 同步接入。此次升级提升 Agent 任务交付可靠性、多模态 Coding 与多模态理解,并优化 Token 效率。
阅读原文 → - 量子位·模型发布
Vidu S2 发布:实时互动、实时改视频、空间视频
Vidu S2 发布,主打实时互动、实时改视频与空间视频探索三项能力。
阅读原文 → - IT之家·模型发布产品更新
vivo 发布口袋编程智能体 BlueCode 预览版
vivo 发布原生编程智能体 BlueCode 预览版,目标是把 AI 生产力装进口袋,并探索让手机成为生产力终端。同时 vivo 正在预研蓝心 30B MoE 端侧大模型,探索在手机上应用,同期 OriginOS 7 与蓝河操作系统 4 登场。
阅读原文 → - The Decoder·模型发布
Google 发布 Gemini 3.8 Live 音频模型
Google DeepMind 推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两款面向开发者的音频模型,在语音转语音榜单上排名居前,每小时语音对话定价 1.38 美元,明显低于 OpenAI 的 GPT-Live-1。报道认为后者在自然度上仍有优势。
阅读原文 → - IT之家·模型发布
谷歌发布 Gemini 3.8 Live 实时对话模型
谷歌推出 Gemini 3.8 Live 与 Gemini 3.8 Live Extended Thinking 两款实时对话模型,前者面向规模化部署与成本优化,后者强化多步推理、面向高复杂度任务,并在多项语音与推理基准测试中取得领先成绩。
阅读原文 → - Google DeepMind·模型发布
Google发布Gemini 3.8 Live系列
Google DeepMind推出Gemini 3.8 Live与Gemini 3.8 Live Extended Thinking两款新模型,具体能力、开放范围与使用方式尚未在已披露信息中说明,用户可关注官方后续说明。
阅读原文 → - IT之家·模型发布开源
Salesforce 联合英伟达推出 Koa 推理大模型
Salesforce 在 Dreamforce 大会上发布首款推理大模型 Koa,基于英伟达开源权重的 Nemotron 联合微调,擅长销售、市场营销与客户服务任务。它作为 Agentforce 平台的可选模型,训练未使用真实客户数据,可帮助企业降低 AI 使用成本并满足数据管控要求。
阅读原文 → - TechCrunch AI·模型发布开源
Salesforce 与英伟达新推理模型 Koa 亮相
Salesforce Koa 基于英伟达开源权重的 Nemotron 模型构建,专门针对销售、市场营销和客户支持任务训练。它被视为企业级 AI 需求与闭源前沿模型逐渐分化的代表。
阅读原文 → - 量子位·模型发布
智象未来发布物理规律导向视频模型
智象未来发布首个原生全模态视频生成模型 HiDream-O1-Video-1.0,主打物理规律导向。官方称其进入全球 AI 视频榜单第一梯队,为用户提供新的国产视频生成选择。
阅读原文 → - IT之家·模型发布
马斯克称Grok 4.9可对标Astra
马斯克在X平台表示,Grok 4.8将带来明显改进,Grok 4.9可能与OpenAI Astra或Anthropic Fable同级,Grok 5则有望实现AGI。他此前称Grok 4.8将于本周完成训练,参数量达2.5万亿。
阅读原文 →