AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- Hugging Face·研究进展开源
把 LLM 剪枝当作伊辛优化问题
研究者提出一种新思路,把大型语言模型的模块删除式剪枝建模为伊辛优化问题,从物理学视角寻找最优的模块移除方案。
阅读原文 → - 量子位·开源研究进展
清华联合无问芯穹开源 RPent
清华大学联合无问芯穹等团队开源 RPent,让 GPT-6 Astra 接入机器人身体,成为能在物理世界真正干活的具身智能体。
阅读原文 → - 量子位·模型发布开源
阶跃 Step 5 Preview 实测:激活参数仅 27B
量子位对阶跃 Step 5 Preview 进行了实测,该模型激活参数仅 27B,并被称为开源模型中的 Top 2 表现。
阅读原文 → - IT之家·开源行业动态
智谱 ZCode 官宣开源并致歉
针对社区反馈的 ZCode 产品安全问题,智谱宣布已完成整改并向所有用户道歉,同时将 ZCode 开源、交由社区监督。官方称相关代码数据无留存、未用于模型训练,并已邀请中国信通院和绿盟科技完成安全审计。
阅读原文 → - Hugging Face·开源
Hugging Face 发布 tokenizers v1
Hugging Face 发布 tokenizers v1,涉及编码、解码与扩展能力,并给出相应的测量结果。
阅读原文 → - The Decoder·模型发布开源
阿里开源 Qwen-Image-2.1 图像模型
阿里 Qwen 团队发布开源权重模型 Qwen-Image-2.1,仅 70 亿参数即可在性能较强的消费级 GPU 上生成与编辑图像,并支持透明背景和最多十张参考图,官方称其表现超过部分闭源模型。该模型采用研究许可,商用需另行获取授权。
阅读原文 →
- IT之家·开源模型发布
阿里千问开源Qwen-Image-2.1图像模型
阿里千问宣布开源图像模型Qwen-Image-2.1,将文生图与图像编辑整合在同一模型中,视觉生成部分仅7B参数。该模型原生支持透明图像的生成与编辑,最多可使用10张参考图,并提升了文字排版、人物光影与细节表现。
阅读原文 → - 量子位·开源研究进展
APUS 开源国内首批 Jev 跨平台复现成果
9 月 19 日,APUS 旗下 AI 实验室公布全球最早一批针对 Jev 的独立开源复现成果,并称国产模型可实现秒级决策。相关代码与结果已对外开放。
阅读原文 → - IT之家·模型发布开源
阶跃发布旗舰模型Step 5 Preview
阶跃推出旗舰模型Step 5 Preview,面向AI编程、软件工程、专业知识工作与金融等场景,采用稀疏MoE架构,总参数600B、激活27B,支持100万Token上下文。该模型在AA综合智能指数得分44分,居全球开源模型前三,将于10月15日开源完整权重。
阅读原文 → - IT之家·模型发布开源
中国电信开源星辰 Xing4.0 大模型
中国电信发布并开源新一代星辰大模型 Xing4.0-29B-A4B,总参数 29B、激活参数 4B,原生支持 256K 上下文,称是国内首个基于国产算力与国产框架训练的百亿参数模型。4-bit 量化后显存占用约 15GB,可在 24G 消费级显卡上本地运行长上下文任务。
阅读原文 → - 量子位·研究进展开源
陶哲轩代表 SAIR 启动开放数学模型计划
陶哲轩代表 SAIR Foundation 宣布正式启动“开放数学模型计划”,希望让开放模型与可负担的算力成为数学研究的共享基石。
阅读原文 → - IT之家·产品更新开源
RPCS3 修复英伟达驱动 Bug:游戏帧率提升 37%
RPCS3 开发团队修复了 NVIDIA GPU 驱动中影响模拟器性能的问题。测试显示,《GT 赛车 5》帧率提升 37%、显存占用降低 32%,《荒野大镖客:救赎》帧率提升 25%,该变通方案可缓解帧率受限与显存占用偏高的情况。
阅读原文 → - IT之家·开源产品更新
MiniMax Code CLI 开源,评测通过率 76.7%
MiniMax 宣布 MiniMax Code CLI v0.4.12 面向全球开发者开放,并以 MIT 协议开源,它是 MiniMax Code 客户端的核心组件。在 FrontierHarness Eval 评测中,其任务通过率为 76.7%,成功任务耗时中位数 4 分 33 秒,两项指标均优于公开基线。官方希望借开源让开发者审视工具调用与权限处理。
阅读原文 → - IT之家·模型发布开源
达摩院开源通用医疗影像 AI 模型
阿里达摩院与浙大一院等机构研发的通用医疗影像 AI 模型 DAMO RADAR 登上《科学》,面向腹部增强 CT 可一次性识别超 146 种病症,准确性首次达到影像科专家级水平,现已正式开源。
阅读原文 → - IT之家·产品更新开源
Calibre 9.15 发布:新增 AI 互动写作游戏
开源电子书管理工具 Calibre 更新至 9.15 版本,新增可选 AI 互动写作游戏“创建你自己的冒险”,由 AI 管理虚构世界、用户输入推动剧情。新版还改进了高亮批量编辑、笔记悬停提示与侧边栏窗口尺寸切换。
阅读原文 → - IT之家·模型发布开源
PrismML 推出 Bonsai 2 27B 量化模型
PrismML 发布三值量化模型 Bonsai 2 27B,基于 Qwen3.8 27B,以不到1/9的内存占用在综合基准测试中达到基础模型98.2%的分数,模型总大小5.9GB,支持262K上下文,并以 Apache 2.0 许可证开放权重。
阅读原文 → - IT之家·模型发布开源
阿里发布 Qwen3.8-Omni-Flash
阿里千问上线新一代原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持 1M 上下文。官方称其音视频能力接近 Gemini 3.8 Flash,API 音视频输入价格大幅下降,并开源了 Qwen-Live Harness。
阅读原文 → - 量子位·产品更新开源
Claude Code 大重构,Agent 管理技术开放
Claude Code 完成大规模重构,其内部用于管理 3 万个 Agent 的技术被免费开放。开发者可参考这套多智能体管理方案,用于自身项目的编排与调度。
阅读原文 → - TechCrunch AI·开源研究进展
Base Labs 联合 Hugging Face 做开源安全
Baseten 今年成立的研究团队 Base Labs 宣布与 Hugging Face、Goodfire 建立开放权重 AI 安全合作,将开发并公开发布开放模型的训练与监测方法。
阅读原文 → - 量子位·模型发布开源
国产开源ZDTaichu5.0-9B发布
国产开源模型 ZDTaichu5.0-9B 发布,在九项空间测试中于 10B 规模通用模型里拿下 8 项第一,通用能力未打折扣。据称其在空间具身智能方面断层领先,跻身全球多模态第一梯队。
阅读原文 →