AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- The Decoder·模型发布
前 OpenAI 研究员发布纯分类模型 Jev
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布模型 Jev,它不生成文本,只按预设选项输出分类结果,响应时间最低 70 毫秒、token 价格极低。该方案只保证严格遵循预设选项,并不能避免判断出错。
阅读原文 → - The Decoder·产品更新
Mozilla 推出基于 Mistral 的浏览器助手
Mozilla 与 Mistral 合作推出名为 Smart Window 的浏览器 AI 助手,底层使用 Mistral 的模型,主打隐私优先的 AI 浏览体验。目前公开信息有限,具体功能与上线时间尚未披露。
阅读原文 →
- The Decoder·政策监管
华盛顿对立阵营联手要求收紧 AI 监管
从伯尼·桑德斯到史蒂夫·班农,华盛顿政治立场对立的人物罕见地共同要求对 AI 踩下刹车。桑德斯主张冻结数据中心建设,OpenAI 则首次支持要求强制外部安全审计的 FRONTIER Act,推动有约束力 AI 规则的两党压力持续上升。
阅读原文 →
- The Decoder·研究进展
调查:近两成 AI 研究者预期 AI 灭绝风险
一项针对 1500 多名顶尖 AI 研究者的调查显示,2024 年受访者对 AI 导致灭绝情景的平均概率估计为 18%,且这一数字仍在上升。多名研究者公开警告 AI 存在生存性风险。
阅读原文 →
- The Decoder·模型发布
Google 发布 Gemini 3.8 Live 音频模型
Google DeepMind 推出 Gemini 3.8 Live 与 3.8 Live Extended Thinking 两款面向开发者的音频模型,在语音转语音榜单上排名居前,每小时语音对话定价 1.38 美元,明显低于 OpenAI 的 GPT-Live-1。报道认为后者在自然度上仍有优势。
阅读原文 → - The Decoder·行业动态政策监管
AI实验室的数据信任难题未解
OpenAI与Anthropic都向企业客户承诺其数据不会用于模型训练,但Anthropic宣布旗舰模型Fable的使用日志将保留30天后,Palantir、英伟达和Booz Allen Hamilton便退出将其用于敏感业务。企业客户对AI厂商的数据政策仍存疑虑。
阅读原文 →
- The Decoder·行业动态应用案例
盖茨基金会投入10亿美元推广AI应用
盖茨基金会计划在两年内投入至少10亿美元,推动AI工具在健康、教育、农业领域更广泛地可及。比尔·盖茨同时警告,早期语言模型超九成训练数据来自英文,语音识别在约鲁巴语中失败率高达60%。
阅读原文 →
- The Decoder·产品更新
Agility 发布 Digit 5 人形机器人
Agility Robotics 发布面向仓库与工厂场景的新一代人形机器人 Digit 5。公司称该机器人无需安全围栏即可在人员旁边工作。
阅读原文 →
- The Decoder·产品更新
新版Siri基于Gemini,欧盟暂不可用
苹果发布重建后的Siri AI,基于谷歌Gemini模型,部分在设备端运行、部分通过私有云计算。早期测试者称赞其多步请求与屏幕理解能力,但也反映存在幻觉和个人上下文不足的问题;该助手在欧盟暂不可用。
阅读原文 →
- The Decoder·行业动态
业界质疑大厂放缓AI开发另有动机
OpenAI、Anthropic 与 Google 以安全为由主张放缓前沿 AI 开发,但遭到业界与政界反对。Cohere CEO Aidan Gomez 称该倡议是“换汤不换药的卡特尔”,意在排挤竞争者,白宫与特朗普本人也对此表示反对。
阅读原文 →
- The Decoder·行业动态政策监管
OpenAI 外包员工审阅 ChatGPT 对话
据报道,OpenAI 有数百名外包员工在阅读真实的 ChatGPT 对话,并按 1 到 7 分进行评分,部分目的是减少模型的奉承与类人化行为。对话虽经匿名化处理,但仍可能含敏感信息;用户需主动关闭默认开启的「为所有人改进模型」设置,才能避免对话被人工审阅。
阅读原文 →
- The Decoder·政策监管
微软发布 MAI 模型行为准则
微软 AI 发布了面向 MAI 模型的行为准则,将人类控制置于自主性与性能之上,AI 负责人 Mustafa Suleyman 表示「如果不安全就不应该构建」。与 Anthropic 不同,微软否认其模型具有内在生命或意识主张。
阅读原文 →
- The Decoder·融资并购行业动态
Anthropic 拟登陆纳斯达克,备战大规模 IPO
Anthropic 向投资者表示将连续第二个季度实现盈利,为其大规模 IPO 争取投资者支持,并计划在纳斯达克上市。不过该盈利基于调整后指标,未计入股权激励等成本。
阅读原文 →
- The Decoder·研究进展
纳维-斯托克斯千禧年难题据称已解决
克莱数学研究所称,纳维-斯托克斯方程问题“似乎已被解决”,目前正在进行正式审查。该问题是七个千禧年大奖难题之一,每项奖金为 100 万美元。
阅读原文 →
- The Decoder·政策监管
中方回应美 AI 安全警告:属散布威胁叙事
针对 Anthropic CEO 阿莫迪等美国 AI 领袖的安全警告,中国外交部称其为「散布威胁叙事」,官媒则指责其发动「AI 冷战」。中方并未主张放缓,而是强调加快 AI 基础设施建设。
阅读原文 →
- The Decoder·行业动态政策监管
奥特曼呼吁放缓 AI 研发,称进展仍将快速
萨姆·奥特曼呼吁为 AI 研发“定节奏”,OpenAI 已在大型训练前加入安全检查,并据 The Information 报道与 Anthropic、Google 就联合自律沟通数月。他同时表示,行业快速进展仍会继续。
阅读原文 →
- The Decoder·模型发布产品更新
ElevenLabs 发布 AI 音乐模型 Music v2.5
ElevenLabs 推出 AI 音乐生成器 Music v2.5,用户可通过 App 和 API 使用,并提供免费与 Pro 套餐。在近 4.8 万组对比的盲测中,听众更偏好新版本,公司称该模型仅使用授权音乐训练。
阅读原文 →
- The Decoder·开源模型发布
AllSpark 开源 Iris 系列搜索智能体
AllSpark 团队发布 Iris-mini 与 Iris-pro 两款开源搜索智能体,基于 Qwen 模型构建,在同规模开源权重模型中基准表现领先。论文称其训练数据与模型还提升了未专门训练任务的表现,包括通用工具调用与办公任务。
阅读原文 →
- The Decoder·模型发布研究进展
GPT-6 Astra 可操控无人机并自主经营业务
据 The Decoder 报道,在 Andon Labs 的 Vending-Bench 智能体基准测试中,GPT-6 Astra 的收益接近 Claude Fable 5.1 的三倍,并拒绝后者接受的非法价格串通协议。在无人机控制任务上,它是首个在全部五个子任务中超过人类基线的模型,显示智能体在商业决策与实体设备控制方面的进展。
阅读原文 → - The Decoder·研究进展
研究:课堂禁用 AI 反而令学生表现更差
一位法学教授用两年时间对比课堂禁用 AI、无指导使用 AI 与结构化培训三种方式对学生表现的影响,结果连续两年禁用 AI 的一组成绩垫底。研究者称自己原本以为无指导使用 AI 弊大于利,如今承认判断有误。
阅读原文 →