AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- NVIDIA Blog·模型发布产品更新
GPT-6 Astra Ultrafast 上线 OpenAI API
英伟达与 OpenAI 宣布,GPT-6 Astra Ultrafast 已在 OpenAI API 上线,并向符合条件的 ChatGPT Work 与 Codex 用户开放。该模式运行于 NVIDIA Blackwell GPU,借助推理优化,token 生成速度最高可达 Astra 标准模式的 8 倍。
阅读原文 →
- IT之家·模型发布产品更新
微软发布实时流式语音转写模型
微软推出首个实时流式语音转写模型 MAI-Transcribe-2-Streaming,支持 60 种语言与自动语言检测,可在讲话过程中持续输出文字。据 Artificial Analysis 测试,其最终词错误率 2.50%、最终延迟 0.13 秒,位居流式模型首位,开发者可通过 Microsoft Foundry 等渠道接入。
阅读原文 → - The Decoder·模型发布研究进展
Tavus 推出 Griffin 实时视频模型
Tavus 发布 Griffin,称其为首个「人类交互模型」,可在视频通话中实时处理面部表情、语调和手势。该公司的研究显示,48% 的参与者在通话一分钟后认为 Griffin 是真人,而此前系统最高仅为 2%。
阅读原文 →
- The Decoder·模型发布开源
Ideogram 4.5 支持图像局部编辑
Ideogram 推出新模型 Ideogram 4.5,可只编辑指定区域而保持图像其余部分不变。该模型原生支持 2K 分辨率,单张价格 0.8 美分起,Runway、Pika、Leonardo AI 等已接入,并计划推出开放权重版本。
阅读原文 → - TechCrunch AI·模型发布
亚马逊发布 Strands Decider 2B
亚马逊云科技旗下 Strand Labs 发布最新决策模型 Strands Decider 2B,属于类 Jeva 模型。当前各类决策模型正密集涌现,相关赛道竞争升温。
阅读原文 → - 量子位·模型发布
谷歌突然发布 Gemini 4 模型
谷歌发布 Gemini 4 模型,据称在 RSI 加持下性能超过 GPT 与 Opus,价格仅为 Astra 的一半。对用户而言,这意味着可以用更低成本获得更强的模型能力。
阅读原文 → - IT之家·模型发布行业动态
谷歌发布 Gemini 4 Argon 模型
谷歌向一小批安全合作伙伴开放旗舰模型 Gemini 4 Argon,称其在多项基准测试中得分靠前,后续将优先向付费订阅用户扩大开放。但部分内部员工质疑该模型在代码等实际任务中表现不佳,谷歌对相关说法表示否认。
阅读原文 → - TechCrunch AI·模型发布
谷歌发布 Gemini 4 Argon 模型
谷歌发布最新 Gemini 模型 Gemini 4 Argon,并将其宣传为面向编程与网络安全工作的主力模型。原摘要未透露该模型的具体开放范围与时间。
阅读原文 → - IT之家·模型发布
谷歌发布 Gemini 4 Argon 模型
谷歌发布其称迄今最先进的 AI 模型 Gemini 4 Argon,聚焦长流程软件工程、企业知识工作与网络安全防御,单次输出上限提升至约 100 万 tokens。官方称其在 DeepSWE v1.1 等基准上领先 Claude Opus 5.5 与 GPT-6 Astra,但该模型目前未面向公众全面开放。
阅读原文 → - The Decoder·模型发布
Gemini 4 Argon 发布:追平但未领先
Google 发布七个多月来首个前沿模型 Gemini 4 Argon,在独立测试中与 GPT-6 Astra 持平,但不及 Anthropic 的 Claude Opus 5.5。其单 token 价格较低,却比 Astra 多消耗一倍以上 token。首批测试者先行使用,API 与付费版本随后开放。
阅读原文 →
- The Verge AI·模型发布
Google 发布 Gemini 4,仅限可信防御者使用
Google 发布新一代前沿模型 Gemini 4 Argon,官方称其在软件工程、法律金融等企业知识工作以及网络安全防御等复杂流程中具备前沿表现。目前该模型访问受限,仅向受信任的网络安全防御者开放。
阅读原文 →
- Google DeepMind·模型发布
Google 发布 Gemini 4 Argon
Google DeepMind 宣布推出 Gemini 4 Argon,称其开启前沿智能的新阶段。目前官方未披露更多功能与开放细节。
阅读原文 → - IT之家·开源模型发布
B站开源 Index-Translate 翻译模型家族
哔哩哔哩 Index LLM 团队发布 Index-Translate 翻译模型家族,2B、9B、35B-A3B 文本模型权重已在 Hugging Face 与 ModelScope 开放,文本模型覆盖 150 种语言。该家族还包含字幕配音、音节可控翻译和长文档翻译等能力,基于 Qwen3.5 构建。
阅读原文 → - IT之家·模型发布
蚂蚁百灵发布 Ling-3.1-flash 模型
蚂蚁百灵发布 Ling-3.1-flash,拥有约 560B 总参数、每 Token 激活约 25B 参数,上下文窗口上限 1M。该模型围绕通用智能体、搜索、办公与软件研发等任务优化,将开放两周免费体验,付费后计划开放 1M 上下文并同步开源。
阅读原文 → - 量子位·模型发布
实测称 GLM-5.3 表现强劲
量子位发布对智谱 GLM-5.3 的实测内容,称其能力很强,并调侃 Anthropic 像是在为智谱做宣传。
阅读原文 → - 量子位·模型发布产品更新
OpenAI 发布 GPT-6.1 Sol 等 25 项更新
OpenAI 上线 GPT-6.1 Sol,并在一晚之内带来约 25 项更新,被形容为今年开发者日更新最密集的一次。
阅读原文 → - IT之家·模型发布
OpenAI 发布 GPT-6.1 Sol 模型
OpenAI 在开发者日活动上发布 GPT-6.1 Sol,官方称其性能接近旗舰模型 GPT-6 Astra,费用仅为后者的五分之一,是同等性能下性价比最高的模型。该模型提供标准、批量、弹性和快速等多种定价模式。
阅读原文 → - IT之家·模型发布产品更新
OpenAI 推出 GPT-6 Astra Ultrafast 服务
OpenAI 在开发者日推出 Ultrafast 服务层级,GPT-6 Astra 在 Codex 中最高可达每秒 300 个词元,API 调用最高约 6 倍生成速度。该服务已开放 API,Pro 500 订阅与企业用户可先在 ChatGPT Work 和 Codex 中体验。
阅读原文 → - IT之家·模型发布
OpenAI 在 Codex 上线 GPT-6.1 Sol 模型
OpenAI 在开发者日于 Codex 和 ChatGPT Work 中推出 GPT-6.1 Sol,官方称其处理复杂任务时性能接近 Astra 而成本更低,适用于代码、应用程序和文档中重复、长时间运行的任务,可用性取决于套餐与工作区设置。
阅读原文 → - TechCrunch AI·模型发布
OpenAI 发布 GPT-6.1 Sol
OpenAI 发布 GPT-6.1 Sol,称其在代码编写与调试、文档理解、多步骤业务工作流等复杂专业任务上较 GPT-6 Sol 有明显提升,同时表示其表现接近 GPT-6 Astra,但成本更低。
阅读原文 →