AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- IT之家·模型发布产品更新
高通发布 1-bit Bonsai 视觉模型
在 2026 骁龙峰会上,高通与 PrismML 在骁龙 AR1 Gen 1 智能眼镜平台上本地运行 20 亿参数的 1-bit 量化 Bonsai 视觉模型。官方称其内存占用约为传统 4-bit 模型的 1/4、文本生成速度翻倍,可支持离线识物、翻译与语音问答,并改善续航与发热。
阅读原文 → - IT之家·产品更新模型发布
腾讯 Hy 翻译 App 上线,支持 33 种语言互译
腾讯混元宣布“腾讯 Hy 翻译”App 上线,同步支持小程序、插件与 PC 端体验。它基于开源的 Hy-MT2 翻译模型,支持 33 种语言互译并覆盖 5 种少数民族语言及方言,提供语音、拍照与离线翻译,已在 12 个国家和地区上线。
阅读原文 → - IT之家·模型发布
消息称 Kimi K3.1 下月登场
科技媒体消息称,月之暗面正筹备推出 Kimi K3.1 模型,或于下月登场,内部配置文件中出现 Low、High、Max 三档推理强度。爆料还提到最高 100 万 Token 上下文、Agent 模式与多智能体协作等能力。
阅读原文 → - IT之家·模型发布产品更新
谷歌发布 Gemini 3.8 Flash 文本转语音模型
谷歌推出 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 两款文本转语音模型,支持用自然语言提示定制语音、约 30 秒音频复刻声音,并内置 SynthID 水印等保护。前者面向角色创意设计,后者面向大规模配音场景。
阅读原文 → - IT之家·模型发布研究进展
小米 MiMo-V3 将采用全新架构
小米 MiMo 大模型负责人罗福莉宣布,MiMo-V3 即将采用全新架构,其核心组件 HySparse 2 同日发布。该方案通过 KV 桥接与 KV 重用等方式,降低长上下文下的预填充计算量与 KV 缓存占用,并提升检索表现,面向智能体推理场景。
阅读原文 → - IT之家·开源模型发布
蚂蚁百灵开源 Ming-Image-0.1-Design 系列
蚂蚁百灵开源 Ming-Image-0.1-Design 系列,含两个 6B 模型:一个可从文字生成 UI、信息图、海报等设计,另一个能把设计图拆成可独立编辑的透明图层,并同步开源 Design Skill 与 PPT Skill。在 UI/UX Design 专项评测中,该系列位列开源模型第一。
阅读原文 → - IT之家·模型发布产品更新
讯飞发布语音识别大模型Spark-ASR-2.0
科大讯飞正式发布新一代语音识别大模型 Spark-ASR-2.0,将于明日上线讯飞输入法。官方称其在通用识别、方言、高噪小音量等复杂场景及文本流畅性上明显提升,整体推理成本较上一代仅增加约 10%。
阅读原文 → - IT之家·模型发布产品更新
阿里千问发布 Qwen-Audio-3.1 语音大模型
千问发布 Qwen-Audio-3.1 系列语音大模型,同时推出音频创作与音频理解新模型,形成覆盖理解、生成、交互、创作的音频能力栈。官方还下调全线语音模型价格,其中 TTS 降价约 70%、Realtime 约 85%、ASR 达 95%。
阅读原文 → - IT之家·行业动态模型发布
IT早报:民企500强出炉,OpenAI发布GPT-6
全国工商联发布2026中国民营企业500强,京东、阿里、恒力位列前三,华为、比亚迪分列第四和第五;高通发布第六代骁龙8超级至尊版,OpenAI推出GPT-6 Sol与Luna并大幅下调API价格,OPPO Find X10系列同期亮相。
阅读原文 → - IT之家·模型发布
OpenAI 发布 GPT-6 Sol 和 Luna 模型
OpenAI 发布 GPT-6 系列新成员 GPT-6 Sol 与 Luna,沿用 GPT-6 Astra 的训练方法,API 价格较 GPT-5.6 促销价降低 50%。官方称两款模型在智能体任务与事实可靠性上提升明显,但 Astra 仍是最强模型。
阅读原文 → - IT之家·模型发布
Anthropic 发布 Claude Opus 5.5
Anthropic 推出 Claude 5.5 家族首个模型 Opus 5.5,官方称其在多数工作上可媲美 Claude Fable 5.1,运行成本比 Opus 5 低 40%。该模型还在自动化行为审计中取得迄今最高分,对提示注入的抵抗力更强。
阅读原文 → - IT之家·模型发布研究进展
奥地利科学院发布古希腊语大模型 Apollo
奥地利科学院联合 Mistral 与 Sail Reply 发布面向古希腊语的大语言模型 Apollo,训练素材约 6 亿个古希腊词汇,可通过聊天机器人界面免费使用。模型能按统计概率填补莎草纸残片缺失词句,帮助学者加快古籍修复与研究。
阅读原文 → - IT之家·模型发布开源
小米开源 MiMo-V2.6 系列全模态模型
小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型,小米称这是其探索 RSI 路径的关键一步。Pro 已以“Co-Scientist”角色参与真实科研,在新材料设计与 Lean 4 形式化证明中协助研究人员,北大研究员评价其达到训练有素博士研究人员水平。定价沿用 V2.5 系列。
阅读原文 → - IT之家·模型发布研究进展
阿里 Qwen4 训练中,新视频模型 11 月发布
阿里在 2026 云栖大会公布大模型进展:基于新一代架构的 Qwen4 已在训练中,后续 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数;下一代视频生成模型将于 11 月发布,朝更长、更可控、更智能方向演进。
阅读原文 → - IT之家·模型发布产品更新
腾讯混元发布 Hy Image3.5 preview
腾讯混元推出面向专业生图创作的 Hy Image3.5 preview,支持文生图、图生图和多轮对话创作,已上线元宝、ima 等应用;腾讯云 API 2K 图像定价为 0.15 元/张,仅对输出图片收费。
阅读原文 → - IT之家·模型发布开源
小米发布并开源 MiMo-V2.6 系列双版本
小米正式发布并开源 Xiaomi MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型,Pro 与 Flash 价格保持不变。其中 MiMo-V2.6-Pro 在 AA 综合智能指数取得 46 分,超过 Kimi K3 与 GLM-5.3,成为当前排名最高的开源权重模型。
阅读原文 → - IT之家·模型发布
SpaceXAI 发布编码与知识模型 Grok 4.7
SpaceXAI 推出新一代 Grok 4.7,主打编程和知识工作场景,官方称其为公司目前最强的编码与知识处理模型,速度是同类模型两倍、价格减半,百万词元输入 2 美元起。该模型采用更大基座并延长强化学习训练,在 GDPval、AA Briefcase 等测试中均较前代提升。
阅读原文 → - IT之家·模型发布产品更新
华为云码道上线鸿蒙编码大模型与智能体
华为云宣布 CodeArts 面向鸿蒙开发者升级,上线鸿蒙编码大模型、鸿蒙编码智能体和鸿蒙开发者实践中心。官方称千行代码错误率降低 80% 以上、一次编译通过率提升 78% 以上,可覆盖从需求梳理到编译构建的全流程。
阅读原文 → - IT之家·产品更新模型发布
我国首款藏语多语言全模态 AI 输入法发布
9 月 20 日,藏语智能全国重点实验室发布我国首款藏语多语言全模态 AI 输入法“智达 AI 输入法”及配套藏文字体集。该输入法基于智达大模型,覆盖手机、电脑等全终端,支持藏文、语音三大方言及汉藏英混合 OCR 输入,词库涵盖 23 个学科术语。
阅读原文 → - IT之家·开源模型发布
阿里千问开源Qwen-Image-2.1图像模型
阿里千问宣布开源图像模型Qwen-Image-2.1,将文生图与图像编辑整合在同一模型中,视觉生成部分仅7B参数。该模型原生支持透明图像的生成与编辑,最多可使用10张参考图,并提升了文字排版、人物光影与细节表现。
阅读原文 →