AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- 量子位·模型发布
商汤正式发布 U1 Pro
商汤正式发布 U1 Pro。据官方信息,该产品生成的图像让人难以看出是 AI 制作,具体能力与开放范围尚未在原文中说明。
阅读原文 → - OpenAI·模型发布应用案例
GPT-6 Astra 研究提效降本一半
Parallel 使用 GPT-6 Astra 让智能体研究并整合劳动力市场数据。与先前模型相比,这项任务的时间和成本均减半,说明该模型可帮助研究型 AI 应用更快、更省。
阅读原文 → - 量子位·模型发布开源
小米六天训练直播收官,拿下开源第一
小米以直播形式公开模型训练过程,六天投入 2000 多万元,最终拿下开源模型榜单第一,Hugging Face CEO 也发声称赞。这种公开“炼丹”的方式让外界得以观察大模型训练的实际投入与过程。
阅读原文 → - The Decoder·模型发布开源
小米 MiMo-V2.6-Pro 登顶开源模型
小米发布 MiMo-V2.6-Pro,凭借耗资 262 万美元的大规模强化学习登上公开可用模型榜首,价格远低于竞争对手。但 Anthropic 指控其从 Claude 抽取训练数据,成功背后存在争议。
阅读原文 →
- IT之家·模型发布研究进展
奥地利科学院发布古希腊语大模型 Apollo
奥地利科学院联合 Mistral 与 Sail Reply 发布面向古希腊语的大语言模型 Apollo,训练素材约 6 亿个古希腊词汇,可通过聊天机器人界面免费使用。模型能按统计概率填补莎草纸残片缺失词句,帮助学者加快古籍修复与研究。
阅读原文 → - IT之家·模型发布开源
小米开源 MiMo-V2.6 系列全模态模型
小米正式发布并开源 MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型,小米称这是其探索 RSI 路径的关键一步。Pro 已以“Co-Scientist”角色参与真实科研,在新材料设计与 Lean 4 形式化证明中协助研究人员,北大研究员评价其达到训练有素博士研究人员水平。定价沿用 V2.5 系列。
阅读原文 → - IT之家·模型发布研究进展
阿里 Qwen4 训练中,新视频模型 11 月发布
阿里在 2026 云栖大会公布大模型进展:基于新一代架构的 Qwen4 已在训练中,后续 Qwen4.5、Qwen5 等版本将扩展至 5-10T 参数;下一代视频生成模型将于 11 月发布,朝更长、更可控、更智能方向演进。
阅读原文 → - IT之家·模型发布产品更新
腾讯混元发布 Hy Image3.5 preview
腾讯混元推出面向专业生图创作的 Hy Image3.5 preview,支持文生图、图生图和多轮对话创作,已上线元宝、ima 等应用;腾讯云 API 2K 图像定价为 0.15 元/张,仅对输出图片收费。
阅读原文 → - IT之家·模型发布开源
小米发布并开源 MiMo-V2.6 系列双版本
小米正式发布并开源 Xiaomi MiMo-V2.6 系列,包含 Pro 与 Flash 两个原生全模态模型,Pro 与 Flash 价格保持不变。其中 MiMo-V2.6-Pro 在 AA 综合智能指数取得 46 分,超过 Kimi K3 与 GLM-5.3,成为当前排名最高的开源权重模型。
阅读原文 → - IT之家·模型发布
SpaceXAI 发布编码与知识模型 Grok 4.7
SpaceXAI 推出新一代 Grok 4.7,主打编程和知识工作场景,官方称其为公司目前最强的编码与知识处理模型,速度是同类模型两倍、价格减半,百万词元输入 2 美元起。该模型采用更大基座并延长强化学习训练,在 GDPval、AA Briefcase 等测试中均较前代提升。
阅读原文 → - The Decoder·模型发布
xAI发布Grok 4.7,低价但基准落后
xAI 发布其迄今最强模型 Grok 4.7,主打低价。但在 Artificial Analysis 智能指数上仅得 46 分,居中游,明显落后于同为 53 分的 Claude Fable 5.1 与 GPT-6,在代理式编码方面差距更大。
阅读原文 →
- IT之家·模型发布产品更新
华为云码道上线鸿蒙编码大模型与智能体
华为云宣布 CodeArts 面向鸿蒙开发者升级,上线鸿蒙编码大模型、鸿蒙编码智能体和鸿蒙开发者实践中心。官方称千行代码错误率降低 80% 以上、一次编译通过率提升 78% 以上,可覆盖从需求梳理到编译构建的全流程。
阅读原文 → - 量子位·模型发布开源
阶跃 Step 5 Preview 实测:激活参数仅 27B
量子位对阶跃 Step 5 Preview 进行了实测,该模型激活参数仅 27B,并被称为开源模型中的 Top 2 表现。
阅读原文 → - IT之家·产品更新模型发布
我国首款藏语多语言全模态 AI 输入法发布
9 月 20 日,藏语智能全国重点实验室发布我国首款藏语多语言全模态 AI 输入法“智达 AI 输入法”及配套藏文字体集。该输入法基于智达大模型,覆盖手机、电脑等全终端,支持藏文、语音三大方言及汉藏英混合 OCR 输入,词库涵盖 23 个学科术语。
阅读原文 → - The Decoder·模型发布开源
阿里开源 Qwen-Image-2.1 图像模型
阿里 Qwen 团队发布开源权重模型 Qwen-Image-2.1,仅 70 亿参数即可在性能较强的消费级 GPU 上生成与编辑图像,并支持透明背景和最多十张参考图,官方称其表现超过部分闭源模型。该模型采用研究许可,商用需另行获取授权。
阅读原文 →
- The Decoder·模型发布研究进展
腾讯 Gander 可边对话边后台处理任务
腾讯的 Gander 能同时处理语音、图像与文本,并在后台执行任务:一个「小脑」负责维持对话,可替换的「大脑」负责搜索文件、写代码等复杂工作,用户可中途打断或更改任务。基准测试中它打断用户的比例仅 8%,低于竞品,但任务准确率落后。
阅读原文 →
- IT之家·开源模型发布
阿里千问开源Qwen-Image-2.1图像模型
阿里千问宣布开源图像模型Qwen-Image-2.1,将文生图与图像编辑整合在同一模型中,视觉生成部分仅7B参数。该模型原生支持透明图像的生成与编辑,最多可使用10张参考图,并提升了文字排版、人物光影与细节表现。
阅读原文 → - IT之家·模型发布开源
阶跃发布旗舰模型Step 5 Preview
阶跃推出旗舰模型Step 5 Preview,面向AI编程、软件工程、专业知识工作与金融等场景,采用稀疏MoE架构,总参数600B、激活27B,支持100万Token上下文。该模型在AA综合智能指数得分44分,居全球开源模型前三,将于10月15日开源完整权重。
阅读原文 → - IT之家·模型发布
星辰 Xing4.0-29B 发布,基于昇腾超节点训练
中电信人工智能科技发布新一代星辰大模型 Xing4.0-29B-A4B,总参数 29B、激活参数 4B,聚焦复杂任务理解、任务规划与工具调用,可用于代码开发、数据分析等场景。华为表示,这是国内首个基于昇腾 Atlas 900 A3 SuperPoD 液冷超节点与昇思框架完成训练的百亿参数大模型。
阅读原文 → - The Decoder·模型发布
Qwen3.8-Omni-Flash 发布,定价低于 Gemini Flash
Qwen 推出首个面向 AI Agent 的多模态模型 Qwen3.8-Omni-Flash,可同时处理音频与视频,并自主调用工具剪辑 vlog、翻译片段或总结影片。其在音视频基准上接近 Gemini 3.8 Flash,而 API 成本低得多。
阅读原文 →