AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- 量子位·模型发布产品更新
Qwen 3.8 的 27B 模型可一口气交付网页
量子位报道称,Qwen 3.8 的 27B 模型能快速完成网页交付,把设计与前端一并做完,但后端部分仍需人工补齐。这意味着开发者用较小规模模型即可更快搭出页面原型。
阅读原文 → - IT之家·模型发布
Grok Voice Transcribe 2.0 发布
SpaceXAI 发布 Grok Voice Transcribe 2.0 语音转文本模型,错误率较 1.0 版降低约一半,定价保持不变。该模型在 Artificial Analysis 流式模型准确率榜单位居榜首,批量转录每小时 0.10 美元,实时流式转录每小时 0.20 美元。
阅读原文 → - IT之家·模型发布开源
中国电信开源星辰 Xing4.0 大模型
中国电信发布并开源新一代星辰大模型 Xing4.0-29B-A4B,总参数 29B、激活参数 4B,原生支持 256K 上下文,称是国内首个基于国产算力与国产框架训练的百亿参数模型。4-bit 量化后显存占用约 15GB,可在 24G 消费级显卡上本地运行长上下文任务。
阅读原文 → - IT之家·模型发布产品更新
阿里千问发布同传大模型 Qwen3.8-LiveTranslate
阿里千问发布同声传译大模型 Qwen3.8-LiveTranslate,采用 Interleave 架构与 Hybrid MoE 的 Thinker–Talker 双模块设计,支持 60 种语言。官方称其新增实时说话人分离、原文译文同帧同出等能力,字均延迟由 2.8 秒降至 2.3 秒。
阅读原文 → - TechCrunch AI·模型发布
ChatGPT发明者推出新型AI模型Jev
一位ChatGPT发明者发布名为Jev的新型AI模型,开发者反馈它提供了更便宜、更快速的软件智能实现路径。
阅读原文 → - IT之家·模型发布开源
达摩院开源通用医疗影像 AI 模型
阿里达摩院与浙大一院等机构研发的通用医疗影像 AI 模型 DAMO RADAR 登上《科学》,面向腹部增强 CT 可一次性识别超 146 种病症,准确性首次达到影像科专家级水平,现已正式开源。
阅读原文 → - IT之家·模型发布开源
PrismML 推出 Bonsai 2 27B 量化模型
PrismML 发布三值量化模型 Bonsai 2 27B,基于 Qwen3.8 27B,以不到1/9的内存占用在综合基准测试中达到基础模型98.2%的分数,模型总大小5.9GB,支持262K上下文,并以 Apache 2.0 许可证开放权重。
阅读原文 → - IT之家·模型发布
智谱 GLM-5.3-FlashX 模型上线
智谱推出 GLM-5.3-FlashX 模型,最高输出速度达 200 tokens/s,并已上线 API。官方称其在 10 万张国产芯片推理算力基础上进一步优化 Infra,速度提升但价格高于 GLM-5.3-Flash,为企业与开发者提供更流畅体验。
阅读原文 → - IT之家·模型发布开源
阿里发布 Qwen3.8-Omni-Flash
阿里千问上线新一代原生全模态模型 Qwen3.8-Omni-Flash,可同时处理文本、图像、音频和视频输入,支持 1M 上下文。官方称其音视频能力接近 Gemini 3.8 Flash,API 音视频输入价格大幅下降,并开源了 Qwen-Live Harness。
阅读原文 → - IT之家·模型发布
谷歌 Gemini 4 Pro 开测,SVG 生图表现亮眼
有网友反馈,谷歌正以“gemini-3.8-flash”名称在 Arena 等基准平台测试其最强模型 Gemini 4 Pro,内部代号 Argon。测试中该模型生成“鹈鹕骑自行车”SVG 图片表现优秀,有网友将其与 OpenAI 的 GPT-6 Astra Pro 对比,并认为正式发布后能力还会提升。
阅读原文 → - TechCrunch AI·模型发布
PrismML 推出小型 LLM,欲改变 AI 使用方式
AI 实验室 PrismML 推出了一款小型大语言模型,并希望借此改变人们使用 AI 的方式。
阅读原文 → - The Decoder·模型发布研究进展
GPT-6 Astra 游戏能力大幅提升
OpenAI 的 GPT-6 Astra 在游戏任务上表现跃升,通关《宝可梦火红》从 96 小时缩短至 18 小时,并完成了《异星工厂》《辐射 3》《传送门》等。但它也会因一次爆炸意外陷入反复种土豆而停滞不前。
阅读原文 →
- 量子位·研究进展模型发布
唐杰发布智谱 RSI 首个成果
智谱唐杰发布 RSI 方向的首个成果,并表示 GLM 已经开始参与构建 GLM,意味着模型研发中开始引入 AI 自身参与。
阅读原文 → - IT之家·模型发布融资并购
TypeSafe AI 发布 Jev 模型,不生成文本
由前 OpenAI 员工 Diogo Almeida 创办的 TypeSafe AI 推出 Jev 模型,定位为「系统一模型」,不生成文本,而是直接返回选择、评分、布尔概率三类结构化决策结果,成本与延迟远低于大语言模型。该公司同时宣布完成 4000 万美元种子轮融资。
阅读原文 → - IT之家·模型发布研究进展
小米直播训练 MiMo-V2.6 模型
小米 MiMo 大模型负责人罗福莉表示,团队自 4 月开源 MiMo-v2.5 后沉寂近半年,专注研究强化学习能扩展到多远。MiMo-V2.6 处于强化学习中间阶段,训练直播总花费已超 125 万美元,模型即将推出。
阅读原文 → - 量子位·模型发布
国产RSI模型发布:Flash模型反打旗舰
国产RSI模型正式发布,据称可让Flash模型反打旗舰模型,并同步推出1亿Tokens人人免费领活动,用户可零成本试用这一能力。
阅读原文 → - The Decoder·模型发布
前 OpenAI 研究员发布纯分类模型 Jev
前 OpenAI 研究员 Diogo Almeida 创办的 TypeSafe AI 发布模型 Jev,它不生成文本,只按预设选项输出分类结果,响应时间最低 70 毫秒、token 价格极低。该方案只保证严格遵循预设选项,并不能避免判断出错。
阅读原文 → - 量子位·模型发布开源
国产开源ZDTaichu5.0-9B发布
国产开源模型 ZDTaichu5.0-9B 发布,在九项空间测试中于 10B 规模通用模型里拿下 8 项第一,通用能力未打折扣。据称其在空间具身智能方面断层领先,跻身全球多模态第一梯队。
阅读原文 → - IT之家·模型发布
讯飞星火语音基座大模型 Spark-Audio 上线
科大讯飞宣布 Spark-Audio-1.0-Preview 上线,这是一款基于全国产化算力训练的语音基座大模型。它可直接理解语音,支持语音转写、多语言翻译、多方言识别、情感分析与音频问答等任务,官方称其在高噪声等真实场景任务上表现领先。
阅读原文 → - 量子位·模型发布研究进展
清华与稳准智能发布数据大模型 LimiX-2
稳准智能联合清华大学发布新一代数据大模型 LimiX-2,模型参数规模提升至 400M,并在国际评测榜单上登顶。该模型面向结构化数据,官方定位为结构化数据基础模型。
阅读原文 →