AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- The Decoder·模型发布开源
Ideogram 4.5 支持图像局部编辑
Ideogram 推出新模型 Ideogram 4.5,可只编辑指定区域而保持图像其余部分不变。该模型原生支持 2K 分辨率,单张价格 0.8 美分起,Runway、Pika、Leonardo AI 等已接入,并计划推出开放权重版本。
阅读原文 → - The Decoder·开源行业动态
DeepSeek与华为开源昇腾芯片编程工具
DeepSeek与华为为昇腾AI芯片打造开源编程工具,核心是TileLang语言,旨在提供比英伟达CUDA更简单的编程模型。双方合作瞄准中国AI产业最大障碍,即充分发挥国产芯片性能的软件生态。
阅读原文 →
- The Decoder·研究进展开源
智谱 GLM-5.3 生成攻击代码能力接近 Claude
Anthropic 称智谱开源模型 GLM-5.3 编写网络攻击代码的能力几乎与 Claude Mythos Preview 相当,其更小的 Flash 版本以约 20 美元即可构建可靠的 Chrome 攻击;模型防护易被去除,未受限版本已在流传。
阅读原文 →
- The Decoder·模型发布开源
英伟达发布 Nemotron 3 说话人分离模型
英伟达推出 Nemotron 3 Diarization,这是一款约 1 亿参数的免费模型,可实时判断对话中正在说话的人,最多支持八位说话人。它可用于会议记录、字幕生成等需要区分发言者的场景。
阅读原文 →
- The Decoder·开源模型发布
Black Forest Labs 发布开源机器人模型 FLUX 3 Action
Black Forest Labs 推出开源世界动作模型 FLUX 3 Action,可通过摄像头画面预测机器人下一步动作。它仅有 70 亿参数,在 RoboLab-120 基准上创下纪录,运行速度最高为前代最优模型的 3.95 倍。
阅读原文 → - The Decoder·模型发布开源
小米 MiMo-V2.6-Pro 登顶开源模型
小米发布 MiMo-V2.6-Pro,凭借耗资 262 万美元的大规模强化学习登上公开可用模型榜首,价格远低于竞争对手。但 Anthropic 指控其从 Claude 抽取训练数据,成功背后存在争议。
阅读原文 →
- The Decoder·模型发布开源
阿里开源 Qwen-Image-2.1 图像模型
阿里 Qwen 团队发布开源权重模型 Qwen-Image-2.1,仅 70 亿参数即可在性能较强的消费级 GPU 上生成与编辑图像,并支持透明背景和最多十张参考图,官方称其表现超过部分闭源模型。该模型采用研究许可,商用需另行获取授权。
阅读原文 →
- The Decoder·开源模型发布
AllSpark 开源 Iris 系列搜索智能体
AllSpark 团队发布 Iris-mini 与 Iris-pro 两款开源搜索智能体,基于 Qwen 模型构建,在同规模开源权重模型中基准表现领先。论文称其训练数据与模型还提升了未专门训练任务的表现,包括通用工具调用与办公任务。
阅读原文 →