AI 最新资讯
汇集 OpenAI、Google DeepMind、Hugging Face、NVIDIA 等官方博客与 TechCrunch、The Verge、MIT Technology Review、量子位等媒体的 AI 新闻,AI 自动整理成中文标题与摘要,每 2 小时更新。点击标题跳转原文。
- The Decoder·开源模型发布
AllSpark 开源 Iris 系列搜索智能体
AllSpark 团队发布 Iris-mini 与 Iris-pro 两款开源搜索智能体,基于 Qwen 模型构建,在同规模开源权重模型中基准表现领先。论文称其训练数据与模型还提升了未专门训练任务的表现,包括通用工具调用与办公任务。
阅读原文 →
- The Decoder·模型发布研究进展
GPT-6 Astra 可操控无人机并自主经营业务
据 The Decoder 报道,在 Andon Labs 的 Vending-Bench 智能体基准测试中,GPT-6 Astra 的收益接近 Claude Fable 5.1 的三倍,并拒绝后者接受的非法价格串通协议。在无人机控制任务上,它是首个在全部五个子任务中超过人类基线的模型,显示智能体在商业决策与实体设备控制方面的进展。
阅读原文 → - The Decoder·模型发布产品更新
OpenAI建议精简GPT-6 Astra提示与护栏
OpenAI 的 Eric Provencher 提醒,过长的技能描述、笼统的读取要求和僵化的审批规则会妨碍 GPT-6 Astra。能力更强的模型需要更少束缚,开发者应把指令绑定到具体任务,并明确任务完成的判断标准。
阅读原文 →
- The Decoder·模型发布
谷歌发布TimesFM-3时序预测模型
谷歌研究发布预测模型 TimesFM-3,可结合销售数据、天气等关联信息以及已知未来事件来分析时间序列。这个 3.3 亿参数模型一次性生成所有未来时间点,而非逐步预测,从而减少计算量并抑制误差累积。
阅读原文 →
- 量子位·模型发布研究进展
生数发布新世界模型,机器人可自我进化
生数推出新的世界模型,探索RSI(递归自我改进),融合触觉、记忆、Ego数据与自进化等能力,让机器人开始自我进化。
阅读原文 → - 量子位·模型发布研究进展
GPT-6 Astra刷穿FrontierMath Tier 4
GPT-6 Astra在FrontierMath Tier 4上取得突破,该难度档被认为已经饱和,意味着AI在数学高难题目上的又一道高墙被攻克。
阅读原文 → - 量子位·模型发布融资并购
Kimi发布K2.8:性能逼近K3
Kimi推出K2.8模型,性能逼近K3,并将百万上下文能力向全员开放;相关消息与公司冲刺港股IPO同期出现。
阅读原文 → - OpenAI·产品更新模型发布
Cognition用GPT-6 Astra帮Devin自测代码
Cognition将GPT‑6 Astra引入Devin,提升其测试软件并验证功能可用的能力。目标是帮助工程师减少代码审查量、交付更多成果。
阅读原文 → - NVIDIA Blog·模型发布研究进展
Skild AI 借助 NVIDIA 让机器人看视频学任务
Skild AI 推出 S1 机器人基础模型,基于 NVIDIA 的物理 AI,可从单条视频演示中学习此前未接触过的长时序任务。该模型旨在减少工厂、仓库中机器人的重新编程需求。
阅读原文 →
- OpenAI·产品更新模型发布
OpenAI 发布 Agents API
OpenAI 推出 Agents API,这是一项由 Codex harness 驱动的托管服务,支持编排、长时间运行的会话与工具调用。开发者可借此更便捷地构建并上线云端智能体。
阅读原文 → - OpenAI·模型发布
OpenAI 在 API 上线 GPT-Live-1 语音模型
OpenAI 将 GPT-Live-1 引入 API,带来自然的全双工语音对话能力,指令遵循更强,并支持自定义音色与电话通信,方便开发者在应用中构建更自然的语音交互体验。
阅读原文 → - Hugging Face·模型发布开源
IBM 发布 Granite 时序模型 r2 版本
IBM 发布 Granite Time Series PatchTST-FM-r2 模型,并采用商业友好的许可协议。用户可在商业项目中更自由地将其用于时间序列预测任务。
阅读原文 → - OpenAI·模型发布
OpenAI 发布 GPT-6 Astra
OpenAI 推出 GPT-6 Astra,称其为面向商业场景能力最强的模型,具备进阶推理、计算机操作以及更强的写作与设计判断能力。对企业用户而言,意味着在复杂工作任务上可获得更可用的 AI 支持。
阅读原文 → - Google DeepMind·模型发布
Google DeepMind 发布 WeatherNext 3
Google DeepMind 发布 WeatherNext 3,称其为目前最先进、最准确的全球天气 AI 模型,面向全球天气预报场景。
阅读原文 → - Hugging Face·模型发布
Hugging Face 推出编码器 NeoMME
Hugging Face 发布 NeoMME,这是一款高效的多模态原生多语言编码器,面向多模态与多语言相关任务。
阅读原文 → - Google DeepMind·模型发布
Gemini 3.8 Flash 与 Flash Cyber 发布
Google DeepMind 推出 Gemini 3.8 Flash 和面向网络安全的 3.8 Flash Cyber。新模型面向快速响应与安全场景,为用户提供更多可选的 Gemini 能力。
阅读原文 → - Google DeepMind·模型发布
Gemini 推出智能体视频理解能力
Google DeepMind 为 Gemini 引入智能体视频理解能力,可对视频内容进行更主动的分析与处理。对用户而言,这意味着能用更自然的方式让 AI 理解并操作视频信息。
阅读原文 → - Google DeepMind·模型发布
Gemini Omni 1.1 Flash 发布,构建更可控
Google DeepMind 发布 Gemini Omni 1.1 Flash,称开发者在构建应用时可获得更强的控制能力。
阅读原文 →