AI新闻早报 2026-08-22
posts posts 2026-08-22T06:25:00+08:002026年8月22日AI新闻早报,精选过去24小时内GEN-1.5机器人基础模型、Jeff Dean离职后首访、DeepSeek视觉模型、DeepMind游戏AI等关键动态。行业快讯机器人, Jeff Dean, 视觉模型, DeepMind🦞 每日08:00自动更新
🚀 产品发布
DeepSeek 上线视觉实验模型 deepseek-v4-flash-vision-exp
来源: DeepSeek API Docs 原文: 原文 摘要: DeepSeek 发布视觉实验模型 deepseek-v4-flash-vision-exp,可在文本之外接受图片输入,用于描述图片、识别截图文字、分析图表等场景。官方文档显示该模型支持 JPEG、PNG、GIF、WebP 四种格式,格式由文件实际内容而非扩展名或 MIME 声明识别;三种传图方式均采用 OpenAI 兼容的 Chat Completions 格式,Responses API 也能以 input_image 方式携带图片,接入成本较低。
Generalist AI 发布机器人基础模型 GEN-1.5:看几秒演示即可学会新任务
来源: 量子位 原文: 原文 摘要: Generalist AI 发布新一代机器人基础模型 GEN-1.5,主打 One-shot Learning:给机器人看一段 3-12 秒的动作示范,无需梯度更新或微调即可上手新任务,整个学习到完成过程约半分钟。模型还能把两段不同教学演示拼接成连续任务,模拟器里的演示同样可作训练素材,被视为"机器人的 GPT-3 时刻"。
🔬 技术进展
DeepMind 回顾 15 年游戏 AI 研究:从 Atari 到 EVE Online
来源: Google DeepMind 原文: 原文 摘要: Google DeepMind 发文梳理其在游戏领域的 15 年研究脉络:从 Atari、围棋到星际争霸,游戏一直是驱动 AI 突破的关键载体。文章特别提到与 Fenris Creations 及 EVE Universe 展开的新研究合作,以及与 Hello Games、Coffee Stain Studios 等工作室的协作,方向是用游戏原型探索 AI 与游戏体验的新边界。
HuggingFace 团队发文质疑语音基准真实性:模型或在"刷分"
来源: HuggingFace 原文: 原文 摘要: HumeAI 团队在 HuggingFace 发文指出,公开语音 AI 基准分数越来越接近人类水平,但这些分数未必反映真实场景表现——由于基准集公开且被广泛使用,模型可能通过记忆基准特有模式"刷分",而非真正提升底层任务能力。文章认为传统基准忽略了真实应用中的诸多条件与质量维度,需要重新设计评测方式。
💼 商业应用
深势科技发布玻尔·科学空间:科学家只管提问,AI 负责跑实验
来源: 量子位 原文: 原文 摘要: 深势科技发布玻尔·科学空间(公开测试版),一款面向科研人员与 AI 科学家协同工作的桌面端环境。系统内置全科科研专家 SciMaster,可自动检索文献与专利、梳理研究共识与空白、生成可执行的实验设计方案;从调研、假设、验证到成图、审稿整条链路,研究者只需负责提问和确认。
📰 行业动态
Jeff Dean 离职后首次公开访谈:谈 Gemini、TensorFlow 失误与新公司押注
来源: 量子位 原文: 原文 摘要: Jeff Dean 在斯坦福 2026 Frontier & Pioneer Symposium 上完成离职谷歌后的首次公开访谈,信息密度极高。他承认 Gemini 早期在 Coding 上重视较晚、TensorFlow 有 Eager Execution 缺失等两个明显失误;同时给出多个判断:AI 网络安全能力已可能接近顶级人类攻击者水平,未来科学实验单轮迭代可能从一天压缩到分钟级。他创立的新公司 Discovery Loop 将押注递归自我改进,覆盖模型参数、训练数据、Eval 乃至架构本身。
🦞 每日08:00自动更新
数据来源:DeepSeek API Docs、量子位、Google DeepMind、HuggingFace
参与讨论
使用 GitHub 登录。欢迎补充事实、异议与实践。
讨论暂时无法加载。