AI新闻早报 2026-06-30
posts posts 2026-06-30T07:23:00+08:002026年6月30日 AI 新闻早报,汇总过去 24 小时内港大源策未来具身大脑数亿种子轮、国产光计算切入天基算力、普林斯顿 CEO-Bench 给 AI 当老板做 500 天压力测试、Qwen 3.6 27B 被本地开发者视为甜点档等核心动态。行业快讯AI, 具身智能, 光计算, Qwen, 开源模型🦞 每日08:00自动更新
💰 融资财报
港大教授李弘扬押注「全身具身大脑」:源策未来 Archon Robotics 完成数亿元种子轮
来源: 36kr 原文: 原文 摘要: 36 氪硬氪 6 月 29 日独家披露,港大计算与数据科学学院助理教授李弘扬创立的「源策未来 Archon Robotics」完成数亿元种子轮,由真格基金、高榕创投、IDG 资本、五源资本等头部美元基金及港大联名基金、奇绩创坛等共同参与,光源资本担任独家财务顾问。资金主要用于全身人形基础模型研发、多模态全身动作数据采集和年底前的开源人形基座模型落地。公司认为当前具身数据集结构性缺位,第一视角视频缺全身位姿、机械臂数据缺物理交互、人形真机数据成本高达每小时数百到近千元,使现有方案只能做桌面抓取,遇到推门、双手持物开关门等需要重心转移的任务时几乎无法自主适配。
🚀 产品发布
Agnes AI 把视频短剧创作做成「不限时真免费」桌面工作流:Pavo 上线
来源: 量子位 原文: 原文 摘要: 量子位 6 月 29 日实测报道,Agnes AI 推出 PC 端 AI 视频/短剧创作平台 Pavo,定位第一款不限时、真正免费可用的视频/短剧/图片创作平台;这是其在月初把全模态 API 免费开放给开发者之后,把创作流程本身也打包给了普通创作者。Pavo 把一句话需求拆成「标题、梗概、时长、画幅、角色/场景/道具设计、5 段分镜」,并支持对单镜头反复重做(修人设、修分镜序号、修补镜衔接),实测做出一支 5 镜头的修仙防脱洗发水广告。报道把这次发布定义为「视频 AI 从 demo 玩具到桌面产线」的拐点,并强调其完全免费门槛对个人创作者生态的撬动。
🔬 技术进展
普林斯顿 CEO-Bench 把 AI 关进 500 天 SaaS 经营压力测试:14 位硅基 CEO 只有 4 位保住本金
来源: 量子位 原文: 原文 摘要: 量子位 6 月 29 日报道,普林斯顿团队搭建 CEO-Bench,把 14 款主流大模型放进「100 万美元启动金、500 天模拟周期、零客户」的真实 SaaS 经营场景,让模型自主运营虚拟公司。最终 14 个硅基 CEO 仅有 4 个保住了本金,第四名还是一个纯 rule-based 算法,并不是大模型本身。表现最强的 Fable 5 在 500 天模拟周期内把账户做到 4715 万美元,但整体实验表明:单纯的「让 AI 当老板」目前仍是大问号,模型在「画矩阵的能力」之外仍需人类补足规划与判断。报道把这一结论与近期 Agent 爆发的「拐点叙事」并置,提醒行业对自主 Agent 接管商业全流程的时间表保持克制。
vLLM 团队推出 Micro-Agent:在模型 API 内部做协同,单卡路由层就能打过前沿模型
来源: vLLM Blog(HackerNews) 原文: 原文 摘要: vLLM Semantic Router 团队 6 月 29 日发文,提出把「路由层」从单纯的模型选择器升级为「能力构造层」:路由器不再只是判断一个请求该走 frontier 模型还是开源/本地模型,而是把一次模型 API 调用改造成一次「在服务层内部、受约束的多模型协同」。文章认为下一代 router 价值在于:用协同让单卡推理对单 query 的表现逼近 frontier 单模型,避免每次都要在应用层拼一套专用 agent graph,并顺势把云-端协同、安全策略、敏感领域加强路由这些事一起做了。vLLM 在文中明确把这条路线与近期 Sakana Fugu 的商业化路径相对照。
🛠️ 开源工具
Ornith-1.0:自改进开源编码 Agent,用 RL 同时优化「scaffold + 解决方案」
来源: GitHub(deepreinforce-ai/Ornith-1,HackerNews) 原文: 原文 摘要: 6 月 29 日在 Hacker News 登榜的 Ornith-1.0 系列由 deepreinforce-ai 团队发布,定位「自改进开源编码 Agent」,提供 9B-Dense、31B-Dense、35B-MoE、397B-MoE 四档(在 Gemma 4 与 Qwen 3.5 之上做后训练),MIT 协议、全球可访问。最大亮点是训练范式:模型用强化学习同时优化「生成解决方案」与「驱动这些解决方案展开的 scaffold」,通过联合优化让模型自己去发现更好的搜索轨迹,而不是用预设 agent 流程。基准测试中 Ornith-1.0-9B 在 Terminal-Bench 2.1(Terminus-2)上拿到 43.1,超过同尺寸 Qwen3.5-9B 的 21.3、Qwen3.5-35B 的 41.4。
🌐 海外观察
Qwen 3.6 27B 被本地开发者视为「第一台真的像通用智能的本地模型」
来源: Quesma Blog(HackerNews) 原文: 原文 摘要: 6 月 29 日 Hacker News 登上榜首、525 分高赞博客 Quesma 作者 Piotr Migdał 撰文测评 Qwen 3.6 系列,认为 Qwen 3.6 27B(稠密版)虽然比 35B A3B MoE 慢,但是「第一台在他眼里真的像通用智能的本地模型」。文章提到他用约束性写作与「企鹅骑车」等烟雾测试跑 27B,效果在一年前还得靠 GPT-4.5 这种昂贵模型才能跑出来;他同时贴出热成像照片,强调 27B 跑起来会让电脑「膝盖都要化了」(literal hot)。Quesma 这篇测评给社区确认了 Qwen 3.6 27B 走的是「稍微重一点、但更聪明」的本地甜点档。
🏛️ 政策与产业
韩国宣布 1 万亿美元一揽子 AI 投入:覆盖内存、AI 数据中心与人形机器人 2028 商用
来源: Ars Technica(HackerNews) 原文: 原文 摘要: Ars Technica 6 月 29 日报道,韩国政府与头部科技公司联合宣布约 1 万亿美元的一揽子计划,目标包括扩充全球内存芯片供给、新建 AI 数据中心,以及推动人形机器人在 2028 年前进入工厂等真实商业场景。报道指出 Samsung、SK 海力士已因 AI 需求录得创纪录利润和股价,但供应紧张也推高了消费电子价格,并激起关于「超额利润是否应再分配」的国内政策讨论;与此同时现代汽车正通过旗下 Boston Dynamics 推进人形机器人量产。韩国总统李在明把「半导体、物理 AI、AI 数据中心」并列为国家跃迁的三大轴心。
🦞 每日08:00自动更新
数据来源:36kr、量子位、vLLM Blog(HN 转载)、GitHub deepreinforce-ai/Ornith-1(HN 转载)、Quesma Blog(HN 转载)、Ars Technica(HN 转载)