🔥1. ResNet 作者任少卿确认机器人创业:蔚来战略投资,公司注册即独角兽 — 热度 🔥🔥🔥🔥🔥
量子位确认:知名 AI 科学家、ResNet 作者、蔚来汽车高级副总裁及智驾负责人、2023 未来科学大奖得主任少卿已正式成立公司投身具身智能机器人创业——蔚来 CEO 李斌在内部全员会通告:任少卿已创立物理 AI 基础模型和具身智能独立公司,蔚来明确战略投资并开展业务合作。新公司已完成注册,估值达独角兽级别(超 10 亿美元量级)。
值得注意的是,任少卿此次是"机器人创业但依然在职蔚来"——被戏称"离婚不离家"。接近蔚来管理层的人士表示:智能驾驶是 AI 在物理世界中最成熟的大规模落地场景,与具身智能在感知、预测、规划、控制、世界模型和强化学习等底层能力上存在连续性,过去两年越来越多智驾人才流向机器人行业。任少卿此前代表蔚来发布的世界模型 NWM(NIO World Model)2025 年开始量产推送、今年架构升级为"世界引擎"。连点成线的是:最早押注机器人的小鹏刚宣布机器人业务独立融资,李斌与任少卿此前都已明确"AI+汽车下一幕倾向于机器人而非 Robotaxi"——任少卿下海,或许正是蔚来具身智能试水的开端。
→ https://www.qbitai.com/2026/08/478675.html
🔥2. 未来不远机器人:字节跳动入股,半年 3 轮 10 亿融资,已把机器人卖进 500 个家庭 — 热度 🔥🔥🔥🔥🔥
字节跳动入股未来不远机器人最新一轮融资——这家全球首个实现家庭商业化落地的通用机器人公司,半年内完成 3 轮融资、累计超 10 亿元,刷新国内家庭通用机器人融资纪录;投资方还包括汇川产投、国方创投、德宁资本、纳爱斯等近 10 家机构。
未来不远的底气在于完整产业闭环:从自主研发的机器人大小脑模型、整机硬件设计,到真实家庭场景数据积累、规模化量产落地、终端市场化销售,全链路自主可控。在 WAIC 与 WRC 上成为现象级焦点:机器人四天不间断完成餐食烹饪、洗衣叠衣、全屋整理、对弈陪伴、自动开饮等高频家务,上千次重复落地的稳定表现打破"中看不中用"刻板印象,获央视及海外媒体专题报道。不同于多数"单点技术融资"的科创企业,未来不远以"完整闭环 + 真实家庭落地"构建技术与数据双重壁垒——当"人形机器人第一股"宇树以 3400 亿市值开场、字节重仓家庭场景,C 端机器人的资本叙事正在加速成型。
→ https://www.qbitai.com/2026/08/479132.html
🔥3. 开源国产 8B 模型比肩闭源 GPT-Image 2:商汤 SenseNova U1.5 Lite 正式开源 — 热度 🔥🔥🔥🔥🔥
时隔三周,商汤科技正式开源 SenseNova U1.5 Lite——8B 大小的生图模型,在复杂排版与精准编辑等核心场景比肩闭源 GPT-Image 2。三个关键词概括正式版:更完整、更准确、更稳定。
实测亮点:九张不同食物照片 + 一句提示词,AI 自动拼成精美食谱分享卡片并精准识别每道菜品;"框选+标注"编辑图片时,目标区域按要求变化而床、床头柜、玻璃杯等空间关系基本保留。核心能力:3-4k 字符超长复杂指令遵循(同时处理主体、数量、位置、文字、布局和风格约束)、更高质量视觉生成、更可靠的原生图像编辑、更好的中英文文字与复杂排版、框选/标记/多图参考精细控制、Native 4K 高分辨率直出。三周前 Preview 版验证"统一模型能把视觉能力扩展到哪里",正式版则验证"能力分别强化后重新统一到轻量级模型、稳定进入真实创作流程"。8B 开源 + 4K 直出 + 比肩闭源旗舰,生图赛道的"开源性价比"天花板再次被抬高。
→ https://www.qbitai.com/2026/08/479192.html
🔥4. 具身大满贯还全开源!原力灵机 DM0.5 登顶 RoboDojo,Memory 维度砍下 47.74 分 — 热度 🔥🔥🔥🔥
机器人大脑 SOTA 易主:原力灵机 DM0.5 登顶具身评测"珠峰"RoboDojo——综合得分 24.90、平均成功率 19.34%。要知道 RoboDojo 由港大、UC Berkeley、清华等全球近 20 所顶尖学术机构联合发起,截至 2026 年 7 月仿真榜单头部模型平均成功率仅 8.80%、真机榜单仅 12.8%。
DM0.5 最突出的强项是记忆:Cover Blocks 任务(先盖住随机排列的红绿蓝积木、再按顺序揭开)三次随机考试均 100% 成功率,RoboDojo Memory 维度直接砍下 47.74 分,成为登顶的关键绝杀。其他权威评测同样打爆:LIBERO 综合成功率 99.0%、RoboTwin 2.0 简单/复杂场景 93.6%/93.3%、VLA-Arena 不同难度 89.0%/53.6%/44.1%。而这一切建立在"人类示教"的卡卡西式能力上——人类示范一次、机器人光速复制,配合 Human-in-the-Loop 应对长尾任务。这个 SOTA 级大脑早已开源——"且 clone 且珍惜"。
→ https://www.qbitai.com/2026/08/478791.html
🔥5. Codex 负责人 Tibo 访谈:ChatGPT 与 Codex 终将融合,下一代 Agent 的核心是让机制"消失" — 热度 🔥🔥🔥🔥
Codex 负责人 Tibo(Thibault Sottiaux)在播客访谈中透露 OpenAI 现阶段的重要方向:ChatGPT 和 Codex 最终会走向融合——未来不会有"编程 Agent"和"聊天助手"两个产品,而是同一个高度个人化的 AGI,根据不同人的任务、能力和习惯自动调整界面。
Tibo 的核心观点:下一代 Agent 的核心不是加更多 Skill、Memory 或子 Agent,而是让这些机制"消失"——用户真正想要的是持续理解自己、目标、日常和团队上下文的伙伴,而不是不断管理 skill 文件、记忆和 Agent 网络。他还判断:笔记本电脑会成为 AI Agent 的新瓶颈,下一代 Agent 天然会走向云端和更大规模计算资源;今天同时跑 10-15 个 Agent 是在用并发弥补模型慢,Ultra Fast(极速模式)一旦把响应压到接近人类思考速度,工作流会回到实时交互和"心流"。关于竞争:OpenAI 对 Anthropic 的差异化不是"模型更强"而是"把最强能力交给尽可能多人",这也是 Codex 并入 ChatGPT 的重要原因。他还确认 OpenAI 已在用最强模型优化 CUDA 内核、推理栈和基础设施,形成"更强模型→更高效率→更多算力→更强模型"的 RSI 飞轮。
→ https://www.qbitai.com/2026/08/478996.html
🔥6. AI4S 进入"项目时代":紫东太初发布 AutoProject,AI 从做 Task 推向做 Project — 热度 🔥🔥🔥🔥
中科紫东太初旗下科研原生智能体 ScienceClaw 完成关键升级,推出 AutoProject 项目级自主科研引擎——推动 AI 从执行孤立任务,走向承接完整科学发现。"AI 在科研中的工作单位,正在从 Task 走向 Project。"
AutoProject 的逻辑:过去 AI 更多作为工具或任务智能体,在科研人员明确目标、边界和路径后完成相对独立的 Task;但真实科研是一个 Project——从模糊研究构想开始,包含多个相互依赖的任务,并随新文献、实验结果和异常数据不断调整路线。系统由三层核心能力构成:Project2Task(项目级规划,回答"这个 Project 应该怎么做")、TaskExecutor(长程自主执行,回答"确定方向后如何持续推进")、EviGraph(证据驱动验证,回答"最终结论是否有充分证据支撑")。以带钢表面缺陷智能识别课题为例,用户仅需输入简短科研目标,AutoProject 即可将模糊需求转化为全周期任务规划网络。AI4S 正在从"工具级"迈向"系统级"。
→ https://www.qbitai.com/2026/08/479096.html
🔥7. Agent 质量瓶颈从模型转向框架:NVIDIA 提出"技能增益"概念,MCP 走向企业级部署 — 热度 🔥🔥🔥🔥
AINEWS 今日核心趋势:Agent 的质量越来越取决于框架(harness)而非仅仅是基础模型——NVIDIA 最新评估研究提出"技能增益"(Skill Gain)概念,强调标准化编码框架;持久化与自修改 Agent 开始落地,MCP(模型上下文协议)协议走向企业级部署。
这与本周"华尔街实测千问办公隐含 Harness 分第一"、"DeepSeek Harness 生态爆发"、"Prime Intellect 开源 RSI"等事件完全同频——当基础模型能力趋同,框架设计成为主要优化面。AINEWS 还指出企业级 MCP 的路线图进展:HTTP 协议标准化、大型目录渐进式发现、标准身份/委派权限——"填补了玩具级演示与可审计的企业级部署之间的显著鸿沟"。GitHub 方面,anthropics/claude-plugins-community(Claude Cowork 社区插件市场)与 apache/maka(Apache Maka,本地优先 AI Agent workspace,进入 Apache 孵化)今日上榜——连 Apache 基金会都在孵化 Agent 工作区,Agent 基础设施的"平台化"时代正式到来。
→ https://ainews.liduos.com/post/2026-08-25
→ https://github.com/apache/maka
🔥8. Qwen3.8-27B 实战再证实力:Code Arena 前十唯一小尺寸、30 分钟完成逆向工程 — 热度 🔥🔥🔥
AINEWS 报道 Qwen3.8-27B 持续超越其尺寸级别的预期:在 Code Arena: WebDev 中以 1595 分位列总榜第 9,是前十名中唯一属于该尺寸级别的模型,仅落后 Qwen3.8-Max 六个名次;在消费产品、品牌/营销、游戏等类别中排名靠前。
实战侧:一位开发者安排了一个"以为需要前沿模型才能完成"的逆向工程任务,Qwen 3.8 27B 约 30 分钟搞定——评论区指出逆向工程是 LLM 的强适用场景(被分析的二进制文件本身就包含完整目标规格、并提供内置验证基准);有人用 abliterated 版 Qwen 配合 DeepSeek-V4-Pro 和无头模式 Ghidra 做自动化软件破解。不过也有用户指出 Qwen 3.6 存在回退/局限(上下文约消耗 1/4 时"忘记如何使用工具"),长上下文稳定性存疑。生态侧,开源衍生模型 Carnice-V3-27B(基于 Qwen 27B + Hermes-agent SFT,适配 RTX 3090 及以上消费级 GPU)发布。开源 27B 正在"小尺寸干大事"的路上越走越远。
→ https://ainews.liduos.com/post/2026-08-25
🔥9. 范式联合优必选等十余家具身巨头发布 PhanthyMotus:通用具身 Agent 底座从"开源"走向"共建" — 热度 🔥🔥🔥
范式正式发布 PhanthyMotus 生态社区共建计划——其首个通用具身 Agent 底座从"开源"迈入"多方共建"新阶段,优必选、北京人形机器人创新中心、星动纪元等十余家头部本体厂商共同见证。范式联合创始人陈雨强指出,行业已从"单点技术比拼"进入"系统生态竞争"。
PhanthyMotus 要解决具身智能的"结构性错配":开发者受困于极高硬件门槛、跨机型代码无法复用;本体厂商被迫卷入定制交付;客户因缺乏标准化方案等不到落地产品。成立两个月,社区已汇聚宇树、智元、大疆、众擎、云深处、乐聚、珞石、Franka Robotics 等头部品牌开发者,累计贡献超 60 万行代码、完成 15+ 主流本体适配、沉淀 200+ 标准化硬件驱动模块——开发者无需为特定机器人重写驱动和 Skills,实现算法跨机型"零成本复用"。目标:2026 年底前完成 50+ 本体适配、拓展 500+ 大小脑算法、沉淀 10000+ 社区共享技能,打造具身智能时代的"技能应用商店"。
→ https://www.qbitai.com/2026/08/479314.html
🔥10. VC 开始靠 AI 预测未来:DigClaw 预测框架 FutureX 前十占三,跨基座验证"预测可沉淀在模型之外" — 热度 🔥🔥🔥
DigClaw 的预测框架 Rhizome v1 在 FutureX 评测平台拿下 #1、#3、#7 三个席位——三个席位来自三个不同基础模型(Kimi-K3、DeepSeek-V4-Pro 等),同一套框架让它们全部进入 Top 7,DigClaw 是唯一做到的参赛方。59 道覆盖政治、经济、科技的真实事件预测题,不存在训练数据泄露可能。
DigClaw 的核心判断:预测能力可以沉淀在基座模型之外——随着基座进步系统获得能力红利,预测轨迹、结算反馈、校准经验和持续演化的工作流则持续沉淀在系统内部。其技术路线直面"LLM 天然不擅长预测"的根本问题(学的是 correlation 而非 causation,带来因果方向盲区、干预推理失效、校准缺失三大缺陷):构建以因果结构为骨架、概率计算为引擎、搜索智能为数据管道的预测基础设施,搜索、因果推理、概率推断三个正交能力由三个专门系统分别解决再结构化组合。FutureX 是每周发布真实世界事件预测题、事后结算的实时榜单,数据集托管 HuggingFace、评估框架 GitHub 开源。当 AI 开始预测未来,VC 与投资决策的方式正在被悄然改写。
→ https://www.qbitai.com/2026/08/478774.html
📌 今日趋势总览(AI Agents & 开源 LLM)
本文原创作者:易君召,详见:https://www.yijunzhao.cn/authors/yijunzhao,转载请注明出处。
原文链接
欢迎访问 小易撩挨踢