🔥 1. 阿里Qwen3.8突袭发布:2.4万亿参数旗舰Max冲进全球第一梯队,直逼Claude — 980 pts
8月3日,阿里巴巴突袭发布新一代基座大模型Qwen3.8——总参数量2.4万亿(激活95B)的旗舰版Qwen3.8-Max,今日最新放榜的Arena榜单中冲到全球第一梯队,表现直逼Anthropic Claude系列,编程能力甚至超过Claude Opus 5和Fable 5的High版本。价格却打了下来:国内每百万Token输入12元、输出36元,隐式缓存命中仅1.5元,国际价格仅为Opus 5的40%与24%。硬核能力包括:从空文件夹出发自主运行16天交付真实可用的自进化智能体框架"oh-my-cli"(已开源);一小时处理数百份法律文档标注上千条款(法务团队需一周);数十秒拆解160小时比赛录像的8400多个攻防回合。Qwen3.8-Max预计下周开源,同时开源Qwen3.8-27B。"又贵又闭源"的旧叙事,正在被"能打又便宜"的新现实击穿。
→ https://www.qbitai.com/2026/08/465226.html
→ https://www.qbitai.com/2026/08/465215.html
🔥 2. Hugging Face CEO发声:中国正在开源模型上碾压我们 — 960 pts
据OSCHINA报道,Hugging Face CEO公开发声:"中国正在开源模型上碾压我们。"这一表态与本周开源动态形成强烈印证——Kimi K3(3T参数)登顶HF趋势榜、Qwen3.8-Max下周开源、商汤SenseNova U1.5-Lite-Preview开源、DeepSeek V4-Flash 0731发布、智谱GLM-5.3提前曝光……中国开源模型正以每周一至两款的速度密集发布,且全部处于全球第一梯队。从"追赶者"到"定义者",中国AI开源生态在模型规模、能力水平和发布节奏三个维度上全面领先。与此同时,DeepSeek Harness宣布内测邀请、Gitee AI队友上线——开源Agent基础设施也在同步爆发。
→ https://www.oschina.net/news
→ https://ainews.liduos.com/post/2026-08-03
🔥 3. 华为诺亚开源MindMemOS:AI Agent的记忆操作系统,让"记忆和Skill一起进化" — 940 pts
华为诺亚方舟实验室开源面向AI Agent的可迁移、自演进记忆操作层MindMemOS——解决Agent使用体验的最大尴尬:"每换一个Agent就像换了一个不了解你的新员工"。MindMemOS将记忆从单个Agent中解耦,用"实体-属性-时间"三维结构重建记忆中的世界——不再把"用户以前喜欢X"和"用户现在改用Y"当成两段互不相干的文本,而是放回同一实体、同一属性的时间轴上。两大创新机制:Dreaming(离线巩固记忆、消解冲突,压缩19.4%-23.5%活跃记忆的同时将问答准确率最高提升10.3个百分点)和Feedback挖掘(从用户隐式纠正中强化或降级已有记忆)。MindMemOS在LoCoMo上取得94.03分,在MemoryAgentBench上大幅领先。项目已开源(github.com/mindscale-noah/MindMemOS)。
→ https://www.qbitai.com/2026/08/464835.html
🔥 4. 赛博义父Tibo爆料:谷歌早一年就做出了ChatGPT,硬是没敢发 — 920 pts
OpenAI Codex负责人Tibo(Thibault Sottiaux)亲自下场证实了一段陈年往事:谷歌比OpenAI早一年就做出了ChatGPT——最初叫LMChat,后来又换了代号,但谷歌太紧张不敢发布,DeepMind则被禁止推出可能冲击谷歌业务的产品。Tibo当时就是那支谷歌团队的成员,"我经常会想起这件事"。前谷歌大脑负责人Jeff Dean曾透露谷歌在ChatGPT之前就有内部Chatbot,"但觉得用它还不如直接用谷歌搜索"。Tibo的爆料揭示了谷歌AI战略的最大教训:以"谷歌搜索"作为对标线起步太高,2023年的大模型"几乎什么都会搞错,但凡涉及时效性内容全是幻觉",但"Scaling解决了一切"——"比谷歌搜索更好"这个验收标准,最终让谷歌付出了昂贵代价。故事还与近期人才动荡呼应:Transformer论文核心作者Noam Shazeer加入OpenAI、DeepMind副总裁John Jumper前往Anthropic。
→ https://www.qbitai.com/2026/08/465176.html
🔥 5. 具身智能开始按生产力重新算账:Demo的高估值时代结束了 — 900 pts
WAIC之后,具身智能行业进入微妙冷静期:开年至今国内融资事件超200起、百亿估值俱乐部扩员到13家,但投资人问的问题已经变了——从"你的机器人会做什么"变成"你的机器人每天干几小时活?客户续不续约?投进去的钱什么时候有回馈?"。文章复盘了"PPT估值、Demo定价"的行业奇观成因:路线尚未收敛时,资本买的是"范式的入场券"而非财务报表。但现在范式切换拐点已现——当Demo不再稀缺,估值逻辑从"为可能性付费"转向"为生产力付费"。具身智能正重走大模型的三年周期:百模大战→头部成形→中间层消失。幸存者的共同答案:手里有真实场景、有数据闭环、有可测算的单位经济性,以及工程化交付能力——"演示做到90分靠天赋,交付做到99.9%靠体系"。
→ https://www.qbitai.com/2026/08/465225.html
🔥 6. 商汤开源SenseNova U1.5-Lite-Preview:4K直出的国产轻量生图模型 — 880 pts
商汤面向社区开源SenseNova U1.5-Lite-Preview——一个轻量级原生统一多模态模型的早期预览版,延续商汤自研NEO-Unify架构,把语言、视觉语义和像素生成放进同一套模型。原生4K直出仅是亮点之一:仅8B-MoT参数的轻量身形下,支持长篇、多约束、层次化结构化视觉指令,面向海报、信息图、品牌视觉等高信息密度内容;更关键的是"指哪儿改哪儿"的编辑能力——支持参考图、多图组合、局部文字编辑以及红框、坐标和marker精准编辑。量子位实测:能从零做复杂信息图、复刻一张图的逻辑再重新输出(领悟的不只是画风而是整套设计框架)、在同一套版式里更换主视觉(模拟真实改稿场景)。"会画图只是第一步,真正决定能否进入创作流程的是复杂任务和编辑能力。"
→ https://www.qbitai.com/2026/08/465673.html
🔥 7. 阿里"千问办公"开启公测:业内首款桌面+云端+企业协同三合一Agent — 860 pts
阿里巴巴旗下企业级Agent产品"千问办公"(QwenWork)开启公测,由QoderWork、MuleRun、悟空三款产品全面整合而来,是业内首款同时支持桌面端Agent、云端Agent、企业协同Agent的产品。最大的区别是全面瞄准企业级市场——已初步打通钉钉IM,未来将全面连接企业真实的数据库和工作流。典型场景:20人律所资深律师完成首份并购尽调报告后,一键沉淀为"组织级Skill"向全团队共享,新人调用该Skill即可产出报告;跨国企业中,中国团队下班后7×24小时在线的Agent在项目群中持续回答英国团队问题。公测期间新用户注册即得2000积分,首周每日登录可领500-2000积分。
→ https://www.qbitai.com/2026/08/465211.html
🔥 8. 亚马逊AI写代码成本失控:烧掉1215万元,超预算860% — 840 pts
据OSCHINA报道,亚马逊内部AI编程项目成本严重失控——AI写代码烧掉1215万元(约171万美元),超预算860%。这一案例揭示了AI编程规模化落地中的真实经济账:模型调用费、Token消耗、多轮迭代调试、人工审查纠错的隐性成本远超预期。它与GPT-5.6自我优化降价(成本降20%)、DeepSeek V4-Flash后训练飞跃形成鲜明对比——AI编程的成本曲线正在分化:模型侧通过自我优化和开源降价不断压成本,企业侧却因工程化不足而烧钱失控。IBM同日报告称1/4的恶意攻击由AI驱动,单起平均造成600万美元损失——AI的成本与风险都在以同样的速度膨胀。
→ https://www.oschina.net/news
🔥 9. DeepSeek V4-Flash 0731发布+Harness内测:开源Agent生态再提速 — 820 pts
DeepSeek发布V4-Flash 0731版本:后训练飞跃、API上线与开源权重即时发布,本地推理社区反应热烈。同日,DeepSeek Harness宣布内测邀请——被称为"全网最大规模开源Agent路演现场",将Harness概念(Agent运行框架)推向开源社区。OSCHINA同期刊发《Loop Engineering:让AI Agent自己跑起来的工程方法》——Qwen3.8正是用这个框架自主运行16天交付了自进化智能体。从"造模型"到"造Harness",开源Agent的技术栈正在快速补齐。商汤SenseNova、智谱GLM-5.3、DeepSeek V4-Flash、Qwen3.8——中国开源模型生态呈现"多线并进、周更不断"的密集节奏。
→ https://www.oschina.net/news
→ https://ainews.liduos.com/post/2026-08-03
🔥 10. 微软Copilot超级应用+IBM AI威胁报告+Gitee AI队友:生态与安全双线推进 — 800 pts
微软确认开发Copilot AI超级应用(整合聊天、编程与智能代理),进一步巩固"AI时代的Office"布局;Gitee AI队友正式上线(免费领500 Credits);Qualia开源面向Java开发者的AI Agent框架——开发者工具全面Agent化。安全侧:IBM报告显示1/4的恶意攻击由AI驱动,单起平均造成600万美元损失,AI安全威胁从"新闻事件"升级为"系统性风险";AgentLoop通过语义链路还原精准发现AI调用中的敏感数据泄漏,拒绝"黑盒式"治理。一面是Agent生态全面繁荣,一面是AI风险持续升级——"造得更快,也要守得更严"成为8月的主旋律。
→ https://www.oschina.net/news
📌 今日趋势一览
注:8月3日周一,信息量全面爆发。最重磅的是阿里Qwen3.8-Max突袭发布——2.4万亿参数、价格仅为Opus 5的40%、编程超Fable 5、下周开源,再加上Hugging Face CEO承认"中国正在开源模型上碾压我们",中国开源AI的攻势已进入"全面压制"阶段。而谷歌"早一年做出ChatGPT不敢发"的爆料、华为MindMemOS开源、亚马逊AI编程成本失控,则分别从历史教训、技术纵深和经济现实三个维度,勾勒出这个AI新纪元的完整图景。