易君召
发布于 2026-08-05 / 作者:易君召 / 0 阅读
0

AI Agents & 开源 LLM 简报 (2026年8月4日)

#AI

🔥 1. DeepSeek低价风暴打服硅谷:V4 Flash 7分钱做游戏、5毛钱做CS,海外平台争相倒贴 — 980 pts

DeepSeek V4 Flash的价格风暴正在席卷全球。实测案例令人瞠目:V4 Flash版太空射击游戏只要7分钱,做CS(反恐精英)只要5毛钱——半年前根本不敢想。OpenCode称8月1日一天DeepSeek Flash就在其平台跑了8万亿Tokens。更神的是,海外"中间商"们还在疯狂叠加补贴:Nous Portal直接给V4 Flash打一折(比Fable 5便宜一千多倍);开源Coding Agent Cline上周六宣布提供V4-Flash免费额度,结果烧了几天发现太便宜,直接把免费额度翻了三倍。真正的转折点是7月31日的V4-Flash-0731——与4月Preview相同的架构,只是重跑了一遍后训练:DeepSWE得分从7.3飙到54.4、Cybergym拿下76.7、能力直逼Opus 4.8。"当模型能力和顶尖选手只差几分时,便宜就不再只是性价比,而是生态武器的终极形态。"

https://www.qbitai.com/2026/08/465814.html

🔥 2. 数学家24小时驳回OpenAI攻破的猜想:"AI证对了每句话,但已跟原猜想无关" — 960 pts

OpenAI宣称下一代AI模型推翻了Connes刚性猜想(1980年提出的世界级难题),并公开了37000行Lean 4形式化代码。然而第二天,堪萨斯大学拓扑物理中心的J. L. Nielsen就发表人类论文回应:AI提出的反例不成立。Nielsen把37000行代码从头追到尾,把每个对象对回数学原型,发现AI构造的其中一个群其实没有满足附加条件(既不是ICC也没有性质(T))——"要证什么"出了问题,不是"证得对不对"的问题,Lean只负责验证后者。Nielsen将自己的两条反驳也写成Lean代码编译通过。文章点出更深层的危机:Lean内核能保证的只是证明在形式上严丝合缝,不负责是否真的证明了原结论——"机器检查的是形式,不是意思"。此前一份针对五个常用Lean基准的审计就给出了4833条发现(反例、空洞定理、不可靠公理),全部通过了机器验证。Connes刚性猜想仍然开放。

https://www.qbitai.com/2026/08/465792.html

🔥 3. 开源版Claude Science来了:北大&元空开源OpenAI4S,零依赖MIT协议内置30+科研Skills — 940 pts

北京大学&元空AI Agent联合实验室正式开源OpenAI4S(Open AI for Scientist)——一个开源、MIT协议、核心零依赖的科研智能体项目,被称作"开源版Claude Science"。它不是长得像,而是沿着Code-as-Action(代码即行动)思路把引擎、持久内核、host-RPC协议、安全层用开源方式独立复现了一遍。核心设计:"代码即行动,内核即环境"——智能体直接生成Python/R代码并在持续运行的内核中执行,数据保留在工作环境里,前一步下载的数据可直接交给后一步分析。首批内置30+个科研Skills(蛋白质结构、分子对接、单细胞分析、文献检索等),其中14个封装了需要GPU的科学计算能力。每份科研产物都会被记录、保存和版本化。"外部服务连不上,它会明确告诉你哪里做不了,不会偷偷塞一份模拟数据把论文强行补齐。"

https://www.qbitai.com/2026/08/466386.html

🔥 4. 腾讯混元发布Hy ASR 3.0:语音识别开始"理解上下文" — 900 pts

腾讯混元正式发布新一代语音识别模型Hy ASR 3.0 preview,基于最新大语言模型Hy3的语言理解能力,融合高精度语音识别与深度语义理解——从"逐字转写"演进为"理解语境、兼容场景、一键直出"。多语种WER控制在3%左右:中文普通话3.34%、英语2.62%、粤语3.12%,整体领先竞品。四大能力提升:通用识别更准(含方言、中英混说)、结合上下文精准纠错同音词、消除语义歧义、支持热词注入(快速识别品牌名和人名)、复杂声学环境(高噪、耳语、悄悄话)专项优化。架构上采用MoE+Hy3基座,自研无监督语音Encoder经数千万小时级数据训练,SFT数据覆盖10大方言片区。已上线腾讯云API,元宝App首发接入(免费),WorkBuddy等产品陆续接入中。

https://www.qbitai.com/2026/08/465973.html

🔥 5. 亿级日活AI App的"算力生死劫":ARPU 2美元 vs 成本3美元,靠跨云架构砍掉75% GPU集群 — 880 pts

一家DAU破亿的"AI穿搭+购物推荐"出海应用,正深陷"越跑越亏"的算力困局:在新兴市场ARPU(单用户收入)只有2美元,而每人身上的云端算力和传输成本是3美元——每留住一个活跃用户就净倒贴1美元。三重算力锁链:L4 GPU生成一张图要12秒(年租卡费2.55美元/人)、跨境出站流量费"算力花一万流量花五千"、14ms网络延迟就让GPU利用率打七折。破局方案:转向Akamai推理云并将GPU重构为NVIDIA RTX PRO 6000(96GB显存、原生支持FP4精度——H100最低只到FP8),生成耗时从12秒压到3-5秒,服务器集群规模直接缩减75%,单图摊销成本反而大幅下降。这个案例揭示了AI推理经济的核心公式:推理成本的优化,正在从"换更快的卡"转向"选对精度和架构"

https://www.qbitai.com/2026/08/465732.html

🔥 6. OpenAI天价网红公关翻车:每晚2000美元的"农场疗愈"捅了马蜂窝 — 860 pts

OpenAI在纽约哈德逊河谷豪华度假村(周末房价每晚超2000美元)举办了一场"夏令营"式高端PR活动,邀请的不是技术圈而是Instagram网红——活动内容是采蜂蜜、绘画、田园牧歌,再发帆布袋和蜂蜜周边,顺便推广ChatGPT Work。结果帖子一出全网炸锅:"太虚伪""你们咋不住到数据中心里去呢""世界正处于水深火热之中,现在可不是炫耀豪华酒店的好时机"。背景补充:OpenAI最近正准备在俄亥俄州大搞数据中心(项目总投入可能超5000亿美元),本就在美国激起自然环境影响的争议——这档口搞田园牧歌属实画风违和。已有参与网红删除了相关视频。这场翻车也暴露了AI巨头"破圈营销"与公众情绪之间的巨大落差。

https://www.qbitai.com/2026/08/466032.html

🔥 7. HF发布LFM2.5-2.6B:本地Agent部署迎来最轻量方案 — 840 pts

Hugging Face发布LFM2.5-2.6B模型,主题是"Deploy local agents everywhere"——让本地Agent部署无处不在。这个仅26亿参数的小模型专注Agent场景优化,可在边缘设备和消费级硬件上运行Agent任务。它与Kimi K3(3T)、Inkling-Small等巨型模型形成完整光谱:从3万亿参数的云端旗舰到26亿参数的边缘Agent,开源模型生态正在覆盖全场景。同一日OSCHINA报道Cloudflare Computer开源——"你的Agent需要一台电脑,而不是一个容器",Cloudflare的推理优化实践(KV cache量化+权重压缩,吞吐量提升41%、成本降30%)也为本地Agent部署提供了基础设施参考。

https://hf-mirror.com/blog
https://www.oschina.net/news

🔥 8. Cloudflare Computer开源+"Agent需要一台电脑":推理优化吞吐提升41% — 820 pts

Cloudflare开源Cloudflare Computer——提出"你的Agent需要一台电脑,而不是一个容器"的理念,为AI Agent提供完整的计算机环境而非隔离容器,让Agent可以像人类一样操作系统级资源。同期Cloudflare分享推理优化实践:KV cache量化+权重压缩,吞吐量提升41%、成本降30%。这套优化方案与亿级App的跨云架构案例(砍掉75% GPU集群)形成呼应——AI推理的成本战争已经从"模型层"打到"基础设施层"。Simon Willison同日撰文"重新拥抱MCP"(无状态协议如何改变游戏规则),MCP生态的成熟让Agent与工具的连接从"专用接口"走向"标准协议"。

https://www.oschina.net/news

🔥 9. OpenAI公开邮件回应苹果诉讼:"Apple is getting this wrong" — 800 pts

OpenAI公开邮件和聊天记录回应苹果诉讼,直言"Apple is getting this wrong"。这是AI行业与科技巨头之间最新的一起重大法律争端,围绕AI技术合作、数据使用或合同条款展开(具体争议细节待进一步披露)。今年以来,AI行业的知识产权诉讼密集爆发:印度法院刚判决OpenAI用新闻内容训练AI不侵权,美国则有多个版权诉讼进行中——AI训练数据的合法边界正在全球范围内被逐案划定。这场OpenAI vs Apple的争端,将再次检验"AI公司与平台巨头"之间的法律博弈规则。

https://www.oschina.net/news

🔥 10. 资本重仓端侧物理AI+开发者生态持续进化:MateClaw 2.0与HarmonyOS 7 — 780 pts

前海母基金数亿元押注Om AI联汇,加速端侧AI商业化落地——端侧物理AI成为资本新宠。开发者生态方面:MateClaw 2.0.0发布(Agent团队、共享任务板与可靠执行链),将多Agent协作推向工程化;HarmonyOS 7正在"抹平系统能力的接入鸿沟"(开发者苦造轮子久矣);慕尼黑市政府为全职开源项目维护者提供资助——开源可持续性获得公共财政支持。从端侧AI到开源维护者资助,AI生态的"毛细血管"正在全面打通。

https://www.qbitai.com/2026/08/466114.html
https://www.oschina.net/news

📌 今日趋势一览

趋势

热度

DeepSeek V4 Flash价格风暴席卷硅谷

🔥🔥🔥🔥🔥

人类数学家24小时驳回AI攻破的猜想

🔥🔥🔥🔥🔥

开源版Claude Science(北大OpenAI4S)

🔥🔥🔥🔥🔥

ASR进入"理解上下文"时代

🔥🔥🔥🔥

AI推理成本战打到基础设施层

🔥🔥🔥🔥🔥

OpenAI豪华PR翻车

🔥🔥🔥🔥

26亿参数本地Agent模型发布

🔥🔥🔥🔥

Cloudflare Computer开源

🔥🔥🔥

OpenAI vs 苹果诉讼升级

🔥🔥🔥🔥

端侧物理AI获资本重仓

🔥🔥🔥🔥

注:8月4日,"价格战"与"真相战"同日上演。DeepSeek V4 Flash把3D游戏做到7分钱、5毛钱做CS,海外平台争相倒贴——AI推理成本正以"福特T型车"式的速度平民化;与此同时,人类数学家24小时驳回OpenAI声称攻破的猜想——"AI证对了每句话,但已跟原猜想无关",给AI科研结果的可信度敲响警钟。一边是白菜价的智能,一边是仍需人类把关的真相——这正是2026年AI产业最真实的双面镜像。