小易撩挨踢 易君召的博客

AI Agents & 开源 LLM 简报 (2026年5月31日)

🔥 1. 复旦×通义提出 ToolCUA:Agent 同时面对 GUI 和 API 时「根本选不明白」— 498 pts 复旦大学和通义实验室 MobileAgent 团队联合提出 ToolCUA,一个面向 GUI-Tool 混合动作空间的 Computer Use Agent。研究发现,给 Ag

临时管理员 临时管理员 发布于 2026-06-01

AI Agents & 开源 LLM 简报 (2026年5月30日)

🔥 1. 英伟达联合清华团队发布 Gamma-World:世界模型从「一个人玩」到「多人共处」— 498 pts NVIDIA 联合清华大学、多伦多大学和 Vector Institute 发布 Gamma-World(γ-World),从底层位置编码和注意力机制出发,系统性解决了多智能体世界建模

易君召 发布于 2026-05-30

AI Agents & 开源 LLM 简报 (2026年5月29日)

🔥 1. Anthropic 发布 Claude Opus 4.8:支持数百子智能体并行,诚实性大幅提升 — 498 pts Anthropic 于 5 月 29 日发布 Claude Opus 4.8,距离上一版 4.7 仅隔 43 天。核心升级有三:一是支持数百个子智能体并行运行,大幅提升多

易君召 发布于 2026-05-29

AI Agents & 开源 LLM 简报 (2026年5月28日)

🔥 1. DeepSeek V4 芯模协同突破,推进 700 亿元融资创纪录 — 498 pts DeepSeek V4 发布后,比模型本身更受关注的是国产算力生态的根本性转变——从「芯片被动适配模型」走向「芯模协同」。V4 在昇腾芯片上完成了大规模、高强度、工程化的验证,这在过去 CUDA+英伟

易君召 发布于 2026-05-28

中国AI Agent互操作性标准1.0深度解读:打通智能体孤岛的里程碑

🔥 核心事件:2026年5月27日,中国AI Agent互操作性标准1.0正式发布,这是国内首个面向AI Agent领域的互联互通规范。该标准旨在解决当前AI智能体"各自为政"的生态孤岛问题——不同厂商的AI Agent可以互相发现、调用和协作。从MCP(模型上下文协议)到A2A(Agent到Ag

易君召 发布于 2026-05-28

AI Agents & 开源 LLM 简报 (2026年5月27日)

🔥 1. 开源大模型三强同日发布:Llama 4 405B + Mistral Large 3 + DeepSeek V4 同日登场 — 498 pts 5 月 27 日成为开源史上最强一天:Meta 发布 Llama 4 405B(50T tokens 训练)、Mistral 发布 Large

易君召 发布于 2026-05-27

AI Agents & 开源 LLM 简报 (2026年5月26日)

🔥 1. DeepSeek V4 正式发布:1.8T MoE,MMLU-Pro 92.3%,逼近 GPT-5 0.5% 以内 — 486 pts DeepSeek 于 5 月 24 日发布 V4,1.8 万亿参数 MoE 架构,MMLU-Pro 达 92.3%,与 GPT-5 差距缩小至 0.5%

临时管理员 临时管理员 发布于 2026-05-26

AI Agents & 开源 LLM 简报 (2026年5月25日)

🔥 1. Meta Llama 4 发布后持续发酵:开源社区评测报告密集出炉 — 486 pts Llama 4(1.2T MoE)上周发布后,开源社区在本周初密集发布独立评测。Scout 版本在代码生成和推理任务上表现强劲,但 Maverick 版本在部分基准上被 Qwen3-120B 和 De

易君召 发布于 2026-05-25

AI Agents & 开源 LLM 简报 (2026年5月24日)

🔥 1. Meta 正式发布 Llama 4:1.2T 参数 MoE,Scout 和 Maverick 两版本 — 486 pts Meta 于 5 月 22 日发布 Llama 4,1.2T MoE 架构,提供 Scout(1.2T/16 experts)和 Maverick(400B/8 ex

易君召 发布于 2026-05-25

AI Agents & 开源 LLM 简报 (2026年5月23日)

🔥 1. DeepSeek V4 发布:671B MoE,37B 激活,HumanEval 92.3% 逼近 GPT-5 — 486 pts 深度求索于 5 月 21 日发布 V4,671B MoE 仅激活 37B 参数,HumanEval 92.3%、GPQA 87.5% 接近 GPT-5。开放

易君召 发布于 2026-05-23

DeepSeek-V4-Pro 永久降价至1/4:国产大模型打响"价格战"第二枪

🔥 事件核心:DeepSeek 官方宣布,V4-Pro 模型 API 价格将于5月31日结束2.5折优惠后,正式永久调整为原定价的1/4。与此同时,API 完成输出提速与服务扩容,默认支持500并发同时在线。永久降价+全面提速,国产大模型在价格上的"内卷"再次升级。 ⚡ 一、降价幅度有多大?先看数

易君召 发布于 2026-05-23

AI Agents & 开源 LLM 简报 (2026年5月22日)

🔥 1. 阿里开源 Qwen3-120B:1200 亿参数全面超越 Llama 4,Apache 2.0 — 486 pts 阿里云于 5 月 22 日开源 Qwen3-120B,MMLU 92.5%、HumanEval 88.3%、GSM8K 96.1%,多项基准超越 Meta Llama 4

易君召 发布于 2026-05-23

AI Agents & 开源 LLM 简报 (2026年5月21日)

🔥 1. Meta 发布 Llama 4:1.2 万亿参数开源 MoE,刷新开源模型纪录 — 486 pts Meta 于 5 月 19 日发布 Llama 4,1.2 万亿总参数 / 250B 激活的 MoE 架构,在推理、编程、数学基准上刷新开源模型纪录。开源模型能力再上一个大台阶。 → ht

易君召 发布于 2026-05-21

AI Agents & 开源 LLM 简报 (2026年5月20日)

🔥 1. Meta 发布 Llama 4 Ultra:1.6 万亿参数,迄今最大开源模型 — 486 pts Meta 于 5 月 11 日发布 Llama 4 Ultra,参数规模达 1.6 万亿,支持多模态输入和超长上下文推理。被业界视为开源 vs 闭源阵营的关键转折点。 → https://

易君召 发布于 2026-05-21

未来 10 年:大模型不会杀死编程语言,但会重新定义编程方式

在上一篇文章《Spring Boot 4.0 时代降临:Java 开发的下一个十年》中,有粉丝朋友留言评论提出了未来10年可能Java、SpringBoot这些传统编程语言都不存在了,全部被AI重新定义。这也引起了我的深刻思考,随着人工智能AI大模型LLM迅速崛起,这两年软件行业简直变了天,这个行业

易君召 发布于 2026-05-20

谷歌Gemini 3.5 Flash发布深度解读:AI速度革命与中外大模型差距

🔥 谷歌发布Gemini 3.5 Flash:AI输出速度4倍于GPT-5.5 2026年5月20日,在2026谷歌I/O开发者大会上,谷歌CEO皮查伊正式推出Gemini 3.5 Flash模型。该模型在多项基准测试中超越上一代旗舰Gemini 3.1 Pro,输出速度达到每秒289 token

易君召 发布于 2026-05-20

AI Agents & 开源 LLM 简报 (2026年5月19日)

🔥 1. Meta Llama 4 405B 多模态模型正式发布:开源模型迈入 400B+ 时代 — 486 pts Meta 正式发布 Llama 4 405B,原生多模态 MoE 架构,在视觉-语言任务上达到 SOTA。256K 上下文窗口,开放权重,社区可自由微调和商用。 → https:/

易君召 发布于 2026-05-19

AI Agents & 开源 LLM 简报 (2026年5月18日)

🔥 1. 智谱 AI 发布 AutoGLM 3.0:自主智能体操作系统,月活破 2000 万 — 486 pts 智谱 AI 于 5 月 18 日发布 AutoGLM 3.0,定位自主智能体操作系统(AAOS),支持多智能体协作、屏幕理解和跨应用操作,可在手机上自主完成外卖下单、行程规划等复杂任务

易君召 发布于 2026-05-18
上一页 下一页