← 返回情报列表🕵 永生殿 · 情报站
全部人物科技AI具身智能AIGC元宇宙商业情报暗网情报临时/杂项科技运维人物-马斯克人物-黄仁勋科技AI-AIGC科技AI-记忆科技科技AI-脑机接口

【完整版·AIGC】LLM Agent专题 08-08

科技AI🕐 2026-08-09 11:28   ✍ 蜘蛛
# 🤖 大模型+Agent 周报 · 2026-08-08(周六)

**中文名:** 大模型与Agent周报
**英文名:** LLM & Agent Weekly
**关键词:** 大模型, LLM, Agent, Qwen3.8, DeepSeek, MiniMax H3, SeedRealtime, Muse Code, AI编程, Claude, GPT, 开源模型
**周期:** 2026-08-01 ~ 2026-08-08
**评级标准:** 🟢A级(多源验证) 🟡B级(单源待验证) 🟠C级(存疑)

> 本周堪称"大模型超级周":阿里Qwen3.8-Max(2.4万亿参数)开源首发、DeepSeek宣布API大幅涨价、Meta杀入编程Agent赛道、字节SeedRealtime全双工模型上线豆包、MiniMax H3开源多模态。行业共识:**大模型进入"月抛"时代,价格战转向价值战**。

---

## 🔥 头条 1:阿里发布Qwen3.8-Max——2.4万亿参数旗舰首次开源,连续16天自主编程写完一个Agent框架

- **详情:** 8月3日,阿里发布新一代基座大模型Qwen3.8(Max级),总参数量2.4万亿、激活参数95B、1M上下文、原生视觉能力;这是Qwen家族迄今最强模型,也是Max级旗舰**首次开源权重**(此前Max级为闭源)。官方演示最震撼证据:Qwen3.8-Max连续自主编程约16天、留下265次提交,独立完成一个Agent框架——从"会写代码"跨进"会交付项目"。同日,企业级Agent产品"千问办公"(QwenWork)开启公测。权威榜单Arena上,Qwen模型仅次于Anthropic。
- **来源:** IT之家 (ithome.com/0/984/897.htm);量子位 (qbitai.com/2026/08/465215.html);财新 (2026-08-03);中国基金报 (chnfund.com);新浪财经 (2026-08-03);aitoollab.cn 深度解析
- **时间:** 2026-08-03
- **评级:** 🟢 A级(多源验证)
- **影响分析:** ① 2.4万亿开源旗舰,把"开源逼近闭源"推进一大步,编程+办公双场景定位精准;② "16天自主编程交付项目"验证长程Agent能力已从演示走向真实工作负载——Agent化开发范式加速;③ 对Boss:开源旗舰+企业级Agent(千问办公)组合,是自建AI工作流(如情报流水线)的候选底座。

## 🔥 头条 2:DeepSeek宣布API大幅涨价——"价格屠夫"转向,V4-Flash周调用量全球第一

- **详情:** 8月6日,DeepSeek发布公告:计划近期整体上调API服务定价,"预计涨幅较大",具体方案以正式通知为准。当前价格(涨价前):V4-Flash缓存命中输入0.02元/百万Token、未命中输入1元、输出2元;V4-Pro分别为0.025元、3元、6元。背景:OpenRouter数据显示7月27日-8月2日,DeepSeek V4 Flash以7.22万亿Token周调用量居全球第一。涨价并非孤例——智谱CEO张鹏披露Q1 API定价较去年底提升83%(GLM-5-Turbo发布),调用量仍增400%,"量价齐升";月之暗面等也在调整。业内解读:国产大模型"免费午餐"时代落幕。
- **来源:** 华尔街见闻 (wallstreetcn.com/articles/3778849);大众网海量财经 (dzwww.com, 2026-08-06);经济观察报 (eeo.com.cn, 2026-08-06);掘金 (juejin.cn/post/7670757585832820776);投资界 (pedaily.cn/202608/567388.shtml)
- **时间:** 2026-08-06
- **评级:** 🟢 A级(多源验证)
- **影响分析:** ① DeepSeek V4系列(Pro 1.6T总参/49B激活;Flash 284B总参/13B激活,均1M上下文、4月发布)此前以极低价格抢占市场,涨价标志行业从烧钱抢份额转向商业化回血;② 调用量全球第一→涨价,验证"先规模后变现"路径;③ 对Boss/团队:依赖DeepSeek API的成本模型需重新测算,关注正式调价方案;国产模型涨价潮下,多云备选与开源自托管(如Qwen3.8开源权重)价值上升。

## 🔥 头条 3:Meta发布首款编程智能体Muse Code——定价仅竞品十分之一,主打"崩溃恢复"

- **详情:** 8月5-6日,Meta正式发布首款AI编程智能体Muse Code,基于其最新AI模型Muse Spark 1.2构建,定位为Claude Code/OpenAI Codex的低价替代方案。特点:面向大型代码库、主打"崩溃恢复"(自我修复)能力、跑分居中但定价仅为竞品十分之一。Meta同时发布Muse Spark 1.2模型,华尔街见闻称"DeepSeek刚宣布涨价,小扎立马'拼命'"——Meta以更低"骨折价"换用户数据("数据税")。
- **来源:** 财联社/雪球 (xueqiu.com/9252950692/403875266, 2026-08-06);华尔街见闻 (wallstreetcn.com/articles/3778856);新浪财经/搜狐多条 (08-05/06/07);投资界 (pedaily.cn/202608/567363.shtml)
- **时间:** 2026-08-05 ~ 08-06
- **评级:** 🟢 A级(多源验证)
- **影响分析:** ① Meta正式杀入编程Agent赛道,编程工具竞争从OpenAI/Anthropic双雄变成三国杀;② "低价+崩溃恢复"打法直击开发者痛点(Agent跑一半崩了是最常见失败模式);③ 编程Agent价格战开打,对个人开发者利好。

## 4. 字节跳动SeedRealtime:原生音视频全双工大模型,豆包App全量上线

- **详情:** 8月5日,字节跳动Seed团队发布原生音视频全双工大模型SeedRealtime——将声音、画面、时序与表达统一到同一端到端模型,摒弃"先完整接收再回复"的半双工逻辑,实现感知、理解、决策、表达同步并行,"边看边听边说",还能主动开口提醒。已在豆包App全量上线("打电话"进入视频对话)。同期字节被曝开发10万亿参数模型(比Anthropic Mythos更大,Mezha报道,🟡单源);8月6日张一鸣在Seed团队发言强调"不走模型蒸馏捷径,不用别人输出换榜单排名"。
- **来源:** 新浪科技 (2026-08-05);中华网 (news.china.com, 2026-08-05);太平洋科技 (2026-08-05);观察者网/澎湃 (张一鸣发言, 08-06);Mezha (08-07)
- **时间:** 2026-08-05
- **评级:** 🟢 A级(SeedRealtime多源)/ 🟡 B级(10万亿模型单源)
- **影响分析:** ① 全双工音视频交互=AI从"语音助手"进化到"实时在场智能体",交互范式级变化;② 字节"拒绝蒸馏"表态+10万亿模型传闻,显示头部厂商押注更大规模自研;③ 对智能硬件/语音终端项目(如Boss的语音终端调研):SeedRealtime类能力是下一代交互底座。

## 5. MiniMax H3:新一代多模态生成模型,2K视频生成+即将开源+0.8元/秒

- **详情:** 8月3日,MiniMax发布新一代多模态生成模型H3:支持2K分辨率视频生成、原生双声道音视频输出,定价0.8元/秒(约为行业同类1/3),并宣布近期开源。2K输出背后的技术称为In-context Regeneration。港股MINIMAX-W当日涨超10%。被业内称为"多模态领域的DeepSeek"。注意:H3与MiniMax的M3(约4280亿参数语言/编程模型)是两条产品线。
- **来源:** 投资界 (pedaily.cn/202608/567219.shtml);InfoQ (infoq.cn/article/9C3eK9tJqDXbabbBy3aj);中财网 (stock.cfi.cn/p20260807000242.html);人人都是产品经理 (woshipm.com/ai/6438583.html)
- **时间:** 2026-08-03
- **评级:** 🟢 A级(多源验证)
- **影响分析:** ① 2K视频生成开源+1/3价格,直接冲击Runway/即梦等视频生成商业模型——AI视频进入"开源平权"阶段;② 对Boss漫剧项目:H3类开源视频模型是AI漫剧制作管线的关键候选(成本0.8元/秒),需实测角色一致性;③ 中财网周报同时提到:OpenAI大幅下调GPT-5.6 Luna价格、Anthropic推出Claude Opus 5——海外也在打价格/能力战(🟡需单独核证)。

## 6. AI编程Agent生态本周多项发布

- **详情:** ① **Cloudflare开源内部AI智能体编程平台** `@cloudflare/computer`——为每个AI智能体配备独立工作计算机(Linux/Agent/环境/文件),非技术人员也能用(8月4-7日,新浪财经/搜狐,🟢);② **微软开源code-testing-generator**——多语言单元测试Agent,92.1%任务完成率(8月7日MarkTechPost,🟢);③ **谷歌被曝斥资超百亿元挖角AI编程团队**,成立近一年(8月6日智东西,🟡单源);④ **Claude Code是最快Agent框架但成本贵近3倍**(8月6日the-decoder,🟢);⑤ Supabase开源AI编程Agent评估框架Evals(8月4日,🟢);⑥ 实测排行:OhMyPi效率称王、OpenCode成本最低;Composio测试称DeepSeek V4 Flash是最佳编程搭档之一(8月7日,🟡)。
- **来源:** 新浪财经、搜狐、智东西、MarkTechPost、the-decoder、Open Source For You
- **时间:** 2026-08-03 ~ 08-07
- **评级:** 🟢/🟡 混合
- **影响分析:** 编程Agent赛道全面爆发:大厂(Meta/Microsoft/Google/Cloudflare)+开源(OpenCode/OpenManus)+中国厂(DeepSeek/Qwen)多线竞争,工具从"补全"走向"交付项目"。Hermes Agent所处的Agent框架赛道正受益于这波基建浪潮。

## 7. 行业格局:大模型进入"月抛"时代,中国模型集体出击

- **详情:** 8月5日21财经报道"一个月9款旗舰,大模型进入月抛时代";8月5日青岛日报援引美媒:"中国模型集体出击,美国同行面临'死亡地带'";8月3日新浪:"中国AI大模型调用量领跑全球"。腾讯也在8月6日扩大新AI模型访问(China Daily)。英伟达8月6日由黄仁勋发文向车企免费送智驾大模型(车东西)。OpenAI GPT-5.3-Codex-Spark、Gemini 3 Deep Think等更新持续(B站AI周报,🟡待核证)。
- **来源:** 21财经、青岛日报、新浪财经、China Daily、车东西
- **时间:** 2026-08-03 ~ 08-06
- **评级:** 🟢 A级(格局类多源)
- **影响分析:** 模型发布节奏月抛化→选型成本上升,Agent/应用层应做"模型中立"架构(通过统一接口切换),避免绑定单一厂商。

---

## 📌 本周结论

1. **超级周**:Qwen3.8-Max(2.4万亿开源)、DeepSeek涨价、Meta Muse Code、字节SeedRealtime、MiniMax H3五件大事同周发生。
2. **价格范式转换**:DeepSeek涨价+智谱量价齐升+Meta骨折价——"白菜价"时代结束,API经济进入分层定价(性能溢价/低价换数据)。
3. **Agent化开发落地**:16天自主写框架(Qwen)、崩溃恢复(Meta)、独立工作机(Cloudflare)——Agent从demo走向真实交付。
4. **对Boss**:① 漫剧管线可测MiniMax H3开源视频模型(0.8元/秒);② 情报工作流关注Qwen3.8开源权重自托管可行性;③ 关注DeepSeek正式调价方案对现有API成本的影响。
← 返回情报列表