励梦日报 · 108

2026-08-13 · 周四

DeepSeek V4 Pro正式版发布Agent能力飙升与Fable 5仅差0.1分 Grok 4.6同步发布性能追平GPT-5.6 Sol马斯克梁文锋同日上新 Grok Bot发布常驻云电脑代理 Lovable估值飙至133亿美元vibe coding赛道资本疯涌 腾讯Q2资本开支暴增176%AI贯穿全业务线 Google Pixel 11发布Tensor G6芯片深度集成Gemini 白宫首次授权私企对跨国网络犯罪组织实施网络行动 Anthropic研究称现有职业培训难以应对AI大规模失业 阿里云灵骏M890超节点上线运行超2万亿参数模型 中美大模型API价格差距正在快速收窄

8月13日,大模型竞争进入"Agent为王"新阶段。模型线:DeepSeek V4 Pro正式版发布,Agent能力飙升——Terminal Bench 2.1得分87.9距Fable 5仅差0.1分,DeepSWE从12.8暴涨至62.7超越Opus 4.8,支持100万Token上下文和38.4万Token输出,兼容OpenAI和Anthropic两套API格式;同日SpaceXAI发布Grok 4.6,Artificial Analysis智能指数达61分追平GPT-5.6 Sol,并推出Grok Bot常驻云电脑代理可后台持续执行任务 · 价格线:DeepSeek宣布API调价采用峰谷定价,8月17日生效;摩根士丹利研报指出中美大模型API价格差距正在快速收窄,中国模型输入价格占比从6%升至19% · 资本线:Lovable以133亿美元估值完成4亿美元融资,vibe coding赛道持续升温;Cognition年化收入达10亿美元估值400亿美元;Vantage数据中心探索1000亿美元IPO · 财报线:腾讯Q2营收2047.9亿同比增长11%,资本开支527.8亿同比暴增176%,AI贯穿全业务线,混元Hy4即将发布 · 产品线:Google发布Pixel 11系列搭载Tensor G6芯片,深度集成Gemini AI支持手语翻译;阿里云灵骏真武M890超节点上线,国内首个运行超2万亿参数大模型的超节点 · 政策线:白宫首次授权经审核的美国私企对跨国网络犯罪组织实施网络行动,开创新模式;美国FCC拟将光模块列入进口禁令清单 · 组织线:字节跳动成立AI一级部门专注大模型数据与安全;Manus官宣恢复独立运营布局通用Agent

第108期 | 2026-08-13 | 星期四

DeepSeek V4 Pro正式版的Agent狂飙与马斯克同日撞车 Grok 4.6追平GPT-5.6 Sol Grok Bot让AI后台帮你干活 Lovable估值133亿vibe coding起飞 腾讯Q2资本开支暴增176% Google Pixel 11全面拥抱Gemini 白宫授权私企发动网络攻击 Anthropic称培训难以应对AI失业潮

8月13日,大模型竞争进入"Agent为王"的新阶段。模型侧,DeepSeek V4 Pro正式版Agent能力全面飙升,Terminal Bench 2.1得分87.9距Anthropic Fable 5仅差0.1分,软件工程能力DeepSWE暴涨近5倍;同日马斯克旗下Grok 4.6发布,智能指数追平GPT-5.6 Sol,并推出Grok Bot常驻代理让AI在云端7×24小时替你干活。价格侧,DeepSeek宣布API峰谷定价,摩根士丹利指出中美大模型价格差距正在快速收窄。资本侧,Lovable以133亿美元估值完成4亿美元融资,vibe coding赛道持续升温;Cognition年化收入破10亿美元估值400亿。腾讯Q2资本开支暴增176%,AI贯穿全业务线。Google发布Pixel 11全面拥抱Gemini。白宫首次授权私企对跨国网络犯罪组织实施网络行动。逐条拆解。

一、DeepSeek V4 Pro正式版发布,Agent能力飙升距全球最强仅差0.1分

8月12日深夜至13日,DeepSeek正式上线旗舰模型V4-Pro正式版(版本标识V4-Pro-0813),API及Chat端同步更新。本次升级核心聚焦Agent能力——即AI真正"干活"的能力:调用工具、执行多步骤任务、编写修改代码、在长链条中持续推进直到交付结果。

核心信息:

  • Agent能力大幅跃升:Terminal Bench 2.1(衡量AI在真实终端执行复杂任务的能力)得分从预览版72.1跃升至87.9,距Anthropic Fable 5的88.0仅差0.1分;网络安全测试Cybergym得分83.3反超Fable 5的83.1;工作流测试AutomationBench 31.8分同样超越Fable 5的29.1分
  • 软件工程能力暴涨:DeepSWE得分从预览版12.8飙升至62.7,接近原来的5倍,超过Anthropic上一代旗舰Opus 4.8的58.0分
  • 高难度数据科学:DSBench-Hard得分从31.1升至67.2,翻了一倍多
  • 规格配置:支持100万Token上下文窗口,最大输出38.4万Token,同时支持思考与非思考模式,思考模式默认开启
  • API兼容性:同时兼容OpenAI和Anthropic两套API格式,开发者几乎不需修改代码即可从Claude切换到DeepSeek
  • 定价:输入3元/百万Token,输出6元/百万Token,缓存命中输入低至0.025元/百万Token
  • API调价公告:DeepSeek同日宣布8月17日起采用峰谷定价,高峰时段(北京时间9:00-12:00、14:00-18:00)为正常价格,空闲时段为高峰的一半
  • Harness悬念依旧:DeepSeek Harness(全链路AI工作流平台)公众号已注册,内测用户评价"宇宙最强",但尚未正式对外发布

据科创板日报、36氪(https://36kr.com/p/3937236905344390)、每日经济新闻(http://m.toutiao.com/group/7673503710240080434/)8月13日报道。

对普通人的影响:

  • AI"干活"能力质变:Terminal Bench和DeepSWE这类测试衡量的不是AI能不能聊天,而是能不能真的写代码、操作电脑、完成工作任务——0.1分的差距意味着DeepSeek已经站到全球Agent能力的最高梯队
  • 开发者成本骤降:V4 Pro输出价格仅0.87美元/百万Token,约为Anthropic Fable 5的五十七分之一。同样能力的模型,价格差57倍——这意味着用AI做开发、做自动化,成本门槛大幅降低
  • API兼容设计很实用:同时兼容OpenAI和Anthropic格式,企业切换模型不需要重写代码,降低了"被一家锁定"的风险
  • 峰谷定价值得关注:如果你的AI应用不需要在高峰期运行,空闲时段价格直接打五折,适合夜间批处理、数据抓取等非实时场景
  • 对vibe coding创业者的启示:DeepSeek V4 Pro的Agent能力意味着AI自动写代码、调Bug、部署应用的可靠性进一步提升,用AI建站、做工具的成本越来越低

二、Grok 4.6发布追平GPT-5.6 Sol,Grok Bot让AI在云端替你干活

8月12日,SpaceXAI(原xAI)发布Grok 4.6旗舰模型和Grok Bot常驻任务代理,与DeepSeek V4 Pro同日上演"中美大模型正面交锋"。马斯克透露Grok 4.7初始训练已完成,正注入SpaceX公司数据,预计3-4周后发布。

核心信息:

  • 性能追平顶级水平:在Artificial Analysis智能指数中,Grok 4.6获得61分,与OpenAI GPT-5.6 Sol并列,低于Claude Opus 5的63分和Fable 5的62分,高于Kimi K3的60分和DeepSeek V4 Pro的53分
  • 知识工作登顶:在面向真实知识工作的GDPVal-AA v2评估中以1753 Elo登顶,超过Fable 5的1741和GPT-5.6 Sol Max的1728
  • 定价策略:输入2美元/百万Token,输出6美元/百万Token,在旗舰模型中保持高性价比
  • Grok Bot发布:为每位用户提供持久运行的云电脑环境,能以具名代理身份登录网站和应用,保存工作状态并持续完成任务——即使关闭电脑,任务仍在云端推进。目前面向SuperGrok Heavy及Cursor Ultra/Teams用户开放beta测试
  • Grok 4.7预告:马斯克表示4.7"显著优于"4.6,正注入SpaceX大量公司数据进行补充训练,3-4周内发布
  • Cursor整合:Grok 4.6整合了SpaceX正在收购的编程公司Cursor的大量技术贡献

据TechStartups(https://techstartups.com/2026/08/13/top-tech-news-today-august-13-2026-anthropic-deepmind-google-lenovo-microsoft-spacexai-more/)、The Neuron(https://www.theneuron.ai/digest/everything-that-happened-in-ai-today-thursday-august-13-2026/)8月13日报道。

对普通人的影响:

  • Grok Bot是"AI后台打工"的雏形:你关掉电脑,AI还在云端帮你完成任务——登录网站、填表、收集数据。这不是科幻,已经开始beta测试了
  • 对创业者的启发:当AI能7×24小时在云端替你执行任务,很多重复性的线上工作(数据录入、信息搜集、账号管理)都可以交给AI代理完成
  • 中美AI同日撞车的意义:DeepSeek和Grok同日发布旗舰模型,说明大模型竞争已经从"偶尔发一个"变成"持续迭代",模型更新速度堪比手机厂商
  • Grok 4.7值得持续关注:注入SpaceX数据的模型在航天、工程等专业领域可能有独特优势

三、Lovable估值飙至133亿美元,vibe coding赛道资本疯涌

8月13日消息,AI代码生成平台Lovable完成4亿美元融资,估值达133亿美元,较去12月估值翻倍以上。与此同时,AI编程公司Cognition据报年化收入达10亿美元,正以400亿美元估值进行融资谈判。

核心信息:

  • Lovable融资细节:4亿美元融资,估值133亿美元,自12月以来估值翻倍以上,反映vibe coding赛道持续吸引大额资本
  • Cognition的爆发:AI编程代理公司Cognition年化收入已达10亿美元(ARR),正以400亿美元估值进行新一轮融资谈判
  • Thrive Holdings:融资20亿美元,估值120亿美元,将AI嵌入会计、IT和受监管的基础设施工作流
  • 行业趋势:vibe coding(用自然语言描述需求、AI直接生成代码)正在从概念验证走向规模化商业落地

据The Neuron(https://www.theneuron.ai/digest/everything-that-happened-in-ai-today-thursday-august-13-2026/)8月13日报道。

对普通人的影响:

  • vibe coding已被资本验证为大赛道:133亿美元、400亿美元估值说明市场认为"用AI写代码"不是玩具而是真正的生产力革命
  • 对励梦文化建站业务的利好:vibe coding的成熟意味着我们帮小商家做单页网站的效率还会持续提升,成本继续降低
  • 机会与竞争并存:资本涌入意味着更多玩家入场,但"帮不懂技术的商家用AI做网站"这个服务层的价值不会消失——因为商家需要的不只是代码,还需要沟通需求、审核内容、部署上线的全流程服务
  • 对求职者的信号:AI编程领域的岗位需求将持续爆发,从模型训练到产品开发到客户成功都有机会

四、腾讯Q2财报:AI贯穿全业务线,资本开支暴增176%

8月12日,腾讯控股发布2026年第二季度财报。该季度营收2047.9亿元,同比增长11%;Non-IFRS经营利润756.4亿元,同比增长9%。AI成为贯穿本季度的核心主线。

核心信息:

  • 混元大模型迭代:从Hy3 preview升级到正式版,Hy4版本计划近期发布,调用量周环比增长68倍
  • AI办公产品爆发:WorkBuddy月访问量突破2000万,CodeBuddy用户实现突破性增长
  • 微信AI助手"小微":6月上线后正扩大灰度测试范围
  • 资本开支暴增:本季度527.8亿元,同比增长176%,主要投向AI基础设施
  • 研发支出大增:272.8亿元,同比增长35%
  • AI产品经理培训生:8月13日腾讯宣布启动"AI产品经理培训生"项目,面向2026-2027届毕业生,不设学历门槛

据蓝鲸新闻、科创板日报8月12日报道,腾讯官方公告(https://www.coze.cn/share-article/201786613524490880)8月13日。

对普通人的影响:

  • 腾讯在AI上的投入是真金白银:资本开支527.8亿、同比增176%,说明腾讯不是在喊口号,而是在砸重金布局
  • 混元调用量增长68倍:说明越来越多的开发者和企业在用腾讯的AI能力,国产大模型的实际使用率正在快速攀升
  • “小微"进入微信值得关注:如果微信AI助手全面铺开,10亿+微信用户都能直接用AI,这将极大降低普通人使用AI的门槛
  • 不设学历门槛的AI岗位:腾讯AI产品经理培训生不设学历门槛,说明AI行业更看重实际能力而非文凭,对转行者友好

五、Google Pixel 11发布Tensor G6芯片,Gemini深度集成手机

8月12日,Google发布Pixel 11系列智能手机(Pixel 11/11 Pro/11 Pro XL),搭载全新Tensor G6芯片,深度集成Gemini AI功能,起售价899美元,8月20日正式发售。

核心信息:

  • Tensor G6芯片:专为AI推理优化,支持端侧AI处理
  • Gemini深度集成:Magic Capture(AI选帧)、手语实时翻译转文字、更自然的语音交互
  • 设备端AI处理:核心AI功能在本地完成,不依赖云端,保护隐私
  • 7年软件支持:承诺提供7年系统更新
  • 生态扩展:同步发布Pixel Tag(对标AirTag)和Pixel Watch 5

据TechCrunch、Google官方8月12日报道。

对普通人的影响:

  • 手语翻译功能很暖心:将手语实时转文字,让听障人士与普通人沟通更顺畅——这是AI落地到真实社会需求的典型案例
  • 端侧AI是趋势:不需要联网就能运行的AI功能,既快又保护隐私,未来国产安卓手机也会跟进
  • 7年更新很实在:一部手机用7年不过时,降低换机频率也是省钱环保

六、白宫首次授权私企对跨国网络犯罪组织实施网络行动

8月13日,白宫指示国家协调中心创建一项新计划,允许经过审核的美国企业对外国网络犯罪团伙实施网络监控和网络影响行动,由司法部和国土安全部联合监管。

核心信息:

  • 准入门槛极高:参与者需接受合同审查、详细操作程序、全面法律合规要求,缴纳100万美元保证金,并排除关键后果
  • 开创新模式:此前网络攻击行动基本限于政府机构,这是首次授权私企参与
  • 背景:网络攻击正从企业网络蔓延到仓库和全球供应链,传统政府力量不足以应对

据The Neuron(https://www.theneuron.ai/digest/everything-that-happened-in-ai-today-thursday-august-13-2026/)8月13日报道。

对普通人的影响:

  • 网络安全格局变了:让私企"以攻代守"打击网络犯罪,意味着网络安全的投入和模式都在升级
  • 对网络安全从业者是利好:这类公私合作模式会催生大量安全岗位需求
  • 也需关注风险:私企发动网络行动的边界和监管如何保障,是值得持续观察的问题

七、Anthropic研究:现有职业培训难以应对AI大规模失业

8月13日,Anthropic经济研究团队(包括David Roodman和Maxim Massenkoff)发布研究报告,综合审查了56项美国随机对照研究和欧洲相关证据,发现当前职业培训体系可能无法应对AI带来的大规模就业冲击。

核心信息:

  • 效果有限:典型职业培训项目仅将就业率提升2-3个百分点,年收入增加约1000美元,而项目成本约13000美元
  • 财政中性:税收和福利抵消后,平均项目基本收支平衡
  • 部分项目效果好但难复制:少数行业培训项目产出更大收益,但往往无法在其他地方重现
  • 核心结论:当前的再培训系统在面对大规模AI导致的失业时可能力不从心

据The Neuron(https://www.theneuron.ai/digest/everything-that-happened-in-ai-today-thursday-august-13-2026/)8月13日报道。

对普通人的影响:

  • 别指望"学个技能就安全了”:研究显示传统培训的效果很有限,不是说学了一个新技能就能高枕无忧
  • 持续学习能力比单一技能更重要:AI时代最核心的能力是"快速学习新东西"的元能力,而不是某一个具体的技术
  • 对社会政策的启示:如果现有培训体系不够用,可能需要探索新的模式——比如AI辅助的个性化培训、企业深度参与的实训项目等
  • 对自己负责:与其等政策或公司来培训你,不如主动利用免费/低成本的AI学习资源持续迭代自己

八、阿里云灵骏M890超节点上线,国内首个运行超2万亿参数模型

8月12日,阿里云宣布灵骏真武M890超节点实例正式上线,首批在乌兰察布地域开售。据称这是国内首个成功运行超2万亿参数大模型的超节点形态算力。

核心信息:

  • 算力规模:国内首个运行超2万亿参数大模型的超节点
  • 已投入使用:Kimi K3和Qwen3.8 Max等大模型已通过该实例对外提供服务
  • 战略意义:标志着国内AI算力基础设施进入超节点时代

据科创板日报、证券时报8月12日报道。

对普通人的影响:

  • 国产AI算力在追赶:超节点算力是大模型训练和推理的基础,M890的上线意味着国内开发者有了更强的本土算力选择
  • 大模型服务会更稳定:有了更强的算力底座,Kimi、通义千问等国产AI工具的响应速度和稳定性有望继续提升
  • 对创业者:算力选择多了,价格竞争也会加剧,使用国产大模型API的成本有望继续下降

九、中美大模型价格差距正在快速收窄

8月12日,摩根士丹利最新研报指出,中国大模型API平均价格过去一年明显上涨,而美国闭源模型价格近期持续下降,中美之间悬殊的价格差距正在收窄。

核心信息:

  • 价格差距变化:2025年Q1中国大模型输入/输出API均价仅为美国同行的6%/5%,到2026年Q2已升至19%/14%
  • 趋势预判:随着中国模型涨价、美国厂商继续降价,差距还将进一步收窄
  • 竞争转向:摩根士丹利指出中国大模型市场竞争重点正从"价格战"转向"智力战"
  • 具体对比:Fable 5每百万输出Token定价50美元,GPT-5.6 Sol Max为30美元,Grok 4.6为6美元,DeepSeek V4 Pro仅0.87美元——即便涨价后仍保持巨大价格优势

据每日经济新闻(http://m.toutiao.com/group/7673503710240080434/)、摩根士丹利研报8月12日报道。

对普通人的影响:

  • 国产AI"白菜价"时代可能逐步结束:但即便涨价,国产模型仍然比美国模型便宜很多(约1/5到1/6的价格)
  • 竞争从价格转向质量:未来的比拼不再是谁更便宜,而是谁更能解决实际问题
  • 对开发者建议:不要只看价格选模型,要综合评估能力、稳定性和服务支持——便宜但不好用的模型,实际成本更高

十、字节跳动成立AI一级部门,Manus恢复独立运营

8月12-13日,多条组织和人事变动消息值得关注:

  • 字节跳动:成立全新AI一级部门,专注大模型数据与安全建设,由王赢磊负责,与Seed(大模型研发)、Flow(AI应用)、抖音等核心部门平行。前身为2023年组建的Global Data团队
  • Manus恢复独立运营:AI初创公司Manus宣布将以独立公司形式继续运营,此前Meta以超20亿美元收购。恢复独立条件之一是在8月23-24日期间删除部分用户数据
  • 金山办公灵犀:8月13日首批接入DeepSeek V4 Pro正式版,用户无需额外配置即可启用
  • 前OpenAI研究员创立River AI:成立仅两个月完成11亿美元种子轮及A轮融资

据AIBase、科创板日报8月12日报道。

对普通人的影响:

  • 字节对AI安全的重视在升级:单独成立一级部门说明数据安全和大模型合规已经不是"顺带做"的事,而是战略级优先级
  • Manus的独立对行业有参考意义:被巨头收购后又独立,说明AI Agent赛道还在快速演化中,大公司整合不一定能成功
  • 金山办公接入DeepSeek V4 Pro:办公软件直接集成最新AI能力,普通用户不需要懂技术就能用上最强模型

本日总结:

8月13日,大模型竞争正式进入"Agent为王"的新阶段。DeepSeek V4 Pro正式版Agent能力飙升,Terminal Bench距离全球最强仅差0.1分,软件工程能力暴涨近5倍;同日Grok 4.6发布追平GPT-5.6 Sol,Grok Bot让AI在云端7×24小时替人干活。价格方面,DeepSeek宣布峰谷定价,摩根士丹利指出中美大模型价格差距正在快速收窄,行业竞争从"价格战"转向"智力战"。资本市场方面,Lovable以133亿美元估值融资、Cognition年化收入破10亿美元估值400亿,vibe coding赛道持续升温。腾讯Q2资本开支暴增176%,AI贯穿全业务线。Google Pixel 11全面拥抱Gemini,手语翻译等AI功能落地手机端。白宫首次授权私企发动网络攻击行动,网络安全格局生变。Anthropic研究指出当前职业培训体系难以应对AI大规模失业,个人持续学习能力比单一技能更重要。

署名:励梦文化团队 声明:本日报内容综合自公开报道,资讯来源已标注,仅供参考。涉及投资信息不构成投资建议。