励梦日报 · 75
2026-07-08 · 周三
OpenAI GPT-5.6三版本7月9日全面发布获美国政府批准,DeepSeek V4峰谷定价细则公布低谷0.5元/百万tokens,马斯克宣布Grok 4.5明日开放,四部门印发人工智能+人社实施意见,中国互联网大会开幕AI智能体数量有望超全球人口,工信部警示Claude Code安全后门隐患
美国商务部批准OpenAI全面发布GPT-5.6 Sol/Terra/Luna三款模型7月9日上线 · DeepSeek V4峰谷定价7月15日全量上线低谷低至0.5元/百万tokens上下文128K可扩展1M · 马斯克宣布SpaceX AI将于7月9日开放Grok 4.5 Opus级别模型 · 人社部等四部门联合印发人工智能+人社实施意见5年建设目标 · 2026中国互联网大会开幕杨杰称AI智能体数量有望超全球人口 · 谷歌Gemini 3.5 Pro预告7月17日发布2M上下文实时多模态 · 工信部警示AI编程工具Claude Code存在安全后门隐患
第75期 | 2026-07-08 | 星期三
OpenAI GPT-5.6三版本7月9日全面发布获美国政府批准,DeepSeek V4峰谷定价细则公布低谷0.5元/百万tokens,马斯克宣布Grok 4.5明日开放,四部门印发人工智能+人社实施意见,中国互联网大会开幕AI智能体数量有望超全球人口,工信部警示Claude Code安全后门隐患
7月8日,全球AI产业迎来"超级发布周"前夜:OpenAI获美国商务部批准全面发布GPT-5.6三版本,马斯克宣布Grok 4.5明日开放,DeepSeek V4峰谷定价细则落地,谷歌Gemini 3.5 Pro预告2M上下文——四大模型同周密集发布,堪称AI行业最激烈的正面交锋。国内方面,2026中国互联网大会在北京开幕,四部门联合印发"人工智能+人社"实施意见,工信部警示Claude Code安全后门。从海外模型解禁到国内政策落地,从行业大会到安全预警,今天的信息量非常大,逐条拆解。
一、OpenAI GPT-5.6三版本获美国政府批准全面发布:7月9日上线
7月8日,据Axios报道,美国商务部已批准OpenAI全面发布其最新大模型GPT-5.6。OpenAI正式宣布,GPT-5.6的Sol、Terra和Luna三个版本将于7月9日公开发布。
核心信息:
- 三版本定位:GPT-5.6 Sol是旗舰型号,面向最复杂推理、科研、软件开发、网络安全、生物研究及AI Agent工作流;Terra和Luna为差异化版本
- 高阶模式:Sol引入Max模式(更长时间深入推理)和Ultra模式(协调多个子Agent协同完成复杂长期任务)
- 性能数据:Sol在编程测试Terminal-Bench 2.1中标准模式得分88.8%,Ultra模式达91.9%,超越竞品Claude Mythos5
- 上下文扩展:从100万Tokens扩展至150万Tokens,提升约43%,可一次性处理整个代码库或数本书籍
- 效率提升:长链条Agent任务Token消耗比GPT-5.5再节省10%-15%
- 监管背景:此前OpenAI应美国政府要求推迟全面公开发布,初始访问限制在一小批审查合作伙伴中
据证券时报/Axios(http://m.toutiao.com/group/7660152337683579446/)7月8日报道。
对普通人的影响:
- GPT-5.6全面发布意味着普通人可以更便捷地使用最强AI模型,复杂推理和编程能力大幅提升
- 150万Token上下文可处理超长文档,一次性分析整本书或大型代码库成为可能
- Ultra模式的多Agent协同能力,对需要处理复杂工作流的创业者和开发者非常有价值
- 美国政府审查制度的松动,说明AI监管正在找到平衡点——既防范风险又不扼杀创新
二、DeepSeek V4峰谷定价细则公布:低谷低至0.5元/百万tokens,7月15日上线
7月8日,DeepSeek公布V4正式版定价与能力参数,确认7月15日全量上线,引入国内首个大模型峰谷定价机制。
核心信息:
- 能力参数:上下文原生128K、可扩展至1M;推理吞吐较V3提升约40%、单位Token成本下降30%
- 峰谷定价:工作日高峰(9:00-12:00、14:00-18:00)API价格翻倍,低谷(夜间+周末)输入价低至0.5元/百万tokens
- 双版本:V4 Pro和Flash两档维持原价,企业可自由错峰调度
- 行业信号:高盛研报指出,这标志着国内大模型价格战正在落幕,行业从"抢量"转向"精细化运营"
- 灰度测试:已有用户反馈V4正式版已开始灰度测试,编程能力明显提升
据AI日报/Yietion(http://m.toutiao.com/group/7659990815195791915/)7月8日报道。
对普通人的影响:
- 低谷时段0.5元/百万tokens的极低价格,让个人开发者和创业者用AI的成本进一步降低
- 峰谷机制类似电费"峰谷电价",有批量推理需求的团队可安排夜间任务大幅降本
- V4推理吞吐提升40%、成本下降30%,意味着同样预算可以做更多事
- 错峰调度能力将成为新的工程竞争力,Agent类产品把非实时任务排到夜间可成本减半
三、马斯克宣布Grok 4.5明日开放:Opus级别模型,速度更快成本更低
7月8日,马斯克在社交平台宣布,SpaceX AI将于7月9日(当地时间)向公众开放Grok 4.5。
核心信息:
- 定位:马斯克称Grok 4.5是一款"Opus级别的模型",但速度更快、Token效率更高、成本更低
- 开放时间:7月9日向公众开放
- 竞争态势:与OpenAI GPT-5.6(7月9日发布)、DeepSeek V4(7月15日上线)、谷歌Gemini 3.5 Pro(7月17日发布)形成同周密集发布
据36氪/证券时报(https://36kr.com/p/3886678879727880)7月8日报道。
对普通人的影响:
- 四大顶级AI模型同周发布,普通人可以横向对比选择最适合的AI工具
- Grok 4.5强调"更低成本",有望推动AI服务价格进一步下降
- 马斯克旗下xAI的快速迭代说明AI竞争白热化,用户是最大受益者
- 建议关注各模型发布后的实际评测,按需选择而非盲目追求最强
四、四部门联合印发"人工智能+人社"实施意见:5年建设目标
7月8日,人力资源社会保障部、国家发展改革委、工业和信息化部、国家数据局联合印发《关于加快推进"人工智能+人社"应用发展的实施意见》。
核心目标:
- 2026年:建设"人工智能+人社"应用基础设施,打造20个基于行业大模型的应用场景及高质量数据集
- 2027年:普及应用一批人社行业大模型和智能体,探索50个左右高价值应用场景赋能路径
- 2030年:形成人社行业领域人工智能普遍应用的创新局面
- 基础设施:构建"1(部级)+N(国家人工智能应用中试基地)+32(省级人社部门)“协同发展格局
- 数据建设:统筹建设政策文件库、业务知识库、人社行业领域人工智能语料库
据证券时报(http://m.toutiao.com/group/7660152337683579446/)7月8日报道。
对普通人的影响:
- AI+人社落地意味着社保查询、就业服务、职业培训等场景将引入AI,普通人办事更便捷
- 50个高价值应用场景的探索,将为AI创业者提供明确的政务和公共服务市场方向
- 人社行业大模型和智能体的普及,可能催生"AI+社保服务"“AI+就业匹配"等新职业
- 关注国家级人工智能应用中试基地建设进展,相关产业链有机会参与
五、2026中国互联网大会开幕:AI智能体数量有望超过全球人口总数
7月8日,2026(第二十五届)中国互联网大会在北京国家会议中心举行,大会聚焦AI算力网络、数实融合、产业智能化等核心议题。
核心亮点:
- 杨杰预判:中国互联网协会理事长杨杰表示,在可预见的未来,各类硅基生命即将迎来群体性涌现,AI智能体的数量有望超过全球人口总数,成为社会劳动力和智力资源的重要组成
- 四大趋势:连接对象深刻变化形成万物智联新格局;网络形态持续演进构筑智能社会新底座;应用场景深度拓展催生智能经济新形态;数据供给全面升级释放数据要素新价值
- 华为数据:华为副总裁王雷透露,当前国内Token实际流通效率仅60%,剩余40%因丢包、时延抖动等被消耗;2030年AI智算相关产业规模将突破30万亿元,占全国GDP比重超20%
- 中国联通:客服热线AI智能服务占比超85%,每年节约运营成本上亿元
- 面壁智能:端侧大模型SuperMate超30万台量产车交付,即将发布法律智能基础设施Legalhub
据21世纪经济报道(http://m.toutiao.com/group/7660102578399429129/)、新浪科技7月8日报道。
对普通人的影响:
- AI智能体数量超过全球人口意味着AI将从"工具"变成"同事”,普通人需要学会与AI协作
- 30万亿AI智算产业规模、占GDP超20%,说明AI已成为国民经济核心支柱,就业机会巨大
- Token流通效率仅60%意味着算力网络还有巨大优化空间,相关基础设施领域存在创业机会
- 中国联通客服AI占比85%说明AI已在服务行业大规模落地,传统客服岗位正在转型
六、谷歌Gemini 3.5 Pro预告:2M上下文+实时多模态,7月17日与DeepSeek同周发布
7月8日,谷歌放出Gemini 3.5 Pro预告,确认7月17日正式发布——与DeepSeek V4(7月15日)撞入同一周。
核心信息:
- 上下文突破:主打200万Token上下文(2M),从1M跳到2M,长文档/长代码库/长视频理解天花板再抬高
- 多模态升级:原生实时视频/语音多模态理解与Deep Research Agent升级
- 性能对标:据泄露基准,Gemini 3.5 Pro将直接对标GPT-5.6 Sol(Terminal-Bench 2.1 96.7% SOTA)
- 定价策略:预计延续"低价抢量"策略
- 竞争格局:DeepSeek V4与Gemini 3.5 Pro同周交锋,是国产与海外旗舰最正面的一次可比评测
据AI日报/Yietion(http://m.toutiao.com/group/7659990815195791915/)7月8日报道。
对普通人的影响:
- 2M上下文意味着可一次性处理数百万字内容,超长文档分析、全代码库审查成为可能
- 实时多模态理解让AI能"看视频"“听语音"并实时响应,视频创作和教育场景将大变
- 中美旗舰模型同周发布正面交锋,企业选型有了更直接的对比参考
- 长上下文工程优化成新战场,相关开发技能值得提前学习
七、工信部警示Claude Code安全后门:未经同意回传敏感信息
7月8日,工业和信息化部网络安全威胁和漏洞信息共享平台(NVDB)监测发现,AI编程工具Claude Code存在安全后门隐患。
核心信息:
- 安全风险:Claude Code内置监控机制,未经用户同意即可向远程服务器回传用户地域、身份标识等敏感信息
- 受影响版本:2.1.91至2.1.196版本
- 官方建议:立即开展全面排查,卸载或升级至已清除后门代码的最新安全版本;加强核心业务网段开发工具外联权限管控与流量监测
- 同步背景:阿里将于7月10日全面禁用Claude,约12万开发者受影响,国产编程模型承接战打响
据新浪科技/工信部NVDB(https://k.sina.com.cn/article_7857201856_1d45362c0019080j3u.html)7月8日报道。
对普通人的影响:
- 使用AI编程工具的开发者需立即检查版本,避免敏感信息泄露
- AI工具的安全审计越来越重要,企业在引入AI工具前应做安全评估
- 阿里禁用Claude后,通义灵码、字节Trae等国产编程模型免费额度大幅提升,开发者可趁机切换
- AI编程工具的安全风险提醒我们:便利性和安全性需要平衡,不能只看效率忽视风险
八、其他值得关注的消息
| 事件 | 要点 |
|---|---|
| 苹果折叠屏iPhone已进入量产 | 富士康大规模招工,今年生产约1000万部,较此前700-800万预期上调 |
| 中企加速弃用英伟达芯片 | 彭博调查:未来12个月中国企业AI加速器预算46%投向本土产品,高于目前30% |
| 蚂蚁灵波发布LingBot-Depth 2.0 | 训练数据从300万扩至1.5亿,深度补全16项测评12项第一,同步开源视觉基座模型 |
| 支付宝"碰一下"AI升级 | 3000万线下触点升级为AI经营网络,推出面向中小商家的"碰万物agent"平台 |
| 蓝色起源拟融资100亿美元 | 投前估值1300亿美元,贝索斯亲自追加20亿,Coatue预计领投40亿 |
| 腾讯引入OpenAI前研究员田永龙 | 加入腾讯大语言模型部,参与VLM视觉语言模型研发 |
| 零一万物推出"一号位决策AI” | 李开复发布老板AI、销冠AI、投资官AI产品矩阵及万策平台 |
| 威刚预警存储芯片继续涨价 | Q3 DRAM涨20%-30%、NAND涨35%-40%,涨价潮可能持续至2028年 |
| Cloudflare与OpenAI合作试点 | 利用全球网络数据优化AI搜索引擎内容发现和索引效率 |
| 小米官宣汽车新系列SkyNomad(澎程) | 雷军回应上市时间"快了”,归属小米主品牌 |
| 625亿数码国补第三批落地 | 全国29省市,平板电脑纳入3C数码补贴,最高直省上千元 |
| 字节绩效规则调整 | 加大半年激励力度,计算基数从月薪调整为月总包,75%发绩效期权 |
九、普通人7月8日行动清单
1. 关注"超级发布周",横向对比选择AI工具
- 7月9日GPT-5.6和Grok 4.5同日发布,7月15日DeepSeek V4上线,7月17日Gemini 3.5 Pro发布
- 四大顶级模型同周发布,建议关注发布后的实际评测而非官方宣传
- 按需选择:复杂推理选GPT-5.6 Sol,性价比选DeepSeek V4 Flash,长文档选Gemini 3.5 Pro 2M上下文
- 普通用户优先用免费/低价方案,不必为最强模型付费,80%的日常需求小模型足够
2. 利用DeepSeek V4峰谷定价降低AI使用成本
- 7月15日V4上线后,低谷时段(夜间+周末)输入价低至0.5元/百万tokens
- 有批量推理需求的团队,把非实时任务排到夜间执行,成本直接减半
- V4推理吞吐提升40%、成本下降30%,同样预算可处理更多任务
- 开发者可研究错峰调度中间件/任务队列,这将成为新的工程竞争力
3. 检查AI编程工具安全,趁机切换国产方案
- 使用Claude Code的开发者立即检查版本(2.1.91-2.1.196受影响),升级或卸载
- 阿里7月10日全面禁用Claude,通义灵码免费额度提升3倍至1000万tokens/日,提供一键迁移工具
- 字节Trae、腾讯CodeBuddy等国产编程模型也在承接用户,可对比选择
- 企业引入AI工具前应做安全评估,加强外联权限管控与流量监测
4. 关注AI+人社政策落地,挖掘公共服务创业机会
- 四部门"人工智能+人社"实施意见提出20个应用场景(2026年)、50个高价值场景(2027年)
- AI+社保服务、AI+就业匹配、AI+职业培训等方向值得深入研究
- 国家级人工智能应用中试基地建设将为相关企业提供测试验证支持
- 人社行业大模型和高质量数据集建设,数据服务和模型训练企业可参与
5. 关注AI智算产业30万亿规模中的机会
- 华为预计2030年AI智算产业规模突破30万亿元,占GDP超20%
- Token流通效率仅60%,算力网络优化(丢包、时延、数据损耗)存在巨大改进空间
- 中国联通客服AI占比85%每年省上亿,传统行业AI化降本增效需求旺盛
- 端侧AI从"可选项"变为"必选项",汽车、机器人、PC等终端场景机会丰富
写在最后
7月8日这天的信息可以用一句话概括:全球AI进入"超级发布周",四大模型同周交锋,国内政策密集落地,行业从"价格战"迈向"精细化运营"。
OpenAI GPT-5.6获准全面发布、马斯克Grok 4.5明日开放、DeepSeek V4定价细则公布、谷歌Gemini 3.5 Pro预告——四大顶级模型在同一周内密集发布,这在AI行业历史上前所未有。更值得关注的是,DeepSeek用峰谷定价率先举起"理性定价"旗帜,高盛判断价格战正在落幕,行业从"谁更便宜"转向"谁更会运营"。
国内方面,2026中国互联网大会传递出明确信号:AI智能体数量有望超过全球人口,AI智算产业2030年将达30万亿规模。四部门"人工智能+人社"实施意见则说明,AI正在从互联网行业向政务和公共服务全面渗透。工信部对Claude Code安全后门的警示提醒我们:AI便利性和安全性需要平衡,国产替代正在加速。
对普通人来说,有三条行动建议:
- 看发布周:7月9日-17日四大模型密集发布,关注实测对比,按需选择AI工具
- 等V4上线:7月15日DeepSeek V4峰谷定价,低谷0.5元/百万tokens,成本敏感用户重点关⽀
- 查安全:使用AI编程工具的开发者立即检查Claude Code版本,趁机评估国产替代方案
AI行业正在从"百模大战"的青春期迈入"理性运营"的成年期。对普通人而言,模型越来越强、价格越来越低、工具越来越多——但选对工具、用对方法、守好安全底线,比拥有最强模型更重要。
本文内容由励梦文化团队整理发布,内容仅供参考学习