AI 行业早报 · 2026 年 9 月 11 日
今日一句话:DeepSeek 新模型更便宜也更强,AI 换脸诈骗同步进入高发期。
给你讲人话的 AI 新闻。今天是 2026 年 9 月 11 日,星期五。
今天聊这六件事:
- 🧠 一、大模型动态
- ✨ 二、明星产品更新
- 🧰 三、热门 AI 应用与工具
- 🏢 四、行业大事件
- 🌱 五、AI 与生活
- 🚨 六、避坑提醒
- 💬 今日小白问答
🧠 一、大模型动态
1. DeepSeek 发布 V4.1 Flash:更小、更快、还更便宜
🗣 大白话讲讲:9 月 10 日,DeepSeek 发了一个叫 V4.1 Flash 的新模型。它是这个系列里"最小号"的,但跑分居然超过了自家更贵的旗舰 V4 Pro。同时 API 价格下调,而且晚上闲的时候用,价格只要高峰期的一半。
👀 为什么值得关注:对行业来说,国产开源模型又把"高端 AI"的价格门槛压低了一截,硅谷闭源公司的定价护城河正在被侵蚀。对普通人来说,你用 DeepSeek 会感觉更快、更少卡住;做开发的人调用成本更低,很多小工具会跟着降价甚至免费。
📖 MoE/混合专家(通俗解释:模型内部住着很多位"专家",来一个问题只叫醒最对口的几位,所以整体很大但干活很省)。
📖 KV Cache(通俗解释:AI 的"草稿纸缓存",把已经算过的东西记下来不重复算,把它压缩就能省钱)。
📰 来源:DeepSeek 官方 / 每日经济新闻 / 广州日报
2. 阿里 Qwen3.8-Max:2.4 万亿参数的"巨型大脑"拿了代码榜第一
🗣 大白话讲讲:阿里上线了 Qwen3.8-Max-0902,参数规模 2.4 万亿,能一口气"记住"100 万 token 的内容(大概相当于一次读完好几本书)。它在国外的代码竞技榜 Code Arena 的 WebDev 榜上拿了第一名。
👀 为什么值得关注:行业层面,国产模型在最硬的代码赛道上正面赢了。对普通人来说,能一次消化超长文档意味着:读合同、看论文、分析长报告会顺手很多。
📖 参数(通俗解释:模型脑子里"神经连接"的数量,越多通常越聪明,但也越贵越慢)。
📖 上下文窗口(通俗解释:AI 一次能记住多长对话的能力,100 万 token 就是能一次记住特别长的内容)。
📰 来源:HeadsUpAI 行业月报 / 阿里云
3. OpenAI 放出 GPT-6 Astra:会自己操作你的电脑
🗣 大白话讲讲:OpenAI 发布的 GPT-6 Astra 不只会聊天。它能自己打开软件、点按钮、一步步把多步任务做完,在多项"AI 自己干活"的考试里拿了最好成绩,还登上了代码竞技榜第一。
👀 为什么值得关注:行业层面,AI 正在从"会回答"转向"会执行"。对普通人来说,以后电脑上那些重复的点来点去,可能一句话就交给 AI 了。
📖 Agent/智能体(通俗解释:能自己动脑子干一堆事的 AI 助手,不只是回答问题)。
📖 电脑操作能力(通俗解释:AI 直接看屏幕、动鼠标键盘,像一个远程帮你点电脑的实习生)。
📰 来源:HeadsUpAI / OpenAI
4. 写代码的 AI 又降价了:Cognition 发布 SWE-2
🗣 大白话讲讲:做 Devin 的那家公司(Cognition)发了新的写代码模型 SWE-2,成绩追平了顶级模型,但成本低了 64%。它还能让你自己选"让 AI 想多久"。
👀 为什么值得关注:行业层面,编程 AI 的性价比战正式打起来了。对普通人来说,写代码这件事的门槛继续往下降。
📖 可配置推理强度(通俗解释:你可以让 AI"想快一点省钱"或者"想久一点更准",像调水龙头一样)。
📰 来源:Cognition / HeadsUpAI
5. 京东开源"视听世界模型"EchoWM:画面和声音一起生成
🗣 大白话讲讲:京东探索研究院在自家大会上开源了一个模型,能在同一个框架里生成画面、环境音、背景音乐和语音,还能实时响应你的操作。
👀 为什么值得关注:行业层面,世界模型是今年最热的方向之一——让 AI 真正"理解"三维世界,而不只是看图说话。对普通人来说,未来做视频、做游戏、搭虚拟场景会越来越省事。
📖 世界模型(通俗解释:AI 在脑子里搭一个可以推演的"小世界",能预测"我这样动,接下来会看到什么")。
📰 来源:京东探索研究院 / 腾讯研究院 AI 速递
✨ 二、明星产品更新
1. 豆包工作上新:能直接改你电脑里的 PPT 和 Excel
🗣 大白话讲讲:豆包工作(字节的 AI 办公产品)现在能直接打开并修改你电脑本地的 PPT、Excel,Word 说随后就上。它还能"录一遍你的操作",然后把流程变成可复用的技能;任务执行环境也能在"本地电脑"和"云电脑"之间随时切换,不用中断对话。
👀 为什么值得关注:行业层面,AI 办公从"陪你聊"升级到了"直接动你的文件"。对普通人来说,最大的好处是不用在软件之间来回导入导出了——AI 直接在原文件上改。
📖 浏览器录制与回放(通俗解释:你先亲手示范一次怎么点,AI 记住整个流程,以后这套活它自己跑)。
📰 来源:艾媒网 / 腾讯新闻早报
2. Google 发布 Windows 原生 Gemini 桌面应用
🗣 大白话讲讲:Google 出了 Windows 版的 Gemini 桌面客户端。不用再开浏览器标签页,装个软件就能随时用。
👀 为什么值得关注:对普通人来说,用起来更顺手,能像微信一样常驻在电脑上。行业层面,各家都在抢"桌面入口"这个位置。
📖 原生应用(通俗解释:专门为这个系统做的软件,比网页版更快、更顺手、能用上系统的功能)。
📰 来源:My AI Guide 日更
3. Meta 发布个人助手「Muse」:你说目标,它帮你办事
🗣 大白话讲讲:Meta 发了个人 AI 助手 Muse。你只要说出目标,它自己拆任务、打开网页、填表单、调用别的应用。每个用户配一台独立的"安全云电脑",你关掉 App 它还能在后台接着干活。
👀 为什么值得关注:行业层面,个人 Agent 从"能聊"走向"能代办"。对普通人来说,代填表单、代下单这类琐事会逐渐被接走。
📖 安全虚拟机(通俗解释:给你单独开的一间"隔离小屋",AI 在里面操作,就算出事也跑不到你真实的电脑上)。
📰 来源:腾讯研究院 AI 速递
4. 剪片软件达芬奇接入 AI:可以"聊天式"剪视频
🗣 大白话讲讲:知名剪辑软件达芬奇(DaVinci Resolve)出了 21.1 版,Studio 版能接 Claude、Claude Code 和 ChatGPT Codex。你可以用日常说话的方式,让它分析项目、整理素材、批量渲染,甚至从长视频里挑出精彩片段、删掉冗余内容。
👀 为什么值得关注:行业层面,专业软件开始把 AI 当"副手"正式接进来了。对普通人来说,剪视频的门槛又低了一点。
📖 批量渲染(通俗解释:一次把很多个视频片段自动导出成成品,不用你一个个点)。
📰 来源:腾讯研究院 AI 速递
🧰 三、热门 AI 应用与工具
1. OpenAI 开放 Agents API 公测,人人都能做"办事型"AI
🗣 大白话讲讲:OpenAI 宣布 Agents API 进入公开测试,面向所有开发者开放,可以跑那种"要连续干很久"的长任务。
👀 为什么值得关注:行业层面,做 AI 应用的门槛降低了。对普通人来说,接下来会冒出一批新的"帮你办事"的小工具。
📖 API(通俗解释:给程序用的"接口插座",插上去就能调用别人的能力,不用自己从零造)。
📰 来源:腾讯新闻早报
2. HeyGen 开源"实时数字人"整套方案
🗣 大白话讲讲:HeyGen 把"实时 AI 数字人"的整套接线方案开源了:把 OpenAI 的实时语音能力和自己的虚拟形象拼在一起,还附送一个日语老师的演示案例。
👀 为什么值得关注:对普通人来说,如果你想做会说话、能对答的数字人助手,现在有现成的参考代码可以拿来改。
📖 开源(通俗解释:把代码公开出来,谁都可以拿去用、拿去改,甚至可以自己商用)。
📰 来源:HeyGen / HeadsUpAI
3. Suno 发布 v6 音乐模型,其中一档免费账号也能用
🗣 大白话讲讲:AI 音乐工具 Suno 出了 v6 系列三档:v6 精致稳健,v6-wild 天马行空爱实验,v6-mini 又快又省,而且免费账号也能用。三档都懂"歌唱、配器、结构、情绪"这些音乐行话。
👀 为什么值得关注:对普通人来说,想做短视频配乐、玩两句自己的小曲子,现在免费档就能上手。
📖 AI 音乐生成(通俗解释:你用一句话描述想要的歌,AI 直接把曲子、人声和伴奏生成出来)。
📰 来源:Suno / HeadsUpAI
4. Runway 出 Adobe 插件:在剪辑时间线上直接生成视频
🗣 大白话讲讲:Runway 放出了免费的 Adobe 插件,装进 Premiere Pro 和 After Effects 之后,生成画面、编辑、放大画质都能直接在时间线上完成,结果落在播放头的位置。
👀 为什么值得关注:对普通人来说,不用再"在 AI 网页和剪辑软件之间来回导文件"了,工作流一下子短了很多。
📖 插件(通俗解释:给已有软件加装的小零件,装上就多出一项功能,不用换软件)。
📰 来源:Runway / HeadsUpAI
🏢 四、行业大事件
1. 京东云联手摩尔线程,要建十万卡国产算力集群
🗣 大白话讲讲:京东云宣布要建一个十万张 GPU 的集群,用的是国产摩尔线程的全功能 GPU,建成后向全行业开放算力,重点服务大模型训练、推理和具身智能。
👀 为什么值得关注:行业层面,这是国产 GPU 第一次进入头部 AI 云的十万卡级核心集群,标志着国产算力从"能用"走向"规模商用"。对普通人来说,算力供给变多,长期看是让 AI 服务变便宜的原因之一。
📖 算力(通俗解释:AI 的"体力",训练和运行模型都要消耗海量计算资源)。
📖 GPU 集群(通俗解释:把成千上万块显卡连起来一起干活,像把一堆小马达编成一个发电厂)。
📰 来源:艾媒网 / 京东云
2. DeepSeek 第二轮融资启动,计划募资 500 亿元
🗣 大白话讲讲:据报道,DeepSeek 第二轮融资已启动,计划募资总规模 500 亿元,对应估值约 5000 亿元;今年 6 月的首轮已经拿了约 510 亿元。若本轮顺利完成,累计融资将突破 1000 亿元。
👀 为什么值得关注:行业层面,中国 AI 大模型的融资纪录正在被反复刷新。对普通人来说,这说明这个赛道短期内不会缺钱,产品迭代还会继续加速。
📖 估值(通俗解释:市场"觉得"这家公司值多少钱,不等于它账上真有这么多现金)。
📰 来源:中国网 / 科创板日报
3. 无问智科完成数亿元 A 轮,专做"物理 AI 的数据底座"
🗣 大白话讲讲:无问智科宣布完成数亿元 A 轮融资,钱主要用来做世界模型、规模化生产真实物理交互数据、建仿真模拟器。它的数据已在物流仓储、工业制造、家庭服务、商业零售等场景落地,月度数据生产能力超过 2 万小时。
👀 为什么值得关注:行业层面,数据正在变成比算法更稀缺的资源——尤其是"机器人在真实世界怎么动"这类数据。
📖 物理 AI(通俗解释:让 AI 不只会聊天,还能理解真实世界里的力、空间和动作,比如机器人怎么抓稳一个杯子)。
📰 来源:经济参考网
4. OpenAI 不再接受"图像和音频生成类竞品"在 ChatGPT 投广告
🗣 大白话讲讲:OpenAI 近日调整了 ChatGPT 的广告政策,不再接受图像与音频生成类的竞争对手投放广告,而这项调整暂时还没更新到公开的广告政策页面上。
👀 为什么值得关注:行业层面,全球最大的 AI 消费入口自己也在做同类产品,等于"既当裁判员又当运动员"——以后 AI 工具的获客,可能越来越取决于和平台的关系,而不只是产品好不好用。
📖 流量入口(通俗解释:用户每天都要经过的那个"大门口",谁守着门口,谁就有话语权)。
📰 来源:每日经济新闻
5. 美团万亿参数大模型 LongCat-2.0 亮相,已在帮 130 万家餐馆干活
🗣 大白话讲讲:美团在服贸会展出了新一代万亿参数大模型 LongCat-2.0,总参数 1.6 万亿,原生支持 100 万 token 上下文,是国内首个在万卡级国产算力集群上完成全流程训练与推理的万亿参数开源大模型。配套的"智能掌柜"已经服务超过 130 万家餐饮商家。
👀 为什么值得关注:对普通人来说,这件事其实已经在身边发生了——你常去的餐馆,可能正用 AI 看评价、做经营诊断、判断该不该在某个商圈开新店。
📖 开源大模型(通俗解释:把模型本身放出来,谁都可以下载、自己部署,数据不用出自己公司的内网)。
📰 来源:央广网
🌱 五、AI 与生活
1. 诺奖经济学家阿吉翁:AI 十年能让生产率年增约 1 个百分点
🗣 大白话讲讲:在上海外滩大会上,诺贝尔经济学奖得主阿吉翁算了一笔账:仅考虑"AI 接管一部分任务",未来十年就能让生产率增速每年多出 0.68 个百分点;如果再加上"AI 催生新想法"的作用,合计可能多出约 1.08 个百分点——影响量级甚至会超过当年的 IT 革命。
👀 为什么值得关注:但他强调这不会自动发生,取决于竞争政策、教育体系和劳动力市场制度。他尤其提醒:要更重视手工劳动和软技能的价值,并建议学校保留一部分"完全不使用 AI"的学习过程,让学生能独立阅读、计算和思考——否则"我们可能会看到整整一代人不会独立计算,也无法专注阅读"。
📖 生产率(通俗解释:同样的人手和时间,能产出多少东西,涨了就说明效率在提高)。
📖 软技能(通俗解释:沟通、协作、共情、判断这类"不是硬技术,但很难被机器替代"的能力)。
📰 来源:海报新闻 / 腾讯新闻
2. 陆铭:岗位不会整体消失,但会被"拆开"重新分
🗣 大白话讲讲:上海交大教授陆铭在外滩大会上说,就业岗位不会整体消失,而是任务会被重新拆分:越标准化、越流程化的部分越容易被机器接手;越需要理解人、做价值判断的部分,人的优势反而更突出。
👀 为什么值得关注:对普通人来说,这其实是个好消息——不用恐慌"整个岗位被替代",但要主动往"理解人、做判断"的那一端靠。
📖 任务拆分(通俗解释:一个岗位不是被整个拿走,而是里面一件件具体的事被分走,比如"写初稿"被拿走,"定方向"还在你这)。
📰 来源:腾讯新闻 / 2026 外滩大会
3. 近五分之一的美国本科生,因为 AI 动过换专业的念头
🗣 大白话讲讲:一项面向美国本科生的调查显示,大约每 5 个本科生里就有 1 个,因为担心 AI 影响未来的就业,认真考虑过换专业。
👀 为什么值得关注:行业层面,AI 已经开始影响年轻人的专业选择。对普通人来说,与其换赛道"躲"AI,不如想清楚一件事:哪些能力是我有、而 AI 没有的。
📖 就业冲击(通俗解释:新技术让某些岗位的需求变少、或者变得跟以前很不一样)。
📰 来源:Lumina Foundation–Gallup 2026 美国高等教育调查
4. AI 数据中心反而造出大量新岗位,明年缺口约 45.6 万人
🗣 大白话讲讲:AI 数据中心越建越多,反而创造了大量施工和维护岗位。Meta 与美国建筑承包商协会合作,投入 1.15 亿美元做培训,公告一出就有成千上万人报名。行业预计明年缺约 45.6 万名相关工人。
👀 为什么值得关注:对普通人来说,这说明 AI 不只是在"抢活",也在造新活——而且造出来的很多是需要动手的实体岗位,不容易被 AI 自己替代。
📖 AI 基础设施(通俗解释:支撑 AI 跑起来的那堆硬件——机房、服务器、电力、散热,是 AI 的"水电煤")。
📰 来源:What's AI
5. 张宏江:"一个人 + 多个 Agent"正在让小公司变得更小
🗣 大白话讲讲:源码资本投资合伙人张宏江在外滩大会上提出,在"一个人配多个 AI 助手"的生产模式下,公司的组织形式会进一步小型化。
👀 为什么值得关注:对普通人来说,这意味着副业和"一人公司"的起步门槛在降低——过去要小团队才能干的活,现在一个人加上几个 AI 助手就能撑起来。
📖 一人公司(通俗解释:一个人加几个 AI 助手,干过去小团队才能干的活)。
📰 来源:腾讯新闻 / 2026 外滩大会
🚨 六、避坑提醒
⚠️ 1. 十分钟被骗 430 万:AI 换脸"假亲友"进入高发期
🗣 大白话讲讲:福州的郭先生接到"好友"的社交软件视频通话,画面里脸清晰、声音逼真,对方以"急需资金周转"求助,他没核实,短短 10 分钟就转出 430 万元,事后才知道对方是用 AI 合成的"数字替身"。
👀 为什么值得关注:"眼见为实"这条用了几十年的老经验,在 AI 时代已经不太靠得住了。伪造视频再逼真,仍有破绽,可以用"一验二看三辨":
一验:让对方快速转头、大幅转身,或用手掌完全遮住脸再移开——AI 合成画面遇到遮挡或侧脸时,极易卡顿、模糊、五官扭曲。
二看:看表情是否僵硬、眨眼频率是否异常、面部边缘是否发虚、唇形与声音是否同步。
三辨:AI 拟声往往缺少自然的呼吸停顿与情感起伏,带轻微机械感,也无法灵活应答随机问题或复刻专属口头禅。
📖 AI 换脸/拟声(通俗解释:拿几张照片和几段语音,AI 就能仿出一个"长得像、声音也像"的假人来跟你视频)。
📰 来源:南海网 / 金融教育宣传周
⚠️ 2. 街头"帮个忙",一分钟就能盗走你的脸
🗣 大白话讲讲:有骗子在商场以"手机没电、麻烦帮我念一下银行卡号"为由,请一位女士对着镜头念数字,随后又以"真人身份验证"为由诱导她眨眼、张嘴,全程大约一分钟。当晚她就连续收到 6 条网贷通知,名下被冒名贷出总额几十万元。
👀 为什么值得关注:人脸和声纹是不可更改的"生物密码"——密码泄露了可以改,脸和声音改不了。所以必须像护着身份证一样护着它。这类骗局没有特定目标人群,老人和年轻人都会被"定制"套路。
牢记:陌生人请求你录视频、做人脸核验、朗读数字信息、扫码、点链接,无论理由多紧急,一律拒绝。也尽量少在社交平台发布高清正脸照片和语音动态。
📖 生物特征(通俗解释:你的脸、指纹、声纹这些"长在你身上、换不掉"的身份证——一旦泄露,没法像改密码那样改掉)。
📰 来源:中国工商银行 / 以案说险
⚠️ 3. 收到自己的"不雅照"勒索信?大概率是合成的
🗣 大白话讲讲:台州临海的王先生收到一封陌生纸质信件,里面附着他与一名女子的"不雅视频"截图,要求他立即联系,否则就把视频散播到网上。他直接去派出所报案,经比对,那张图是把他的脸 P 到模板上的假照片。
👀 为什么值得关注:这是近期高发的"PS 艳照/AI 不雅视频"敲诈:买个人信息 → 合成假影像 → 匿名投递 → 威胁要钱。而且你越妥协,他抬价越高、纠缠越久。
处理方式:不回复、不转账,果断拉黑切断联系;妥善保存聊天记录、信件、照片等证据;第一时间拨打 110 报警,或通过反诈中心 App 举报。
记住一句话:只要涉及转账,必是诈骗。
📖 影像合成(通俗解释:把一个人的脸贴到另一张图或视频上,做出"看起来很真"的假照片假视频)。
📰 来源:央视新闻 / 浙江公安
⚠️ 4. 亲友视频来借钱?先挂断,再用自己熟悉的号码回拨
🗣 大白话讲讲:警方反复强调的核心动作只有一个:凡是电话或视频里提出转账的,先挂断,再用你自己熟悉的号码回拨确认,或者通过共同亲友交叉核实。
👀 为什么值得关注:这一步几乎能拦掉绝大部分 AI 拟声、换脸诈骗,而且成本极低——只多花你一分钟。另外,绝不向陌生人提供人脸、声纹、短信验证码,拒绝开启"屏幕共享"。
📖 交叉核实(通俗解释:不顺着骗子给你的那条线去问,而是换一条你自己知道的线去确认,比如打给共同的朋友)。
📰 来源:中国工商银行 / 南海网
⚠️ 5. 最高法明确:用 AI"开盒"、换脸造谣要担责
🗣 大白话讲讲:最高人民法院发布《依法审理涉人工智能纠纷案件的意见》,明确:以刺探隐私为目的,用 AI 追踪、分析他人信息并泄露公开,构成对隐私权的侵害(也就是常说的"网络开盒""人肉搜索");利用 AI 实施诈骗、侮辱诽谤、侵犯公民个人信息等,构成犯罪的依法追究刑事责任。
👀 为什么值得关注:意见还明确,被 AI 换脸造谣的受害者可以申请"人格权侵害禁令",而且法院不仅可以责令发帖的人停止侵权,还可以责令网络服务提供者、AI 服务提供者及时采取必要措施。对普通人来说,这是被 AI 造谣、换脸时更清晰的维权路径。
📖 人格权侵害禁令(通俗解释:等不到打完整场官司,先请法院喊一声"立刻停下",防止伤害继续扩大)。
📖 网络开盒(通俗解释:把一个人的姓名、电话、住址等隐私扒出来公开,让别人去骚扰他)。
📰 来源:最高人民法院 / 深圳政法网(9 月 7 日发布)
💬 今日小白问答
今天聊透一个话题:为什么 DeepSeek 一个"小号"模型,能打赢自家更贵的旗舰?
问:MoE 是什么?为什么"小"模型打得过"大"模型?
答:MoE 就是混合专家。把它想成一家大医院:医院科室特别全(DeepSeek 这次总参数 552B,很"大"),但你只是来看皮肤,导诊台只会叫皮肤科医生过来(实际出力的只有很小一部分,很"小")。所以它既有大医院的见识,又只付一个科室的挂号费。
这次它还做了个"非对称"设计——读进去(输入)只用 8B,写出来(输出)用 16B。道理跟人也差不多:"听懂问题"比"组织好答案"要省力得多。
问:那 KV Cache 又是什么?压缩它凭什么能省钱?
答:KV Cache 可以理解成 AI 的"草稿纸"。你聊得越长,它前面说过的内容就越要反复翻,为了不每次都重算一遍,它会把这些中间结果先记在草稿纸上。问题是,这张草稿纸非常占地方(占的是显存,也就是电脑干活时用的临时桌面)。
DeepSeek 这次说,对 HBM(高带宽显存)的需求降到上一代的 1/4、对 SSD(固态硬盘)降到 1/8。翻译成人话就是:同样一台机器,能装下更长的对话、同时服务更多人,单次调用自然就便宜了。这就是它为什么敢降价,而且闲着的时候只收你一半钱。
问:这些跟我有什么关系?
答:三点。第一,你直接用 DeepSeek,会感觉更快、更少"卡住"。第二,因为它变便宜了,很多第三方小工具的成本会跟着降,免费额度可能更多。第三,它上线就同步开源——你所在的公司如果想私有化部署(数据不出内网),现在多了一个性价比很高的选项。
顺带一提,这种"越来越便宜"的趋势,正是今天外滩大会上经济学家讨论的那件事:AI 的生产率红利能不能变成真金白银,得看它能不能被更多人真正用上。
🎧 朗读版:本期同时提供语音播报音频(完整版约 5 分钟),可直接在下方播放器收听。
下期推送:明天(9 月 12 日)早上 8:00
本早报由 AI 自动整理生成,信息来自公开报道,仅供了解趋势参考,不构成任何投资或决策建议。重要信息请以官方发布为准。