每日AI信息汇要

2026年9月8日

国内·AI要闻

10 条
1

小米发布玄戒O100:全球首款6nm 3D晶圆级堆叠封装,端侧推理速度达330TPS

9月7日晚,小米秋季旗舰新品发布会推出玄戒O100 AI加速芯片:采用6nm制程与全球首款3D晶圆级堆叠先进封装,辅以混合键合工艺,键合间距逼近物理极限;带宽达1.22TB/s,为传统手机内存的16倍,端侧推理速度330TPS,可支撑大模型本地推理。同场还亮相3nm旗舰SoC玄戒O3(10核全大核、安兔兔跑分561万、行业首发LPDDR6)和国内首款3nm智驾芯片玄戒D100(160GB统一内存、支持本地部署200B模型),构建起手机SoC+AI加速+智驾三类自研算力底座。

IT之家 查看原文 →
2

科大讯飞发布星火X2.5大模型:293B MoE全国产算力训练,端侧4B/1.7B模型已开源

9月7日,科大讯飞正式发布星火X2.5大模型。该模型采用MoE架构,参数规模293B-A30B,重点提升代码与智能体能力,并增强数学、理解等通用能力;全流程训练及推理均基于全国产算力完成,持续优化国产超长序列训推难题,已上线讯飞开放平台。此前星火X2.5-4B与1.7B两款端侧模型已开源,原生支持最长100万Token上下文窗口,以千亿Token级高质量数据训练,可本地部署于长文档处理、代码辅助、数据分析等场景,支撑模型在连续交互中基于完整信息处理复杂任务,推动大模型加速进入手机、PC、汽车座舱与机器人等终端。

3

HarmonyOS 7正式发布:小艺升级系统级智能体,可调用2100余项系统能力

9月7日,华为正式推出HarmonyOS 7,围绕空间美学、智能、性能、安全、互联五大维度升级,鸿蒙6/7终端设备数已突破8500万。系统首次提出"Agent亲和系统架构",小艺从语音助手升级为系统级智能体:可感知200余项系统级用户数据、调用2100余项系统能力,接入500多家伙伴精选Skills和2000多个鸿蒙智能体,实现跨端协作、系统操控等复杂任务自主执行,推动交互从"人找应用"转向"意图即服务"。星盾安全防诈风险检出率超90%,方舟引擎使整机性能提升15%、续航延长36分钟。

赛迪网 查看原文 →
4

MiniMax M3"入籍"沙特:中国开源模型拿下国家级大客户,七项阿语测试五项第一

9月7日,36氪旗下硅星人Pro报道,沙特公共投资基金旗下AI公司HUMAIN在LEAP 2026上发布面向阿拉伯语世界的前沿模型HUMAIN-M3,底座为中国MiniMax M3。该模型总参数4280亿、每Token激活约230亿参数,用超1万亿阿拉伯语原生Token继续训练,在七项阿拉伯语公开测试中五项第一,等权平均分89.37%,高于GPT-5.6 SOL(87.30%)与Claude Opus 5(87.34%)。据CNAS统计,全球67国已推进184个主权AI项目,开源底座正成为中国模型出海新市场。

5

最高法发布首部涉人工智能纠纷司法裁判规则文件:AI换脸拟声、AI幻觉侵权均有明确规则

9月7日,最高人民法院发布《关于依法审理涉人工智能纠纷案件的意见》,系首部由国家最高审判机构出台的涉AI司法裁判规则文件,分5部分共24条。针对"AI换脸拟声""AI复活逝者",明确未经同意生成可识别虚拟数字形象、合成人声构成侵害人格权益;对"AI幻觉"侵权引入"避风港规则",服务提供者接到通知未及时采取措施须担责;模型训练在合理范围处理已合法公开个人信息且个人未拒绝的一般不认定侵权;同时规制"大数据杀熟""仿冒名人带货",明确自动驾驶事故赔偿责任及开源软件责任豁免等规则。

最高人民法院 查看原文 →
6

摩尔线程遭遇上市后首次解禁跌停:2577万股解禁市值约134亿,总市值跌破2000亿元

9月7日,国产GPU厂商摩尔线程在科创板早盘触及20%跌停,报415.48元,总市值跌破2000亿元关口,为上市以来首次。直接原因是2577.45万股首发网下配售限售股当日解禁,占总股本5.48%,流通盘近乎翻倍,按9月4日收盘价估算解禁市值约133.86亿元,公司回应称属正常解禁节点、基本面未变。半年报显示,其上半年营收17.36亿元、同比增长147.42%,已超2025年全年;毛利总额9.89亿元增长103.78%,归母净亏损收窄95.73%。12月7日还将迎来占总股本39.55%的更大规模解禁。

21财经 查看原文 →
7

燧原科技公布科创板IPO发行结果:发行价142.18元,预计募资61.19亿元即将挂牌

9月7日,燧原科技披露首次公开发行股票并在科创板上市发行结果公告:发行价142.18元/股,发行4303.5173万股,预计募资总额61.19亿元,上市时市值约611.87亿元。回拨后网下最终发行2409.9639万股、网上1032.85万股,网上中签率0.02455315%,网上弃购16874股由主承销商包销239.91万元。这家未跟随CUDA生态、自研"驭算TopsRider"全栈软件平台的国产云端AI芯片公司,预计2026年前三季度营收23亿至30亿元、同比增长325.78%至455.36%,公司预计2026或2027年有望实现合并报表盈利。

证券时报·e公司 查看原文 →
8

上半年935亿元涌入具身智能:融资事件322起同比增长137%,资本转向"大脑"

9月7日,澎湃新闻报道,2026年上半年国内具身智能领域融资总额达935亿元,约为2025年同期的五倍;融资事件322起,同比增长137%,半年规模已超2025年全年。投资逻辑一年内反转:具身大脑企业从不到20家猛增至上百家,投资人关注团队履历、VLA技术路线稀缺性与真实订单获取能力;人形机器人本体价格已降至5万元以内,"谁能干活主要由大脑决定"。专家指出当前VLA架构存在状态、因果、记忆、目标四个缺口,产业验证仍处早期,关节执行器占整机成本一半以上,产业化还需闯零部件降本与场景挖掘两道坎。

澎湃新闻 查看原文 →
9

微信内测"小微AI社交":两个AI先行代聊,用户只在关键节点拍板

9月7日,每日经济新闻记者实测发现,微信正在内测"小微AI社交"功能:用户向自己的AI助手"小微"提出约饭、约时间等诉求后,由它前往好友的"小微"沟通,对方授权确认后两个AI先行交流,再将结果带回,需要拍板时提醒用户确认——与"代发消息"不同,这是AI对AI(A2A)的完整任务流程,用户仅在授权与决策环节介入。实测发现相关对话只留在"小微"内,不进入个人聊天框。"小微"为微信原生AI助手,主模型为微信团队自研WeLM,部分回答调用DeepSeek处理。

每日经济新闻 查看原文 →
10

千问开放平台首批十余家金融智能体上线:覆盖证券、基金、期货、保险四大领域

9月7日,首批金融类智能体集中上线阿里千问,覆盖证券投资、基金、期货、保险等领域,投资类包括兴业证券智能投资助手、国泰海通灵犀、九方灵犀投资助手、浙商期货FutSeek、五星智投i投研、易方达基金小易、东吴秀财、中金财富等,保险类包括众安保险、小雨伞、慧择保险。用户可在千问内一站式调用不同金融机构的专业AI服务,进行市场分析、投资研究、基金研选与保险咨询。千问开放平台支持开发者通过标准化协议低门槛接入智能体,并提供账号、AI支付等基础设施,此前已覆盖物流、本地生活、汽车等十多个领域。

财联社 查看原文 →
🌍

全球·AI动态

10 条
11

黄仁勋宣告"AGI已到来":GPT-6 Astra由超10万块Grace Blackwell训练,40万GPU即将上线

9月6日,英伟达CEO黄仁勋在X平台发文祝贺OpenAI发布GPT-6 Astra,称"GPT-6 Astra由约10万套以上NVIDIA Grace Blackwell NVLink72训练,从ChatGPT到o1再到Astra只用了4年,AGI已经到来",并预告"下一批40万GPU即将上线"。Astra于9月3日发布,在FrontierMath Tier 4得分98%、ARC-AGI-3得分99.9%。该帖获约280万浏览,引发AGI定义争论:OpenAI自身并未将Astra定性为AGI,总裁布罗克曼仅称"正进入AGI时代"。黄仁勋此前财报会上还表示Grace Blackwell每吉瓦可产生250亿美元收入机会,Vera Rubin将提升至400亿美元。

华尔街见闻 查看原文 →
12

芝诺机器人发布协作具身智能基础模型Zeno-1:3B参数本地推理,双机自主涌现协作行为

9月7日,机器之心消息,芝诺机器人发布专为去中心化多机器人协作设计的物理智能基础模型Zeno-1:仅3B参数,可在本地端侧完成30Hz闭环视觉-运动推理,无需依赖云端调度。在真实场景实验中,两台搭载Zeno-1的机器人在无全局指挥的条件下自主涌现出挂裤子、装枕头等双人协作行为,展示了"机器人间自组织协作"的可行性。与依赖中心化大模型调度的主流路线不同,Zeno-1让每台机器人具备独立的物理智能,通过轻量通信实现多机协同,为家庭、仓储等多机器人规模化部署提供了低成本、低时延的新范式,也标志着具身智能研究从"单机智能"迈向"群体智能"。

机器之心 查看原文 →
13

Anthropic11个月锁定5170亿美元算力合约:相当于10座先进核电站输出,IPO临近

9月6日,据The Information统计,Anthropic过去11个月签署的算力采购协议总额达5170亿美元、折合至少14.8吉瓦容量,相当于超过10座韩国APR1400先进核反应堆的输出,或2600万人口都市圈的用电量,远超其去年12月向投资者披露的"至2029年1800亿美元服务器租赁"计划。最大一笔为亚马逊与谷歌合计11吉瓦、10年超3000亿美元;另包括微软Azure 1吉瓦300亿美元、SpaceX至2029年最高450亿美元等。Anthropic还直接采购博通/谷歌TPU与AMD芯片,并与Fluidstack联合投资500亿美元自建数据中心;其IPO预计10月底至11月初挂牌。

首尔经济日报 查看原文 →
14

英国ARIA创始主席入职Anthropic五天后宣布卸任:"旋转门"利益冲突引发政界关注

9月7日,英国政府高风险科研资助机构ARIA(高级研究发明局)创始主席马特·克利福德宣布辞去主席职务,距其9月2日宣布加入Anthropic出任国际事务董事总经理仅5天。英国下议院科技委员会主席、工党议员昂乌拉赫此前致信AI事务大臣,称其兼任政府"登月"机构主席与AI公司全职职务构成"明显利益冲突"。克利福德表示卸任是为了"确保我在Anthropic的新角色不会分散ARIA工作的注意力",将留任至11月6日的过渡期,期间设置利益冲突防范安排;新主席遴选程序即将启动。此前英国前首相苏纳克也已入职Anthropic。

Unite.AI 查看原文 →
15

GPT-6 Sol被曝内测:输出规模接近Astra但速度快约6倍,或9月29日开发者大会亮相

9月7日,多方爆料显示OpenAI正在内部测试下一代模型GPT-6 Sol。网友实测同一SVG生成任务:Sol零样本耗时约3分钟、输出约2.8万Token,而Astra耗时约19分钟、输出约2.5万Token——输出规模接近但速度约为Astra的6倍;Sol还曾一次性生成含昼夜切换、地名放置面板的像素风沙盒游戏原型。分析认为Astra主打最高难度深度推理,Sol偏向速度、吞吐与规模化Agent调用,可能在9月29日OpenAI开发者大会正式发布,GPT-6 Terra、Luna等变体也可能同台亮相。该爆料未获OpenAI官方证实,且"Sol"与GPT-5.6系列已有档位名存在命名重叠。

太平洋科技 查看原文 →
16

OpenAI官宣达成"自动化AI研究实习生":每1个人类工作日对应3.1个Agent工作日

9月7日,OpenAI发布博客《Research acceleration: The view inside OpenAI》,宣布已达成去年定下的"自动化AI研究实习生"目标,并瞄准2028年3月实现完全自动化的AI研究员。内部数据显示:截至2026年8月中旬,研究部门每1个人类工作日对应3.1个AI Agent工作日,AI劳动力已是人类三倍多;中位数研究员日推理消耗约600美元(按API价格),第90百分位重度用户超7000美元/天;8月每位活跃实验者的实验数量创2025年1月以来新高。同时OpenAI坦言,4-8小时复杂任务中超半数成功案例仍需至少一次人工干预,且尚不知如何安全实现完全对齐的递归自我改进。

凤凰网科技 查看原文 →
17

联想IFA发布Yoga Pro 9n:RTX Spark加持本地跑1200亿参数大模型,Windows首次具备Agent主机潜力

9月7日,爱范儿报道联想在柏林IFA 2026期间发布的Yoga Pro 9n笔记本(国内型号YOGA Pro 15 Spark)。该机搭载英伟达RTX Spark超级芯片,通过NVLink-C2C将20核Grace CPU与6144个CUDA核心的Blackwell RTX GPU合为一体,提供1 PFLOPS(FP4精度)AI性能,最高配128GB统一内存,CPU与GPU共享同一内存池,可本地运行1200亿参数、100万token上下文的大语言模型。整机重1.65千克、最薄16.7毫米,80W TDP由X Power散热压住。这是Windows+CUDA生态首次具备承载千亿参数模型与多智能体工作流的量产笔记本。

爱范儿 查看原文 →
18

Similarweb:ChatGPT网页流量份额回升至55.5%,Claude一年增长近5倍成最大变量

9月7日,The Decoder援引Similarweb数据报道,ChatGPT在AI聊天机器人网页流量中的份额从三个月前的52.7%回升至55.5%,重新拉开与追赶者的差距;谷歌Gemini则从27.8%回落至25.6%,其此前的强势反扑未能持续。同比来看ChatGPT仍从73.3%明显下滑,但Gemini份额一年内翻倍,Anthropic的Claude从1.9%增至9.3%、增长近五倍,成为最值得关注的变量;DeepSeek占3.4%、Grok 2.4%、Copilot 1.6%、Perplexity 0.9%。该统计仅覆盖网页端,未计入Gemini的Android推送入口、ChatGPT移动App及新版桌面端ChatGPT Work。

The Decoder 查看原文 →
19

英矽智能AI设计药物登Nature Biotechnology:六种衰老时钟一致显示生物年龄逆转

9月7日,英矽智能宣布其研究成果发表于《自然·生物技术》:对特发性肺纤维化(IPF)IIa期试验中42名患者的2841种蛋白质纵向Olink数据,套用哈佛、牛津、北大等团队独立开发的六种蛋白质组学衰老时钟,全部一致显示rentosertib治疗组患者预测生物年龄逆转,其中30mg每日两次组第4周效果最强、逆转约3-4岁,个别时钟最高达6岁;肺功能关键指标FVC亦呈剂量依赖性改善。这是首个对"AI发现靶点(TNIK)+AI设计分子"候选药的临床抗衰老评估,为在常规疾病试验中嵌入衰老终点提供了可扩展框架,研究结果将于9月8日巴黎Nature会议上报告。

英矽智能 查看原文 →
20

Hinton背书英国《人工超级智能安全法案》:9月8日提交议会,呼吁全球禁止开发超级智能

9月7日,诺贝尔奖得主、"AI教父"杰弗里·欣顿公开呼吁英国政府禁止开发超级智能AI系统,警告"失去对比我们更聪明的AI的控制可能是灾难性的,甚至可能导致人类灭绝"。其表态与《英国人工超级智能安全法案》发布同步:该法案由倡议组织ControlAI起草、工党议员亚历克斯·索贝尔推动,9月8日作为普通议员法案提交议会,将禁止在英国开发超级智能AI、要求政府监测和限制其前身技术,并承诺推动达成国际禁令协议,ControlAI称已获超过100名跨党派议员和上院议员支持。加州伯克利教授斯图尔特·罗素亦发声,称放任开发等同于"俄罗斯轮盘赌"。

Business Matters 查看原文 →
📍

江苏资讯

5 条
21

江苏启动AI消费"省补"新清单:具身智能机器人首次入补,十大类智能产品享15%补贴

9月8日,南京日报报道,8月29日起江苏省新一轮智能产品消费补贴扩围:智能影像、智能学习办公等新品类进入省补清单,具身智能机器人首次入列,十大类智能产品统一享受15%购新补贴。政策与产业目标高度契合——南京提出到2027年人工智能终端产业规模达2000亿元;南京首个AI智能终端消费中心已在雨花台区启幕,集中展示消费级AI硬件并打通"体验—补贴—交付"链路。AI消费从"软件订阅"走向"硬件入户",省补杠杆正在把大模型能力送进千家万户,也为本地AI终端产业链提供了确定性需求入口。

南京日报 查看原文 →
22

南京发布15项机器人"揭榜挂帅"需求榜单:聚焦电力、石化、钢铁、船舶最硬核环节

9月8日,南京晨报报道,南京市工信局发布15项机器人应用需求榜单,面向全国征集揭榜团队,9月24日前可申报。榜单聚焦本地优势产业最硬核环节:500kV升压站四足巡检机器人、金相检测具身智能机器人、30-50米船体高空除锈与喷漆机器人、石化装置带压堵漏机器人等,均来自真实企业生产一线痛点。南京已集聚机器人相关企业近300家,此次以"政府出题、企业答题"方式开放需求侧场景,把电力巡检、危化作业等高危场景变成技术验证场,为具身智能技术从实验室走向产线提供真实工况与订单牵引。

南京晨报 查看原文 →
23

靖江"具身智能+海工"供需对接:机器人企业与造船厂同桌对话,狭小空间智能焊接列需求首位

9月7日,江苏经济报报道("制造强省·AI赋能"系列首篇),靖江举办具身智能机器人与船舶制造供需对接活动:新时代造船把"狭小空间智能焊接"列为需求首位,中船澄西要求焊缝缺陷识别率不低于95%,扬州中远海运重工拟引入四足机器人开展船坞巡检。靖江坐拥6500余家制造企业、造船完工量占全国约四分之一,正把真实生产场景向机器人企业开放,让算法与机械臂在船坞里接受真实工况检验。省工信厅相关负责人表示,将以船舶行业为切入口推动AI与制造业深度融合,打造"AI+海工"的江苏样板。

江苏经济报 查看原文 →
24

苏州博格科技完成近2亿元B轮融资:国器元禾领投,直写光刻设备微纳光学全链贯通

9月7日,科创板日报消息,苏州博格科技完成近2亿元B轮融资,由工业母机产业投资基金(国器元禾)领投,苏州AI产业专项母基金、盈富泰克跟投。公司聚焦显微加工及检测领域,产品覆盖2D/2.5D/3D直写光刻设备,具备微纳光学全产业链贯通能力,核心产品已在光波导、衍射光学元件等精密光学器件制造环节实现进口替代。本轮资金将用于新一代直写光刻设备研发、产能扩充与海外市场拓展。苏州工业园区集成电路与AI产业基金集群持续加码硬科技装备赛道,为本地"AI+高端制造"企业提供从研发到量产的全周期资本支撑。

科创板日报 查看原文 →
25

天奇股份超10亿元具身智能机器人产业项目无锡惠山奠基:汽车智造龙头全面切入具身赛道

9月6日,无锡市人民政府官网消息(项目于9月5日奠基),天奇股份具身智能机器人产业项目在惠山高新区培土奠基,总投资超10亿元、占地70余亩,规划汽车装备智能制造基地与面向汽车行业应用的机器人具身智能系统研发中心两大板块,定向开发柔性装配、分拣等垂类模型。天奇2023年布局具身智能赛道,已搭建真机、UMI、EGO多路线融合数据采集体系,积累超8000小时有效多模态数据,方案已在整车制造、锂电、3C等领域实现应用验证;2025年与银河通用合资设立无锡天奇银河机器人有限公司,牵头共建的江苏省具身智能机器人工业应用重点实验室亦获批筹建。同园区内,智元江苏具身智能产业基地已落地5家公司,首台"惠山造"人形机器人G2手握约千台订单。

无锡市政府官网 查看原文 →
💡

AI智库资讯

5 条
26

安邦智库:中国开放权重模型加速融入全球AI产业链——从产品出海走向技术输出

随着中国开放权重模型能力持续提升,越来越多海外AI企业开始在其基础上进行后训练并开发自主模型和产品。美国法律科技公司哈维(Harvey)基于Qwen3开发首个后训练开放权重模型,依托约1750个专业化法律智能体环境完成迭代,专项任务完整完成数量较基座增加约20%;另有海外公司以中国开放权重模型生成合成数据用于首轮监督微调,或借鉴其模型架构与训练方法。安邦指出,开放权重模型具备自主部署、持续优化的成本与控制优势,中国模型正由产品出海向技术输出延伸,日益成为海外企业开发新模型、新产品的重要技术来源。

安邦智库
27

安邦智库:盐城东台正加速向绿色算力枢纽跨越——绿电+区位双优势承接长三角算力外溢

继7月31日中国移动长三角算电协同东台示范区项目签约后,万国数据东台智算中心项目日前正式签约,将建设300兆瓦高标准绿色智算中心,全面采用绿色高密、液冷等先进技术,重点承接长三角地区算力外溢需求,服务超大型云厂商与人工智能企业。绿电是东台核心竞争力:已并网风电光伏容量375.02万千瓦、年发电量61.14亿千瓦时,全部开发后年绿电发电量可突破260亿千瓦时;沿海智算中心距新能源集控中心仅27公里,依托自然水体恒温冷却可降能耗40%以上。安邦认为,东台坐拥2小时直达上海的立体交通网与2.2万亩零碳园区,正处于承接长三角算力缺口的最佳位置。

安邦智库
28

安邦智库:14家央国企将开放超60亿条高价值数据——可信数据空间与AI融合赋能高价值场景

据国家数据局消息,8月29日,14家央国企发起国内首个相关活动,面向全社会免费开放高价值数据资源,推动数据供需精准对接和高效开发利用,促进数据价值释放。14家央国企汇聚超500项优质数据资源,预计开放数据总量超60亿条,覆盖电力、油气管网、物流、汽车、农机等十余个行业。在此过程中,可信数据空间提供安全可控的数据流通和开发环境,通过可信数据空间与人工智能融合应用,赋能一批高价值场景落地。安邦认为,央国企高价值数据规模化开放,将为大模型训练与行业智能体开发提供高质量"燃料"。

安邦智库
29

中宏国研要参:中国机器人产业进入技术涌现、应用铺开的新阶段

中宏国研要情决策要参(第8-3号)指出,我国机器人产业技术创新进入"集群涌现"新阶段、行业应用迈入"全面铺开"深水区:人形机器人整机已推出300多款、超过全球半数,核心零部件国产化率突破75%,2026年上半年人形机器人出货超4万台、占全球97%,产业营收1655亿元、同比增长24.5%;上半年具身智能融资1041亿元、近半数资金投向软件"大脑"。短板在于感知与决策环节核心零部件依赖进口,行星滚柱丝杠、高端六维力传感器国产化率不足30%。建议以标准引领、中试验证、产学研协同、场景开放、统筹安全五大举措推动产业高质量发展。

中宏国研
30

ME News深度:图形学宗师童欣加盟Meshy——Mora架构给出"超越世界模型"的新解法

9月7日,ME News刊发深度报道:在微软亚洲研究院工作25年的图形学宗师童欣(Google Scholar引用超2.1万次)正式加盟AI 3D公司Meshy出任首席科学家。Meshy由MIT博士胡渊鸣创办,今年7月完成近4亿美元B轮融资、投后估值超100亿元,为全球AI 3D领域估值最高公司。同期发布的Mora架构(多模态开放世界实时架构)把互动世界拆成三块拼图:Coding Agent生成世界骨架与运行代码、3D生成构建稳定三维世界、视频模型负责最终画面音效,直击现有视频世界模型一致性弱、物理解算弱、延迟高的八大局限,为"三维是否只是视频生成的特例"给出阶段性回答。

📚AI 热词速查 · 一看就懂

25 词条

基础概念 5

大模型(LLM) Large Language Model

大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。

智能体(Agent) AI Agent

能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。

多模态 Multimodal

能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。

Token(词元) Token

大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。

生成式AI Generative AI

能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。

模型技术 9

训练 / 推理 Training / Inference

训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。

预训练 Pre-training

用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。

强化学习(RL) Reinforcement Learning

通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。

微调 Fine-tuning

用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。

蒸馏 Distillation

把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。

RAG 检索增强 Retrieval-Augmented Generation

检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。

MCP 协议 Model Context Protocol

Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。

开源权重 Open Weights

模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。

世界模型 World Model

能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。

算力基建 6

算力(FLOPS) Compute

每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。

GPU Graphics Processing Unit

图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。

智算中心 AI Data Center

专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。

超节点 Super Pod / Scale-up

把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。

云巨头 Hyperscaler

AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。

推理云(Neocloud) Neocloud

专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。

产业应用 5

具身智能 Embodied AI

AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。

AI4S AI for Science

AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。

AGI 通用人工智能 AGI

具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。

词元 / Token经济 Token Economy

以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。

FDE(前沿部署工程师) Frontier Deployment Engineer

把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。

← 返回当日 9月7日 9月4日 9月3日 9月2日 9月1日