国内·AI要闻
10 条比亚迪璇玑A3车规级4nm智驾芯片开启规模化量产:芯片种类覆盖13大类567款车规产品
9月16日,比亚迪在绍兴赛车场举办高管面对面股东交流会,集团董事会秘书、投资处总经理李黔表示,半导体是比亚迪非常重要的能力之一,芯片种类覆盖13大类、567款车规芯片产品,从功率半导体、模拟芯片延伸到今年向逻辑芯片拓展,公司具备芯片设计、晶圆制造、封装测试全链路能力。他透露,今年推出的璇玑A3是中国首款车规级4nm智驾芯片,目前已开启规模化量产;随着汽车智能化发展,整车半导体价值量将显著提升,比亚迪未来会继续在半导体领域投入和发力。据介绍,璇玑A3于今年5月发布,支持L3、L4自动驾驶,三颗芯片总算力超2100TOPS,结合自研算法深度优化,算力利用率提升100%。目前比亚迪已推出2000多款芯片产品,拥有5座晶圆工厂。
智谱将年末ARR指引上调至30亿美元,称算力供给短期不再构成主要约束
9月16日,智谱面向分析师和投资人举行电话交流会,将2026年末ARR(年度经常性收入)指引由24亿美元上调至30亿美元,上调幅度25%。管理层透露,公司近期已与境内外头部云服务商签署收入分成协议,GLM系列开源模型将以托管API形式在海外云平台提供服务,相关收入自10月起确认。截至电话会时,智谱全业务口径ARR已达18亿美元;9月13日完成约50亿美元再融资后,算力供给短期内不再是收入快速增长的主要约束。自GLM-5.3发布一个月内,Co-work行业订单金额已超10亿元。
阿里千问Qwen3.8-27B登顶Hugging Face史上最受欢迎开源模型
9月16日,全球最大AI开源社区Hugging Face更新“最受欢迎(Most likes)”榜单,阿里千问Qwen3.8-27B超越FLUX.1、DeepSeek-R1、Kimi-K3、Meta-Llama-3等模型,成为Hugging Face历史上最受欢迎的开源大模型。该模型因较高的智能密度被海外社区称为“本地Opus4.6”,开源不到一个月,Perplexity等硅谷公司已将其选为本地Agent业务的首选模型。截至目前,阿里累计开源460余款Qwen大模型,全球下载总量突破30亿次,衍生模型超过30万个。
中国移动向全球开源具身智能通用连接底座Open-RAIL
9月16日,中国移动正式向全球开源具身智能推理执行框架Open-RAIL,为行业内首个连接VLA/WAM模型与机器人本体的通用工程底座。该框架不修改模型,而是在框架层把观测、推理、控制拆成三条并行流水线,并叠加块内、块间两级平滑策略,使关节加速度标准差从10+ rad/s²降至0.1 rad/s²。目前Open-RAIL已适配宇树G1、智元精灵G1等4款异构机器人,支持10个主流VLA/WAM模型;新机型接入周期从“以周计”压缩到“以小时计”,新模型接入最低只需50至100行代码。
科大讯飞发布全国产语音基座大模型Spark-Audio-1.0-Preview
9月16日,科大讯飞上线全国产语音基座大模型Spark-Audio-1.0-Preview,采用0.65B(Dense结构)音频编码器搭配30B-A3B(MoE结构)语言模型,使用1300万小时音频及大量文本数据,基于华为昇腾910B、海光BW1000等国产算力集群完成全流程训练。该模型在同一模型中支持文本与语音双模态输入,可完成语音转写、多语言翻译、多方言识别、环境音识别、情感分析与复杂音频问答,覆盖99种语言和202种方言;在Fleurs、KeSpeech等评测中部分指标超过Gemini-3.1 Pro,Fleurs中文测试集取得SOTA。
百度智能云发布“产业智能体操作系统”,天池超节点实现全栈国产
9月16日,在2026智能经济论坛上,百度集团执行副总裁、百度智能云事业群总裁沈抖提出“产业智能体操作系统”理念,把通用智能体、专业智能体与定制智能体组织成一套能协同、能闭环、对结果负责的系统。百度同步发布以百度搭子为基础的开发平台,并宣布百度搭子生态平台开放入驻、启动伙伴招募,承诺永不向生态伙伴抽佣;Agent Infra已接入超过150个模型。算力侧,百度宣布天池超节点实现全栈国产,已在全国多地智算中心完成千柜级规模部署,并全面开放架构、供电、散热、节点、互联、管理六大核心模块技术规范。
字节跳动分拆的AI制药公司Anew Labs完成2.9亿美元首轮融资
9月16日,自字节跳动分拆的AI制药公司Anew Labs(新生实验室)完成首轮独立融资,融资总额2.9亿美元,投后估值约15亿美元,为今年以来AI制药领域最大单笔融资。本轮由HSG(原红杉中国)、IDG资本、高瓴创投领投,五源资本联合领投,高榕创投、春华创投及中国生物制药等医药产业方参与;融资后字节跳动仍持股约56%。公司核心团队约50人,2026年6月独立运营,已在上海、旧金山、新加坡设立办公室,并披露全球首个“全谱”IL-17小分子抑制剂处于临床前阶段。在AI制药赛道融资节奏分化的背景下,这笔由多家头部机构联合出资的交易受到行业关注。
vivo发布OriginOS 7与蓝心大模型矩阵,同步预研30B MoE端侧模型
9月16日,2026 vivo开发者大会在深圳举行,vivo正式发布搭载蓝心智能体系的OriginOS 7。蓝心大模型升级为RealTime语音、Nano端侧、Flash与Pro云侧四款,分别覆盖语音理解、个人记忆与任务执行;新增系统级蓝心Harness,把感知、记忆、规划、执行串成完整链路,将6000多项原子技能转化为智能体可调用工具,可支持超过一万种任务。vivo同步公布原生编程智能体BlueCode预览版,并预研30B MoE端侧大模型。新系统将于10月9日起分批推送升级,X500系列首发搭载。
生数科技发布Vidu S2:实时互动与实时视频编辑双模型
生数科技发布Vidu S2视频大模型系列,包含面向持续交互数字角色生成的Vidu S2-Avatar,以及面向输入视频流实时编辑的Vidu S2-Editing,并进一步探索面向VR头显的实时空间视频生成与编辑。S2-Avatar将实时输出分辨率由540P提升至720P,支持在互动过程中随时加入物品、服装或背景参考图,并引入视觉反馈机制保障“拿起杯子再微笑”等连续动作与状态的可靠性;S2-Editing可对持续输入的视频流实时完成风格迁移、虚拟试穿、人物替换与背景替换四类任务。模型发布当天即全量开放体验。
小米直播MiMo-V2.6强化学习训练全过程:Pro与Flash双模型并行,累计开销已超百万美元
9月16日晚间,小米MiMo团队宣布MiMo-V2.6系列进入强化学习(RL)训练阶段,并把训练全过程通过官方监控页实时公开,训练队列、指标、故障与算力开销均可在线查看。本轮RL在三个维度做规模扩展:每步约消耗20亿token,配置为1568条提示词×16条推演轨迹、全异步架构;采用多任务智能体RL,单次训练流程混合运行多套评测套件;奖励侧引入测试用例与评分细则双重机制的组内信用分配。MiMo-V2.6 Pro总参数1T、激活42B,Flash总参数309B、激活15B,两套模型同步训练以对比不同基座的RL收益。截至披露时两套任务合计开销已超110万美元,团队表示未来数周将分批开源整套Agent RL工程实现细节。
全球·AI动态
10 条Salesforce联合英伟达发布首个CRM推理模型Koa
9月16日,Salesforce在Dreamforce大会上宣布与英伟达合作训练并发布Koa,这是其首个面向CRM数据推理的专用模型,基于英伟达Nemotron架构做后训练。Koa结合监督微调与强化学习,并采用“群体相对策略优化”技术,使用模拟医疗、金融、制造等14个行业工作流的合成数据集训练;Salesforce强调该模型未使用任何客户数据。基准测试显示,Koa在CRM相关任务上表现与领先通用模型相当甚至更优,错误率降低三倍。模型将在Agentforce自身的信任边界内运行,目前已向部分客户开放试点,计划于冬季正式可用。
英伟达、谷歌与Emerald AI组建AI能源管理联盟,拟释放最高100GW电网容量
9月16日,英伟达、谷歌与Emerald AI宣布成立AI能源管理联盟(AEMA),推动AI数据中心根据电网实时状况动态调整用电,创始成员包括Anthropic、美国国家电网、AES、NRG等18家企业。联盟称,通过转移计算负载、释放储能或启用现场发电等方式提升负荷灵活性,有望从现有电力系统中释放最高100GW容量,并为每吉瓦新建AI数据中心节省约7.33亿美元电力系统成本,相关调度软件预计今年晚些时候在英伟达弗吉尼亚AI工厂研究中心作商业规模部署。联盟方面认为,这一模式的意义在于把数据中心从单纯的用电方,转变为可参与电网实时调节的灵活性资源。
诺和诺德与Anthropic合作,用Claude Science加速新药研发
9月16日,诺和诺德与Anthropic宣布合作,将使用Anthropic前沿模型及面向科研的Claude Science平台,加快新药发现与开发,并借前沿模型强化AI驱动的软件开发。双方将针对诺和诺德科学家与计算团队提出的药物发现难点开发定向解决方案,首阶段围绕具体研发工作流测试Claude Science。诺和诺德CEO Mike Doustdar表示,AI有望提高研发效率、压缩从科研到产品上市的周期;Anthropic CEO Dario Amodei称,AI有可能把原本需要一个世纪的生物学与医学突破压缩至十年。合作纳入数据治理与人工监督机制。
谷歌公布多语言AI进展:覆盖300多种语言,开源端侧翻译模型TranslateGemma
谷歌公布其多语言AI最新进展:语言技术已支持超过300种语言,覆盖全球约86%人口,并嵌入搜索、安卓、Chrome、YouTube、Google Play等九大核心平台。此次开源TranslateGemma轻量级翻译模型家族,面向55种语言在端侧设备运行,无需连接云端;Gemini 3.5 Live Translate支持70种语言、2000多个语言对的实时口语翻译,Gemini 3.5 Transcribe面向嘈杂环境与复杂术语的语音转写。谷歌还与WAXAL、瓦尼计划等合作补充低资源语言数据,并推出可视化7000多种语言的Language Explorer。
联合国秘书长呼吁全球协作为人工智能设立“护栏”
9月16日,联合国秘书长古特雷斯在今年联大高级别周开始前的记者会上呼吁全球协同行动,为人工智能设立护栏。他表示,近来越来越多的AI开发者警告开发速度超出人类对风险的认知,各国政府必须首先负起责任;由于AI发展及其风险超越国界,全球协作不可或缺,孤立的、无法验证的、不均衡实施的自愿暂停措施无法解决当前问题。他强调人类承担不起人工智能走向“逐底竞争”的后果,需要就如何安全、负责任地推进AI开发,以及何时需要强化监督形成共识,让人工智能安全、透明、可问责,并以人类尊严为中心。在他看来,各国政府需要首先承担责任,而由于AI风险超越国界,全球协作与可验证的实施机制同样不可或缺。
Meta计划推出无摄像头智能眼镜Luna,转向语音AI
据The Information报道,Meta计划于今年秋季推出一款不配备摄像头的智能眼镜,内部代号Luna,预计在9月23日至24日举行的Connect开发者大会上亮相,并计划10月开始出货。该产品内置六枚麦克风与定向扬声器,通过语音接入Meta AI及新推出的消费级智能体Muse,镜腿侧面设有一键唤醒Meta AI的快捷按键,取消摄像头后镜腿更纤细、外观更接近普通眼镜。此举被视为对现有拍摄眼镜隐私争议的回应——多地场所已对带摄像头智能眼镜设限,Meta此前也在软件层面限制用户篡改录制指示灯的行为。
Mozilla报告:中美AI模型能力差距缩短至4.4个月
Mozilla发布第二版《开源AI现状》报告(数据截至9月1日),称中国最佳开放权重模型与美国前沿闭源模型的能力差距已缩至约4.4个月,与Epoch AI的四个月估计一致。报告显示,最佳开放模型在Artificial Analysis智能指数上仅落后闭源领先者三分,价格约为其六成;月之暗面Kimi K3得分比Anthropic Fable 5低三分,成本约为其30%。按METR任务时长口径,最佳闭源模型可可靠完成约12小时任务,开放模型约7小时。2026年8月OpenRouter按Token量排名前十的模型中,八个为开放权重模型。
SK海力士回应与英特尔洽谈在美生产存储芯片:尚未确认任何计划
9月16日晚间,SK海力士官网发布公告称,关于公司与英特尔就美国存储芯片生产进行洽谈的报道,目前尚未确认任何计划。此前有报道援引知情人士称,SK海力士正与英特尔洽谈首次在美国本土生产存储芯片,方案包括租用英特尔位于俄亥俄州规划工厂的部分产能,或与英特尔及主要云服务公司共同成立合资企业。SK海力士表示,公司正在探索多种方案以增强全球竞争力,但目前尚未敲定任何具体计划或安排,对报道提到的两种方案也尚未作出决定。当日SK海力士在韩国市场收涨4.08%。公司强调,任何方案都将以增强全球竞争力为前提,目前尚无需要对外披露的确定安排。
日本JSR、东京应化、信越化学宣布10月起光刻胶涨价15%
9月16日,日本JSR、东京应化、信越化学等宣布,自2026年10月1日起对全球客户光刻胶新定价整体上调15%。按产品线看,高端ArF系列长协报价上调16%至22%,HBM专用浸没式ArF最高上调24%,现货散单涨幅达32%至38%;KrF系列常规牌号涨价9%至14%,3D NAND厚膜专用KrF涨幅18%至20%。AI算力拉动HBM与存储芯片需求爆发,高端ArF光刻胶供给紧张。三家日系厂商在全球高端光刻胶市场占据主导地位,海外涨价与交期拉长将倒逼国内晶圆厂加速导入国产ArF、KrF产品。
Anthropic签下澳大利亚首份数据中心协议,锁定2.16吉瓦容量
9月16日,Anthropic签署其在澳大利亚的首份数据中心租赁协议,一次性锁定一处大型数据中心的容量,该设施规划总容量高达2.16吉瓦,计划于2027年投入运营,选址在距布里斯班约250公里的区域。继OpenAI之后,Anthropic成为又一家在大洋洲布局算力的AI企业。业内认为,提前锁定2.16吉瓦量级的容量,反映Claude背后持续扩张的训练与推理算力需求,同时也把公司算力的地理布局进一步分散至南半球,以降低对单一时区与单一电网的依赖。继OpenAI之后落子澳大利亚,也显示出头部AI公司正把算力布局从北美向大洋洲等地区进一步扩展。
江苏资讯
5 条苏州创材深造完成近亿元A+轮融资,构建可自我进化的“具身AI材料科学家”
9月16日,苏州AI+新材料企业创材深造宣布完成近亿元A+轮融资,由源码资本、金雨茂物联合领投,亿宸资本等跟投。资金将用于智能系统M-Loop研发、实验平台M-Lab扩产、材料数据集积累及OPL自驱实验室建设。公司成立于2021年,目标是构建具自我进化能力、能在物理世界做实验的AI材料研发系统,即“具身AI材料科学家”,由大模型与Agent、专用算法、高通量实验闭环(M-Lab,已迭代至3.0)与超10万条多模态数据四大要素支撑。已发布近20款高性能材料,多款量产落地,平台MLoop 1.0预计年底发布。其超强铝合金疲劳性能达世界领先水平两倍以上,研发验证周期由5至10年压缩至2至3个月,成本降至国外约1/10。
江苏发布2026年第7批公共数据“跑起来”实践案例,五地县域场景入选
9月16日,江苏省数据局发布2026年第7批公共数据“跑起来”场景县(市、区)实践案例,南京江北新区、淮安涟水县、淮安经开区、泰州姜堰区、宿迁泗洪县5地入选,覆盖司法执行、特色农业、校园食品安全、畜禽养殖、水产智养等领域。南京江北新区归集公共停车场与车辆动态数据,接入22个公共停车场、2个自营停车场共3000个车位,将涉诉车辆平均搜寻耗时缩短至1小时以内;淮安经开区构建校园餐饮供应商信用数据库,覆盖80余所学校、8万余名师生,行政检查频次压降50%;涟水县依托气象与销地市场数据搭建农业风控与价格预测模型,可提前3至7天推送极端天气预警。江苏自去年7月率先开展该案例征集以来,已累计发布13批共99个实践案例。
脉脉发布AI人才流动报告:苏州、南京新发AI岗位增量跻身全国前十
9月16日,脉脉高聘人才智库发布《Agent重置职场——AI人才流动报告》。报告显示,2026年1至7月平台新经济行业新发AI岗位量同比增长789.47%,新发AI岗位平均月薪达63160元,较去年同期上涨2.74%;北京、上海、深圳位居新发AI岗位量前三,合肥、成都、苏州的AI岗位增速最快,同比分别增长1570.37%、1158.70%和1068.18%,南京同样进入增量前十。岗位结构上,AI应用开发岗位占比达60.97%,Agent开发工程师成为企业最热招岗位;FDE(现场部署工程师)岗位量同比增长1522.73%,AI产品经理增长120.54%。
2026江南电影大会在苏州举办,“长三角人工智能影视协同创新实验室”揭牌
9月15日至17日,2026江南电影大会在苏州举办,16日上午举行开幕式,“长三角人工智能影视协同创新实验室”同步揭牌。该实验室由沪苏浙皖四省市电影发行放映协会与苏州电影业协会共同发起,秘书处设在苏州电影业协会,重点推进三方面工作:推动四省市影棚、算力、动捕设备对成员企业优惠开放;为中小微影视企业提供AI技术匹配与专项信贷扶持;推动AI影视硬件与内容协同发展。大会设置长三角电影发行放映、人工智能赋能影视产业振兴两个分会场,围绕数字影视技术革新、人机协同叙事创新、AI全景声生成等方向展开交流。苏州拥有高铁新城数字影棚、昆山数字梦工场9000平方米数字化制作旗舰棚,以及超1200亿元规模的集成电路产业集群。
2026苏州国际AI算力产业展览会启幕,近300家企业聚焦液冷全链条
9月16日,2026苏州国际AI算力产业展览会、第七届苏州国际数据中心液冷技术展览会及苏州国际热管理材料技术博览会在苏州国际博览中心启幕。展会以“AI驱动创新、液冷赋能未来”为主题,展出面积约1万平方米,汇聚近300家产业链上下游企业与科研机构。展品分为三大板块:AI算力与算法板块集中呈现智算服务器、算力芯片、光通信产品与智算中心整体建设方案;数据中心基础设施板块覆盖微模块数据中心、供配电、智能安防等成套方案;液冷专区完整展示冷却液、氟化液等基础原料,冷板式、浸没式、喷淋式全系列液冷装置及循环泵、温控传感器等核心部件。随着AI大模型与高性能计算场景普及,液冷正从“可选配置”转变为支撑算力基础设施绿色升级的核心刚需。
AI智库资讯
5 条中信建投武超则:AI产业本身没有泡沫,问题在资本开支与商业闭环的时间错配
9月16日,在新浪财经主办的AI投资峰会上,中信建投证券执委会委员、未来产业和政策研究院院长武超则表示,“AI产业本身并没有泡沫”,泡沫体感更多来自底层巨大的资本开支与商业模式闭环之间的时间错配,以及技术非线性迭代与短期估值线性外推之间的矛盾。她给出对比:移动互联网二十年里中美底层资本开支约每年1000亿美元,而今年北美CSP厂商资本开支约8000亿美元、中国约1万亿元人民币,投资规模扩大10倍,算上两套供应链可能达20倍。她认为只要模型持续迭代与Scale,算力需求仍具较强确定性,国产化主线未来几年增速可能更快。
英特尔CEO陈立武:内存短缺还将加剧,电力与散热是下一战场
据韩国《首尔经济日报》16日报道,英特尔CEO陈立武在加州圣克拉拉举行的AI基础设施论坛上表示,内存短缺问题将进一步加剧,确保电力供应和开发散热技术也将成为半导体市场的重大挑战。他称内存产能非常有限,价格已上涨五到七倍,许多项目因无法获得足够的内存而延期,制造低端手机或笔记本电脑获取内存已十分困难。他还指出电力至关重要,为在部分应用中实现低功耗,架构设计与互联技术变得关键;散热方面,除风冷外英特尔正投资液冷与微流体冷却等领域。他同时建议关注半导体市场向系统级架构转型的趋势。他强调,在算力需求快速增长的背景下,产业链各环节需要围绕电力、散热与内存供给提前布局。
摩根士丹利:中国消费端AI普及全球领先,变现关键在于嵌入既有平台
9月16日,36氪刊出摩根士丹利余凯杰团队最新报告的解读。报告认为,中国在消费端AI普及方面已处于全球领先位置:AlphaWise调查显示,中国每周至少使用一次个人AI的用户占比已达80%,显著高于美国的54%。报告将差距归因于生态分发体系、丰富的日常使用场景以及免费访问与春节营销活动的叠加效应,并指出相较于独立AI原生App,嵌入既有平台的“App内AI”具备更高的投资回报率,因为可直接复用现有流量、专有数据与支付履约能力。报告预计,到2030年中国C端AI可变现市场规模约为3000亿元人民币。
证券时报:国产算力链景气度抬升,Trend Force上调国产份额预测至近90%
9月16日,证券时报梳理算力基础设施产业链景气度:光模块、光芯片、光器件等环节上半年业绩大幅增长,剑桥科技已完成1.6T光模块客户测试与验证,源杰科技100G EML激光器芯片供不应求。Trend Force最新报告已将2026年中国高端AI芯片市场中,国产解决方案的份额预测从50%上调至接近90%,并指出国产AI算力正形成“国产AI芯片加速扩大供应”与“大型云服务商加快自研ASIC”两条路线。华泰证券测算,2028年国产超节点市场空间有望达到3414亿元,2026年至2028年复合增长率高达194%。
彭文生:AI大模型是数字经济迈入工业化时代的标志,中国绝对优势在人才
9月16日,在新浪财经主办的AI投资峰会上,上海交大上海高级金融学院实践教授、高金智库首席经济学家彭文生提出,AI大模型是数字经济迈入工业化时代的标志:不同于边际成本趋近于零的互联网平台,大模型须持续投入算力、数据与电力,且规模定律下性能提升速度会放缓,呈明显重资产特征。他对比称,互联网平台靠免费拉新形成网络效应,呈“价值崛起大于价值创造”;大模型可变成本不为零、切换成本低,呈“价值创造大于价值崛起”,收益更多外部化为社会生产率红利。谈及中美格局,他认为美国绝对优势在芯片,中国绝对优势在人才——全球51%的高水平AI研究者本科就读于中国,美国仅12%;中国可借算法框架创新与人才优势形成规模报酬递增曲线,应对算力限制。
AI 热词速查 · 一看就懂
27 词条基础概念 5
大模型(LLM) Large Language Model
大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。
智能体(Agent) AI Agent
能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。
多模态 Multimodal
能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。
Token(词元) Token
大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。
生成式AI Generative AI
能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。
模型技术 10
训练 / 推理 Training / Inference
训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。
预训练 Pre-training
用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。
强化学习(RL) Reinforcement Learning
通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。
微调 Fine-tuning
用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。
蒸馏 Distillation
把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。
RAG 检索增强 Retrieval-Augmented Generation
检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。
MCP 协议 Model Context Protocol
Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。
开源权重 Open Weights
模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。
Harness(智能体驾驭框架) Agent Harness
在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。
世界模型 World Model
能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。
算力基建 6
算力(FLOPS) Compute
每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。
GPU Graphics Processing Unit
图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。
智算中心 AI Data Center
专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。
超节点 Super Pod / Scale-up
把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。
云巨头 Hyperscaler
AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。
推理云(Neocloud) Neocloud
专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。
产业应用 6
具身智能 Embodied AI
AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。
AI4S AI for Science
AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。
AGI 通用人工智能 AGI
具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。
词元 / Token经济 Token Economy
以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。
FDE(前沿部署工程师) Frontier Deployment Engineer
把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。
OPC(一人公司) One Person Company
以个人为核心、依托AI工具与共享服务完成产品开发与商业闭环的新型创业范式。创业者用智能体承担设计、开发、运营等环节,以极低团队规模开展内容创作、跨境电商、软件开发等业务。江苏多地正建设OPC社区,并通过算力券、模型券、云网券等政策降低创业成本,宿迁提出打造“OPC创业之城”。