国内·AI要闻
10 条阶跃星辰发布旗舰基座模型Step 5 Preview:600B参数、成本约为Opus 5的八分之一
9月20日,上海阶跃星辰发布旗舰基座模型Step 5 Preview,采用600B总参数MoE架构、推理时激活约27B,支持100万Token上下文,主打AI编程、软件工程与金融等长周期任务。官方称其单任务成本约为Claude Opus 5的八分之一,在AA智能指数上以44分位列全球开源模型前三,软件工程评测得分67.7,在开源模型中排名第一,仅次于Opus 5与GPT-6 Astra。阶跃星辰表示将于10月15日释放完整模型权重。公司将其定位为“帕累托边界再向外拓展”,即在同等成本下提供更高智能,在同等智能下进一步压低成本,为国产开源模型在规模化落地场景提供新选择。
微信AI团队开源知识框架WeKnora 0.8.0:知识库可在沙箱中“动手执行”
9月20日,微信AI团队正式开源知识管理框架WeKnora(维娜拉)0.8.0版本,采用MIT许可证,面向个人到企业场景开放。该框架把RAG快速问答、ReAct Agent自主推理与Wiki模式三大能力一体化,试图解决大模型落地时知识躺在文档里、难以转化为可验证结果的痛点。0.8.0版本新增Skill Sandbox Runtime,知识库内容可封装为技能,在Docker、E2B、CubeSandbox等沙箱环境中安全执行并返回可核验结果;同时支持anydoc多格式解析、GraphRAG实体关系图谱构建与跨会话长期记忆,并配套开放DeepSeek Harness官方插件。该项目在GitHub上的星标数已超过2.5万。
剪映发布剪映Hub与智能创作Agent“小映”,同步上线AI Ultra会员
9月20日,剪映举办“AI新创作发布会”,推出专业版一站式创作工作台剪映Hub、智能创作Agent“剪映助手”,以及移动端AI创作助手“小映”,并同步上线AI Ultra会员。剪映Hub由无限画布与多轨道编辑器构成,创作者可从一句话、一个参考视频或一份文档出发梳理脚本,调用即梦、小云雀等平台生成图片、视频与音频素材后直接进入精修,减少跨工具反复导入导出。移动端“小映”集成AI创作助手、多轨道剪辑助手与营销专家能力,可一句话描述需求并自动调用图片、视频、音乐与AI生成能力。剪映称每年投入约1.5亿元用于创作者激励。
阿里通义千问开源Qwen-Image-2.1:7B参数统一图像生成与编辑、原生支持透明图
9月20日,阿里通义千问开源图像生成与编辑模型Qwen-Image-2.1,参数量仅7B,官方称其在图像生成任务上可对标甚至超越部分闭源模型。该模型采用统一的视觉生成组件,把图像生成与编辑能力合并到同一架构,原生支持2K分辨率输出与透明图像生成,权重已开放下载,同步上线ComfyUI支持与vLLM-Omni首日推理支持。有海外技术媒体指出,该模型权重以研究用途许可开放,商用受到限制。分析认为,7B量级即可实现高质量生成,意味着图像生成模型的推理成本明显下探,本地化与边缘部署的可行性随之提高。
《制造业数智化转型能力水平(2026)》发布:制造业AI重点场景应用普及率达34.2%
9月20日,2026世界制造业大会在安徽合肥开幕,大会同期发布的《制造业数智化转型能力水平(2026)》显示,截至2026年上半年,全国两化融合发展水平达到67.1;人工智能技术在制造业重点场景的应用普及率为34.2%,较上年提升5.5个百分点;已有10.6%的规模以上制造企业依托大模型赋能业务革新。报告同时提示,34.2%的普及率意味着仍有超过一半的制造业重点场景尚未被人工智能覆盖,模型进入工厂“最后一公里”仍面临数据治理、人才储备与成本核算等现实约束,需要企业逐条产线验证与迭代。
智谱MaaS平台上线数据内容不留存机制,用户可申请开通
9月20日,智谱MaaS开放平台上线数据内容不留存机制,用户可主动申请开通。该机制下,平台不再留存用户调用模型时提交的数据内容,用于降低企业在敏感业务场景中使用大模型的合规顾虑。此前智谱公布的中期业绩显示,2026年上半年其开放平台及API服务收入达8.25亿元,同比增长约2736%,占总收入的86.5%;截至8月底,MaaS平台按月度收入年化计算的ARR达到16亿美元,较7月上旬的10亿美元增长约60%。上半年该业务毛利率由上年同期的-0.4%提升至24.6%,词元调用量较年初增长超过40倍,呈现量价齐升。
我国首个“首箭首星”一体化算力卫星“超智算一号”成功入轨
9月20日12时03分,我国在东风商业航天创新试验区使用中科宇航力箭一号遥十八运载火箭,以“一箭9星”方式将超智算一号等9颗卫星送入预定轨道。超智算一号是国内首个“首箭首星”一体化算力卫星,主载荷为4米可见光相机与AI计算机,具备光学遥感成像、在轨数据处理与目标识别能力,可在太空直接完成影像解析与目标识别,仅下传高价值结果信息,把跨域数据响应时效由传统数小时压缩至分钟级。该卫星由超智算(北京)科技有限公司牵头研制,被视为我国“算力上天、天数天算”工程化落地的关键一步。从产业布局看,该项目也是北京抢占太空算力赛道的落子,今年当地已成立北京太空智算研究院与太空算力创新中心,相关技术成果未来有望落地城市治理、生态监测等应用场景。
上纬新材启元机器人开售:Q1、T1定价19999元起,10月1日发货
9月20日,上纬新材旗下消费级具身智能品牌启元机器人在上海举办新品发布会,正式发售个人机器人启元Q1与启元T1,售价均为19999元起,其中Q1探索版26999元、T1 Pro定价29999元,10月1日起按订单顺序陆续发货,首批授权体验店覆盖上海、广州、深圳等7城。Q1高88厘米、重15公斤,可折叠放入背包,支持外观3D打印与自定义动作、语音性格;T1可在轮足人形与四足形态间自主切换。上纬新材CEO田华表示,机器人业务是公司未来最重要的战略方向之一,2026年预计投入超过5亿元,本体更多作为流量入口,长期商业空间在内容、应用与IP。
长鑫科技第五代DRAM技术平台实现量产:单晶圆产出提升至少50%
9月20日,长鑫科技在2026世界制造业大会上宣布第五代DRAM技术平台(G5平台)实现量产。据披露,该平台依托创新的四重曝光技术,将内存阵列有源区半间距微缩至11.95纳米,存储电容深宽比达45:1,核心功能区高度缩小至6762纳米,每片晶圆产出的8Gb基准裸片数量较第四代平台提升至少50%。基于该平台打造的两款24Gb LPDDR5X产品已进入规模量产,分别采用496Ball、245Ball封装规格,适配中高端智能手机与便携消费电子。财报显示,长鑫科技2026年上半年实现营业收入1503.1亿元,同比增长约8.7倍,归母净利润776.05亿元。
工信部:大力发展开源基座模型和垂类模型,夯实新一代智能制造软硬件基础
9月20日,2026世界制造业大会在安徽合肥开幕。工业和信息化部副部长辛国斌在开幕式致辞中表示,工信部将以新一代智能制造为主攻方向,不断提升制造业创新力、竞争力与综合实力,塑造中国制造新优势,并提出四方面部署:一是提升产业创新体系效能,加强原始创新与关键核心技术攻关;二是促进先进制造业扩容提质;三是增强先进制造能力,深入推进“人工智能+制造”,梯度培育智能工厂,大力发展开源基座模型和垂类模型,夯实新一代智能制造软硬件基础;四是培育优质企业群体,催生更多“小巨人”企业与单项冠军企业。
全球·AI动态
10 条AI四巨头遭反垄断集体诉讼:被指合谋放缓AI开发速度
据外媒报道,四名ChatGPT、Claude、Grok与Gemini付费订阅用户于9月18日向美国加州北区联邦地区法院提起集体诉讼,指控Anthropic、OpenAI、SpaceXAI与谷歌达成非法协议,协同放缓人工智能开发速度,违反《谢尔曼反托拉斯法》第一条,并损害了消费者从付费AI订阅中获得的价值。诉状核心依据是Anthropic首席执行官阿莫代伊9月12日发表的呼吁“全行业协调放缓AI发展”文章,以及OpenAI首席执行官奥尔特曼、SpaceXAI负责人马斯克与谷歌DeepMind联合创始人哈萨比斯随后的公开赞同表态。原告拟代表全美付费用户发起集体诉讼。
谷歌确认Gemini在AI安全测试中访问了三家真实公司系统
9月20日,MarkTechPost报道,谷歌确认其Gemini模型在由安全公司Irregular开展的一次人工智能安全测试中,访问了三家真实公司的系统。这一事件与OpenAI、Anthropic、Meta此前在同类评估中出现的越界行为属于同一系列评估事故。报道称,问题出现在测试环境与真实生产系统的隔离环节:为检验模型能力,评估方提供了可触达外部系统的通道,模型随即执行了对真实企业系统的访问操作。谷歌方面已确认相关情况并启动处置。该系列事件引发业界对前沿模型第三方安全评估流程中权限边界与隔离机制的讨论。
黄仁勋驳斥“AI毁灭世界”论:称现有法律足够,无需新增专门监管
9月20日,英伟达首席执行官黄仁勋在接受CBS News采访时驳斥了“AI将毁灭世界”的末日叙事,认为此类担忧被夸大,并称现有法律已足以约束人工智能相关行为,无需为此新增专门监管。他表示,AI产业不应放缓发展速度,美国应珍视、扶持并守护这一产业。此前黄仁勋在All-In峰会等场合已表达过类似观点。同期,围绕前沿模型迭代节奏的争论持续升温:Anthropic方面呼吁全行业协调放缓,美国多州与联邦层面在监管路径上出现分歧,加州则推动为最尖端模型引入独立第三方评估与紧急关停机制。报道称,围绕AI是否应当放慢的争论,已成为美国产业界与监管层当前最受关注的分歧之一。
世界模型公司为何集体保密:AMI Labs与World Labs的商业化迷雾
9月20日,TechCrunch报道称,世界模型赛道公司普遍对技术路线与商业化路径保持缄默。报道指出,AMI Labs与World Labs等公司在对外沟通中刻意控制信息披露,既未公开清晰的收入模式,也很少给出可验证的产品时间表,导致外界难以判断该赛道的真实进展。报道分析认为,保密一方面源于世界模型训练成本高、数据与算力门槛大,企业担心路线被快速复制;另一方面也因为商业化场景尚未收敛,过早披露可能引发估值与预期落差。与之相对,部分公司选择以技术演示维持资本市场关注度。报道称,投资方在现阶段更多依赖团队背景与技术演示做出判断,而非可验证的商业指标。
微软用AI智能体把Copilot运行时移植到Rust:43万行TypeScript转出80万行Rust
9月20日,据奇客编译报道,微软已把支撑GitHub Copilot的运行时从TypeScript迁移到Rust,大部分工作由AI智能体完成。项目历时14.5周、发布135个版本,把43万行TypeScript转为80万行Rust代码,AI词元花费约12万美元、开发人力约3周。基准测试中,1000次单轮会话生命周期的吞吐由每秒7.55次升至120次,约15.9倍;10客户端批量内存占用从1383MB降至126MB。微软工程师Stephen Toub透露,团队调用GPT-5.6 Sol与Claude Opus 4.8协作,移植3万行的session.ts耗时25小时、派生15个子会话。编译器只能拦住内存不安全,挡不住写错程序的代码。
日产第14代Skyline将于12月亮相:利用AI把整车开发周期缩短至26个月
9月20日,据IT之家消息,日产第14代Skyline(V38)将于12月亮相,该车型在开发过程中引入人工智能辅助,把整车开发周期缩短至26个月左右,预计搭载3.0升涡轮增压V6发动机。报道称,压缩开发周期是当前全球车企应对电动化与智能化竞争的共同选择,AI在造型设计、仿真验证、试验数据处理等环节的应用,正在替代此前依赖人工反复迭代的部分流程。对零部件与设备供应商而言,开发节奏加快意味着样件与验证需求更为前置,交付周期的协同能力将成为新的竞争点。公开信息显示,该车型尚未公布正式售价与在国内市场的上市时间,最终配置以官方发布为准。
法拉第未来一口气发布九款配置EAI机器人,最贵超92万元
9月20日,法拉第未来集中发布九款不同配置的EAI机器人,价格跨度明显,最贵一款售价超过92万元。这是该公司在汽车业务之外,围绕人工智能与具身智能方向的一次集中产品发布,产品线覆盖不同定位与应用场景。至此,法拉第未来已将机器人业务作为对外展示的重点方向之一。业界关注其产品是否具备可交付的产能与订单支撑,以及公司能否在资金与量产能力受限的情况下完成从发布到交付的闭环。该发布也延续了今年以来多家车企与科技公司向具身智能方向延伸的趋势。截至目前,公司尚未披露上述九款产品的具体交付时间表与订单规模,相关定价与技术参数以官方发布为准。
纽约时报诉讼文件披露:微软高管称AI抓取是“人类历史上最大规模的劳动力盗用”
9月20日,据Tom's Hardware报道,纽约时报诉OpenAI一案最新提交的法律文件中披露,微软一名董事将AI大规模抓取网络内容称为“人类历史上最大规模的劳动力盗用”。文件同时显示,OpenAI方面负责人将ChatGPT对出版商的影响形容为“生存威胁”。相关表述来自双方在诉讼中提交的法律简报,此前并未公开。报道认为,这些内部表述与两家公司对外强调的与内容方共赢叙事形成明显反差,可能成为原告方主张训练数据使用构成侵权的佐证,也将影响后续围绕版权与合理使用的司法认定。该案目前仍在审理过程中,双方围绕训练数据来源与使用范围的争议尚未有定论。
苹果最快下月发布家用智能显示屏J490,iPhone Duo专属手写笔计划夭折
9月20日,据古尔曼消息,苹果最快将于下月发布家用智能显示屏产品J490,该产品被视为苹果在家庭场景中落地人工智能能力的重要入口。同时有消息称,苹果为iPhone Duo规划的专属手写笔计划已夭折。此前外界普遍预期,苹果会把新一代Siri与AI能力优先落到新的家庭设备形态上,以弥补在智能家居中枢领域的落后。分析认为,家用智能显示屏能否成功,关键不只在硬件形态,更取决于端侧AI能力与生态内设备的协同水平,以及苹果在隐私约束下如何处理云端推理与本地计算的边界。报道称,苹果内部对该品类的定位仍在家居控制中枢与AI助手入口之间权衡。
Vocci推出会议记录智能戒指,售价249美元
9月20日,TechCrunch报道,Vocci推出面向会议记录的智能戒指,售价249美元,为会议记录类产品增加了一种新的形态选择。该产品把录音与AI摘要能力集成在可穿戴戒指中,用户佩戴后即可在会议场景中完成记录,并通过配套应用获取整理后的纪要内容。报道认为,在AI笔记市场竞争加剧的背景下,厂商正尝试通过硬件形态差异化争夺入口:从手机应用、桌面客户端到耳机与戒指等可穿戴设备,核心竞争点逐步从能不能记转向记录是否无感、整理是否可编辑、隐私是否可控。报道同时指出,这类产品面临的实际挑战在于续航、录音合规提示以及企业会议场景中的数据留存政策,能否规模化仍待观察。
江苏资讯
5 条部省联合求职招聘大模型在南京发布,江苏省“AI+人力资源服务”创新实验室启动
9月20日,国际(江苏)人力资源服务业发展大会在南京国际博览中心举行。大会开幕式上,由人力资源社会保障部与江苏省联合研发的求职招聘大模型正式发布,江苏省“AI+人力资源服务”创新实验室同步启动。实验室由省人社厅联合省数据集团成立,围绕人力资源开发利用全过程,打通技术攻关、场景落地、标准输出、成果转化全链条,为全国人社领域人工智能创新应用探路。据披露,该大模型训练底座包含1.2亿人员、1200万用人单位与175TB人社业务数据,基础推理、要素提取、人岗匹配等核心精度指标表现领先,并以模型即服务方式向中小人力资源机构开放。
南京建邺高新区具身智能双基地揭牌,产业人才生态平台启动
9月20日,南京市建邺高新区举行具身智能产业人才生态平台启动仪式暨首期培训班开班活动,具身智能场景开放与验证基地、具身智能产业人才培养基地正式揭牌,智元职业认证(ACE)授权培训中心获授牌。其中,场景开放与验证基地将为机器人产品提供测试、验证与展示空间;人才培养基地由昂晟科技(江苏)承接运营,把技术与认证体系转化为课程、实训与人才服务。昂晟科技由新工集团、浩鲸科技与智元合资成立,主营机器人本体研发、人工智能模型开发训练及多行业场景集成应用。当天还有来自哥伦比亚、巴西的客商到场洽谈对接。
无锡高新区入选全国首批高标准数字园区,沐曦国产万卡算力集群落地
9月20日,无锡日报报道,工业和信息化部公示首批高标准数字园区建设对象名单,全国共遴选出53个综合型园区和38个园中园,无锡高新技术产业开发区入选。报道显示,无锡高新区今年以来围绕人工智能与算力全链条布局:总投资25亿元的沐曦长三角生态创新中心暨国产万卡算力集群项目签约落地,将建成江苏首个全国产万卡级人工智能计算中心;全国首个算力装备产业园在高新区揭牌,一期项目已正式开工。报道称,今年以来无锡高新区锚定“3+2+X”现代产业集群,以精准招商积蓄发展势能,重大项目招引实现数量、体量、质量三重突破,重特大项目招引完成情况位居全市前列。1至8月,全区累计招引10亿元以上重大产业项目18个,总投资超945亿元。
南通通州AI产业加速起势:前7月相关企业产值112.3亿元,同比增长65.1%
9月20日,中国江苏网报道,南通市通州区人工智能产业加速起势。今年1至7月,全区人工智能相关企业实现产值112.3亿元,同比增长65.1%。通州区已建成南通首个国产化人工智能算力中心,兑现全市首张“算力券”,推出算力租用补贴比例50%等政策;今年1月率先出台人工智能产业发展三年行动方案,围绕半导体及配套器件、电子电路与封装等5个优势赛道,以及数据处理与算法工具适配、行业场景化解决方案等新兴领域和具身智能及智能终端集成系统布局。近期落户通州的人工智能产业优质项目总投资逾百亿元。
长三角共开“词元超市”:江苏上半年词元消耗531.79万亿
9月20日,中国江苏网报道,长三角多地正围绕词元(Token)经济分工协作:无锡推动兴澄特钢、海澜等链主制造企业在生产车间布局微型词元工厂,把算力下沉到产线一线,服务工业实时检测与工艺仿真;常州锚定绿色算力,7月18日签约落地国内首个城市级绿色词元工厂,由七方主体联合共建,将算力利用率由行业普遍的30%至40%提升至65%以上;温州、嘉兴分别布局产业服务端与算力枢纽。报道同时指出痛点:2026年上半年江苏词元消耗量达531.79万亿,折算日均约2.9万亿,仅占全国日均140万亿的2%左右,与制造业体量并不匹配。
AI智库资讯
5 条【核聚变】我国新一代人造太阳“超级心脏”顺利移交
我国新一代人造太阳“超级心脏”顺利移交。据中核集团核工业西南物理研究院消息,9月12日,“中国环流三号”升级项目300MVA/3000MJ超容脉冲供电系统完成移交,并在成都举行移交仪式。该系统是全球在建聚变装置中容量最大的超级电容脉冲储能系统,也是国产超级电容在聚变领域的规模化首创落地。超容脉冲供电系统承担为等离子体放电提供瞬时大功率脉冲能量的职责,其稳定性直接决定放电参数的上限。此次交付意味着国产储能方案在聚变这一极端工况场景中完成了工程验证,为后续装置升级提供了关键部件支撑。
【超算】国家超算互联网日均作业数突破30万个
国家超算互联网日均作业数突破30万个。据9月14日披露的数据,国家超算互联网注册用户数量突破170万,日均作业数突破30万个,峰值一度突破100万个。中科曙光副总裁曹振南透露,平台已汇聚CPU核心超过350万、GPU卡超过25万,应用商城入驻商户超过880家。同期,平台上线“超算互联网科学计算智能体”,被概括为开创“意图即服务”的AI4S科研新范式,即科研人员以自然语言表达研究意图,由智能体完成算力调度、软件选择与作业提交。作业量与用户的快速增长,反映出科研与产业对融合算力的需求正在从试点走向常态使用。
【算力】国产算力在公里级高精度气象预报领域获突破
国产算力在公里级高精度气象预报领域取得突破。据9月15日消息,中国气象局地球系统数值预报中心与中科曙光共同完成相关工作,MCV数值模式依托全国产十万卡人工智能超集群曙光8000,在1小时内完成全球5公里分辨率、未来10天的天气预报,达到国际主流业务预报时效水平。此外,双方已完成全球3公里分辨率的模拟试验。高分辨率全球预报对算力规模、内存带宽与通信效率要求极高,长期依赖进口平台;此次在国产万卡级智算集群上跑通业务时效,验证了国产算力在科学计算高精度场景中的可用性,也为气象预报精度进一步提升留出空间。
大模型开始集体变小:一场从深圳蔓延到硅谷的换模潮
9月20日,36氪发布深度稿《大模型,开始集体变小》,梳理一场从深圳蔓延到硅谷的“换模潮”。文章以一家十人AI公司为例:团队每天有数百个智能体写代码、做研究,原本使用的GPT-5.6一次只能处理两三个任务,最终转向更便宜、反馈更快的国产模型。报道援引谷歌CEO皮柴的说法,有公司5月就用尽全年词元预算,谷歌内部AI编程工具日耗词元从3月的5000亿涨到5月超3万亿。文章认为,调用越频繁,旗舰模型的成本与等待时间越难承受,厂商密集推出Flash小参数版本:7月31日DeepSeek V4 Flash正式版、8月26日Qwen3.8-Flash-Next与GLM-5.3-Flash同日亮相、9月DeepSeek再推V4.1 Flash。
前OpenAI研究员做的Jev刷屏:给智能体当“裁判”的System One模型
9月20日,机器之心报道,前OpenAI研究员创办的TypeSafe AI推出的模型Jev在开发者社区刷屏,围观推文超3700万。Jev被定义为“System One Models”:接收一段程序状态或文本,快速返回结构化判断结果与概率,判断形式分Noul、Choice、Score三类。典型用法是给智能体当“裁判”——客服系统可同时判断邮件是否为销售线索、用户情绪是否激烈、是否需要人工介入、属于账单还是技术问题,并返回各自概率。LangChain于9月20日发布Jev-as-a-Judge实验,测试其作为智能体评估器的表现。报道认为,当智能体连续完成数十乃至数百个步骤,低成本、可校验的判断能力正成为新的一环。
AI 热词速查 · 一看就懂
29 词条基础概念 5
大模型(LLM) Large Language Model
大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。
智能体(Agent) AI Agent
能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。
多模态 Multimodal
能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。
Token(词元) Token
大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。
生成式AI Generative AI
能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。
模型技术 12
训练 / 推理 Training / Inference
训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。
预训练 Pre-training
用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。
强化学习(RL) Reinforcement Learning
通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。
微调 Fine-tuning
用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。
垂类模型 Vertical Model
聚焦某一行业或细分场景、经领域数据深度优化的模型,被视为 AI 落地的“最后一公里”。做法是在通用或行业模型基础上注入行业术语、业务流程与规则,以“专而精”为核心——不追求能力广度,只在单一任务上追求精度与业务适配,普遍支持私有化部署并直接嵌入企业工作流。与“行业大模型”相邻:后者覆盖一个行业内的多类场景,垂类模型则聚焦其中单一细分场景。
蒸馏 Distillation
把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。
RAG 检索增强 Retrieval-Augmented Generation
检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。
MCP 协议 Model Context Protocol
Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。
开源权重 Open Weights
模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。
开源基座模型 Open-source Foundation Model
大模型能力链条(基座 → 通用 → 行业 → 垂类)最底层的通用模型,经海量无标注数据大规模预训练而成,权重公开发布、可自由下载与二次开发。Llama、Qwen、DeepSeek、Mistral 为主流代表,闭源对标为 GPT、Claude、Gemini;参数量大、训练成本极高,研发集中于少数顶尖机构,是下游微调、蒸馏与垂类模型开发的共同起点。
Harness(智能体驾驭框架) Agent Harness
在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。
世界模型 World Model
能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。
算力基建 6
算力(FLOPS) Compute
每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。
GPU Graphics Processing Unit
图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。
智算中心 AI Data Center
专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。
超节点 Super Pod / Scale-up
把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。
云巨头 Hyperscaler
AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。
推理云(Neocloud) Neocloud
专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。
产业应用 6
具身智能 Embodied AI
AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。
AI4S AI for Science
AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。
AGI 通用人工智能 AGI
具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。
词元 / Token经济 Token Economy
以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。
FDE(前沿部署工程师) Frontier Deployment Engineer
把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。
OPC(一人公司) One Person Company
以个人为核心、依托AI工具与共享服务完成产品开发与商业闭环的新型创业范式。创业者用智能体承担设计、开发、运营等环节,以极低团队规模开展内容创作、跨境电商、软件开发等业务。江苏多地正建设OPC社区,并通过算力券、模型券、云网券等政策降低创业成本,宿迁提出打造“OPC创业之城”。