国内·AI要闻
9 条小米发布并开源MiMo-V2.6系列:1.02万亿参数MoE,登顶开放权重榜首
9月22日,小米正式发布并开源新一代MiMo-V2.6系列大模型,含旗舰MiMo-V2.6-Pro与高效推理模型MiMo-V2.6-Flash。两款模型均为原生全模态,支持文本、图片、音频、视频输入,上下文窗口100万词元;Pro总参数1.02万亿、单次推理激活约420亿,Flash总参数3100亿、激活约150亿。第三方机构Artificial Analysis综合智能指数显示,Pro以46分位列开放权重模型第一,超过Kimi K3与Qwen3.8 Max,但低于Claude Opus 5.5的58分。训练侧Pro与Flash合计成本约347万美元,各完成30步,累计约75万条轨迹。模型权重以MIT协议开源。
千问加速打造Personal Agent:开放平台覆盖超20个领域
9月22日,在2026云栖大会上,千问宣布加速打造Personal Agent(个人智能体)。千问产品负责人郑嗣寿表示,依托Qwen 3.8系列模型的Agentic能力,千问正在构建全新的Personal Agent形态,为3亿用户提供持续、个性化的智能服务。阶段性进展包括:在用户授权下接入健康、运动等个人数据,为健康咨询与运动规划提供更有针对性的分析;接入海量专业理财数据及机构智能体,并支持部分用户连接个人持仓;在工作场景中通过专业Skill和工具协助完成复杂任务。目前,千问开放平台已从本地生活、物流等场景拓展至求职、运动、游戏等领域,累计覆盖20多个领域,申请入驻伙伴超过1000家。
千问AI眼镜N1系列亮相云栖大会:眼动追踪+虹膜支付,10月13日发售
9月22日,新一代全系列千问AI硬件在云栖大会首次集中亮相,包含千问AI眼镜N1、N1 Pro及千问AI耳夹式耳机,三款新品当天同步开启线上预约,并将于10月13日现货发售。N1系列搭载5000万像素传感器,支持第一视角拍摄;其中N1 Pro支持眼动追踪与虹膜支付,用户看向展品并提问时,AI可借助视线信息判断其所指对象。核心配置采用高通骁龙AR1、恒玄BES2800与低功耗感知芯片的三芯方案,镜腿电池可拆卸、换电不断电,并支持心率、血氧、HRV等体征监测。耳夹式耳机结合Bose调音与AI助理能力,支持面对面翻译、AI听记与语音办事。
智谱开源ZCode代码库:信通院与绿盟科技出具第三方审计结论
9月21日,智谱宣布ZCode正式开源至GitHub,并公布两份第三方审计结论:中国信息通信研究院技术评测确认,涉事的阿里云OSS存储桶处于“云端零数据”状态;绿盟科技确认桶内全部数据对象及存储桶本身已删除,ZCode v3.14.0客户端已移除Repo Wiki入口及相应生成链路。事件起于9月18日,有开发者反映ZCode在登录状态下自动打包上传工作区的完整Git历史与配置文件。智谱致歉并承诺相关数据无留存、从未用于模型训练,同时建立常态化安全漏洞反馈机制。此外,智谱MaaS平台宣布近期将上线“数据内容不留存”功能,用户申请生效后,平台不对输入输出作静态存储。
中科曙光发布AI推理原生存储FN Neo:词元吞吐提升150%
9月21日,中科曙光在2026年CCF全国信息存储技术学术会议上正式发布全新迭代升级的AI推理原生存储FN Neo,以统一存储池承接推理业务数据,为AI推理规模化落地提供存力底座。该产品通过池化共享架构实现集群级KV Cache资源调度,把原本绑定在各计算节点内部的私有缓存转变为整个推理集群可调度的共享资源,减少重复计算并提升昂贵算力硬件的利用率。实测数据显示,FN Neo单阵列带宽可达160GB/s、亚毫秒级时延,延迟表现、吞吐量与多请求并发数相比传统本地NVMe方案均有约2倍提升,可实现模型首词出现时间缩减73%、整体词元吞吐能力提升150%,并提供99.999%高可靠运行保障。
芯驰科技完成C+和C++轮融资:年内C轮融资约10亿元
9月21日,国内车规级芯片企业芯驰科技宣布完成C+和C++轮融资,加上今年5月公布的C轮融资,公司2026年已先后完成C轮、C+轮、C++轮三次融资,合计约10亿元人民币。参与此次融资的机构包括华登科技、陕投基金、陕西金资、新时代资本等。所融资金将重点用于核心技术研发和产品化,持续投入智能座舱与车控芯片研发,同时推动相关车规级产品技术向具身智能等智能终端场景拓展。截至目前,芯驰全系列芯片累计出货量已突破1400万片,客户覆盖国内90%以上主机厂及部分国际主流车企,具身智能相关芯片已在头部企业产品中实现量产。
特斯联联手威华达设立34亿元算力合资平台“光智特科”
9月21日,威华达控股(00622.HK)发布公告,公司与特斯联共同设立合资平台“光智特科”,注册资本34亿元人民币,将围绕国产算力生态建设与AI生产力服务展开布局。根据交易安排,威华达控股以每股2.70港元向特斯联关联主体Nova Scope Ventures Limited配发及发行11.8亿股新股,交易总对价约31.86亿港元,完成后后者将持有威华达扩大后股本的14.53%。股权结构上,光智特科由特斯联方面持股50.40%、掌握技术研发与日常运营主导权,威华达控股间接持股49.60%。该平台以AI智能优化引擎与Agent集群调度为底座,贯通“智算中心—算力租赁—Token工厂”业务闭环。
大晓机器人携手中国石油:首个加油站便利店具身智能项目试运营
9月21日至22日,多家媒体报道,大晓机器人与中国石油上海销售公司达成战略合作,启动试运营国内首个加油站便利店场景的全闭环具身智能机器人项目,探索“场景出题、平台协同、模型驱动、本体执行”四位一体的具身零售共创模式。首店昆仑好客便利店(中国石油振兴店)已进入试运营阶段:消费者通过美团下单后,订单经中国石油数智平台进入作业系统,机器人可在75厘米通道及2米高货架条件下完成商品识别、拣选、搬运、打包并同步更新订单状态。大晓机器人由商汤科技联合创始人王晓刚出任董事长、AI科学家陶大程院士任首席科学家,已推出开悟世界模型Kairos 3.1等成果。
阿里开源Qwen-Image-2.1:7B视觉生成登顶开源生图榜首
9月21日,阿里千问正式开源图片生成模型Qwen-Image-2.1,实现文生图与图像编辑一体化,原生支持透明(RGBA)图像生成,最多可接收10张参考图,并进一步强化局部编辑与人像、商品保真能力。其视觉生成部分采用32层Single-Stream DiT、参数量仅7B,原生支持2K分辨率输出。公开评测中,Qwen-Image-2.1以60.28总分登顶开源模型第一,超过闭源的Nano Banana 2.0(59.82)与GPT Image 1.5(59.65)。模型权重已在Hugging Face、ModelScope等平台同步发布,并在发布当天获得Diffusers、ComfyUI、vLLM-Omni等推理框架支持。
全球·AI动态
10 条Anthropic发布Claude Opus 5.5:登顶第三方智能指数,成本降约四成
当地时间9月22日,Anthropic发布Claude 5.5系列首个模型Claude Opus 5.5。官方称该模型较Opus 5显著提速并降低成本,API定价为每百万词元输入4美元、输出20美元,较Opus 5的定价下调20%,典型工作负载的运行成本降幅约40%。第三方评测机构Artificial Analysis数据显示,Claude Opus 5.5以58分登顶其综合智能指数。同日该模型上线OpenRouter。Anthropic同步发布的系统卡披露,在安全演习中约半数运行出现或有危害行为。此次发布与OpenAI GPT-6 Sol、Luna同日上线,前沿模型竞争进一步转向单位任务成本。
OpenAI发布GPT-6 Sol与Luna:API价格较GPT-5.6促销价腰斩
当地时间9月22日,OpenAI正式发布GPT-6 Sol与GPT-6 Luna,扩充GPT-6产品线。两款模型沿用与旗舰GPT-6 Astra相近的训练方法,定位为速度更快、成本更低的型号。价格方面,GPT-6 Sol每百万词元输入2美元、输出10美元;GPT-6 Luna输入0.10美元、输出0.50美元,均较GPT-5.6同级模型的促销价下降50%。OpenAI将降价归因于缓存与推理效率提升,读取已缓存输入词元的折扣最高可达90%。两款模型即日起在ChatGPT Work与Codex中面向Plus、Pro、Business、Enterprise及Edu用户推出;免费及Go用户可在桌面端应用中体验GPT-6 Luna。
SpaceXAI发布Grok 4.7:智能指数46分,价格与前代持平
当地时间9月21日,马斯克旗下SpaceXAI正式发布新一代模型Grok 4.7,官方称这是目前旗下功能最强大的编程与知识处理模型。据评测机构Artificial Analysis数据,Grok 4.7在智能指数上得分46,位列模型榜单第六,也让SpaceXAI进入全球排名前四的人工智能实验室之列。Grok 4.7使用了比Grok 4.6更大更新的基础模型,经过更长时间的强化学习训练,侧重需要数小时才能完成的长任务。其API价格保持每百万输入词元2美元、输出6美元不变,与Grok 4.6一致。首批评测显示,模型在长时程智能体任务与编程测试中进步明显,但在网页、3D场景与可视化编程实测中出现较多“跑分强、落地翻车”的样本。
AMD市值盘中首破1万亿美元:数据中心业务同比增长107%
9月21日美股盘中,超威半导体(AMD)股价显著上涨,一度触及每股615.99美元的历史新高,市值首次突破1万亿美元,成为全球市值突破万亿美元的半导体公司之一;随后其股价涨幅收窄,市值回落至1万亿美元下方。分析认为,此轮上涨的核心驱动力来自其AI算力战略的全面兑现。公司2026年第二季度财报显示,营收达115亿美元、同比增长50%,净利润23亿美元、同比增长163%;其中数据中心业务收入67亿美元、同比增长107%,占总营收比重攀升至58%。此外,AMD近期与OpenAI、Meta、Anthropic等公司签订多项合约。目前万亿美元市值俱乐部中的半导体制造商包括英伟达、台积电、博通、三星电子、SK海力士与美光科技。
软银拟发行超110亿美元垃圾债,为追加投资OpenAI筹资
9月21日,据彭博社援引知情人士报道,软银集团正寻求发行总额超过110亿美元的债券,为其对OpenAI的投资提供资金,这将成为有史以来规模最大的单一企业垃圾债券发行之一。条款清单显示,美元计价票据分为3年半、5年半和7年半三个期限,合计100亿美元;欧元计价债券分为4年和6年两个期限,合计10亿欧元。募集资金将部分用于支付软银对OpenAI第三笔后续投资的100亿美元款项,预计将于10月1日完成。债券发行预计9月24日定价、9月29日结算,花旗集团和摩根大通担任主承销商。软银此前已向OpenAI投资近650亿美元。
亚马逊封禁Meta Muse智能体:称其未获授权代用户购物
9月21日,据IT之家报道,亚马逊已阻断Meta全新个人AI智能体Muse代用户在亚马逊网站购物的访问权限。此前,亚马逊曾尝试劝说Meta主动在Muse中排除亚马逊电商站点,但协商未能达成一致。亚马逊表示,问题的核心在于公司自始至终从未许可该访问行为:Meta事先没有告知亚马逊Muse会访问其电商平台;该智能体在网页浏览时不会主动表明自身AI身份;且Muse似乎会采集并保存用户账号凭证,可能带来隐私与安全隐患。自当地时间上周日晚间起,用户尝试使用Muse在亚马逊下单时会收到提示,称未经授权的AI智能体继续访问违反平台使用条款。Meta回应称,Muse无法读取用户密码或支付信息。
五角大楼内部调查:过度依赖Palantir的Maven系统致伊朗小学遭袭
9月21日,据彭博社9月19日援引参与调查的官员消息报道,今年2月美军空袭伊朗南部米纳卜市一所女子小学、造成超过150人死亡,内部调查显示军队在命令紧迫下过度依赖Palantir公司开发的人工智能工具,为造成事件的主因之一。官员透露,特朗普政府下令在24小时内打击逾千个伊朗目标,军令紧迫压缩了核实时间,再加上负责平民保护的人员被大幅削减、目标地点基础信息缺失以及对AI的过度依赖,最终酿成这场惨祸。美国国防部过去一年将Palantir的Maven智能系统纳入作战体系,该系统将2017年已与军营以围墙分隔的米纳布小学标为革命卫队设施,使其成为首轮打击目标之一。
苹果新款Mac mini与Mac Studio正式发售:主打设备端AI
9月22日,苹果宣布新款Mac mini与Mac Studio正式发售。新款Mac mini搭载M6芯片或M5 Pro芯片,起售价分别为899美元和1699美元;Mac Studio搭载M5 Max或M5 Ultra芯片,起售价分别为2499美元和5499美元。苹果称,搭载M6芯片的新款Mac mini的AI性能提升最高可达4倍,存储速度与图形处理速度双双翻倍,CPU性能提升40%;新款Mac Studio是苹果性能最强的Mac机型,AI性能提升最高可达4.3倍,图形处理速度提升最高可达1.8倍,支持最高512GB统一内存。两款产品均为强大的设备端AI平台,每颗核心均配备新一代图形处理器与神经网络加速器,并搭配最新macOS 27。
高通与谷歌深化合作:推动AI手机进入“代理时代”
当地时间9月22日,在2026骁龙峰会上,高通与谷歌宣布进一步深化合作,共同推动AI智能手机向“代理式体验”转型。谷歌平台与设备高级副总裁里克·奥斯特洛与高通CEO阿蒙同台。谷歌披露,Gemini月活跃用户已增至10亿,成为其史上最快达10亿用户的产品;谷歌搜索每月有10亿用户使用AI模式;谷歌云上季度80%企业客户采用其AI服务。双方合作的核心是从传统操作系统向“智能系统”过渡,谷歌称之为“Gemini智能”,让设备从回答问题转向帮用户完成任务。手机、PC、智能眼镜、汽车都将成为AI代理终端。高通方面表示,AI手机需重新设计计算引擎,CPU对代理编排至关重要,NPU提供高效推理,同时须遵守热约束并保持全天续航。
加拿大不列颠哥伦比亚省就校园枪击案起诉OpenAI
9月22日,据加拿大通讯社报道,加拿大不列颠哥伦比亚省政府于当地时间21日在美国加州起诉OpenAI及其首席执行官萨姆·奥尔特曼,指控该公司未将塔布勒岭枪击案凶手在ChatGPT上的异常对话报告给当地警方。18岁的凶手杰西·范鲁策拉尔于今年2月10日先在住所杀害母亲和弟弟,随后前往塔布勒岭中学枪杀5名未成年人和1名教师。早在2025年6月,OpenAI就封禁了一个与该凶手相关的账户,因其曾在平台上输入与枪支暴力相关的提示词,但公司没有将有关威胁报告给加拿大皇家骑警。该省要求OpenAI赔偿损失,并寻求法院命令要求其改变处理可能导致暴力的对话的方式。
江苏资讯
6 条2026英特尔技术创新与产业生态大会在苏州开幕:聚焦智能体产业落地
9月22日,2026英特尔技术创新与产业生态大会在苏州开幕,以“同芯·智远”为主题,设11场主题演讲、80余场技术课堂与15000平方米成果展。英特尔CEO陈立武在视频致辞中称,x86持续驱动计算向智能化发展,公司将依托CPU、GPU、ASIC、先进封装与晶圆制造等优势,与生态伙伴把握智能体机遇。战略聚焦三方面:打造覆盖PC、边缘与数据中心的开放计算平台;围绕特定负载设计定制芯片;以制程与先进封装实现系统集成。端侧依托CPU、GPU与NPU协同的XPU架构,推动PC向车载AI Box、AI NAS等延伸;云端以CPU为中枢建设智算中心。百度搭子、Marvis、千问办公、TRAE等参与端侧优化,节卡机器人结合其边缘计算平台落地。
江苏发布首个“人工智能+电子商务”专项行动方案,设10亿元产业基金
9月22日,江苏电商创新发展大会在南京国际展览中心举行,会上发布《江苏省“人工智能+电子商务”创新发展行动方案(2026—2028年)》,这是国内首个省级层面的人工智能与电子商务融合发展专项政策。方案围绕智能选品、数字人直播、智能客服、跨境出海等方向提出12条具体举措,明确设立规模10亿元的相关产业基金,并推动建设163个高质量数据集、培育166个行业智能体。同期,南京AI电商创新发展对接会在建邺区召开,长三角(南京)直播电商产业集聚区正式揭幕。建邺高新区已形成电商直播全产业链,园区网络零售额已近200亿元。
盐城响水:“AI+制造”免费诊断覆盖43家服务商,170余家企业产线改造
9月22日,中国江苏网报道,盐城市响水县以“AI+制造”推进县域制造业数字化赋能,通过组织43家人工智能服务商为企业开展免费诊断,推动170余家规上企业实施生产线智能化改造。当地采取“诊断先行、改造跟进”的路径:先由专业机构入企排查设备联网率、数据采集能力与关键工序瓶颈,再按行业分类给出改造清单,降低中小企业的试错成本。改造后,部分企业实现关键工序参数的自动采集与过程质量在线判定,设备综合效率与一次良品率明显提升,用工与能耗同步下降。响水县方面表示,将继续扩大诊断覆盖面,推动人工智能从单点应用走向产线级、车间级整体升级。
江苏“AI+农业141”行动落地盐都七星农场:巡检效率提升约30倍
9月22日,新华报业网报道,江苏“AI+农业141”行动在盐城市盐都区七星农场落地应用。项目围绕农情监测、病虫害识别、精准施肥、智能灌溉与农机调度等环节部署5类人工智能算法,构建覆盖耕、种、管、收全流程的数字化管理体系。据披露,应用后田间巡检效率提升约30倍,化肥与农药使用量减少约15%,并实现作物长势与土壤墒情的连续感知和预警。农场方面表示,人工智能算法的价值在于把过去依赖经验的判断转化为可量化、可复用的决策依据,减少人工巡田频次与主观偏差。下一步将向周边种植主体复制推广相关模型与服务模式。
扬州邗江AI产业加速成型:AI视觉检测将不良率从2.65%降至1.05%
9月22日,我苏网报道,扬州市邗江区人工智能产业加速成型,形成以智能机器人、半导体与工业视觉为核心的产业集群。区内企业云深处的四足机器人已在巡检、安防等场景落地应用;扬杰科技将AI视觉检测引入功率半导体生产线,产品不良率由2.65%降至1.05%。邗江区通过建设专业园区、设立产业基金、开放应用场景等方式吸引项目落地,并推动本地制造业企业与人工智能企业结对,围绕工艺优化、质量检测、设备预测性维护等环节开展改造。当地表示,下一步将重点补强算力服务与数据要素供给,推动人工智能从单点应用向产业链协同延伸。
徐州人工智能教育示范中心建成投用,全市算力规模达540PFlops
9月22日,澎湃新闻报道,徐州市云龙区人工智能教育示范中心建成投用,由云盛集团与威盛电子共建,面向中小学提供人工智能课程、师资培训与场景体验服务。中心设置智能机器人、无人驾驶、生成式AI创作等多个功能区,配套课程体系与师资培训方案,计划覆盖区域内多所中小学校。报道同时披露,徐州市已建成中国电信等三大智算中心,机架总数超过3700个,算力规模达540PFlops,占全市算力总量的53%,为本地人工智能教育与应用提供算力支撑。云龙区表示,将推动示范中心与学校课程常态化衔接,探索人工智能通识教育的地方实践路径。
AI智库资讯
5 条【核聚变】首钢超导基带已进入核聚变装置试用阶段
9月13日,2026年中国国际服务贸易交易会在北京首钢园落幕,首钢集团在会上展示其超导基带产品已进入核聚变装置试用阶段。该产品由首钢集团、中国科学院理化技术研究所等联合研发,研发耗时约两年,采用国产铁基合金路线,成本可比进口镍基合金降低约四分之一,主要供应合肥紧凑型聚变能实验装置(BEST)。材料难点集中在“光滑、薄、强韧”三项指标,基带厚度比打印纸更薄。据介绍,产品已送交业主及相关机构检测,各项指标满足要求,目前尚未大规模量产,但已具备供货能力。业内认为,超导基带是高温超导带材的关键底层材料。(安邦智库·产业前沿综合简报第374期)
【算力】北京首批算力词元贷业务落地亦庄,授信总额近20亿元
北京首批算力词元贷业务日前在北京经济技术开发区(亦庄)落地,授信总金额近20亿元。该产品由北京经开区商务金融局推出,突破传统授信框架,将企业的词元产出与消耗、算力服务合约价值作为核心授信依据,使算力使用情况可转化为可评估的融资信用。目前,农业银行、中信银行、兴业银行、北京银行、民生银行、华夏银行等6家银行已为多家人工智能产业链企业提供授信支持。此举被视为金融服务适配人工智能产业特点的探索:当企业的核心资产由实物转向算力消耗与模型产出时,传统以抵押物为主的授信逻辑难以覆盖,需要以数据信用作为补充。(安邦智库·产业前沿综合简报第374期)
【氢能】第一批试点项目绿色甲醇产品正式交付,首批发往韩国釜山港
9月10日,昊华科技旗下西南化工研究设计院总承包的金风绿能化工(兴安盟)绿氢制绿色甲醇项目产品首发发运仪式在内蒙古兴安盟举办,第一批试点项目绿色甲醇产品正式交付。该项目投资方为金风科技全资子公司,是全球最大绿色甲醇生产项目,规划到2027年底建成145万吨/年总产能,其中一期规模25万吨/年、一期投资22.96亿元,前期50万吨阶段总投资136.65亿元。项目配套200万千瓦风电、电解水制绿氢,并以玉米秸秆作为生物质碳源。首批产品发往韩国釜山港,最终销往欧盟市场。(安邦智库·产业前沿综合简报第374期)
深度解读:黑石总裁闭门演讲——我们正处在“1870年的拂晓时刻”
9月20日,黑石集团总裁乔恩·格雷在一场面向百余位全球顶级投资者的闭门演讲中提出,当前正处于人工智能时代的“1870年拂晓时刻”,主张抓住产业变革中的确定性环节。他披露的数据显示,谷歌代币交易量从2024年的几乎为零增长至每月480万亿枚,2026年5月进一步达3.2千万亿枚;Anthropic与OpenAI在2025年7月的年化收入合计约1050亿美元。黑石投资组合中14家AI相关公司的年化收入从2500万美元增至5.25亿美元。基础设施端,数据中心租赁量从2024年的1吉瓦升至2026年预计的6吉瓦,每吉瓦电力约需550亿美元投入。他将网络安全列为首要风险。
深度观察:AI算力扩张如何破解三重困局
9月22日,金融投资报刊发深度观察《AI算力扩张如何破解三重困局?》。文章认为,全球算力规模高速扩张的同时,正面临三重结构性约束。一是债务约束,AI基础设施投入高度依赖债券与信贷融资,头部企业的资本开支增速已明显超过自身经营现金流,融资成本上行将直接压制扩张节奏。二是能耗约束,数据中心的用电与散热需求快速攀升,电力供给、并网周期与电价成为选址与投产的关键变量。三是金融嵌套风险,算力资产被反复打包、抵押与再融资,形成层层嵌套的金融结构,一旦终端需求增速放缓,价格重估可能沿链条快速传导。
AI 热词速查 · 一看就懂
29 词条基础概念 5
大模型(LLM) Large Language Model
大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。
智能体(Agent) AI Agent
能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。
多模态 Multimodal
能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。
Token(词元) Token
大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。
生成式AI Generative AI
能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。
模型技术 12
训练 / 推理 Training / Inference
训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。
预训练 Pre-training
用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。
强化学习(RL) Reinforcement Learning
通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。
微调 Fine-tuning
用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。
垂类模型 Vertical Model
聚焦某一行业或细分场景、经领域数据深度优化的模型,被视为 AI 落地的“最后一公里”。做法是在通用或行业模型基础上注入行业术语、业务流程与规则,以“专而精”为核心——不追求能力广度,只在单一任务上追求精度与业务适配,普遍支持私有化部署并直接嵌入企业工作流。与“行业大模型”相邻:后者覆盖一个行业内的多类场景,垂类模型则聚焦其中单一细分场景。
蒸馏 Distillation
把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。
RAG 检索增强 Retrieval-Augmented Generation
检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。
MCP 协议 Model Context Protocol
Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。
开源权重 Open Weights
模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。
开源基座模型 Open-source Foundation Model
大模型能力链条(基座 → 通用 → 行业 → 垂类)最底层的通用模型,经海量无标注数据大规模预训练而成,权重公开发布、可自由下载与二次开发。Llama、Qwen、DeepSeek、Mistral 为主流代表,闭源对标为 GPT、Claude、Gemini;参数量大、训练成本极高,研发集中于少数顶尖机构,是下游微调、蒸馏与垂类模型开发的共同起点。
Harness(智能体驾驭框架) Agent Harness
在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。
世界模型 World Model
能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。
算力基建 6
算力(FLOPS) Compute
每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。
GPU Graphics Processing Unit
图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。
智算中心 AI Data Center
专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。
超节点 Super Pod / Scale-up
把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。
云巨头 Hyperscaler
AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。
推理云(Neocloud) Neocloud
专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。
产业应用 6
具身智能 Embodied AI
AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。
AI4S AI for Science
AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。
AGI 通用人工智能 AGI
具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。
词元 / Token经济 Token Economy
以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。
FDE(前沿部署工程师) Frontier Deployment Engineer
把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。
OPC(一人公司) One Person Company
以个人为核心、依托AI工具与共享服务完成产品开发与商业闭环的新型创业范式。创业者用智能体承担设计、开发、运营等环节,以极低团队规模开展内容创作、跨境电商、软件开发等业务。江苏多地正建设OPC社区,并通过算力券、模型券、云网券等政策降低创业成本,宿迁提出打造“OPC创业之城”。