每日AI信息汇要

2026年9月29日

国内·AI要闻

10 条
1

华为 openPangu-2.0 预训练、SFT 与后训练 RL 代码全栈开源

9月28日,华为宣布盘古大模型2.0开源版 openPangu-2.0 的预训练、SFT(监督微调)代码及后训练 RL(强化学习)代码正式开源上线。openPangu Training Framework 是面向大规模基础模型训练的统一框架,支持大语言模型、视觉语言模型与多模态模型的训练开发,提供多维分布式并行、高效数据流水线、混合精度训练、自定义算子优化与高可用训练等能力。后训练侧,openPangu-2.0-RL 以强化学习框架 VERL 为训练编排内核,通过运行时补丁与昇腾亲和优化,在昇腾集群上完成 Actor/Rollout/Reward 协同训练。此前 Flash(92B)与 Pro(505B)已开放权重,本轮把训练管线一并交出。

凤凰网科技查看原文 →
2

澜起科技 DDR5 第五子代寄存时钟驱动器 RCD05 实现量产

9月28日,澜起科技宣布其 DDR5 第五子代寄存时钟驱动器芯片(RCD05)已成功实现量产。该芯片符合 JEDEC DDR5 RCD05 规范,支持 8000MT/s 数据传输速率,较上一代 RCD04 提升约 11%,面向高性能 DDR5 RDIMM 内存模组,可满足数据中心与 AI 服务器对高带宽、高可靠内存系统的需求。产品集成高性能、低抖动 PLL 时钟驱动电路,支持 CTLE 连续时间线性均衡、ZQ 校准等功能,有助于提升高速信号传输的完整性与稳定性。目前全球能量产 DDR5 内存接口芯片的厂商仅有澜起科技、瑞萨电子与 Rambus 三家,合计占据全球九成以上份额。

澜起科技查看原文 →
3

蜂助手签署 39.6 亿元算力服务器采购协议与 57.17 亿元算力服务协议

9月28日晚,蜂助手(301382)公告称,公司近日分别与 C 公司签署《算力服务器采购协议》、与 D 公司签署《算力服务协议》。服务器采购协议总金额 39.6 亿元(含税);算力服务协议金额 57.17 亿元(含税,不含机柜服务费),服务合作期限 60 个月,服务范围覆盖 CPU、内存、GPU、存储、带宽及机柜等配套服务。公司向 D 公司分批交付、分批计费,机柜服务按实际使用量结算,需在合同签订后 22 周内完成全部交付。项目资金由自有资金、融资租赁及配套流动资金贷款组合筹措,其中融资租赁预计占比 80% 至 95%,本次交易尚需提交股东会审议。

中国证券网查看原文 →
4

神州数码上线“问学灵果”Routero MaaS 平台,纳管海内外 100 余个主流大模型

神州数码(000034.SZ)近日正式上线“神州问学灵果”(Routero)MaaS 平台。作为企业级 AI 控制中枢,平台以统一网关替代传统点对点链路,纳管海内外 100 余个主流大模型,具备包括 OpenAI、阿里等在内的多原厂词元分发能力,企业通过单一入口即可采购多模型所需词元并按实际调用量统一对账。核心能力落在调用环节:平台实时解析任务复杂度,将常规任务分流给高性价比模型、复杂深度推理动态调度给旗舰模型,实测企业整体交付效率提升近四成;内置自适应缓存复用多轮会话重复上下文以减少冗余计费,并支持自带密钥(BYOK)模式。平台计划 10 月底率先在海外市场上线自助充值与计费功能。

证券时报查看原文 →
5

快手可灵 Kling 4.0 将于 10 月上线,支持 4K HDR 与 30 秒视频生成

9月28日,快手可灵 AI 宣布 Kling 4.0 将于 10 月正式上线,Kling 4.0 Flash 已率先向黑金年卡会员开放小范围体验。据介绍,Kling 4.0 支持 4K、1080p 的 10-bit HDR 格式输出,单次输入最多可组合 10 张图片、5 段视频及 7 个主体,支持单次生成视频最长 30 秒并支持长镜头与连续叙事,提示词输入长度提升至 8000 tokens。产品同时升级高速运动、跟拍、环绕等大幅镜头运动的稳定性,支持中、英、日、韩、西、葡、德、法、印地语等多语种及多种方言口音,并加入视频精准编辑、创意复刻与最长 2 分钟的视频续拍能力。

6

蚂蚁灵波与阿拉伯数字经济联盟签署备忘录,“中国具身大脑”进入中东市场

9月28日,在第五届全球数字贸易博览会配套活动“中阿数字经济产业对接会”上,阿拉伯数字经济联盟(AFDE)与蚂蚁集团旗下具身智能公司蚂蚁灵波科技签署框架合作备忘录。双方将建立常态化合作机制,推进具身智能与机器人全栈解决方案在阿联酋、海合会(GCC)乃至中东市场的部署与本地化,并在场景应用、数据模型优化与区域产业生态共建等维度合作,确立五大方向,覆盖酒店餐饮、零售、物流、工业运营、智慧城市与医疗健康等场景。蚂蚁灵波自研 LingBot-VLA 2.0 基础大模型在预训练阶段已支持 17 个品牌、20 种机器人构型,其开源模型在 GitHub 上获 3.18 万颗星。

蚂蚁灵波查看原文 →
7

枢途科技完成近亿元 Pre-A 轮融资,一个月内连获三轮投资

9月28日消息,枢途科技完成近亿元人民币 Pre-A 轮融资,由鼎晖百孚、鲲鹏基金(大数据方向国家级基金)联合领投,广州产投、亿合资本联合投资,老股东趋势投资超额追投,这是公司一个月内完成的第三轮融资。本轮资金将支持触觉数据表征训练的研发与验证,推动 SynaTac 触觉产品线迭代,并加快面向机器人接触策略训练与端侧部署的业务布局。公司以数据产品 SynaData 与触觉产品 SynaTac 形成“世界理解+接触执行”双引擎,SynaData 已服务超过 60% 的百亿估值具身智能独角兽企业,并获得头部科技厂商批量采购。

雷锋网查看原文 →
8

全国首个成果转化大模型“智者”升级 3.0 版本

9月28日,在2026杭州国际人才交流与项目合作大会上,杭州技术转移转化中心正式发布“智者大模型”3.0版本,这是该平台继2024年作为国内首个成果转化大模型亮相、2025年上线2.0版本后的第三次重大升级。3.0版本定位为“7×24小时在线的 AI 技术经理人”,数据基座从浙江省数据扩展至全国全域,已入库全国 220 万家科技企业信息,构建 15.3 万名专家学者的科研能力画像、覆盖 1100 余家高校院所,标准化入库 130 余万项科技成果,并整合 11.8 亿项专利、论文等数据。经 20 万余次匹配迭代调优,企业技术预测准确率接近 80%。

中国新闻网查看原文 →
9

工业创新进入“组队局”:开放生态如何打通工业 AI 赋能链路

9月28日,量子位发文拆解工业开放生态的赋能链路,指出工业 AI 落地正从单点工具采购转向“组队式”生态协同。文章以西门子 Xcelerator 开放生态为例分析:工业场景高度碎片化、行业经验分散,单一厂商难以覆盖从设计、仿真到生产运营的全链条,开放平台通过汇集软件伙伴、系统集成商与行业解决方案商,把通用 AI 能力与垂直行业知识组装成可交付方案。对国内制造业而言,这类开放生态的价值在于降低中小制造企业引入 AI 的集成门槛,把原本需要分别采购、二次开发的环节收敛为可复用模块,加速“人工智能+制造”从示范项目走向规模化复制。

量子位查看原文 →
10

阿里 Qwen-Audio-3.1-TTS 登上权威语音榜单全球第一

9月28日,据上海证券报·中国证券网报道,阿里巴巴在 2026 云栖大会发布的语音合成大模型 Qwen-Audio-3.1-TTS,在全球权威 AI 评测平台 Artificial Analysis 的语音排行榜 Controlled Voice Arena 上以 1177 的 Elo 评分位列全球第一。该模型支持多语种及方言合成,可让同一音色在不同语言间自然迁移,并支持通过指令控制情绪、语速与表达方式。同一系列还包括语音转写 ASR 与实时语音交互 Realtime 两类模型,三类模型 API 均已上架千问 AI 平台,全线语音模型价格最高降幅达 95%。此次登顶表明国产语音大模型在公开盲测口径下已进入全球头部。

通义千问查看原文 →
🌍

全球·AI动态

10 条
11

AMD 以逾 80 亿美元全股票收购 World Labs,李飞飞出任执行副总裁兼首席科学家

9月28日,AMD 宣布以逾 80 亿美元(约 82 亿美元)全股票交易收购李飞飞联合创办的空间智能公司 World Labs,李飞飞将出任 AMD 执行副总裁兼首席科学家。World Labs 专注空间智能与世界模型,此前被业界视为世界模型赛道的代表性初创公司。对 AMD 而言,这笔收购补齐了其在“物理 AI”与空间理解方向的能力版图,与英伟达在仿真与世界模型领域的布局形成正面竞争;对 World Labs 而言,并入 AMD 可获得大规模算力与硬件协同支持。这也是近期 AI 领域规模最大的并购之一,显示芯片厂商正从算力供应商向模型与空间智能栈上游延伸。

The Verge查看原文 →
12

Anthropic 发布 Claude Sonnet 5.5:速度提升逾 30%、单任务成本最多降 30%

9月28日,Anthropic 发布 Claude Sonnet 5.5,成为 Claude 5.5 家族的第二款模型。官方称其速度较 Sonnet 5 提升逾 30%,多数工作任务成本最多降低 30%,并已作为 claude.ai 免费层的默认模型上线。在第三方评测中,Sonnet 5.5 在智能体编码任务上的表现反超上一代旗舰 Opus 5.5,Terminal-Bench 4.0 得分 70.6%,Artificial Analysis 智能指数得分 56,仅次于 Opus 5.5。Anthropic 同期发布面向开发者的使用指南与迁移说明。作为定位“更便宜、更快的工作搭档”的中端模型,Sonnet 5.5 的性价比提升被视为对开发者推理成本压力的直接回应。

Anthropic查看原文 →
13

英伟达发布开放智能体安全平台:OpenShell 沙箱隔离、Sentry 毫秒级隔离异常智能体

9月28日,英伟达联合超过 100 家合作伙伴发布开放智能体安全平台(Open Agent Safety Platform)。平台包含两大组件:OpenShell 基于 Vera CPU 为智能体提供沙箱运行环境;Sentry 依托 BlueField-4 DPU 实现对异常智能体的毫秒级隔离,可在智能体行为越界时快速切断其网络与资源访问。该平台面向企业与开发者在生产环境中部署自主智能体时的安全治理需求,回应了近期多起智能体越权、沙箱逃逸事件暴露出的风险。英伟达同时宣布更广泛的生态协作计划,把安全能力下沉到智能体运行时的基础设施层。

MarkTechPost查看原文 →
14

Meta 推出企业级 AI 平台,聘请 MongoDB 首席执行官主导新业务

9月28日,Meta 宣布推出面向企业客户的 AI 平台,并聘请 MongoDB 首席执行官领导这一新业务。该平台旨在把 Meta 的大模型能力与企业既有数据、工作流结合,切入企业级 AI 应用市场。此前 Meta 的 AI 产品重心更多集中在消费端与开源模型,此次动作标志着其正式向企业级市场延伸。业界分析认为,Meta 在开源模型生态上的积累为其企业业务提供了差异化入口,但企业市场需要成熟的销售体系、合规能力与行业解决方案,Meta 将面临与微软、谷歌、OpenAI 等已深耕该领域的厂商的直接竞争。

TechCrunch查看原文 →
15

Shopify 向浏览器端 AI 智能体开放结账能力

9月28日,Shopify 宣布向浏览器端的 AI 智能体开放其结账(checkout)能力。这意味着用户可以让浏览器内的 AI 智能体代为完成在 Shopify 商家店铺中的下单与支付流程,而不再需要手动逐项填写。此举被视为电商基础设施对“智能体商务”(agentic commerce)趋势的正面回应:随着多家厂商推进智能体代用户购物,支付与结账环节一直是最大的落地障碍,商家与平台需要在授权、风控与责任归属之间建立新规则。Shopify 的开放动作让 AI 智能体的购物链路从“比价与加购”延伸到“完成交易”,也为商家获得来自智能体渠道的新增量提供了技术前提。

16

Cloudflare 发布面向智能体的命令行工具 cf,覆盖全部 3000+ API 操作

9月28日,Cloudflare 发布面向 AI 智能体的命令行工具 cf,覆盖其全部 3000 余项 API 操作。该工具让智能体可以通过统一的命令行接口调用 Cloudflare 的 DNS、安全、CDN、零信任与 Workers 等服务,无需逐个适配 API 文档与鉴权方式,被官方定位为“为整个 Cloudflare API 打造的智能体 CLI”。在智能体从对话走向实际执行任务的趋势下,基础设施厂商正主动为智能体提供可编程操作入口。Cloudflare 表示,cf 工具的设计重点在于让智能体安全、可审计地执行基础设施变更,降低自动化运维中的误操作风险。

Cloudflare查看原文 →
17

Databricks 如何让 1.4 万名员工在模型发布首日就用上新模型

9月28日,Databricks 发布博客,介绍其让 1.4 万名员工在前沿模型发布首日即可正式使用的内部工程实践。文章披露,公司通过统一的模型接入层、集中式权限与成本治理,以及面向不同岗位的评测与提示词模板,把新模型的评估、合规审查与上线流程前置,使模型发布当天即可完成企业内的分发与启用,而非经历数周的内部审批与适配。Databricks 认为,随着前沿模型迭代周期缩短到数周,企业 AI 落地的瓶颈已从“能否接入模型”转向“能否在模型换代时保持业务连续性与成本可控”,工程化治理能力成为关键。

Databricks查看原文 →
18

GitHub 安全团队用开源 AI 安全智能体发现 24 个 Android 漏洞

9月28日,GitHub 发布博客披露,其安全团队利用自研的开源 AI 安全智能体在 Android 生态中发现 24 个安全漏洞。文章介绍了这套智能体的工作方式:结合静态分析工具与代码大模型,对海量代码进行自动化审计、复现与验证,把原本依赖人工阅读的漏洞挖掘过程部分自动化,并由人类研究员对候选结果进行确认与上报。GitHub 表示,该智能体及其方法论将开源,供安全社区复用。这一案例说明,AI 智能体在安全研究领域已从辅助提效走向实际发现未知漏洞,也为代码平台构建“AI 驱动的安全开发生命周期”提供了实践样本。

19

20 多位顶尖 AI 研究者警告:自动化 AI 研究存在极端风险

9月28日,据 The Decoder 报道,20 多位顶尖 AI 研究者联合发出警告,认为完全自动化的 AI 研究,即让 AI 系统自主设计、训练与改进下一代 AI 模型,存在极端风险。研究者指出,一旦研发循环由 AI 自主闭环,人类将难以在关键节点实施有效监督与干预,能力提升速度可能超出安全对齐与评估机制的跟进能力;他们呼吁在自动化 AI 研究的早期阶段就建立可验证的安全护栏、可追溯的研发记录与外部审计机制,而不是等能力突破后再补安全管理。该警告与近期业界对“递归自我改进”概念过热的讨论形成呼应。

The Decoder查看原文 →
20

MIT 用 AI 算法优化 RNA 疫苗配方,实现室温稳定保存一年

9月28日,MIT 发布消息称,研究团队利用 AI 算法优化 RNA 疫苗配方,使其在室温条件下可稳定保存一年,有望大幅降低 mRNA 类疫苗对超低温冷链的依赖。研究通过机器学习筛选脂质纳米颗粒与辅料组合,在大量候选配方中快速定位能提升 RNA 稳定性的方案,并用实验验证其在不同温度下的有效性。RNA 疫苗的冷链要求长期推高存储与配送成本,尤其在冷链基础设施薄弱的地区,室温稳定性直接决定疫苗可及性。该成果展示了 AI 在材料与制剂研发中的加速价值,也为“AI for Science”在生物医药领域的落地提供了又一案例。

📍

江苏资讯

5 条
21

《南京都市圈发展规划(2026—2035)》正式印发

9月28日,《南京都市圈发展规划(2026—2035)》由南京都市圈城市发展联盟印发实施,成为未来十年推动南京都市圈高质量发展的指导性文件。规划范围沿用上一轮空间范围,并拓展到南京、镇江、扬州、淮安、芜湖、马鞍山、滁州、宣城 8 市全域及常州市金坛区、溧阳市,总面积约 6.6 万平方公里,2025 年常住人口约 3580 万人。规划期限为 2026—2035 年,明确“一核三圈五带”空间布局与四大发展定位,提出到 2030 年都市圈地区生产总值超过 7 万亿元、到 2035 年超过 9 万亿元的阶段目标,并部署协同创新、便捷畅达、美丽宜居、人文品质、安全智慧、同城发展六方面重点任务。

南京市发展和改革委员会查看原文 →
22

南京“智汇无限”AI 视听产业生态服务平台上线,接入 34 款大模型

9月28日下午,“智汇无限”AI 微短剧产业高质量发展推进会在南京江北新区举行,会上“智汇无限”AI 视听产业生态服务平台正式上线。平台由南京市委宣传部统筹、南京文旅集团具体实施:面向个人创作者提供从创意构思到成片交付的一站式创作工具;面向企业接入 34 款大模型,提供高并发接口调用服务,并通过算力集采降低规模化制作成本。平台配套推出面向青年创作者的“AIGC 无限课堂”公益课程,上线“青柠梦工坊”模块,每日提供不少于 5 次全流程免费算力支持,并集成南京近 50 个 OPC 社区信息。平台试运行一个月已吸引 4700 余名个人创作者入驻,20 余家企业使用接口服务。

南京日报查看原文 →
23

南京玄武“模数师学院”:AI 人才“孵化器”加速成长

9月28日,南京广播电视台报道,位于南京玄武区的“模数师学院”正持续为产业输送 AI 实用人才。学院建有两大核心功能板块:一是 AI 人才培养与就业中心,面向高校学生、企业高管、机关干部、退役军人等不同群体开展分层分类的 AI 实战培训;二是直接对接政府、企业、高校的真实需求,依托市场订单为参训学员提供全流程实操锻炼。学院同步运营 OPC 创业社区,提供场地、算力、订单与陪跑服务。自去年 11 月正式运营以来,学院已开设“AIGC 数字营销”“OPC 创业启航营”等培训班与赛事活动 88 场,累计覆盖 1.6 万余人,并成为玄武区“技能夜校”指定公共培训点。

南京广播电视台查看原文 →
24

扬州大数据集团三周年:多个“全国首单”落地,运河算力平台撮合交易额突破 5000 万元

9月28日,我苏网报道扬州大数据集团成立三周年成果:集团主导的“扬州数据—数据资产1期资产支持计划”今年 5 月通过深交所批复,首期获批规模 4.76 亿元,创下三项全国首创;6 月完成全国首单共享单车管理公共数据场内交易;7 月运河城市算力平台 2.0 上线,其算电协同增效模式登上央视《焦点访谈》。平台已汇聚 24 座城市算力资源,用户超过 5000 个,累计算力撮合交易额突破 5000 万元,并从单纯算力调度向模型、智能体与应用场景延伸。集团近期还将发布 AI 毛绒玩具行业标准(全国首个)与 OPC 社区建设标准,并打造跨区域词元(Token)区域运营中心与 Token 市集。

我苏网查看原文 →
25

盐城亭湖:校地共育推动 AI 影视创作企业成长

9月28日,新浪财经刊发盐城亭湖区创业服务报道,其中盐城湛思人工智能科技有限公司成为校地融合育企的典型代表。该公司主要从事 AI 电影、AI 短剧研发制作与智能影像内容创作,采用“核心团队常驻+学子滚动实训”的运营模式,长期保持约 20 人的稳定核心创作团队,并持续吸纳高校在读学生入驻实训,系统开展 AI 创作、脚本策划、后期剪辑等专项培训,依托真实商业项目实战练兵。报道显示,亭湖区已建成创业孵化基地 17 家,其中省级 1 家、市级 9 家,初步形成梯次布局的创业孵化体系,为 AI 等新兴业态项目落地提供载体与服务支撑。

新浪财经查看原文 →
💡

AI智库资讯

5 条
26

【核技术】我国氪同位素测厚源实现“全国产化”

氪同位素是重要的放射性同位素,在工业测厚、仪器仪表校准、示踪监测等领域应用广泛,长期以来相关产品供给受制于人。9月17日,甘肃省研产融合科技攻关赋能计划标志性成果——氪同位素测厚源产品发布会在兰州召开。中核四〇四成功研制出具有自主知识产权的多种规格氪同位素测厚源产品,可匹配不同工业测厚应用场景的需求,标志着我国氪同位素测厚源产品实现从依赖进口到自主可控的跨越,为高端制造业可持续、高质量发展提供了坚实保障。中核四〇四隶属于中国核工业集团有限公司,是1958年经中央专委批准建设的我国规模最大、体系最完整的国家新型核工业基地。

安邦智库
27

【光伏】首个钙钛矿光伏领域国家标准出炉

近日,市场监管总局(国家标准委)发布首个钙钛矿光伏领域国家标准《光伏器件 第12部分:钙钛矿光伏电池及组件的电流—电压特性测量方法》(GB/T 6495.12—2026),将于 2027 年正式实施。该标准由工信部提出、全国太阳光伏能源系统标准化技术委员会归口,隆基绿能、宁德时代、东方日升、京东方、晶澳科技、通威股份等上市公司,中国华能、中国石油等央国企,以及纤纳光电、协鑫光电等创业企业共同参与起草。标准针对钙钛矿器件在光照与电压变化下性能易波动、面积定义尚未统一、传统晶硅测试方法难以直接套用等痛点,构建了科学、可推广的测量方法体系,填补我国在新兴光伏技术标准化测试领域的空白,为检测认证、产线质控、贸易交付及后续国际标准制定提供关键技术支撑。

安邦智库
28

【机器人】特斯拉机器人团队落地宁波审厂受关注

特斯拉机器人团队落地宁波审厂一事受到资本市场广泛关注。9月21日,从产业链人士处获悉,特斯拉机器人团队已于上周在拓普集团、三花智控、均胜电子等供应链企业开启审厂工作,上述企业主要供给关节模组、执行器、精密结构件等核心机电部件;本次审厂并非只在宁波展开,还覆盖杭州、上海等长三角地区的供应链企业。审厂将对相关产线质量、合规等方面开展评估,通过后将很快开始生产。即将量产的是特斯拉第三代人形机器人,也是其首款面向量产的机型,重点升级手部灵巧机构与关节执行器,优先承担工厂内物料搬运、简单流水线辅助等工业任务,相关产线规划年产能达 100 万台。

安邦智库
29

深度观察:从制造到贸易,数贸会见证 AI 加速融入产业与创新

9月28日,21世纪经济报道发文观察第五届全球数字贸易博览会:本届数贸会共有 996 家人工智能企业参展,数量约为上届的三倍,带来超百个人工智能应用场景;今年 1—8 月杭州外贸出口增长 11.8%,其中人工智能出口增长 150% 以上。文章指出,AI 正从单点应用加速走向产业深处:算力侧,杭州“新八骏”企业曦望 Sunrise 从智能体原生需求出发,重新定义面向词元(Token)生产的推理芯片;实体产业侧,恩和科技的 SAION AI 平台构建了从生物计算、菌株筛选到中试放大的全链条能力;贸易服务侧,连连数字推出智能营销、智能合规、智能客服等 AI 智能体。文章同时观察到,AI 正在改写科研创新方式与企业组织协作方式。

21世纪经济报道查看原文 →
30

深度观察:从真机到世界模型,具身智能正在补一条看不见的数据产线

量子位智库发文指出,具身智能的竞争焦点正从“找数据”转向“造数据、管数据、用反馈继续生产数据”。文章认为,算力驱动数据加工、数据喂养模型、模型又持续消耗算力,三者构成“数据飞轮”,但天然存在“模型需要好数据、好数据又需要更强模型”的鸡生蛋难题。具身数据产线包含采集、存储、清洗、标注、质检与增广、训练评测、数据管理与反馈回流七个环节,任一环节卡住都会传导至下一环。论坛上,无界动力联合创始人兼 CTO 夏中谱强调“对于具身来说,幻觉是灾难性的”,原力灵机联合创始人范浩强则直言“加数据涨点,这不是必然的”。文章判断,具身 Scaling Law 尚未被真正验证,全栈工程能力正成为新的竞争壁垒。

量子位智库查看原文 →

📚AI 热词速查 · 一看就懂

29 词条

基础概念 5

大模型(LLM) Large Language Model

大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。

智能体(Agent) AI Agent

能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。

多模态 Multimodal

能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。

Token(词元) Token

大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。

生成式AI Generative AI

能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。

模型技术 12

训练 / 推理 Training / Inference

训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。

预训练 Pre-training

用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。

强化学习(RL) Reinforcement Learning

通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。

微调 Fine-tuning

用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。

垂类模型 Vertical Model

聚焦某一行业或细分场景、经领域数据深度优化的模型,被视为 AI 落地的“最后一公里”。做法是在通用或行业模型基础上注入行业术语、业务流程与规则,以“专而精”为核心——不追求能力广度,只在单一任务上追求精度与业务适配,普遍支持私有化部署并直接嵌入企业工作流。与“行业大模型”相邻:后者覆盖一个行业内的多类场景,垂类模型则聚焦其中单一细分场景。

蒸馏 Distillation

把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。

RAG 检索增强 Retrieval-Augmented Generation

检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。

MCP 协议 Model Context Protocol

Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。

开源权重 Open Weights

模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。

开源基座模型 Open-source Foundation Model

大模型能力链条(基座 → 通用 → 行业 → 垂类)最底层的通用模型,经海量无标注数据大规模预训练而成,权重公开发布、可自由下载与二次开发。Llama、Qwen、DeepSeek、Mistral 为主流代表,闭源对标为 GPT、Claude、Gemini;参数量大、训练成本极高,研发集中于少数顶尖机构,是下游微调、蒸馏与垂类模型开发的共同起点。

Harness(智能体驾驭框架) Agent Harness

在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。

世界模型 World Model

能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。

算力基建 6

算力(FLOPS) Compute

每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。

GPU Graphics Processing Unit

图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。

智算中心 AI Data Center

专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。

超节点 Super Pod / Scale-up

把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。

云巨头 Hyperscaler

AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。

推理云(Neocloud) Neocloud

专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。

产业应用 6

具身智能 Embodied AI

AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。

AI4S AI for Science

AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。

AGI 通用人工智能 AGI

具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。

词元 / Token经济 Token Economy

以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。

FDE(前沿部署工程师) Frontier Deployment Engineer

把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。

OPC(一人公司) One Person Company

以个人为核心、依托AI工具与共享服务完成产品开发与商业闭环的新型创业范式。创业者用智能体承担设计、开发、运营等环节,以极低团队规模开展内容创作、跨境电商、软件开发等业务。江苏多地正建设OPC社区,并通过算力券、模型券、云网券等政策降低创业成本,宿迁提出打造“OPC创业之城”。

← 返回当日 9月28日 9月24日 9月23日 9月22日 9月21日