每日AI信息汇要

2026年9月11日

国内·AI要闻

10 条
1

DeepSeek发布V4.1 Flash并下调Flash系列价格:552B MoE架构,输出价最高降60%

9月10日,深度求索正式发布新一代模型DeepSeek-V4.1-Flash,并自当日12:00起调整Flash系列定价。新模型采用5520亿参数(552B)MoE架构与Causal-Encoder-Decoder设计,单次推理输入激活约80亿、输出约160亿参数,并通过SSD缓存技术将KV Cache占用降至HBM显存的1/4。官方称其在性能、费用、速度与总耗时上全面超越V4 Pro,原有快速、专家、识图模式合并为统一智能模式,可自动检测查询复杂度与图像输入;V4 Pro的API请求将自动路由至新模型并按新价计费。价格方面,闲时缓存命中输入低至0.02元/百万Token、缓存未命中1元、输出4元,高峰时段为闲时2倍,最高降幅达60%。

深度求索官方 查看原文 →
2

月之暗面启动Kimi"登月计划":FDE驻场交付,首批签约5家上市公司

9月10日,月之暗面正式启动Kimi企业合作伙伴"登月计划",以FDE(前置部署工程师)模式与系统集成商共建现场部署团队,推动大模型进入企业核心业务流程,成为国内首家采用FDE模式进行AI末端部署的大模型公司。首批签约伙伴包括中软国际、金山云、华胜天成、亚康股份、亚信科技5家上市公司,覆盖软件信息服务、通信、基础设施与云计算领域,计划持续面向IT服务商、软件商及咨询机构开放。此举标志国产大模型商业化从"卖Token"向"驻场交付+现场落地"的服务体系竞争延伸。

21财经 查看原文 →
3

高德发布全球首个3D原生城市世界模型ABot-Earth 0.7:单卡10分钟生成公里级3D城市

9月10日,高德在2026外滩大会发布全球首个3D原生城市世界模型ABot-Earth 0.7,覆盖196个以上国家和地区,可在单张消费级GPU上约10分钟生成公里级3D城市。该模型突破传统二维地图局限,以三维空间原生方式理解城市结构,面向自动驾驶仿真、数字孪生与城市治理等场景,其轻量化推理能力大幅降低3D城市重建门槛,为地理空间AI提供新型基础设施,也显示地图厂商正从"导航入口"转向空间智能底座。

北京商报 查看原文 →
4

宇树发布6B具身基座模型UnifoLM-WLA-1.0:单模型统一完成64项机器人任务

9月10日,宇树科技发布6B参数具身智能基座模型UnifoLM-WLA-1.0,基于2500小时真机采集数据训练,单模型即可统一完成64项机器人任务,覆盖运动控制、操作与交互等能力,显著降低具身智能对多模型堆叠的依赖。作为人形机器人厂商,宇树将基座模型与自研硬件深度耦合,以"模型+本体"一体化路径加速机器人泛化能力在真实场景落地,延续国产具身智能从"拼本体"转向"拼基础模型"的竞争趋势。

凤凰网科技 查看原文 →
5

燧原科技登陆科创板:募资61.19亿元,成"上海AI芯片四小龙"最后一家上市公司

9月11日,AI芯片企业燧原科技正式登陆科创板,发行价142.18元/股,发行数量4303.5173万股,募集资金总额约61.19亿元,发行市值约611.87亿元,成为"上海AI芯片四小龙"中最后一家登陆资本市场的企业。募资将投向第五代、第六代AI芯片研发及产业化。公司坚持自研DSA架构、不兼容CUDA路线,第三代芯片累计出货约16万片,国产AI算力芯片资本化进程再进一步。

证券时报 查看原文 →
6

文远知行获西班牙首张L4级自动驾驶牌照:联手Uber布局马德里

9月10日,中国自动驾驶企业文远知行(WeRide)在西班牙马德里获颁首张L4级自动驾驶乘用车运营牌照,合作方包括Uber与当地运营商AVOMO。此前文远知行已在全球9个国家获得自动驾驶牌照,马德里牌照是其欧洲布局的关键落子,意味着中国自动驾驶技术与运营能力进一步获海外监管认可,Robotaxi出海由中东、东南亚加速向欧洲市场延伸。

中国新闻网 查看原文 →
7

字节跳动聘Coatue前高管蒋凯掌管香港财务投资部门:加速AI领域投资布局

9月10日,据报道,字节跳动聘请Coatue Management前高管蒋凯(Jiang Kai)掌管位于香港的财务投资部门,向首席财务官高准(Julie Gao)汇报。知情人士称,此次任命将帮助字节建立更系统化的机制投资新兴科技初创企业,是其加速AI战略、推进投资布局的重要举措。此前字节已在芯片、大模型与AI应用等领域多点出手,此次人事调整或意味着其以更机构化的方式参与AI一级市场。

新浪财经 查看原文 →
8

英矽智能AI药物Rentosertib进入III期临床:首例患者给药,京沪两家医院牵头

9月10日,英矽智能(Insilico Medicine)宣布,其AI平台设计的特发性肺纤维化(IPF)药物Rentosertib完成III期临床试验首例患者给药,由北京协和医院与上海市肺科医院牵头。Rentosertib是英矽智能自主研发AI平台发现的候选分子,此前II期数据已显示安全性与疗效信号。III期启动标志AI制药从早期发现迈入关键注册临床阶段,是中国AI制药管线向前推进的重要里程碑。

医药魔方Pro 查看原文 →
9

生数科技发布自进化世界模型Motus2:能力等级由L3迈向L4

9月10日,生数科技在2026外滩大会发布新一代自进化世界模型Motus2。该模型能力等级由L3迈向L4,具备自主感知、推理与持续演化的世界建模能力,可基于环境反馈自我迭代,面向视频生成、仿真与具身智能训练等场景。作为清华系AI初创,生数科技以视频与世界模型见长,Motus2的发布标志其在通用世界模型赛道进一步推进,也折射出国内世界模型竞争正从"能生成"走向"能自进化"。

同花顺 查看原文 →
10

蚂蚁灵波科技开源LingBot-World 2.0系列:13亿参数Small版面向具身智能

9月10日,蚂蚁集团旗下灵波科技发布并开源LingBot-World 2.0系列三款模型,包含13亿参数Small等不同规格,面向机器人/具身智能的世界模型与仿真场景,支持物理世界理解与动作生成。该版本在环境建模、长时序一致性及训练效率上较上代提升,延续蚂蚁在大模型与具身智能方向的开放策略,降低开发者仿真训练门槛,为世界模型在机器人训练中的工程化落地提供可复现底座。

界面新闻 查看原文 →
🌍

全球·AI动态

10 条
11

OpenAI开放Agents API公测:一次调用创建生产级智能体,Codex框架全面开放

当地时间9月10日,OpenAI宣布Agents API进入公开测试,将支撑其旗舰编程助手Codex的托管智能体执行框架以API形式开放。开发者一次API调用即可创建可跨数小时至数天运行的生产级智能体,支持云端运行代码、处理文件、上下文自动压缩、并行工具调用与多智能体编排(最多3个并发子智能体),可选择OpenAI托管沙盒或自有/伙伴基础设施(已与Cloudflare、Modal、Oracle等9家沙盒服务商集成)。该API不额外收费,仅按Token与工具调用计费。物流公司Nash已借此部署数千个长时运行智能体管理全球数亿次配送。

OpenAI官方博客 查看原文 →
12

OpenAI将全双工语音模型GPT-Live-1开放至API:每分钟0.05美元

当地时间9月10日,OpenAI将全双工语音模型GPT-Live-1开放至API,前端语音层定价每分钟0.05美元。该模型听与说同步进行,可处理打断、停顿与背景噪声,将语音识别与合成整合于单一模型,复杂推理与工具调用可委派给GPT-6 Astra等后端模型。官方称其Full Duplex Bench得分较GPT-Realtime-2.1提升30个百分点,端到端语音智能体测试Tau3排名第一;早期客户反馈对话中断减少近80%,代码库简化80%、减少2.3万行代码。

Unite.AI 查看原文 →
13

美司法部调查英伟达170亿美元Groq交易:是否以"许可+招人"架构规避反垄断

据《纽约时报》报道,美国司法部正调查英伟达与AI芯片创企Groq的170亿美元交易是否刻意以"非独家许可+高管入职"架构规避反垄断审查。该交易去年12月公布,英伟达获Groq芯片技术非独家授权并吸纳创始人Jonathan Ross等高管。司法部已发出正式信息披露要求;若认定违规或处以罚款,但预计不撤销交易。此前两位美国参议员曾致函称此类交易实为"变相并购",监管部门对此类AI交易结构的关注度正在上升。

财联社 查看原文 →
14

英伟达联合Palantir共建主权供应链智能体:Nemotron模型接入Foundry与AIP

9月10日,英伟达与Palantir宣布合作,将NVIDIA Nemotron开放模型接入Palantir Foundry与AIP平台,结合Palantir Ontology构建供应链AI技术栈,首批落地英伟达自身运营。该系统面向每套Vera Rubin机架约130万个零部件的复杂供应链,用于提升可见性、识别瓶颈、加速"从晶圆到首个Token"的决策;可本地或云端部署,后续推广至制造、医药、农业与政府等行业,被视为"主权智能"在关键供应链的落地样本。

英伟达官网 查看原文 →
15

黄仁勋:网络安全将成AI下一个重大应用场景,回应英伟达"循环投资"质疑

当地时间9月10日,英伟达CEO黄仁勋在旧金山高盛科技大会上表示,网络安全很可能成为人工智能的下一个重大应用市场。他指出,AI模型正推动编程自动化,代码被发现漏洞、遭利用以及需要修复的速度都在加快,正在重塑网络安全行业的供需格局,企业将更多使用AI发现漏洞并防御攻击。黄仁勋同时否认英伟达密集投资并购存在"循环投资"问题,强调投资前会确认潜在标的已有真实客户需求。此前英伟达宣布以约130亿美元收购AI初创Hugging Face。

金融界 查看原文 →
16

英伟达联手8家澳企推进最高2GW AI工厂:澳洲算力规划翻倍,Sharon AI部署6.8万GPU

英伟达9月9日宣布与澳大利亚8家数据中心与云生态企业(Firmus、IREN、Megaport、ResetData、Sharon AI、CDC、NEXTDC、AirTrunk)合作,计划到2027年支撑最高2GW的AI工厂容量,采用多代NVIDIA DSX全栈架构。澳大利亚现有算力约1.6GW,本次规划相当于翻倍以上。合作方运营设施,英伟达提供DSX平台、加速计算、网络与软件;其中Sharon AI将部署最多6.8万块GPU,IREN南澳Bundey园区将扩至800兆瓦。"最高2GW"为规划容量,投资规模与分阶段时间表未披露。

新浪科技 查看原文 →
17

Anthropic发布9月威胁情报报告:披露7类Claude滥用与多起真实案例

9月10日,Anthropic发布《检测与反制AI滥用:2026年9月》威胁情报报告,覆盖2025年12月至2026年8月被其阻断的Claude滥用活动,涉及网络运营、监控、影响操作、诈骗、生物滥用、常规武器开发与非法蒸馏共7类危害。报告以编号披露多起案例:俄语团伙针对乌克兰的间谍活动、ShinyHunters凭证窃取、俄官媒用Claude生成宣传内容等,指出攻击者正以多智能体框架将Claude作为执行层。这是继其8月对齐评估报告后,对模型滥用治理的又一次系统性披露。

Anthropic官方 查看原文 →
18

苹果Siri AI将于9月14日随iOS 27公测:首发仅英语,欧盟与中国暂不可用

苹果在9月9日发布会上确认,重写后的Siri AI将于9月14日随iOS 27以测试版形式上线,首发仅支持英语,法语、日语、韩语、葡萄牙语与西班牙语将于10月跟进。Siri AI基于Apple Intelligence,可跨"信息""邮件""照片"调取个人上下文、理解屏幕内容、通过相机进行视觉智能识别、执行跨App操作,并保留跨设备对话历史。欧盟与中国市场初期不可用;服务端功能设每日用量上限,未来高阶访问将收费,Beta定位意味着能力与接口仍可能调整。

Macworld 查看原文 →
19

SpaceX全面调整AI数据中心建设模式:扩建放缓,转向"以可靠性换速度"

9月11日,据The Information与华尔街见闻报道,SpaceX(xAI)全面调整AI数据中心建设方式,由火箭业务老将Wesley Salandro接管,转向"以可靠性换速度":加装电力与冷却冗余、上线前全面测试,扩张或显著放缓。背景是9月3日田纳西州孟菲斯数据中心因施工触碰输电线路宕机,导致部分Grok模型下线,并波及Anthropic、谷歌等算力租赁客户。逾1300名火箭工程师报名支援轮岗,已有300多名工程师加入;随着对外算力租赁扩张,可靠性重要性上升。

华尔街见闻 查看原文 →
20

微软拟2032年将数据中心容量提升至38GW:较当前增两倍以上,缓解算力短缺

据彭博社9月10日报道,微软计划到2032年将全球数据中心容量提升至超过38吉瓦,较目前约12吉瓦增加两倍以上。该规划含自有及租赁设施,不含从CoreWeave等"新型云"租用的算力。目前约12吉瓦容量中仅约2吉瓦用于AI专用芯片,到2032年AI专用算力预计占总量约三分之一。微软上一财年资本支出达1450亿美元,此前曾因数据中心容量不足限制部分地区新云服务订阅,此次扩张有望缓解算力短缺并支撑AI服务增长。

每日经济新闻 查看原文 →
📍

江苏资讯

5 条
21

第27届光博会上的"苏州答案":SISPARK"光军团"集中亮相AI光互联全链条

9月9日至11日,第27届中国国际光电博览会在深圳举行。来自苏州国际科技园(SISPARK)的高科技企业组成"光军团"集中亮相,围绕AI光互联、高速光模块、硅光芯片、微纳光学发布一批硬核新品:中际旭创旗下智禾光通展示3.2T NPO方案与基于2nm DSP的800G ZR+相干光模块,为国内展会首次公开展示;海光芯创首发6.4T NPO硅光模块;奇点光子展出面向GPU直连的AI计算光IO芯粒原型;苏大维格、思瑞浦、镭昱光电等分别从微纳光学装备、光通信模拟芯片到Micro-LED光互联协同亮相,勾勒出一条完整的光互联产业链,展现苏州工业园区的"光力量"。

SISPARK发布 查看原文 →
22

南京南芥智能完成近亿元首轮融资:南大LAMDA团队以"学件"范式建海量模型基础设施

9月10日,AI基础设施公司南芥智能(SinapisAI)宣布完成近亿元人民币首轮融资,由鼎信资本与南京市创新投资集团联合投资,资金将用于底层技术研发、产品建设与市场拓展。公司成立于2026年,定位海量模型时代的AI基础设施,让分散的模型能力可被理解、按需调用与组合。核心成员来自南京大学人工智能学院LAMDA实验室,联合创始人孙腾中任CEO、刘建东任CTO;公司以中国科学院院士、南京大学副校长周志华提出的"学件(Learnware)"范式为技术根基,构建面向海量模型协作的技术体系与产品,尝试在基础模型与AI应用之间建立一层新的模型能力调度基础设施。

投资界 查看原文 →
23

淮安光电产业崛起成为新增长极:规上企业营收增量贡献率48.8%,算力中心达1500PFLOPS

9月11日,新华日报报道,今年上半年淮安市淮安区规上光电类企业营收增量贡献率达48.8%。淮安区从教学具、包装印刷传统制造向Mini/Micro高清显示等"智造"跃迁,联合中国光学光电子行业协会深化合作,红视光电、超为光电等企业相继落户,"一块屏"产业集群破土而出;显示屏广泛应用于舞台演艺、文旅夜游等文化消费场景。全区首家县区级算力中心投运,规划总算力1500PFLOPS,为沉浸式夜游、AI虚拟演艺提供算力支撑,苏北城市以"显示+算力"切入AI产业链的路径逐渐清晰。

新华日报 查看原文 →
24

南通举办人工智能产业供需对接:集聚AI企业200余家,聚焦算力硬件与具身智能

9月10日,依托2026中国上市公司高质量发展论坛,南通举办人工智能产业供需对接活动,AI上市公司与投资机构围绕算力硬件、集成电路、光模块、具身智能等方向展开对接。据报道,南通已集聚人工智能企业200余家,正以"AI+制造"推动船舶海工、高端纺织等优势产业智能化升级,并借论坛平台吸引资本与项目落地,探索以供需对接机制打通AI技术与本地应用场景的路径,为苏中地区AI产业生态补链强链。

证券日报 查看原文 →
25

泰州推进产业科创强市:前阿里达摩院专家携"生命智能基座"落地仿生机器人

9月10日,我苏网报道,泰州推进产业科创强市建设:前阿里达摩院高级算法专家携"生命智能基座"框架落地泰州,专攻仿生机器人头等方向;当地布局离岸创新中心27家,以"研发在外、转化在泰"模式链接长三角创新资源。作为苏中城市,泰州正以"科创+产业"双轮驱动,在人工智能与生命健康交叉领域培育新增长点,通过柔性引才与离岸研发补强本地高端技术供给,探索非核心城市承接AI人才的差异化路径。

我苏网 查看原文 →
💡

AI智库资讯

5 条
26

氢能:江苏加速打造千亿氢能产业集群

江苏正加速打造千亿级氢能产业集群。作为国内重要氢能产业集聚区,江苏以上游材料攻坚为突破口:氢能产业起步之初,质子交换膜、碳纸、气体扩散层膜电极等关键零部件高度依赖进口,江苏构建"四级创新矩阵",江苏省氢能技术创新中心自主研发的超薄复合膜最薄可达6微米,成功打破海外技术封锁。链主企业方面,张家港国富氢能用十年从天然气装备配套企业成长为氢能制储运加全产业链龙头(国内氢能装备行业第一家港股上市企业),带动集聚数十家涉氢企业,推动张家港氢能产业年产值突破百亿元;其氢能无人机可实现超大范围广域作业或跨昼夜不间断巡查,适用于边境巡查、抢险救灾、地形测绘等场景。江苏还打造差异化集群:常州聚焦电堆、检测装备赛道(集聚50余家产业链企业)、无锡深耕大型碱性电解槽制造、连云港探索绿电—氢耦合新模式、南通打造全国氢经济示范城市(主攻港口氢能重卡、分布式热电联供装备),预计到2027年江苏氢能产业规模突破千亿元。

安邦智库
27

储能:世界第一高坝水电站一期投产发电

世界第一高坝水电站一期投产发电。据央视新闻8月31日报道,国家能源集团位于四川阿坝州大渡河的双江口水电站一期三台机组全部投产发电。该电站是国家重点能源工程,大坝坝高315米,为当今世界第一高坝;电站总装机容量200万千瓦,共安装4台单机容量50万千瓦的混流式水轮发电机组,水库总库容29亿立方米,是大渡河上游兼具防洪、发电、水资源调配功能的控制性龙头工程。自今年6月首台机组投运以来,建设团队紧扣成渝经济圈高温用电保障需求,两个月内高效完成三台机组接续投产,累计输送清洁水电5亿千瓦时,有力夯实四川及成渝经济圈夏季电力保供基础。电站全部机组投产后,年均发电量约77亿千瓦时,每年可为下游梯级电站群增加66亿千瓦时发电量增益,持续提升大渡河流域水资源综合利用效率。

安邦智库
28

金属:AI浪潮下的铜需求仍在放大

AI浪潮下的铜需求仍在放大。一边是前沿算法,一边是深埋地下的传统金属,当AI与电力、散热连在一起,铜的重要性被重新定价:服务器的高速运算需要更强的供电、更快的数据传输和更高效的散热,铜在其中至关重要。据市场测算,一台普通服务器通常只需几公斤铜,而用于AI训练的高性能服务器单台用铜量可达15至30公斤,是普通服务器的3至6倍;2026年AI服务器专用高端铜箔需求约2.4万吨,同比增长约260%。随着液冷加快应用,导热性能较好的铜被更多用于液冷板等散热部件,江西鹰潭某铜材企业生产线24小时运转、订单已排到年底,算力芯片液冷板月产量超2000吨、订单同比增长30%;安徽池州一家企业的超低轮廓铜箔表面粗糙度可控制在2微米以内,信号传输速率比传统铜箔提高70%。从去年12月以来部分高阶铜箔加工费上涨30%至50%,今年适配AI服务器和高速算力设备的超低轮廓铜箔价格上涨约10%至30%,算力增长正推动铜需求向高导热、高频高速、高精度材料集中。

安邦智库
29

深度观察:免费的代价——中国开源大模型出海为什么开始收费

9月10日,钛媒体刊发深度分析:中国开源大模型出海正从"免费"转向"收费",开源许可证正成为收费工具。文章指出,决定出海动作的并非模型能力而是收入结构——Agent规模化落地使Token消耗首次脱离用户规模,一次任务消耗可达普通问答的数十至数百倍,完全开放许可会让增量收入无偿流向第三方托管方。三家策略因处境而异:智谱以MIT许可换取调用规模、押注用户习惯;月之暗面将最高30%分成写进K3许可证、向资本市场证明收入可持续;MiniMax以技术底座交付沙特HUMAIN。核心判断:许可证的松紧取决于模型方能否从Token消耗中直接获益,中国开源大模型的商业化正进入"按使用计费"的新阶段。

钛媒体 查看原文 →
30

深度观察:AI提高经济效率,需求、就业、收入分配、通胀如何变化?

9月10日,财新"观势"栏目基于外滩大会《AI经济增长新范式》论坛,系统分析AI对宏观经济的多重影响。核心观点:AI提高供给效率,但可能冲击部分就业、扩大资本与劳动回报差距;若更多收入流向资本、劳动收入占比下降,总需求将受抑制,"供强需弱"或从阶段性问题变为长期问题。短期看,算力、存储瓶颈推高部分价格;长期看,生产率提升与劳动替代将产生去通胀压力。诺奖得主萨金特提醒,AI投资回报面临巨大不确定性,巨额投入建立在"可疑的模型"之上,生产率究竟提高多少、价值如何分配尚无定论,技术突破不等于经济增长。

📚AI 热词速查 · 一看就懂

26 词条

基础概念 5

大模型(LLM) Large Language Model

大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。

智能体(Agent) AI Agent

能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。

多模态 Multimodal

能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。

Token(词元) Token

大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。

生成式AI Generative AI

能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。

模型技术 10

训练 / 推理 Training / Inference

训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。

预训练 Pre-training

用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。

强化学习(RL) Reinforcement Learning

通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。

微调 Fine-tuning

用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。

蒸馏 Distillation

把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。

RAG 检索增强 Retrieval-Augmented Generation

检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。

MCP 协议 Model Context Protocol

Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。

开源权重 Open Weights

模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。

Harness(智能体驾驭框架) Agent Harness

在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。

世界模型 World Model

能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。

算力基建 6

算力(FLOPS) Compute

每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。

GPU Graphics Processing Unit

图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。

智算中心 AI Data Center

专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。

超节点 Super Pod / Scale-up

把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。

云巨头 Hyperscaler

AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。

推理云(Neocloud) Neocloud

专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。

产业应用 5

具身智能 Embodied AI

AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。

AI4S AI for Science

AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。

AGI 通用人工智能 AGI

具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。

词元 / Token经济 Token Economy

以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。

FDE(前沿部署工程师) Frontier Deployment Engineer

把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。

← 返回当日 9月10日 9月9日 9月8日 9月7日 9月4日