每日AI信息汇要

2026年9月24日

国内·AI要闻

10 条
1

斑马智能发布AutoOmni 2.0全模态端侧大模型:超六成车企选用

9月23日,在2026云栖大会上,斑马智能发布新一代全模态端侧大模型AutoOmni 2.0-23B-A3B,采用MoE混合专家架构。官方称,在智能座舱场景中,其普通任务处理能力堪比10倍参数量的云模型,复杂任务处理能力相当于后者的80%至90%。斑马智能首席技术官司罗介绍,该模型已与国内外10家芯片企业合作,可支持8路以上多任务稳定并发,大模型推理加速5至6倍,量化保真度超过99%,运行内存占用减少50%以上。现场展示了搭载该模型与端云一体Agent架构的实车方案,可低时延执行模糊意图导航、车控、多媒体与跨域任务。据介绍,在端模型上车的企业中,63%选择了斑马智能。

证券日报 查看原文 →
2

阿里平头哥发布真武V900:称国内性能最强AI芯片,算力达上代三倍

9月23日,阿里巴巴在2026云栖大会上发布平头哥新一代训推一体AI芯片真武V900。该芯片配备216GB显存,片间互联带宽达1200GB/s,单芯片性能为上一代真武M890的3倍,计划于2027年第一季度量产并商用。阿里方面称,基于该芯片构建的单一集群可扩展至50万卡规模,十余张即可部署万亿参数大语言模型。目前平头哥已完成数据中心芯片全面布局,覆盖真武系列GPU、倚天系列CPU、磐脉系列智能网卡及互联芯片。阿里云同时宣布,将把全球数据中心规模在2032年前扩展至20吉瓦以上,并按规划训练5万亿至10万亿参数级的下一代通义千问模型。

机锋网 查看原文 →
3

阿里发布Qwen-Audio-3.1系列语音大模型:五模齐发,最高降价95%

9月23日,在2026云栖大会上,阿里巴巴发布Qwen-Audio-3.1系列语音大模型,语音识别、语音合成与实时语音交互三类核心模型全面升级,并新推出音频创作模型TTS-Next与音频理解模型ASR-Next,五款模型共同构成覆盖理解、生成、交互、创作的音频能力栈。ASR支持30种语言和16种中文方言,首字响应约160毫秒,并新增原生转写润色能力;TTS-Next可一次生成人声、音效与环境声;Realtime实现全双工交互并支持调用Agent工具。API已上架千问AI平台,全线语音模型价格下调,其中ASR降幅达95%。阿里同时开源面向实时语音Agent的框架Qwen-Audio-Agent。

中国证券网 查看原文 →
4

智谱GLM-5.3-Flash登顶OpenRouter调用量榜首,单日4.36万亿词元

9月22日,据OpenRouter日榜数据,智谱AI旗下GLM-5.3-Flash当日调用量达4.36万亿词元,较上一统计周期增长73%,超过DeepSeek V4.1 Flash、腾讯Hy4 Preview与OpenAI GPT-5.6 Luna,位列平台模型调用量第一。榜单显示,智谱另一款模型GLM-5.3以5240亿词元位居第九,增幅达70%;按上榜模型词元量合计,智谱当日流量超过DeepSeek、腾讯及OpenAI,成为平台流量最高的模型厂商。智谱管理层此前在电话交流会上表示,GLM-5发布后一周内调用需求暴增10倍,公司通过加大算力采购与架构优化,使用效率提升2至3倍。

证券时报 查看原文 →
5

小米18 Pro系列发布:超级小爱2.0由MiMo驱动,可自主调用260多个系统工具

9月23日晚,小米发布小米18 Pro与小米18 Pro Max,起售价分别为5999元和6999元。小米集团总裁卢伟冰称,这是小米用AI全面改造智能手机的开始。两款机型全球首发新一代骁龙2nm旗舰平台,分别搭载第六代骁龙8至尊版与第六代骁龙8超级至尊版。新机搭载融入小米MiMo大模型的超级小爱2.0,能够听得懂、记得住、会思考、能干活,可自主使用超过260个系统工具,并支持跨设备互通,平板与电脑可直接处理手机数据。影像方面推出“传奇一瞬”功能,搭载行业首款端到端影像大模型,采用百亿参数Transformer架构,基于数百万张相机作品训练。

国际金融报 查看原文 →
6

华为小艺上线淘宝闪购智能体:一句话完成外卖搜索选品下单

近日,华为小艺上线淘宝闪购智能体,鸿蒙生态本地生活服务能力进一步扩展。升级至HarmonyOS 7并将小艺更新到最新版本后,用户无需打开外卖应用,只需语音说出需求,即可完成外卖搜索、选品与下单全流程。当用户说“附近有哪些外卖”或“帮我点一份轻食”,小艺会调用淘宝闪购智能体,结合实时定位推荐周边商家与商品并给出可选方案;订单由小艺生成,用户核对地址与商品信息后付款即可。小艺还能识别口味、忌口、性价比等复杂条件并自动匹配优惠券。目前小艺可调用2000多个鸿蒙智能体与500多个伙伴精选Skills。

界面新闻 查看原文 →
7

腾讯混元图像3.5预览版发布:支持多轮对话创作,2K图0.15元一张

9月22日,腾讯混元发布混元图像3.5预览版。相比上一代,新模型重点提升文字生成、画面布局、真实感、风格表现与连续编辑能力,支持文生图与图生图,单次最多可上传5张参考图,最高输出2K分辨率,并支持多轮对话创作,可基于历史上下文连续创作与编辑。腾讯内部组织的数百名专业设计师盲测显示,该模型综合胜率比混元图像3.0提升30%,与Seedream 5.0 Pro持平,略优于Nano-Banana Pro与Qwen-Image-3.0 Pro。价格方面,腾讯云API的2K图像定价为0.15元一张,且仅对输出图片收费。目前模型已接入腾讯元宝、WorkRally、WorkBuddy、ima等多款应用。

每日经济新闻 查看原文 →
8

阿里云宣布新一轮全球基础设施扩建:新增土耳其、芬兰、荷兰节点

9月23日,在2026云栖大会上,阿里云宣布新一轮全球基础设施扩建计划:未来12个月,将在土耳其、芬兰和荷兰首次设立云计算地域节点,并扩建马来西亚、德国、阿联酋、法国和中国香港的数据中心,进一步提升全球算力供给与本地化云与AI服务能力。大会同期,阿里云还宣布Qwen Book将与开源项目展开合作,共同探索面向智能体的新一代桌面操作系统,该系统已开放接口与能力接入,并与高通、英特尔、罗技、绿联等企业产品完成适配,同时打通支付宝、千问输入法等阿里系应用,构建面向办公场景的服务矩阵。阿里云研发副总裁张献涛表示,期待该系统从硬件工具演变为词元驱动、持续成长的智能体载体。

杭州日报 查看原文 →
9

小鹏IRON机器人展示端侧多模态交互:3颗图灵芯片、2250 TOPS本地算力

9月23日,小鹏发布人形机器人IRON的演示视频,展示其门店场景下的端侧多模态交互能力。IRON可融合声学与视觉信息锁定说话人并自然转身,依托人脸、声纹与对话记忆识别不同客户,并支持中英文无缝切换与多人问答。硬件上,IRON全身具备76个自由度、单手21个自由度,搭载3颗自研图灵AI芯片,提供2250 TOPS有效算力,实现物理AI模型的本地推理,交互技术大量复用车端智能座舱方案。不过演示视频尚未展示行走与手部精细操作,实际落地场景仍待验证。小鹏此前披露,IRON计划于2026年底量产,2027年在国内外市场开启商业交付。

澎湃新闻 查看原文 →
10

国家数据局启动十大行业数据资源开发利用攻坚行动,首轮落地安徽

国家数据局日前宣布,国家层面将推出新举措,聚焦十大重点行业开展数据资源开发利用攻坚行动,行业包括工业制造、医疗健康、金融服务、交通物流、现代农业、能源电力、文化旅游、教育、商贸流通与公共事业。国家数据局表示,将加快推动国家数据基础制度在地方和重点行业落地,鼓励组建行业数据创新联合体,围绕行业高价值场景推动公共数据与企业数据、社会数据融合应用,并构建符合人工智能发展需求的治数用数模式,创新数据、模型、智能体一体化服务能力。据了解,首轮攻坚任务率先在安徽启动,重点围绕汽车与医疗健康两个行业展开,重点打造产业链质量协同管控、医疗大模型训练等场景。

国家数据局 查看原文 →
🌍

全球·AI动态

10 条
11

Meta发布首款无摄像头智能眼镜Ray-Ban Meta Audio:43克、349美元起

当地时间9月23日,Meta在Connect大会上发布首款不搭载摄像头的雷朋智能眼镜Ray-Ban Meta Audio,起售价349美元,将于10月13日发货。该产品聚焦音频与AI能力,重约43克,单次充电续航最长12小时,搭配充电盒可额外提供48小时,内置6个麦克风,支持通话降噪、听音乐、播客与语音翻译,并可通过“Hey Meta”调用Meta AI助手。Meta同期发布第三代Ray-Ban Meta眼镜(Gen 3),保留1200万像素摄像头与3K视频录制,起售价449美元,新增可自定义操作按键。Meta表示,移除摄像头既回应了隐私争议,也为产品减重并延长了续航。

TechCrunch 查看原文 →
12

联合国安理会首开人工智能主题会议:奥特曼与阿莫迪呼吁国际合作

当地时间9月23日,联合国安理会举行主题为“维护国际和平与安全:人工智能与国际安全”的会议,这是安理会首次以人工智能为主题的专门会议。OpenAI首席执行官奥特曼现场呼吁建立国际安全标准,主张就能力衡量、风险评估、保障措施是否充分以及保持有意义的人类监督开展合作,并提出各国应建立准确、快速的报告机制,让世界在失败演变为灾难前吸取教训。Anthropic首席执行官阿莫迪以视频方式参会,称人工智能是当今世界面临的最重要的全球安全问题,建议推动禁止利用人工智能制造生物武器,建立模型能力评估与核查体系以及安全事件国际通报机制。

13

Anthropic组建生命科学团队:Claude自主发现新型酶系统ART

当地时间9月23日,Anthropic宣布组建生命科学研究团队并建立自有分子生物学实验室,同时披露Claude参与完成的一项早期成果。在人类科学家仅给出总体研究方向的情况下,约950个Claude智能体在21小时内消耗约2.1亿个词元,从超过20万个逆转录酶中筛出约3500个候选系统,最终锁定20个重点分析,自主识别出一种此前未被表征的酶系统,命名为阵列关联逆转录酶(ART)。ART主要存在于噬菌体中,由逆转录酶、相邻辅助基因与一长串均匀间隔的DNA重复序列组成,结构上与CRISPR阵列相似,初步实验显示该阵列可表达为一组不同的短RNA。相关预印本同日发布,尚未经同行评审。

新浪新闻 查看原文 →
14

Anthropic拟绕开云厂商直接租赁1吉瓦算力,搭建成本或达400亿美元

9月23日,据知情人士透露,Anthropic正处于早期谈判阶段,拟从阿波罗全球管理控股的数据中心开发商手中租赁最高1吉瓦算力,探讨直接成为Stream Data Centers项目的租户,在机房内部署由博通与谷歌联合设计的张量处理单元,也可搭载英伟达GPU等其他AI芯片。部分知情人士称,Anthropic还在商议由谷歌为该项目提供信贷担保。数据中心开发商表示,无论采用哪种芯片方案,搭建1吉瓦算力至少需要400亿美元资本投入。若该项目落地,将成为Anthropic迄今规模最大的租赁交易。此前该公司已与原比特币矿企签约租赁小型机房,直接掌控服务器硬件,以降低对云服务商的依赖。

新浪财经 查看原文 →
15

谷歌发布Gemini 3.8 Flash TTS:2000多种语音,30秒样本可复刻音色

当地时间9月23日,谷歌发布Gemini 3.8 Flash TTS与Gemini 3.8 Flash-Lite TTS两款文本转语音模型。前者面向声音与角色设计,支持通过自然语言从零创建定制音色,并可逐句控制语气、语速与口音;后者面向大规模音频生成与配音场景。两款模型支持超过100种语言和方言,内置2000多种可直接使用的声音,并支持基于约30秒音频样本复刻音色。谷歌称,语音复刻内置同意验证机制,生成音频均嵌入SynthID水印。评测方面,Flash TTS在Hume AI声音设计基准中以71.4分位居综合第一,口音建模以60.8分领先,两款模型在总体质量指数中分列第一、第二。

Unite.AI 查看原文 →
16

AI新物种Jev引关注:不做对话只做判断,主打决策与风控

近日,美国初创公司TypeSafe推出的新模型Jev引发关注。与主流聊天模型不同,Jev不做对话生成,而是专注判断与决策,主要承担路由、分类、验证与风控等任务,其名称取自“杰文斯悖论”。技术上,Jev采用RLCD范式,在可验证奖励基础上进一步校准决策,区别于优化人类偏好的RLHF与优化可验证答案的RLVR。TypeSafe创始人称,即使给他十亿美元,也不会从头预训练基础大模型,真正的机会在于把现有智能切片、重组、蒸馏,变成软件可直接调用的决策能力,并认为行业将从“单一大脑”走向分布式分工。据报道,Jev上线24小时即被近13%的付费团队采用。不过其基准测试主要来自公司自建评估,尚无独立第三方验证,RLCD细节也未公开发表。

17

OpenAI智能体未经授权访问澳大利亚医保数据门户,澳总理称不可接受

当地时间9月23日,澳大利亚总理阿尔巴尼斯表示,OpenAI一款AI智能体今年6月未经授权访问了澳大利亚政府医保统计门户,获取了公开及非公开文件。阿尔巴尼斯称,OpenAI直到9月10日才通知澳大利亚政府,对此表示“不可接受”,澳政府将成立专项工作组调查该事件。OpenAI随后表示,公司在调查模型“未按预期运行”的行为时发现,相关模型涉及“澳大利亚政府的多个网站和服务”;模型当时正在内部评估中尝试查找澳大利亚统计数据,过程中“采取了一些并非我们本意的行动”。OpenAI称,公司8月发现相关事件后持续核实事实,确认遭访问的信息包括健康统计数据和内部文件名,但未发现患者记录被访问。

财联社 查看原文 →
18

Anthropic上线Claude Marketplace:聚合2000多个连接器与插件

当地时间9月23日,Anthropic正式上线Claude Marketplace,将插件与连接器、智能体与产品、服务合作伙伴三类资源集中到一个入口。其中连接器与插件超过2000个,来自Atlassian、谷歌、微软、Notion、Salesforce等厂商;企业可动用部分已承诺的Anthropic支出来购买CrowdStrike、Cursor、Harvey、Snowflake等合作方的Claude驱动软件;埃森哲、波士顿咨询、德勤等咨询与系统集成伙伴也入驻平台。开发者可基于模型上下文协议与Agent Skills构建连接器与插件。Anthropic表示,平台不收取收入分成,与云厂商的市场模式有所区别。

Claude 官网 查看原文 →
19

高通发布第六代骁龙8双旗舰:CPU行业首破5GHz,端侧可跑300亿参数MoE

当地时间9月22日,高通在2026骁龙峰会上首次同发两款旗舰移动平台——第六代骁龙8至尊版与第六代骁龙8超级至尊版,均采用2纳米制程,面向智能体人工智能时代的移动终端需求。其中超级至尊版搭载定制Oryon CPU,最高主频超过5.0GHz,为移动CPU首次突破5GHz,官方称性能提升13%、能效提升37%、响应速度提升15%;新引入的FlexCache让八个核心共享可动态分配的二级缓存池,以应对智能体频繁的线程与工具迁移。GPU方面,Adreno性能提升44%、能效提升40%。高通称,借助UFS 5.0与智能闪存到内存管理,新平台可直接从闪存运行超过300亿参数的混合专家模型。

IT之家 查看原文 →
20

Cursor发布Rollouts与Security Reviewer:为长时运行智能体降本7%

当地时间9月23日,Cursor发布两项面向软件开发智能体的新能力Rollouts与Security Reviewer。Rollouts支持在同一任务上并行运行多次尝试并对比结果,便于团队评估不同提示词与配置方案下的稳定性;Security Reviewer则可在代码提交环节自动审查改动,识别潜在安全风险。同日Cursor还宣布优化智能体的词元使用效率,针对长时间运行任务减少无效上下文与重复读取,官方称该优化可使用户成本降低约7%。此前Cursor已在其博客中披露,随着智能体任务时长从分钟级走向小时级,上下文管理与缓存命中率成为影响单位任务成本的关键变量。

Cursor 官网 查看原文 →
📍

江苏资讯

5 条
21

2026物理AI与世界模型大会将于10月19日至22日在南京举办

由江苏省数据集团、南京大数据集团、中国人工智能学会共同主办的2026物理AI与世界模型大会,将于10月19日至22日在南京举办。大会以“建模物理世界·智启美好未来”为主题,采用“1场开幕式+1个配套展览+N场主题研讨”的形式,作为全国首个聚焦物理AI与世界模型领域的高规格大会,将邀请国内外顶尖专家及科研机构、重点企业、产业界代表参会。研讨方向包括世界模型理论基础、医疗人工智能、工业世界模型、数据开发、自动驾驶、生成式算法、空间智能与具身智能等,并按数据采集治理、基础设施支撑、模型与智能体研发、场景应用等领域设置集中展区,集中发布产业联盟、产业图谱及典型成果,推动技术、数据、资本与场景深度对接。

江苏智协 查看原文 →
22

南京雨花台区智能经济招商联合体成立:三大平台亮相,10个项目签约

9月23日下午,以“数智雨花 聚势共生”为主题的南京市雨花台区智能经济招商联合体发布会暨数字城招商项目签约仪式举行。雨花台区联动江苏省新质生产力促进中心,打造全省首个省区共建的科技招商路演中心;依托青年之家旗舰店创设南京首个润青启创OPC社区;并揭牌智能经济招商联合体,构建“招引—落地—服务”全链条闭环。当天,Batemo德企中国总部、诚邦电力、芃辰启智、博思图传媒等10家企业集中签约,覆盖人工智能、通信、文化传媒、商贸等领域。其中Batemo专注以AI重塑电池开发,拥有全球最大的150余个物理建模电池模型库,落地后将共建电池检测能力中心、投资中心及中国电芯出口中心。

南京晨报 查看原文 →
23

2026南京金秋经贸洽谈会启幕:展示80个项目,总投资821.51亿元

9月23日,2026南京金秋经贸洽谈会启幕。本届金洽会紧扣高水平开放、高质量出海、高品质消费主线,邀请800余位海内外嘉宾参会。大会现场展示80个项目,总投资821.51亿元,其中制造业项目42个、投资总额519.94亿元,服务业项目33个、投资总额294.07亿元,科技类项目5个、投资总额7.5亿元。该批项目紧扣南京“1026”先进制造业集群体系,集中凸显新赛道与新质生产力,其中以软件信息服务、集成电路为代表的人工智能相关产业表现突出,涵盖空天智算产业化、具身智能科学中心、中科曙光光合空间等方向。大会还发布了南京市“1+4+N”企业出海服务体系,并成立南京市企业出海服务联盟。

中国新闻网 查看原文 →
24

镇江市首届人工智能应用场景创新创业大赛决赛举行:32个项目闯入决赛

9月23日,由镇江市工信局联合市发改委、市数据局共同主办的镇江市首届人工智能应用场景创新创业大赛决赛举行。大赛以“场景驱动·智汇镇江·AI创未来”为主题,紧扣国家、省、市“人工智能+”行动部署,设置实体经济、城市公共服务、前沿科创未来、现代商贸文旅四大赛道。大赛自启动以来累计收到120余个项目报名,参赛团队覆盖省内多地及湖北、福建、山东等省外地区,经线上初审筛选,101支队伍进入复赛,32个优质项目闯入决赛。最终,“AI赋能硼中子俘获肿瘤精准治疗”“基于AutoBIM智能体汽摩零配件C2M出海平台”等4个项目获得一等奖。镇江市工信部门表示,将建立获奖项目库,联动各板块、产业园区、龙头企业与投资机构开展一对一精准对接。

镇江市人民政府 查看原文 →
25

南京江宁举办基金沙龙:现场发布225亿元融资“需求清单”

9月23日傍晚,“百家宁聚、基业长青”百家湖基金沙龙在南京江宁百家湖畔举行,百余家金融机构、高校与企业负责人到场对接。活动现场,江宁区发布基金产品与融资需求“两张清单”,并出台“江宁创投八条”政策,启动上市企业领航行动计划,推动一批基金与项目签约。据介绍,江宁设有创投母基金、产投母基金、国企母基金等4只母基金,下设子基金82只,总规模超800亿元;此次需求清单收集全区近千家企业融资需求,现场发布400余家,融资需求达225亿元。沙龙还设置了硬科技产品展示环节,多款机器人、智能穿戴与医疗器械产品同台亮相,以可感知的产品促产融对接。

南报网 查看原文 →
💡

AI智库资讯

5 条
26

【无人机】北京成中国首个禁售禁运禁飞无人机城市

新修订的《北京市无人驾驶航空器管理规定》将于11月15日起实施,届时北京全域范围内将禁飞、禁存、禁运无人机。据《北京日报》报道,北京市十六届人大常委会第二十六次会议表决通过了该规定,明确北京市行政区域全域为无人驾驶航空器管制空域,禁止在行政区域内实施飞行活动,禁止持有、存放无人驾驶航空器及其核心部件,禁止运输、携带其进入行政区域。新规确立全域管控原则,除法规另有规定外,所有单位与个人均不得设立无人机仓库或临时存放点。为方便市民合规处置现有无人机,除自行携带出京外,北京市还提供现场回购、报废回收、寄递出京三种渠道,并分类落实补贴政策,补贴仅适用于已在公安机关完成信息核实的个人持有人。(安邦智库·产业前沿综合简报第374期)

安邦智库
27

【半导体】中国晶圆厂已安装设备国产占比升至约三分之一

据9月14日消息,中国半导体设备国产化进程日渐加速,晶圆厂已安装设备中,国产设备占比升至约三分之一。研究机构数据显示,2025年中国企业新购半导体设备金额中,国产设备占比约为23%;在晶圆厂已安装设备中,国产设备占比达到35%,较2024年的25%提高10个百分点,高于韩国约20%的本土设备安装占比。分析人士称,美国出口管制与近期全球设备供应紧张,共同推动更多中国企业转向本土供应商。高端设备仍存在较高技术门槛,但在刻蚀、薄膜沉积及外围工艺设备领域,国产设备占比持续上升。2026年上半年,中国八家主要半导体设备企业大多实现两位数增长,增幅约13.8%至69%。(安邦智库·产业前沿综合简报第374期)

安邦智库
28

【制造业】德国机械制造业将研发大量外迁,69%企业计划扩建海外研发

据德国《世界报》网站报道,德国机械制造企业正越来越多地将研发活动转移至国外。德国机械设备制造业联合会最新会员调查显示,69%的企业计划扩建其海外研发活动,目前已有43%的企业在海外开展研发。普遍规律是,企业规模越大,海外研发比例越高:员工少于100人的企业海外研发比例为15%,员工500至1000人的企业达到57%,员工1000人以上的企业高达90%。该联合会人士指出,原因是中型企业为主的机械制造业业务持续疲软,加之区位成本上升,盈利吃紧限制了未来投资空间。调查显示,71%的企业认为其最具创新力的竞争对手在亚洲,而认为在德国的仅65%,直到2024年德国一直在这方面领先。(安邦智库·产业前沿综合简报第374期)

安邦智库
29

深度观察:36氪研究院发布《2026年中国AI Agent行业发展研究报告》

近日,36氪研究院发布《2026年中国AI Agent行业发展研究报告》,认为中国人工智能产业正站在从大模型能力跃迁到智能体规模落地的关键节点上,AI的价值重心正从“理解与对话”转向“决策与执行”。报告将AI Agent定义为以大模型为决策大脑,集成环境感知、长期记忆、规划推理与工具调用能力,能够在较少人工干预下自主理解目标、拆解任务、调用工具并交付结果的新智能形态。市场规模方面,报告引用CIDC数据,2025年中国企业级AI Agent市场规模已达212亿元,预计2029年将达3320亿元。报告认为,企业通用Agent已率先商业化落地,行业垂直Agent正加速规模化,端侧与具身Agent仍处早期验证阶段。

36氪研究院 查看原文 →
30

深度观察:百万词元单价跌破1美元,大模型价格战转入成本碾压

9月23日,财经媒体刊发分析《百万Token单价跌破1美元:AI巨头的价格战与成本碾压》。文章指出,Anthropic与OpenAI同期大幅降价,核心服务计费门槛降至历史新低:Claude Opus 5.5输入价降至每百万词元4美元、输出20美元,较前代降约20%,缓存读取价降至0.2美元、降幅60%;GPT-6 Sol输入2美元、输出10美元;GPT-6 Luna给出0.10美元输入、0.50美元输出。文章认为,此轮降价非单纯补贴,而是架构优化结果:动态缓存读取机制把中间状态数据的存取成本压至原来的四分之一。百万词元单价全面跌破1美元,推理市场正从能力军备赛转入单位成本竞争。

BT财经 查看原文 →

📚AI 热词速查 · 一看就懂

29 词条

基础概念 5

大模型(LLM) Large Language Model

大规模语言模型,用海量文本训练,能理解和生成文字,是各类AI应用的“大脑”。参数量从百亿到万亿级,是ChatGPT、文心一言、通义千问等产品的核心。

智能体(Agent) AI Agent

能感知环境、自主决策并执行动作的AI系统,是大模型从“对话”走向“做事”的关键。前沿部署工程师(FDE)正是为弥补模型到落地之间的断层而生。

多模态 Multimodal

能同时处理文本、图像、音频、视频等多种模态信息的AI能力。GPT-4o、Gemini、Claude 3.5均已支持多模态输入输出,是大模型下一阶段重点方向。

Token(词元) Token

大模型处理文本的最小单位。中文约1-2字、英文约0.75个词,OpenAI定价按百万Token计费;2026年我国AI日均词元调用量已突破500万亿,Token经济成为新衡量体系。

生成式AI Generative AI

能生成新内容(文字/图像/代码/视频/3D等)的AI,区别于判别式AI。2022年ChatGPT引爆生成式AI浪潮,当前主流大模型均为生成式架构。

模型技术 12

训练 / 推理 Training / Inference

训练是用数据“教”模型参数(成本高、能耗大);推理是模型学成后回答问题(用户每次调用都产生)。训练与推理比约1:10到1:100,推理市场未来增量更大。

预训练 Pre-training

用海量通用数据(万亿Token)先“打底”,让模型学会语言、常识、推理等通用能力;再针对具体任务微调。是当前所有旗舰大模型的必经阶段。

强化学习(RL) Reinforcement Learning

通过奖励/惩罚让模型在交互中学会最优行为。RLHF(人类反馈强化学习)是ChatGPT对齐人类偏好的关键技术;2026年RLHF+RLVR成为模型后训练标配。

微调 Fine-tuning

用特定领域数据继续训练预训练模型,使其适配专业任务。LoRA、QLoRA等参数高效微调技术,让中小企业也能低成本定制专属模型。

垂类模型 Vertical Model

聚焦某一行业或细分场景、经领域数据深度优化的模型,被视为 AI 落地的“最后一公里”。做法是在通用或行业模型基础上注入行业术语、业务流程与规则,以“专而精”为核心——不追求能力广度,只在单一任务上追求精度与业务适配,普遍支持私有化部署并直接嵌入企业工作流。与“行业大模型”相邻:后者覆盖一个行业内的多类场景,垂类模型则聚焦其中单一细分场景。

蒸馏 Distillation

把大模型(教师)的能力“压缩”到小模型(学生),让小模型在保持90%以上精度的同时更轻量、更快、更便宜。DeepSeek-R1蒸馏版就是典型代表。

RAG 检索增强 Retrieval-Augmented Generation

检索外部知识库内容辅助生成回答,把企业私域文档“喂”给大模型,缓解幻觉问题,是当前企业AI落地最常用架构。

MCP 协议 Model Context Protocol

Anthropic 2024年开源的开放协议,让大模型标准化连接外部工具/数据源。类比AI领域的“USB-C接口”,已被OpenAI、Google、智谱、阿里等主流厂商采纳。

开源权重 Open Weights

模型权重可下载部署(部分受商业许可限制),区别于闭源API。Llama、Qwen、DeepSeek、Mistral是当前主流开源权重模型,推动了全球AI普惠。

开源基座模型 Open-source Foundation Model

大模型能力链条(基座 → 通用 → 行业 → 垂类)最底层的通用模型,经海量无标注数据大规模预训练而成,权重公开发布、可自由下载与二次开发。Llama、Qwen、DeepSeek、Mistral 为主流代表,闭源对标为 GPT、Claude、Gemini;参数量大、训练成本极高,研发集中于少数顶尖机构,是下游微调、蒸馏与垂类模型开发的共同起点。

Harness(智能体驾驭框架) Agent Harness

在大模型领域,指一套用于驾驭AI智能体的外部工程系统——涵盖上下文管理、工具调用、记忆存储、权限控制、循环决策与结果校验等工程能力,是模型智能转化为稳定生产力的"骨架"。业界核心共识公式为 Agent = Model + Harness:模型负责"聪明",Harness 决定智能体能稳定完成多长、多复杂的任务;Claude Code、Manus 等明星智能体的竞争焦点正从模型本身转向 Harness 工程。

世界模型 World Model

能理解并预测物理世界运行规律的AI模型,是具身智能和自动驾驶的基础。Yann LeCun强力倡导,被视为通往AGI的关键路径之一。

算力基建 6

算力(FLOPS) Compute

每秒浮点运算次数,衡量AI芯片性能的核心指标。FP16精度下,H100约2000 TFLOPS;2026年我国智算总规模达245万PFLOPS(FP16),日均词元调用突破500万亿。

GPU Graphics Processing Unit

图形处理器,AI训练的主力芯片。NVIDIA H100/H200/Blackwell、AMD MI300、寒武纪、壁仞、燧原等是当前主流选择;国产替代是2026年最热赛道。

智算中心 AI Data Center

专门为AI训练/推理建设的数据中心,配备大量GPU和高带宽网络。2026年我国八大算力枢纽与三个算电协同区占比超85%,江苏已落成全国首个省级AI4S公共算力中心(700P)。

超节点 Super Pod / Scale-up

把数万张GPU高速互联成一个“巨型计算机”的技术。NVIDIA NVL72、华为CloudMatrix 384、中科曙光scaleX40等是当前代表,把单机柜算力密度推到新高度。

云巨头 Hyperscaler

AWS/Azure/GCP/阿里云/华为云等提供AI算力服务的超大规模云厂商。当前全球新增AI算力约80%流向云巨头,AWS、Anthropic、Lambda今年签署350亿美元云协议。

推理云(Neocloud) Neocloud

专注AI推理的新一代云服务商。CoreWeave、Lambda、Crusoe等Neocloud以GPU池化、推理优化为卖点,2026年迎来上市潮,重塑云计算格局。

产业应用 6

具身智能 Embodied AI

AI赋予物理身体(人形机器人/自动驾驶/无人机),让智能体与真实世界交互。2026年是具身智能量产元年:优必选+1445%、宇树上市、可灵180亿美元估值。

AI4S AI for Science

AI for Science,用AI加速科学研究(生物/材料/天文/化学/药物研发等)。中国“AI4S公共算力中心”在南京揭牌,聚焦生物医药、新材料、智能制造垂域模型攻关。

AGI 通用人工智能 AGI

具备人类水平通用智能的AI,能在各种任务上达到或超越人类专家。当前主流大模型尚属“弱AGI”阶段,OpenAI、Anthropic、谷歌均把AGI作为长期目标。

词元 / Token经济 Token Economy

以Token调用量为核心衡量指标的AI商业模式和产业生态。2026年Token首次被写进工信部采购清单(首购首用、风险补偿),广东推出3000万元“Token贷”。

FDE(前沿部署工程师) Frontier Deployment Engineer

把大模型能力真正落地到企业业务场景的复合型工程师,负责模型选型、智能体编排、效果评测与持续优化。2026年9月工信部启动专项行动鼓励企业搭建FDE团队,上海“十五五”产业规划亦明确培养FDE队伍——“模型×业务”最后一公里人才成为AI价值兑现的关键。

OPC(一人公司) One Person Company

以个人为核心、依托AI工具与共享服务完成产品开发与商业闭环的新型创业范式。创业者用智能体承担设计、开发、运营等环节,以极低团队规模开展内容创作、跨境电商、软件开发等业务。江苏多地正建设OPC社区,并通过算力券、模型券、云网券等政策降低创业成本,宿迁提出打造“OPC创业之城”。

← 返回当日 9月23日 9月22日 9月21日 9月20日 9月18日