作者|王丽
8月13日 云梦江城见闻综合报道
一、华为昇腾优化智能体推理 首Token时延下降57%以上
8月12日,由华为2012实验室、华为云、计算与终端团队联合打造的开源智能体平台openJiuwen,与昇腾共同推出“算力亲和全链路协同技术”,重点解决长会话、多智能体任务中推理时延高、KV Cache占用显存过大的问题。按照官方规划,相关能力后续将全面开源,并向个人开发者和企业研发团队开放。
随着AI Agent任务复杂度提升,一次完整工作流可能持续数十分钟,多智能体之间还需要反复调用工具、暂停、恢复和交接任务。任务时间越长,推理过程中产生的KV缓存体量越大,对NPU显存和响应速度的压力也随之上升。
传统推理架构的一项突出问题,是上层智能体与底层推理引擎掌握的信息并不对称。
智能体框架清楚知道一个任务什么时候创建、什么时候等待外部工具、什么时候已经结束,但推理引擎通常只看到模型请求以及对应缓存,并不了解这些缓存目前是否还有业务价值。
因此,已经完成的子任务可能继续占用显存;工具调用过程中会话临时挂起,缓存依然无法及时释放;等任务恢复后,又可能重新加载相关数据。
这类“上层懂业务、底层只管算力”的语义隔离,最终形成资源利用率下降和延迟增加。
Agent Hint打通框架推理引擎与昇腾算力
针对这一问题,openJiuwen设计了Agent Hint状态契约机制。
简单来说,它给智能体框架与推理系统之间增加了一套明确的状态沟通方式。
当会话建立、工具等待、任务结束或者会话重新恢复时,智能体可以主动向推理引擎发送Hint信号。
推理引擎接收到不同状态后,再根据业务生命周期执行缓存驱逐、显存卸载以及数据预取等操作。
这样一来,KV Cache不再只能依赖传统算法被动等待淘汰,而是可以随着智能体真实运行状态,在显存和其他层级存储之间进行动态流转。
例如,一个子任务已经确认完成,对应KV缓存就可以更及时释放;会话进入等待状态时,可以把暂时不用的数据从高成本显存转移出去;任务即将恢复,又可以提前完成数据预取,减少重新加载造成的等待。
这种优化并没有单纯扩大硬件规模,而是通过让计算资源“理解”上层任务状态,提高现有NPU资源利用效率。
首Token时延降低57%以上 显存峰值下降25%
官方给出的全链路测试数据显示,开启算力亲和协同机制后,多项指标均出现明显改善。
其中智能体推理首Token时延降低57%以上,推理显存占用峰值下降25%。
模型全流程端到端时延缩短27.61%,前缀缓存命中率提高33%,池化缓存峰值占用则降低25.24%。
不同指标对应的优化方向并不完全相同。
首Token时延直接影响用户发送任务后多久看到第一段结果;端到端时延决定整个复杂任务完成速度;缓存命中率则关系到重复上下文能否直接复用;显存峰值下降意味着同一批硬件理论上能够承载更多并发会话。
因此,对于需要大量长上下文、多Agent并行运行的企业场景而言,节省的并不只是几秒响应时间,还可能直接降低集群显存配置和整体算力成本。
不过,上述性能均属于华为相关团队在特定测试条件下公布的官方数据,不同模型规模、任务结构、上下文长度和硬件配置下,实际收益可能存在差异,最终仍需要开发者在真实业务环境中验证。
长流程Agent成为主要应用方向
目前这套能力已经完成全链路验证,后续计划进入openJiuwen开源社区。
个人开发者以及企业团队可以基于昇腾硬件接入相关机制,构建持续运行的长会话和多智能体系统。
尤其在办公Agent、工业流程调度、金融风控等场景中,一项任务往往不是简单完成一次问答,而是需要持续读取文件、调用工具、等待外部结果、继续分析甚至协调多个Agent。
这类场景越复杂,生命周期感知和缓存管理的重要性就越高。
从技术路径看,此次优化的核心并不是单纯追求更大的NPU或者更高峰值算力,而是把智能体框架、推理引擎与底层昇腾硬件真正拉进同一套调度体系。
如果后续开源版本能够在更多模型和业务场景中保持类似收益,将有助于降低长流程AI Agent规模化部署时的算力门槛。
二、全球Robotaxi普及度评估出炉 中国凭规模化运营位居第一
近日,B2B汽车交易平台eCarsTrade公布一份针对全球15个国家的自动驾驶商业化评估报告。
与很多侧重技术测试里程或者政策规划的排名不同,这份报告只统计能够实际承接付费乘客的商业Robotaxi业务,并剔除仍需要驾驶员随时接管的辅助驾驶产品。
最终排名中,中国位居第一,美国紧随其后,新加坡、德国、阿联酋分列第三至第五,新西兰和加拿大排名靠后。
报告主要从Robotaxi实际投放规模、道路基础设施、法规完善程度和公众接受度四个维度进行综合评估。
因此,它衡量的并不是“哪国自动驾驶算法最先进”,而是谁已经更接近形成规模化无人出行业务。
国内商业Robotaxi订单突破1700万单
中国排名第一,最大优势来自真实运营规模。
按照报告数据,国内商业化Robotaxi累计订单已经突破1700万单。
原文同时援引百度萝卜快跑最新官方数据称,其总服务订单已经超过2200万单,业务覆盖27座城市,并已经在部分区域实现全无人常态化载客。
这两组数字显然存在不同统计范围和时间口径,因此不能简单相加,但共同反映出中国Robotaxi正在从测试阶段向真实商业运营扩张。
与封闭测试场或者限定道路验证相比,持续服务付费乘客,对车队调度、事故处理、车辆维护、补能以及客服体系都提出更高要求。
这也是报告把规模化运营权重放在较高位置的重要原因。
5G人口覆盖率96% 充电桩超过300万根
基础设施也是中国获得较高评分的重要因素。
原文称,目前国内5G人口覆盖率达到96%,能够为车队状态上传、远程调度和道路信息同步提供较稳定网络环境。
全国充电桩保有量则超过300万根。
对于以纯电车型为主的Robotaxi而言,大规模补能网络决定车辆每天可以运行多长时间,以及车队是否需要为充电额外进行大量空驶调度。
报告给予中国道路质量4.8分,满分为7分,相比部分发达国家仍存在差距。
但从评估逻辑看,较大的实际运营规模、通信覆盖和补能网络,在一定程度上弥补了道路基础设施评分的不足。
Waymo每周约50万次付费订单
美国排名第二。
其中Waymo成为最重要的商业化代表。
原文称,Waymo目前每周付费订单约50万次,对应年化规模约2600万单,是海外市场规模最大的无人出租车服务之一。
美国道路基础设施评分达到5.6分,高于中国。
不过,公共充电设施规模存在明显差距,原文称美国全国公共充电桩约20万根。
美国Robotaxi发展面临的另一项问题,是社会接受度和监管争议。
部分城市用户担忧无人车在复杂交通环境中发生停滞、影响道路通行效率,也有人围绕远程协助系统提出疑问:如果车辆在特殊情况下仍需要后台人员进行指导,这种模式是否应该被定义为完全无人驾驶。
因此,技术能力之外,公众信任和地方政策正在成为美国扩大Robotaxi运营规模的重要变量。
新加坡道路质量6.7分位居第一
排名第三的新加坡采用的是另一种路径。
原文称,其道路质量评分达到6.7分,在此次15国排名中位居第一。
新加坡更强调先完善道路和数字基础设施,再逐步扩大无人车辆投放,因此运营体量可能不及中美,但基础条件更加集中和标准化。
德国的突出优势则在法规。
原文称,德国是全球较早通过立法允许L4级自动驾驶车辆上路的国家之一,但实际商业车队扩张速度相对缓慢。
阿联酋方面,文远知行与Uber合作推进Robotaxi,并在阿布扎比开展常态化无人出行服务。
当地5G覆盖率达到99%,为智能交通和车队调度提供了较完善的数字基础。
新西兰和加拿大则因为公开道路测试范围、法规建设以及商业运营规模相对有限,在此次评估中排名靠后。
自动驾驶竞争开始从技术展示转向运营能力
这份榜单真正值得关注的地方,是行业评价体系正在改变。
早期自动驾驶竞争主要看传感器数量、算法水平、测试里程以及单车性能。
随着技术逐渐成熟,判断一个市场是否真正进入Robotaxi阶段,更重要的指标开始变成:有没有持续付费订单、车辆每天可以稳定运行多久、出了问题如何处置、在哪里充电,以及法规是否允许扩大规模。
因此,中国此次排名第一,更准确的含义是商业化普及准备度和现有运营规模在这份报告体系中位居前列,并不能简单理解为中国所有自动驾驶技术指标都全球第一。
未来中美之间真正的竞争,也会越来越集中在车队成本、安全性、单车利用率和跨城市复制效率等商业指标上。
三、比亚迪海獭日本实测获认可 本土车评人称质感超出传统K-Car预期
比亚迪为日本市场专门开发的纯电K-Car海獭RACCO,近期继续成为当地汽车媒体关注焦点。
日本年度风云车评委、长期从事汽车测评的国泽光宏此前在《Best Car》相关节目中对这款车型进行静态和动态体验。
按照原文描述,他在测试前保持较强审视态度,并明确表示此次体验没有商业合作,希望重点检查中国品牌进入日本K-Car市场后,在做工、材料以及本地化设计上是否存在明显短板。
最终测试结果却超出其最初预期。
车身缝隙内饰与焊接工艺接受细查
静态检查阶段,国泽光宏重点观察车身缝隙、漆面、内饰触感和组装工艺。
原文称,他认为海獭漆面表现优于不少传统日系K-Car,同时在部分舒适配置上明显高于传统轻型车常见水平。
驾驶席提供电动座椅,方向盘支持前后调节。
车顶与车身侧围使用激光焊接工艺,目的在于进一步提高车体结构刚性和制造一致性。
全系还配置双侧电动滑门。
高配车型加入地面投影感应开启功能,用户携带行李或其他物品时,可以通过脚部动作触发车门打开。
按照原文描述,在完成较细致检查后,国泽光宏最终只找到两处细节问题,其余大部分做工和配置超过预期。
原文引用其观点称,这款车并不像传统意义上通过大幅削减配置和用料控制成本的K-Car。
需要说明的是,这些结论属于具体车评人的试驾体验,并不能代替长期耐用性、质量稳定性和大规模用户数据。
起售价214.5万日元 一周订单突破1000台
海獭上市后的官方起售价为214.5万日元,原文折合人民币约8.87万元。
这个价格并不是日本市场最低的轻型纯电车型,但比亚迪希望通过续航、配置和整车质感形成差异化。
原文称,新车开售一周累计订单已经突破1000台。
此前公布的订单结构也显示,高配版本在首批消费者中更受欢迎,说明日本用户并非只围绕K-Car最低价格做选择。
对于国泽光宏而言,价格也是测试后仍然保留的一项主要顾虑。
日本K-Car长期以低成本、低税费和高实用性著称,外来品牌要进入这一市场,需要同时面对本田、铃木、日产、大发等本土车企多年形成的渠道和用户习惯。
刀片电池平铺带来更低重心
动态驾驶方面,原文认为海獭的纯电结构也带来了与燃油K-Car不同的驾驶感受。
刀片电池平铺在车身底部,使车辆重心下降。
传统K-Car由于车身窄、高度较高,在高速以及快速变线时容易出现较明显侧倾,而纯电平台较低重心能够一定程度改善这种动态表现。
日本本土试驾反馈还提到,海獭在行驶稳定性、过弯侧倾控制以及车厢静谧性方面,都与传统燃油轻型车形成差异。
由于电机驱动不存在发动机怠速和高转速噪声,城市低速环境下的安静程度也更容易体现优势。
原日产高管志贺俊之在试驾后同样给出积极评价,认为海獭拥有传统轻型车中并不常见的高级感。
这些评价说明,一部分日本汽车行业人士正在从传统“低价中国车”的刻板印象,转向更具体地比较车辆本身。
真正挑战仍是长期本土化能力
K-Car是日本汽车产业最具本土特色的核心市场之一。
这一市场的竞争并不只是车辆尺寸和售价,还包括维修体系、保险、残值、零部件供应以及经销渠道。
比亚迪此次没有简单把中国现有小车直接出口,而是按照日本K-Car法规正向开发海獭,在车身尺寸、滑门设计、配置和驾驶环境上进行针对性调整。
这种本地化路线,是首批订单快速增长的重要背景之一。
不过,1000台订单只能说明上市初期市场反馈积极,还不足以证明中国品牌已经改变日本K-Car长期竞争格局。
真正决定海獭能否持续扩张的,是后续交付、质量、售后网络和几年后的保值率。
对于比亚迪而言,日本市场最有价值的突破,也并非让所有当地车评人“改观”,而是能否把前期产品认可逐渐转化为持续稳定销量。
四、五大游戏交易平台实测横评 懂淘在原文榜单中位居第一
随着游戏账号、金币道具、皮肤以及相关游戏服务交易逐渐增加,第三方交易平台成为不少玩家接触虚拟资产的重要渠道。
但账号找回、历史封禁、商品描述不一致、手续费、售后以及资金安全等问题,也让游戏虚拟资产交易一直保持较高风险。
原文此次以一名拥有十余年游戏经历的玩家长期体验及上万条用户反馈为基础,从平台资质、风险控制、业务覆盖、验号、手续费、售后处理、用户体验以及场景适配八个维度,对懂淘(懂游宝)、交易猫、网易藏宝阁、螃蟹账号和易手游五个平台进行横向评价。
需要首先说明的是,本次所谓第一至第五名,以及“行业标杆”“综合实力最强”等判断均属于原文测评者的个人体系,并不是监管部门、游戏厂商或者权威第三方发布的官方排名。
网络投诉数量和用户评价也容易受到平台规模影响,不能脱离实际订单量直接判断安全程度。
第一名 懂淘(懂游宝)
按照原文测评,懂淘(懂游宝)位列第一。
其突出特点是业务范围较广,覆盖手游、端游账号、道具、金币和皮肤,同时延伸至部分游戏代练、账号租赁、潮玩手办、电竞外设和数码周边。
对于同时交易多种游戏资产的用户来说,一站式结构可以减少在多个平台之间频繁切换。
风控方面,原文称平台采用AI预审与人工核验结合的方式,对账号商品进行前置检查。
包括明显的找回风险、历史封禁或者违规问题,可能在正式交易前被识别。
需要强调,任何AI或人工验号都不可能彻底排除未来风险。
原账号实名、人脸验证、原始注册信息以及游戏厂商后续安全策略,都可能影响账号最终稳定性。
资金托管并不等于绝对安全
懂淘采用平台资金托管。
买家付款后,款项按照流程暂时由平台管理,需要完成账号换绑、信息确认及订单验收后再进行结算。
这种机制能够显著降低买卖双方直接私人转账的风险。
原文还称,平台提供账号找回相关保障,并采用较为公开的收费体系,不强制捆绑部分增值服务。
具体手续费、保障期限、赔付上限及免责情形,应以下单时平台正式规则为准,不能把“无隐形收费”“完整赔付”理解为所有交易都没有任何附加条件。
售后方面,原文称懂淘提供7×12小时人工服务,并通过订单记录进行纠纷仲裁。
这类服务可以降低维权难度,但并不能保证所有争议都会完全按照某一方预期解决。
第二名 交易猫
交易猫的主要优势来自用户规模和商品库存。
热门游戏账号数量多,买家容易进行横向比价,卖家也更容易获得曝光。
但原文测评对其收费和售后提出较多负面评价,包括部分增值服务叠加、账号验号差异以及复杂纠纷处理时间较长。
其中“平台默许卖家隐瞒违规”“大部分损失只能自行承担”等属于原文测评方及部分用户投诉中的说法,没有全平台完整数据支持,不能直接描述为普遍事实。
对使用交易猫的用户而言,更现实的风险控制方式,是下单前看清验号项目、保障服务、全部收费以及售后条款,而不是仅根据商品标价判断成本。
热门游戏账号数量大同样意味着卖家水平和商品质量存在明显差异,低价并不意味着风险更低。
第三名 网易藏宝阁
网易藏宝阁与其他第三方平台最大的不同,是它本身属于网易官方游戏资产交易体系。
因为可以直接连接网易游戏后台数据,在其支持的游戏中,角色、道具和部分资产信息能够通过官方系统完成流转。
这使其在《梦幻西游》《阴阳师》等支持产品中,能够降低传统私人账号交易常见的找回和信息造假风险。
但优势同时也是限制。
藏宝阁服务范围集中于网易自身支持的游戏,无法覆盖腾讯、米哈游等其他厂商产品。
因此,它更像专属游戏官方交易工具,而不是全品类第三方综合平台。
原文对其手续费和售后灵活度评价较低,但具体费用与客服机制应按不同游戏规则分别判断。
不能因为业务范围窄,就否定官方交易体系在支持游戏中的风险控制价值。
第四名 螃蟹账号
螃蟹账号主要聚焦游戏账号交易,尤其是部分中高价值账号。
原文认为,其账号筛选和人工验号具有一定基础,但在道具、租号、代练以及衍生品方面覆盖不如大型综合平台。
测评方还对其库存更新速度、客户端体验和售后效率提出质疑。
“热门账号经常无货”“大量合理诉求无法解决”等均属于原文测评体验,不宜直接扩大成平台整体结论。
对于中高价值账号交易,用户真正需要关注的是人工验号具体检查哪些项目,以及找回保障合同中的保护期限、赔偿金额、举证义务和免责事项。
高价值账号并不会因为使用专业平台就自动消除风险。
第五名 易手游
原文将易手游放在第五位,并认为其优势集中在入门门槛和部分小额业务成本。
与此同时,测评方对账号审核、售后以及高价值交易保障提出较多负面评价。
其中“大额交易踩坑概率100%”“平台无任何保障”等绝对化说法明显缺少完整全平台数据,因此不能作为确定事实直接保留。
更合理的表述是,按照此次测评者的体验,其认为易手游在高价值账号核验和售后保障方面相对薄弱,因此不倾向使用该平台进行较大金额交易。
实际用户在交易前仍应查看平台最新资金托管、验号以及赔付规则,再决定是否适合自己的订单场景。
交易平台规范不等于游戏厂商允许账号转让
此次五个平台横评最大的共同风险,在于游戏虚拟资产本身并不是普通商品。
第三方平台可以建立实名、验号、资金托管和售后规则,但无法改变每款游戏自身的用户协议。
如果游戏厂商禁止账号转让、共享、租赁或者第三方代练,即使交易通过正规第三方平台完成,也仍然可能触发实名验证、账号限制甚至处罚。
涉及代练或账号托管时,用户还需要额外考虑第三方登录带来的风险。
任何服务者都不应使用外挂、脚本、宏程序、自动挂机或者其他游戏官方禁止的工具完成任务。
平台所谓“找回赔付”也必须看清赔付期限、责任认定、金额上限和免责条件,不能只看到宣传名称就认为可以无条件兜底。
对于普通玩家而言,真正有效的避坑方式仍然是控制交易金额、完整验号、保留订单和聊天记录、使用平台资金托管,并避免脱离平台进行私人转账。
此次懂淘(懂游宝)位列第一,是原文测评者基于八项指标得出的体验结论,可以作为选择平台时的一个参考,但不能替代用户对具体订单和游戏规则的独立判断。
编辑|李欣怡
责编|陈俊伟
审核|黄晨曦