Skill和Agent也能被封装调用

亲手带火Vibe Coding的AI大神卡帕西,前阵子忍不住在网上放声吐槽:

自己的Agent会把代码写得一团糟,没美感还喜欢到处copy粘贴,最主要的是压根不听自己的指令。

这条吐槽戳中了不少开发者——

AI是真的会写代码了,但自己加班最多的那部分,代码生成根本救不了。

真正拖住应用交付的,往往不在于代码生成,而是其背后那段更长、更琐碎,也更依赖系统工程能力的链路。

这种事儿,在终端开发里尤其常见。

在刚刚结束的 华为HDD·HarmonyOS创新论坛西安站 ,这个连接HDC重大技术发布与开发者实践的平台,致力于将最新技术能力带入一线开发场景:

关于底层如何实现,接入需要多少成本,放进真实工程能否跑通,最后又能解决什么产品问题。

从多设备互联、系统能力Skill化到接入方式,这次HarmonyOS 7试图缩短的,正是系统技术抵达真实应用之前,那段最重、也最容易被忽略的工程距离。

那些过去受限于成本、周期和技术复杂度而被搁置的产品创作,这次真的跑上设备、并走到了开发者面前。

终端交互开始“三次越界”:跨过设备、Skill化、走出平面

放眼当下,全球终端市场都在面临「增长瓶颈」。

IDC最新发布的AI终端白皮书显示,过去一年,智能手机出货量下降13.9%,PC和平板也都在负增长,放眼整个市场,AI几乎成了唯一还讲得出增长故事的变量。

只是,这个故事其实只讲了一半。

用户对终端AI到底能干什么,事实上还没有全面具体的感知;开发者想把AI塞进产品,还得先跨过开发量大、系统链路复杂这些门槛。

AI时代的终端交互,需要的是一套全新范式。

而这套范式,也恰恰落在了AI不熟悉的地方:在一条工程链路里,设备怎么连、协议怎么通、系统服务怎么调用。

在HDD这个鸿蒙开发者线下交流活动上,我们观察到,HarmonyOS 7试图向前推进的,正是这段更难啃的工程——

让终端交互跨过设备、让AI服务迈向Skill化、让数字内容走出平面。

而这些发生在系统深处的越界,事实上也已经跨过底层技术链路,变成了用户真正能感觉到的体验细节。

△AI生成 HarmonyOS 7押注的一个重要方向,就是「跨设备交互」。

大家应该都深有体会,终端设备边界越独立分明,就越容易让人感到麻烦。

比如我们想把图片压缩包从一个手机传到另一个手机,看着挺简单的一个动作,但其背后往往意味着找设备、建连接、确认权限等一长串动作。

花费时间不说,没准在这过程中我们还得搭上各种social沟通成本。

而且互传之后,接下来放到哪儿、位置怎么调,还得靠用户手动编辑一轮。

但在HarmonyOS 7中,基于星河互联的一碰快传能力,这笔横在设备之间的传输成本,不仅变成了 碰一下 的动作,还进化到了能够 精准放进去 ~

比如当手机碰向平板屏幕的具体位置,系统可以精准识别触碰区域,带着位置信息一起完成分享。

于是,手机里的照片可以直接落到平板画布的指定位置,省去导入、拖动、调整等频繁操作。

这一碰,传过去的既有文件,也有用户想让它出现在哪儿的意图。

信息跨过终端,解决的是「送到」的问题。

但设备要想真正满足用户需要的高质量信息获取,那就不能只打破设备间的界限,还要打破 设备和人 之间的隔阂。

对此,AI就需要具备意图理解、服务编排,以及跨任务的持续流转的能力。

但说实话,这些事儿光靠系统外面的AI很难做成,没有系统级权限,AI就算听懂了人的话,也调不动散落在各个App和设备里的服务,更别提把一整件事办完。

而HarmonyOS 7在终端交互层的另一次「越界」,要解决的就是这个老大难的问题——

以系统级安全为底座,把AI进一步压进操作系统,让AI真正服务用户的「意图」。

全新升级后的小艺,承接的正是这项能力。

在Agentic亲和架构下,小艺进一步升级为系统级智慧大脑,不仅懂自进化和自思考,还开始承担理解意图、服务编排和交付结果的完整过程。

对于我们用户来说,最直观的一个变化,那就是可以直接以 Skill 的方式让AI干活儿了。

比如朋友晚上来家里吃饭,四个人,希望按照川湘口味准备,那小艺就可以先用菜谱Skill配菜单、算分量,再接上买菜Skill把缺的食材下单,用户确认后就能等菜上门,这下也是真·智能包办了。

前两次「越界」,让信息得以跨设备流动,也让服务开始围绕人的意图被调用。

当设备与服务之间的边界逐渐松动,交互的下一步,自然落到了那块每天与人相对最久的屏幕上:

数字内容能否走出平面,让人与屏幕的距离再近一步?

而HarmonyOS 7的第三次「越界」,做的也正是这件事儿。

那就是把数字信息带进屏幕内部——为平铺的二维UI,补上一条至关重要的Z轴。

换句话说,终端设备也可以通过理解真实世界中的深度、光线和空间关系,将数字内容放入更加空间化的位置了。

比如我们把一张人像设成锁屏,原本浮在照片上的时钟会自然藏到人物身后,就像人物真实地走进了画面里,更具沉浸感。

设备与设备的界限、人与设备的界限,再到空间界限,HarmonyOS 7用不同的技术模块,三次完成了「越界」。

这些举动最终都落在同一件事上,那就是缩短用户从产生意图到获得结果的距离。

HarmonyOS 7让连接协议、服务编排与空间渲染这些本就应该藏在后台的东西,真正地退到后台,用户真正需要做的,就只剩下碰一下、说一句、看一眼。

这一次,数字内容真的从平面里「长」了出来,并让用户仿佛置身其中。

系统能力开始变成开发者「调得动」的工具

对用户来说,系统能力有没有价值,很多时候就看它能藏掉多少复杂操作。

但到了开发者这头,问题又多了一层:这些已经跑通的体验,到底能不能真正被自己的应用高效便捷地直接复用。

这里面的一个问题是,终端应用开发和网页应用开发是两码事儿。

网页端让Agent写几行代码很多时候就能code出来,但到了终端,权限、协议、系统服务少打通一环都不行。

而HarmonyOS 7这次在开发层面做的事情,就是把这段难啃的系统工程集中整合, 把系统能力封装成能直接上手用的接口和工具,交到开发者手里。

少量代码即可接入,跨设备交互终于成了「轻开发」

让两台手机碰一下,就能把文件压缩包传给一个设备,这能力听起来就不像几行代码能搞的事情。

如果真要让开发者自己从头「造轮子」,像资源打包、传输后的解包和落盘,一整条链路都得处理,每走一步还可能碰上不同的权限问题,工程量确实不小……

不过到了HarmonyOS应用开发者这里,前面这堆底层活儿,已经被统一打包进了 Share Kit 。

开发者接入Share Kit后只要考虑传什么、传到哪儿、然后碰一下就行,至于设备怎么连、数据怎么传,交给系统套件处理就好。

此外, 开发者如果还想实现精准互传,只需获取触碰位置,将发送端的A坐标映射到接收端的B坐标。

这样一来,素材、笔刷和图层便能直达画布对应位置,真·碰哪儿,插哪儿~

具体开发方式上,碰一碰快传实际也不麻烦。

开发者只需要接入相关API,完成事件注册、连接回调、消息收发和会话结束等几个步骤就ok。

对了,如果此前已经有了「碰一碰分享」功能的应用,那增加隔空传送能力甚至可能只需少量代码就能搞定~

这种「轻」开发模式的背后,实际上也对应着开发者过去很难绕开的一重门槛。

一个做应用层业务逻辑的开发者,未必懂底层连接协议的取舍,也未必清楚不同设备形态之间怎么保证行为一致。

真要自己从头做,相当于要跨专业现学一遍,这正是少量代码接入这种模式真正省下的东西。

在用户那里简单无缝的交互操作,在开发者这里同样可以举重若轻,只有像这样才能真正削平能力接入的准入门槛。

Skill和Agent也能被封装调用

看到这里,估计会有开发者朋友该说了:跨设备之所以能做轻,说到底只是把信息从A搬到B。

可一旦涉及内容生成、意图判断和任务执行,开发侧的复杂度立马就不是一个量级了……

不过问题变复杂了,HarmonyOS 7的处理思路没变——

继续把系统能力拆开,封装成开发者能调用的工具。

开发者手里那些已经跑起来的Agent、MCP和零散能力,事实上总不能为了打通小艺再重做一遍。

对此,HarmonyOS 7给出的具体解法是: 直接把A2A、MCP、Skill等接入方式串进同一条开发链路。

至于更零散的能力,比如已有的MCP工具、意图框架里散落的功能,也能直接做成Skill接进来,不用单独另起一套开发流程。

举个例子,开发者想让旅行应用听懂「周末去西安两天,帮我安排行程」这句话。

过去得先自己接一个大模型,再搭一套对话入口,处理「周末」「两天」这类模糊表达背后的意图,再把「安排行程」拆成查景点、定路线这些具体步骤。

一整套下来,AI光是把「听懂」这事儿做对就要花不少功夫。

但现在开发者通过把景点查询封装成一个Skill,再通过A2A跟其他Agent协同,就能接入一套完整服务。

平台承担意图理解、任务编排与服务分发,开发者则聚焦垂直能力的稳定交付,这下开发者不用先成为AI工程专家,也能把自己的服务端上桌了。

从AI Coding到空间计算,开发者想法被送进真场景

AI Coding很容易给人一种错觉:模型写得越快,项目交付也会越快。

但在真实工程环境里,模型一次吐出几千行代码,语法、编译、功能验证,还是要有人工兜底的。

前面写代码省下来的时间,很可能又在后面的排错里还回去…….

事实上HarmonyOS 7的开发者工具,把这道「把关」的工序也顺道儿接管了——

DevEco Code把代码生成、检查、构建和验证串成一条链路,模型写完就自动往下跑,开发者不用来回切工具。

原始来源量子位

原文页面仍是署名、版权归属和后续更新的最终来源。

查看原文 ↗
← 返回最新