Copilot 交互层
对话 + 地图圈选交互唯一输入口:把「在哪、干什么」的模糊诉求,转成结构化目标 + 上下文。
用地图圈选代替坐标描述,用一句话代替填表。因为地址不唯一、诉求带隐含条件,交互层要做的不是解析成命令,而是攒够上下文交给 Agent。
这一层大概率被追问
为什么用圈选而不是让用户打字说地点?
地址不唯一、且区域范围用文字说不精确;圈选把「空间范围」这个高歧义信息一次性确定下来,降低后续决策出错概率。
专题 · Deep Dive
把一句「圈选这块地,巡检消防通道」变成一条能自己找设备、规划航线、起飞取证、发现异常就处置的闭环——模型当编排者,平台当护栏。
面向城市治理 / 应急巡检的飞手与运营人员;他们懂业务,不想记几十个接口和航线参数。
讲解从这张图开始,也回到这张图。人记不住段落,但记得住节点之间的位置关系。
图太小或被限制?在新窗口打开完整交互图 ↗
走一遍最能代表系统价值的路径。几乎任何追问,都落在这条链的某个节点或两个节点之间。
点左侧任意一层,用三档深度讲它。面试时先给电梯答案,对方点头再往下钻——同一层,三种深浅。
唯一输入口:把「在哪、干什么」的模糊诉求,转成结构化目标 + 上下文。
用地图圈选代替坐标描述,用一句话代替填表。因为地址不唯一、诉求带隐含条件,交互层要做的不是解析成命令,而是攒够上下文交给 Agent。
这一层大概率被追问
地址不唯一、且区域范围用文字说不精确;圈选把「空间范围」这个高歧义信息一次性确定下来,降低后续决策出错概率。
任务、航线、设备对接、数据落库都留在既有平台;Copilot 只做交互与编排,通过 10 个动作调用平台。
Copilot 不接管飞控与实时控制回路;它调用平台动作,平台负责与设备安全通信。
起飞等不可逆高危动作,即便校验全过也需人工二次确认;模型可以建议,不能擅自执行。
看编排者:巡检里「要不要喊话」没写在任何 if-else,是模型观察照片后在第 N 轮动态决定的。这一条就把它从工作流里区分出来。
运行时才知道的分支太多(设备可用性、航线复用、异常处置),写死=组合爆炸且脆;动态决策把成本从人预先枚举转成模型按上下文选择,用护栏兜底可控性。
靠 Agent Trace:意图→Tool→参数→下一步决策逐轮留痕,配场景测试清单定位问题在理解、选择、参数还是收敛,再改描述或加校验。