文章主要内容总结
本文介绍了一种名为AirTrafficGen的端到端框架,旨在利用大型语言模型(LLMs)自动化生成空中交通管制(ATC)训练场景,以解决手动设计场景耗时、多样性有限的问题。
该框架的核心包括:
- 基于图的空域表示:将三维空域(包含航线、导航点等)离散化为图结构,使LLMs能够处理空域拓扑信息;
- 工程化提示框架:通过精细设计的提示词,实现对场景中交互存在性、类型、位置等特征的细粒度控制;
- 基准测试:系统评估了主流LLMs(如Gemini 2.5 Pro、OpenAI o3等)在四个关键推理维度的表现:飞机空间密度、时间推理(场景时长)、扇区复杂度(航线交互性)、交互建模(场景复杂度);
- 迭代优化能力:验证了LLMs能基于文本反馈修正有缺陷的场景,提升场景合理性。
实验表明,先进LLMs(如Gemini 2.5 Pro和o3)能生成高流量且符合操作实际的场景,为ATC训练和空域验证提供了可扩展的替代方案,同时展示了LLMs在安全关键领域复杂规划中的潜力。
创新点
- LLMs推理能力的基准测试:首次系统评估了LLMs在空管场景生成中关键的空间、时间及时空推理能力,明确了模型的优势与局限;
- 基于图的知识表示:专门设计的图结构将复杂空域信息编码为
订阅专栏 解锁全文

278

被折叠的 条评论
为什么被折叠?



