研究人员开发了COMLLM,一个旨在改进移动边缘计算(MEC)系统中任务卸载的新框架。该方法利用大语言模型(LLMs),并新颖地集成了组相对策略优化(GRPO)和前瞻协作模拟(LACS)机制。COMLLM通过将多步模拟纳入其奖励设计来捕捉决策的长期影响,从而实现近乎最优的延迟和更好的负载均衡公平性。一个关键优势是其零样本拓扑可扩展性,允许在较小网络上训练的模型在无需重新训练的情况下泛化到更大、未见过的网络。 AI
影响 这项研究可能通过利用大语言模型进行复杂决策,从而实现更高效、更具适应性的移动边缘计算系统。
排序理由 该集群包含一篇详细介绍移动边缘计算新框架的研究论文。[lever_c_demoted from research: ic=1 ai=1.0]
- Chuangxin Cheng
- COMLLM
- deep reinforcement learning
- Group Relative Policy Optimization
- Grpo
- Lacs
- large-language models
- Look-Ahead Collaborative Simulation
- Monte Carlo
- supervised fine-tuning
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →