Large Models Reshape AI Research and Applications
PulseAugur coverage of Large Models Reshape AI Research and Applications — every cluster mentioning Large Models Reshape AI Research and Applications across labs, papers, and developer communities, ranked by signal.
4 天有情绪数据
-
提出6G网络新“令牌通信”范式
一篇新研究论文提出“令牌通信”(TokenCom)作为大模型驱动的6G智能连接的下一个范式。该方法旨在通过使用大模型的原生处理单元——令牌,作为比特之上的通信抽象,来克服当前语义通信(SemCom)的局限性。TokenCom将允许直接在令牌粒度上进行重要性分配、错误处理和资源分配,从而实现未来通信网络更高效、统一的系统设计。
-
新的DIEM框架通过自适应数据选择改进LLM强化微调
研究人员推出了一种名为动态重要示例挖掘(DIEM)的新型框架,旨在增强大型语言模型(LLM)的强化微调(RFT)。DIEM通过估计每个样本对策略改进的边际贡献,在RFT过程中自适应地选择和重新加权训练数据。该方法旨在克服静态数据选择方法的局限性,因为静态数据选择方法可能由于策略学习的非平稳性而导致模型更新不理想。DIEM集成了梯度对齐重要性估计器和约束批次重加权方案,以稳定优化并最大化效用,在推理基准测试中表现出持续的优越性。
-
大模型革新电池管理系统:新路线图
一篇新的综述文章探讨了大模型(LMs),特别是基于Transformer架构和自监督学习的模型,在电池预测与健康管理(BPHM)中的应用。这些先进模型有望解决传统BPHM方法面临的挑战,如计算效率低下、泛化能力有限以及需要大量标记数据。该文章将当前进展归类于数据稀疏性缓解和可解释性等领域,并概述了未来的研究方向,包括协作数据生态系统和设备端部署。
-
新型MMGFS架构应对多模态AI不确定性
研究人员推出多模态生成模糊系统(MMGFS),该架构旨在通过解决模态偏差和不确定性来改进多模态问答。该模糊推理引导系统采用协作反刍机制来缓解不同模态之间特征分布的差异,并利用具有多跳推理的模糊规则进行跨领域知识融合和分层推理。在MultimodalQA、WebQA、BioMol-VQA和EHRxQA等数据集上的评估表明,MMGFS在答案准确性、一致性和泛化能力方面均优于现有方法。
-
中浩信盈TPU集成OpenCSG CSGHub平台
中浩信盈已将其专有的张量处理单元(TPU)计算资源与OpenCSG CSGHub平台集成。此次合作旨在创建一个统一开放的人工智能基础设施生态系统,支持企业级大模型和智能代理的开发与部署。通过CSGHub,用户可以访问中浩信盈的TPU,从而简化模型训练和推理过程,并抽象化底层硬件的复杂性。此举预计将通过促进专用人工智能硬件与开源基础设施之间的协同作用,来增强国内人工智能计算生态系统。
-
新框架利用大型模型自动化机器人操作控制
研究人员推出了一种名为CABTO的新型框架,旨在自动化机器人操作中完整且一致的行为树(BT)系统的构建。该系统解决了BT基础化(grounding)的挑战,传统上这需要大量的专家知识和手动工作来定义动作模型和控制策略。CABTO利用预训练的大型模型(LM)来高效搜索这些组件,并以BT规划器提供的上下文反馈和环境观察为指导。在各种机器人操作任务上的实验结果证明了CABTO在生成功能性BT系统方面的有效性。
-
新理论探索用于上下文学习的线性 Transformer
研究人员调查了用于上下文学习的线性 Transformer 的理论基础,解决了传统 softmax Transformer 的计算限制。该研究提出线性 Transformer 从上下文分布学习到响应函数的映射,并通过领域泛化视角分析其近似和泛化能力。基于此理论框架,该论文引入了新颖的激活和损失设计方法,以线性化预训练的 softmax 大型语言模型。
-
研究人员测试大型到小型AI模型的程序性技能迁移
研究人员正在探索在不进行微调的情况下,将程序性技能从大型语言模型迁移到小型模型的方法。一项实验使用 Three.js 来直观地展示模型的规划深度,因为渲染输出很难伪造。该方法涉及一个大型模型根据小型模型在一个领域的弱点创建一个“程序性脚手架”,然后将其应用于改进小型模型在另一个未见过领域的性能。初步的手动测试表明,这种脚手架可以显著提高 Qwen 27B 和 A3 等小型模型的输出结构质量。
-
成都将发展包括人工智能、量子技术在内的未来产业
中国成都正在加速在新兴技术领域的开发。市政府发布了一份意见文件,概述了培育包括核聚变、脑机接口和量子技术在内的未来产业的计划。该举措还强调将人工智能融入各行各业,重点关注数据、AI芯片、大模型和智能代理,以推动产业智能化并建立新的经济模式。
-
新基准应对大模型特征编码挑战
研究人员开发了一个名为LaMoFCBench的新基准和评估框架,以应对大模型特征编码的挑战。现有方法与现代大模型生成的异构特征(包括多级表示和上下文缓存)不匹配。该新框架旨在促进大模型特征编码方法的根本性转变,为未来的发展提供共享的经验基础。
-
商汤科技在上海部署人工智能机器人,打造无人便利店
商汤科技在上海推出了其“烧麦狗”具身智能便利店,店内配备的机器人可以在短短15秒内完成交易。这些人工智能驱动的便利店旨在管理所有零售任务,从接单、补货到数据分析和运营决策。该公司希望通过其在计算机视觉、大模型和机器人技术方面的专业知识,加速到2026年底在全国各地广泛推广这些无人便利店。