PulseAugur
实时 10:24:28
实体 squad

squad

PulseAugur coverage of squad — every cluster mentioning squad across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
4
90 天内 10
发布 · 30天
0
90 天内 0
论文 · 30天
4
90 天内 10
层级分布 · 90 天
主题
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/1 页 · 共 10 条
  1. RESEARCH · CL_206644 ·

    SQuad框架通过子二次注意力大幅降低视频Transformer的计算成本

    研究人员开发了SQuad,一个子二次注意力蒸馏框架,旨在提高视频扩散Transformer(DiTs)的效率。该新方法降低了自注意力机制的计算成本,该机制通常随token数量呈二次方增长。SQuad实现了O(n√n)的复杂度,显著降低了FLOPs和延迟,同时保持了可比的视频生成质量。

  2. TOOL · CL_196070 ·

    BERT基础QA模型可靠性评估;RoBERTa表现最稳定

    一项新近发表在arXiv上的研究评估了包括RoBERTa、ALBERT和DistilBERT在内的多个基于BERT的模型在问答任务上的可靠性。研究人员通过在SQuAD和QuAC数据集上引入蒙特卡洛Dropout和输入释义的变化来评估模型稳定性。研究结果表明,RoBERTa是测试模型中最可靠的,而ALBERT和DistilBERT则表现出明显的不一致性。研究还证实,蒙特卡洛Dropout是一种有效的衡量可靠性的指标,且不会干扰推理。

  3. RESEARCH · CL_180205 ·

    新的 RAG 验证方法改进多跳问答

    一篇新研究论文提出了一种改进检索增强生成(RAG)系统验证的新方法,特别适用于多跳问答。研究表明,传统的按块过滤方法对于多跳查询无效,因为没有单个块包含足够的信息。提出的解决方案包括将验证条件设置为分解的子问题,这显著提高了在 MuSiQue 等数据集上的性能。研究还强调,像 Qwen2.5-7B 这样的现成模型可以适应这项分解任务,尽管它们可能无法完全发挥其潜力。

  4. TOOL · CL_167168 ·

    新的 cMoLLM 架构通过动态卷积缩放 LLM

    研究人员推出了一种新颖的大型语言模型缩放方法 cMoLLM,该方法将混合专家(MoE)风格融入整个模型管道,而不仅仅是前馈网络。该方法将 MoE 层重新构建为动态卷积,允许进行条件于输入的核聚合以及端到端流的可微分路由。在 FineWeb 数据集上使用 GPT-2 风格模型进行的实验表明,在匹配的计算预算下,cMoLLM 提高了语言建模困惑度和下游任务的准确性,与 ParaScale 和 AltUp 等现有方法相比,显示出更稳定的优化…

  5. RESEARCH · CL_63570 ·

    Microsoft 详解用于一次性 AI 代理的 Agent Framework

    Microsoft 详细介绍了其 Agent Framework,这是一个用于构建 AI 代理的分层 SDK。该框架强调一次性代理,这些代理可以利用持久化内存,从而实现复杂的任务执行。这种架构支持模块化开发和高效的代理工作流处理。

  6. RESEARCH · CL_53458 ·

    新的 RAG 研究将上下文长度与语义竞争区分开来

    一篇新的研究论文提出了一种方法,用于区分检索增强生成(RAG)系统中错误的原因是上下文长度还是语义竞争。该研究引入了一种匹配对照协议,该协议可以分离竞争性段落对模型性能的影响。在 Phi-2 和 Qwen2.5-1.5B 模型上的实验表明,减少语义竞争,而不仅仅是上下文长度,可以显著提高 F1 和答案包含率等性能指标。

  7. TOOL · CL_21937 ·

    新的AS-LoRA方法提高了联邦学习的隐私性

    研究人员开发了AS-LoRA,一种用于隐私保护联邦学习中LoRA组件自适应选择的新型框架。该方法通过允许每一层独立选择其活动组件并在通信轮次中调整这些选择来解决此类设置中常见的聚合错误。AS-LoRA在不增加隐私成本的情况下,理论上提高了收敛速度和准确性,并在GLUE和SQuAD等基准测试中取得了显著的进步。

  8. RESEARCH · CL_22001 ·

    PACZero 实现具有可用效用的 PAC-私有语言模型微调

    研究人员开发了 PACZero,一种新颖的大型语言模型微调方法,可提供强大的隐私保证。该方法利用梯度的符号量化来实现一种隐私机制,在这种机制下,成员推断攻击的成功率不高于随机猜测。PACZero 在 SST-2 和 SQuAD 等标准基准测试中表现出具有竞争力的性能,即使在零互信息的情况下,在高隐私设置下也优于先前的方法。

  9. RESEARCH · CL_08278 ·

    研究人员发布 Faithfulness-QA 数据集以训练上下文忠实的 RAG 模型

    研究人员开发了 Faithfulness-QA,一个包含近 10 万个样本的新数据集,旨在训练检索增强生成(RAG)模型优先考虑检索到的上下文而非其内部知识。该数据集通过系统地替换现有问答基准中的命名实体为替代项来创建,从而在上下文和参数记忆之间产生冲突。该资源旨在提高 RAG 系统的忠实度,并为其提供评估其上下文基础能力的基准。

  10. RESEARCH · CL_06833 ·

    新的硬件设计为边缘AI提供高效的Softmax和LayerNorm

    研究人员开发了用于Transformer模型在边缘设备上运行的、硬件高效的Softmax和Layer Normalization的近似方法。这些方法确保了保证归一化,这对于边缘NLP和生成式AI应用中以得分为导向的任务至关重要。所提出的架构采用Verilog HDL实现,并在28nm CMOS工艺上合成,与现有解决方案相比,其精度下降极小,面积也显著减小。