PulseAugur
实时 10:38:58
实体 self-critique

self-critique

PulseAugur coverage of self-critique — every cluster mentioning self-critique across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
0
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. COMMENTARY · CL_159940 ·

    生产AI需要结构化的提示策略,而不仅仅是演示

    生产AI系统的提示工程需要一种超越简单演示的结构化方法,侧重于可靠性和特定任务的需求。工程师必须根据任务的复杂性、推理需求以及对外部数据或工具的需求,选择合适的提示模式,例如零样本(Zero-shot)、少样本(Few-shot)、思维链(Chain-of-Thought)或ReAct。核心原则是将选定的模式与精心策划的上下文(包括指令、示例、模式或检索到的文档)相结合,形成一个提示,经过验证后输入到应用程序中。

  2. RESEARCH · CL_44000 ·

    新方法旨在提升大语言模型的文化意识和公平性

    研究人员开发了两种不同的方法来提高大语言模型的文化意识。一种方法由 DFKI-MLT 用于 SemEval-2026 Task 7,通过使用语言向量的激活引导在推理时调整模型,在多项选择赛道上达到了 86.96% 的准确率。另一种方法称为跨语言共识,它使用多语言自洽性和自我批评,将潜在的文化知识从本地语言表示提取并传播到英文提示中,将 BLEnD 基准的性能平均提高了 5.03%。两项研究都强调了大语言模型中文化知识不均衡的挑战,并提…