PulseAugur
实时 05:33:12
实体 temperature

temperature

PulseAugur coverage of temperature — every cluster mentioning temperature across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
7
90 天内 10
发布 · 30天
0
90 天内 0
论文 · 30天
3
90 天内 3
层级分布 · 90 天
主题
关系
情绪 · 30 天

6 天有情绪数据

最近 · 第 1/1 页 · 共 10 条
  1. COMMENTARY · CL_166800 ·

    LLM 温度:在生产环境中平衡确定性和创造性

    大型语言模型(LLM)中的温度参数控制着文本生成过程中 token 选择的随机性。温度为 0 会始终选择最有可能的 token,从而产生确定性的输出;而较高的温度会通过从更广泛的概率范围进行采样来增加随机性。对于生产环境,建议在数据提取和分类等任务中使用较低的温度(0-0.3),在事实问答和摘要等任务中使用中等温度(0-0.5),在营销文案等创意生成任务中使用较高的温度(0.7-1.0)。需要注意的是,即使温度为 0,由于浮点数运算和…

  2. COMMENTARY · CL_143133 ·

    LLM 解码策略:贪婪搜索、Beam Search、Sampling、Top-K 和 Top-P 详解

    语言模型通过将概率分布转化为 token 序列来生成文本,不同的解码策略会导致不同的输出。贪婪解码在每一步选择最有可能的 token,这可能导致重复的文本。Beam search 保留多个序列以寻找整体上更好的句子,但可能产生平淡的结果。Sampling 方法,如 temperature、top-k 和 top-p(nucleus sampling),引入随机性以生成更多样化和富有创意的文本,现代模型通常将这些技术与重复惩罚相结合。

  3. RESEARCH · CL_141063 ·

    TSCoNet模型对环境变量进行不确定性预测

    研究人员开发了TSCoNet,一种结合了CNN和LSTM架构以及高斯Copula的新型两阶段模型,用于对具有不确定性量化的多个相互关联的环境变量进行预测。该方法旨在解决深度学习模型中准确性和不确定性报告之间的权衡问题,特别是对于相关数据。TSCoNet首先生成准确的均值预测,然后优化共享表示以估计预测方差,在不牺牲点准确性的情况下提供校准的预测区间。该模型已在模拟空间场和真实世界的降水及温度数据上进行了评估,证明了其提供精确预测和可靠…

  4. COMMENTARY · CL_136290 ·

    大语言模型类比:星系代表语义空间,提示词是入口点

    一种新的类比将大语言模型比作夜空中的星系,每个星系代表一个语义空间。用户的提示词既是方向,也是进入其中一个星系的入口点。模型在空间中的遍历受到温度等参数的影响,温度控制着标记(星辰)之间的“跳跃距离”,而上下文则塑造了导航路径。

  5. COMMENTARY · CL_132887 ·

    将自由意志概念化为变分自编码器中的一个学习参数

    本文提出将自由意志视为一个模型参数,而不是算法的二元状态,类似于变分自编码器(VAE)中的标准差(σ)。与语言模型的温度或强化学习代理的 epsilon(全局且由用户设置)不同,VAE 的 μ 和 σ 是输入相关的并且是学习到的。作者认为,VAE 中用于平衡泛化与过拟合的 KL 散度项代表了灵活性与约束之间的学习平衡,从而将自由意志形式化为每个维度的、学习到的属性。

  6. TOOL · CL_138248 ·

    新方法使用环境信号探测地理空间自监督学习表示

    研究人员开发了一种新方法来评估地理空间卫星图像中的自监督学习(SSL)表示。该方法不依赖于下游任务,而是使用来自ERA5数据集的共址环境变量(如温度、降水和土壤水分)来探测表示。这使得能够评估SSL模型是否固有地捕捉到与这些物理环境因素的统计关联,从而在任务特定性能之外提供对其能力的更细致的理解。

  7. TOOL · CL_114050 ·

    优化 AI API 使用:关键参数与成本节约误区

    来自 dev.to 的两篇文章为使用 AI API 的开发者提供了实用建议,重点关注成本优化和性能提升。第一篇文章详细介绍了五个关键 API 参数——temperature、max_tokens、top_p、frequency_penalty 和 stream——这些参数可以提高 AI 应用速度、降低费用并提高输出质量。第二篇文章指出了导致 AI API 成本高昂的三个常见错误:缺乏速率限制、忽略对重复提示的缓存以及为简单任务使用昂贵…

  8. COMMENTARY · CL_101447 ·

    LLM 创造力由温度和采样参数控制

    LLM 使用温度和采样参数来控制其输出的创造性和可预测性。温度重塑了潜在下一个词的概率分布:低温度(接近 0)倾向于最可能的词,导致确定性和重复性的响应,而较高的温度(大于 1)则使分布变平,让不太可能的词有机会出现,从而产生更具创造性但可能出错的文本。top-k 和 top-p 采样等技术通过修剪概率尾部来进一步优化词语选择,在保持多样性的同时防止出现荒谬的词语选择。最佳设置取决于任务,低温度适用于事实性任务,而较高温度适用于创意性工作。

  9. COMMENTARY · CL_89555 ·

    LLM采样:为什么你只应该调整温度或Top-P

    文章解释了大型语言模型中温度(temperature)和top-p(nucleus sampling)采样的不同功能,并警告不要同时使用两者。温度会重新调整词元(token)的概率分布,影响所有词元的几率;而top-p通过保留累积概率达到阈值之前最有可能的词元来截断分布。同时使用这两个参数会导致不可预测的交互,并使模型行为的推理变得困难,因为它们的效果并非相互独立,且应用顺序通常无法控制。作者建议选择一个参数进行调整,并将另一个保留在…

  10. COMMENTARY · CL_86463 ·

    LLM 采样参数详解:Temperature、Top-P、Top-K 和 Min-P

    本文解释了如何有效调整大型语言模型(LLM)中使用的采样参数,以实现期望的输出特性。文章详细介绍了四种常用参数:temperature、top-p、top-k 和 min-p,并解释了每个参数如何修改 token 生成的概率分布。该帖子旨在帮助开发者为其特定用例选择合适的参数,超越可能不适合生产环境的默认设置。