实体
candy
candy
PulseAugur coverage of candy — every cluster mentioning candy across labs, papers, and developer communities, ranked by signal.
总计 · 30天
3
90 天内 3
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 3 条
-
用于代码生成的 LLM 对齐:预训练模型 vs. 微调模型
研究人员探讨了大型语言模型 (LLM) 对齐技术在代码生成任务中的有效性,研究了对齐应该从预训练的 LLM 还是微调的 LLM 开始。该研究在五个最先进的 LLM 上使用了两种无奖励对齐方法:直接偏好优化 (DPO) 和 BoNBoN。结果表明,对齐预训练模型比其预训练的对应模型在对齐版本中带来了更大的改进,尽管预训练模型总体上准确性较低。相反,对齐微调模型产生的性能提升较小,甚至出现性能下降。
-
Roblox游戏“打扫超市”揭示常见的物品摆放错误
Roblox游戏“打扫超市”中有几件物品玩家经常会放错货架。例如,糖果经常被误放在零食货架,而不是罐头货架,而方便面则属于谷物货架。本指南提供了正确的摆放位置,以帮助玩家优化游戏中的购物行程。
-
DailyBlogroll 因度假错过发布而道歉
此集群包含一条 Mastodon 帖子,来自 DailyBlogroll 账号。作者为因度假错过发布而道歉,并列出了几位提供内容的贡献者。该帖子还包含与游戏和独立网站相关的标签,并提到了交互式 Web 应用程序需要 JavaScript。