PulseAugur
中
实时 23:45:10
实体 Vicuna-13B

Vicuna-13B

PulseAugur coverage of Vicuna-13B — every cluster mentioning Vicuna-13B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
2
90 天内 2
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 0
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 2 条
  1. COMMENTARY · CL_166667 ·

    LLM法官评分不可靠,因比较存在缺陷

    一个LLM法官给一个标题打了0.00分,但这个分数存在问题,因为比较集有问题。该标题与和解新闻和产品发布进行了比较,混合了不同类型的内容,因此该分数对于评估标题质量毫无意义。文章强调,LLM法官评分高度依赖于比较集、响应顺序和所使用的特定法官模型等因素,不应被视为最终判决。

  2. TOOL · CL_38990 ·

    四款早期开源大模型曾短暂统治聊天机器人竞技场

    四款早期开源模型——Vicuna-13B、Guanaco-33B、Vicuna-33B 和 WizardLM-70B——曾短暂主导聊天机器人竞技场,表现优于早期的商业产品。Vicuna-13B,训练成本为 300 美元,开创了使用 ChatGPT 对话数据进行微调的先河,并间接促成了聊天机器人竞技场平台的创建。Guanaco-33B 展示了 QLoRA 在消费级硬件上进行高效微调的强大能力,这项技术彻底改变了开源模型开发。Wizard…