PulseAugur
中
实时 12:00:23
实体 DeepSeek-R1-Distill-Qwen-14B

DeepSeek-R1-Distill-Qwen-14B

PulseAugur coverage of DeepSeek-R1-Distill-Qwen-14B — every cluster mentioning DeepSeek-R1-Distill-Qwen-14B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
5
90 天内 5
发布 · 30天
0
90 天内 0
论文 · 30天
4
90 天内 4
层级分布 · 90 天
主题
最近 · 第 1/1 页 · 共 5 条
  1. RESEARCH · CL_229141 ·

    新的ECGQuest基准测试用于评估和微调心脏病学解释的LLM · 已跟踪2个来源

    研究人员开发了ECGQuest,这是一个旨在评估和微调专门用于心电图(ECG)解释的语言模型的新基准测试。该数据集包含从医学参考资料和会议记录中生成的21,000多个真/假问题。评估显示,GPT-5在零样本设置下表现最佳,优于通用和医学专业模型。微调较小的开源模型可显著提高其准确性,其中一个五模型集成实现了最高性能。

  2. TOOL · CL_221133 ·

    发布新的基准数据集 OpenSanctions Pairs,GPT-4o 在实体匹配性能上领先

    发布了一个名为 OpenSanctions Pairs 的新基准数据集,专为制裁和 OSINT 数据的大规模实体匹配而设计。该数据集包含超过 755,000 个专家标记的配对,源自 293 个来源和 45 个司法管辖区的 100 万多个实体,具有显著的语言和结构多样性。评估显示,GPT-4o 取得了最高性能,F1 分数为 99.0%,紧随其后的是开源模型 DeepSeek-R1-Distill-Qwen-14B,F1 分数为 98.2…

  3. TOOL · CL_181762 ·

    2026年笔记本电脑本地编码的5款LLM

    作者重点介绍了五款适合在2026年笔记本电脑上本地运行的大型语言模型,并强调较小的量化模型现在能够处理重要的编码任务。Qwen2.5-Coder因其完善度和生态系统被推荐为默认模型,而DeepSeek-R1-Distill-Qwen-14B因其详细的推理能力而成为复杂调试的首选。微软的Phi-4 14B因其高效、结构化的输出而受到关注,Bonsai 27B则被展示为一个通过新颖的低比特量化挑战传统大小-性能权衡的模型。

  4. TOOL · CL_123126 ·

    新方法用更少数据增强网络安全大语言模型

    研究人员开发了一种名为领域自适应持续预训练(DAP)的资源高效方法,用于网络安全任务的大语言模型(LLMs)专业化。他们使用了一个精选的1.26亿词语料库和一个分布式FSDP流水线,适配了Llama-3.1-8B、DeepSeek-R1-Distill-Qwen-14B和Llama-3.3-70B-Instruct模型。适配后的Llama-3.3-70B-Ins-DAP模型在使用显著少于同类模型的训练数据的情况下,在三个网络安全基准测…

  5. TOOL · CL_22541 ·

    LLMs 借助代码分析提升恶意软件归因能力

    研究人员开发了 LCC-LLM,这是一个旨在利用大型语言模型改进恶意软件归因的框架和数据集。该系统利用以代码为中心的表示,包括反编译的 C 代码和汇编代码,以提供比以往方法更深入的分析。LCC-LLM 集成了检索增强生成管道和网络安全知识,以提高事实可靠性和分析师决策支持,在结构化报告生成和恶意软件分类方面显示出有希望的结果。