PulseAugur
中
实时 22:10:17
实体 PubMed

PubMed

PulseAugur coverage of PubMed — every cluster mentioning PubMed across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
80
90 天内 80
发布 · 30天
0
90 天内 0
论文 · 30天
59
90 天内 59
层级分布 · 90 天
主题
关系
情绪 · 30 天

12 天有情绪数据

最近 · 第 1/5 页 · 共 88 条
  1. TOOL · CL_286768 ·

    AI 工具缺乏清晰度:70% 的描述未能解释用法

    对 Smithery 上 46 个热门 MCP 服务器的最新分析显示,它们的工具描述存在严重缺陷。在检查的 1,118 个工具中,约有 69% 未能明确其预期用途,45% 未描述其返回值。此外,同一服务器内的工具描述通常非常相似,以至于 AI 代理可能会混淆它们,有 15 个服务器在 90 对工具中出现了此问题。正如 PubMed 和 Gmail 的示例所示,这种缺乏清晰度可能导致 AI 代理错误地选择工具。

  2. TOOL · CL_284533 ·

    Redpine Science 平台提升 AI 文献访问的准确性

    Redpine Science 是一个新平台,通过 API 和模型上下文协议为 AI 模型和代理提供对同行评审文献的访问。该平台已通过四象限方法进行了评估。评估结果显示,与依赖网络搜索或不进行检索的代理相比,使用 Redpine Science 的代理在问答基准测试中实现了更高的准确性。具体而言,在 ScholarQABench SciFact 基准测试中,使用 Redpine Science 的代理正确回答了 94.4% 的声明,显…

  3. TOOL · CL_284290 ·

    新的 BioStudyBench 基准测试 AI 代理在知识截止日期后的生物医学研究能力

    研究人员推出 BioStudyBench,这是一个旨在评估 AI 代理复制知识截止日期后生物医学研究结果能力的新基准。该基准包含 25 项任务,这些任务源自知识截止日期之后发表的研究,数据来自 PubMed。评估内容包括代理是否能独立查找相关公共数据、使用仅返回截止日期前记录的工具搜索文献,以及执行数据分析以匹配报告的研究结果。结果表明,数据和工具的可用性显著提高了代理的表现,尽管开源模型通常落后于闭源模型。

  4. TOOL · CL_282179 ·

    新的RL系统TrustMed-RL推进了基于证据的临床诊断

    研究人员开发了TrustMed-RL,一个新颖的、用于基于证据的临床诊断的长期强化学习系统。该系统在PubMed的罕见病病例和标注的图像面板上进行训练,整合了访谈、检查和文献检索等各种诊断步骤。拥有8B视觉-语言策略的TrustMed-RL,诊断准确率达到了37.1%,优于开放权重基线,并比监督微调提高了12个百分点以上。在特定的诊断准确率指标上,其表现也优于GPT-4o,并获得了医生的高度信任评分。

  5. RESEARCH · CL_280320 ·

    新基准改进模式生物的生物文献检索

    研究人员为细胞和发育生物学中的模式生物变形虫开发了一个新的检索基准,以应对文献稀疏和特定生物术语的挑战。该基准源自 dictyBase 并链接到 PubMed,包含策展人生成的查询和结构化的基因注释。他们的研究探讨了交叉编码器重排、基因感知查询扩展和全文检索的影响,发现这些方法可以有选择地提高准确性,尤其是在摘要缺乏关键证据时。

  6. TOOL · CL_273624 ·

    O-Funnel 库提供从不断变化的文档中进行无损数据提取

    研究人员开发了 O-Funnel,一个新颖的 Python 库,旨在无需手动编写模式即可从异构且不断变化的文档中提取数据。O-Funnel 将结构捕获与值提取分离,将 XML、JSON 和 HTML 等各种文档格式转录为统一的树状结构。这种方法确保即使在模式发生变化时,数据提取仍然健壮,正如其在模式重命名后对 PubMed 记录的完美准确性所证明的那样,其性能优于传统的基于正则表达式的解析器。

  7. TOOL · CL_269651 ·

    AWS 详解 Amazon Quick 套件的提示工程

    AWS 详细介绍了其 Amazon Quick 套件工具的提示工程技术,重点在于最大化输出的精确性和可操作性。该博文概述了如何为 Quick Research 和 Quick Flows 等特定的 Quick 组件构建有效的提示。对于 Quick Research,它强调了明确目标、将复杂主题分解为子问题,以及仔细选择数据源以聚焦代理的搜索。对于 Quick Flows,建议侧重于提供关于“什么、何时以及何地”的明确细节,以准确地自动化工作流程。

  8. TOOL · CL_261483 ·

    AI代理在遗传病严重程度分类中达到93.55%的准确率

    研究人员开发了一种AI代理,该代理结合了推理和检索增强生成技术来对遗传病的严重程度进行分类。该代理在10,211个“人类表型本体论”术语上进行了训练,并利用了美国医学遗传学学院和美国妇产科学院的指南。该系统在表型层面达到了93.55%的准确率,并与外部基因列表显示出95.2%的一致性,为遗传病分类提供了一种标准化和自动化的方法。

  9. TOOL · CL_261425 ·

    新系统整合医学病例报告以诊断罕见病

    研究人员开发了一个多模态信息系统,该系统整合了来自医学病例报告的结构化临床摘要,包括图像和生物医学实体。该系统使用医学本体来组织信息,旨在改善初级临床医生检索相关病例的效率,从而辅助罕见病的诊断。该系统处理了 2000 年至 2021 年间发表的 52,949 份开放获取病例报告的数据,这些数据来自 PubMed 数据库。

  10. TOOL · CL_259505 ·

    视频运动捕捉缺乏临床验证,审查发现

    对 2015 年 1 月至 2026 年 2 月期间发表的 117 项研究进行的系统性文献回顾发现,基于视频的无标记运动捕捉尚未能有效替代临床环境中的传统标记式系统。虽然矢状面下肢的一致性约为 5-6 度,但仍未达到临床可接受的标准,并且在平面外运动学、动力学和病理人群方面的验证很少。该回顾强调了新兴计算机视觉进展与其在已验证的生物力学研究中的整合之间存在显著差距,表明未来的研究应侧重于这些领域以提高临床相关性。

  11. TOOL · CL_254509 ·

    新的CNN-BiLSTM框架提供事实依据的生物医学文本摘要

    研究人员开发了一种结合一维卷积神经网络(1D-CNN)和双向长短期记忆网络(BiLSTM)模型的新混合框架,用于生物医学和临床文本的抽取式摘要。该方法旨在通过直接从源材料中选择和重排句子来防止抽象式摘要中常见的factual不准确性。该模型在PubMed和MIMIC-CXR数据集上表现强劲,优于简单的CNN和LSTM基线模型,并表明结构约束可以带来更值得信赖的摘要系统。

  12. RESEARCH · CL_254166 ·

    新 AI 代理使用 Gemini 和 DeepSeek 简化临床试验数据访问

    研究人员开发了 ClinAgent,一个旨在简化临床试验注册信息查询过程的对话式人工智能系统。该系统利用一个基于 ReAct 的大型语言模型 (LLM) 代理,集成了搜索 PubMed 等外部数据库和本地临床试验数据集的工具。对 Gemini 3.0 Flash 和 DeepSeek V3.2 模型进行的评估显示,Gemini 总体表现最佳,专家评分更高,而 DeepSeek 在规划质量方面表现出色。

  13. TOOL · CL_247703 ·

    人工智能和深度学习用于肺癌检测:系统性综述

    一项系统性映射研究回顾了 2015 年至今关于将人工智能 (AI) 和深度学习 (DL) 应用于医学影像肺癌检测的 96 篇文章。研究强调了使用迁移学习和数据增强的卷积神经网络 (CNN) 在提高诊断准确性和效率方面的有效性。然而,该研究也指出了重大挑战,包括数据标准化、模型可解释性、患者隐私和伦理考量,强调在广泛临床应用之前需要进一步的研究和监管。

  14. TOOL · CL_247696 ·

    研究发现:医疗LLM研究滞后于模型发布

    一项对2023年至2026年医疗大型语言模型进行的最新研究显示,模型发布日期与评估研究发表日期之间的差距日益扩大。研究发现,尽管与医疗LLM相关的出版物数量激增,但绝大多数并未采用随机对照试验等严谨的研究设计。此外,从模型发布到其在已发表研究中进行评估的时间滞后显著增加,许多研究评估的是已停产的模型系列。

  15. COMMENTARY · CL_243783 ·

    研究发现,对科学家的信任与价值观共享有关,而非专业知识

    最近的一项英国研究表明,公众对科学家的信任主要受共享价值观和政治身份的影响,而不是他们的专业知识水平。这一发现与美国类似的趋势观察一致。研究表明,社交媒体上的错误信息和政治两极分化等因素在塑造公众对气候变化和疫苗有效性等议题的科学共识的看法方面发挥着重要作用。

  16. TOOL · CL_239218 ·

    生物医学AI研究面临LLM退役带来的可复现性危机

    一篇新发表在arXiv上的研究强调了由于大型语言模型(LLMs)的退役,生物医学研究中存在重大的可复现性风险。研究人员发现,42%使用LLMs的论文涉及的模型在其发表两年内已经退役或计划退役。从发表到模型退役的中位时间为538天,这表明许多依赖这些模型的生物医学出版物在发表后不久就可能变得无法在计算上复现。该研究强调,模型弃用需要作为该领域的一个关键报告和保存问题来解决。

  17. RESEARCH · CL_234781 ·

    美国环保署提案可能终止对数据中心空气污染许可证的公众意见征询

    美国环境保护署(EPA)提出了一项规则,将取消各州在批准数据中心和其他工业设施的空气污染许可证之前通知公众和征求意见的联邦要求。这一变化可能会使公众更难了解和评论拟议中的数据中心项目,这些项目已经引起了社区的强烈反对并影响了选举格局。

  18. TOOL · CL_238360 ·

    微调大语言模型以从文本自动生成流程挖掘日志

    研究人员开发了一个新的框架,使用大语言模型(LLMs)从非结构化文本自动生成结构化事件日志。该方法解决了手动创建事件日志的瓶颈问题,而事件日志对于流程挖掘至关重要。通过在自定义文本到日志数据集上微调LLMs,模型可以从事件单和报告等来源提取高保真事件数据,其性能远超零样本或少样本提示。

  19. TOOL · CL_230555 ·

    OpenAI 集成 ChatGPT Health 与 Epic EHR 以便临床医生访问数据 · 跟踪 5 个来源

    OpenAI 通过与 Epic 的电子健康记录 (EHR) 系统集成,增强了 ChatGPT Health 的功能,该系统服务于超过 3.25 亿患者。此次集成允许临床医生安全地导入患者数据,例如预约记录和实验室结果,并利用人工智能查询这些信息,用于就诊前审查和时间线准备。该系统提供对健康记录的只读访问,OpenAI 还推出了一个 Healthcare Public Data 插件,用于访问来自 ClinicalTrials.gov …

  20. TOOL · CL_229088 ·

    新的 En-ViMedNER 语料库助力越南语生物医学 NLP 研究

    研究人员推出了 En-ViMedNER,这是首个英越平行生物医学命名实体识别 (NER) 语料库。该语料库使用统一医学语言系统 (UMLS) 语义类型进行标注,为与现有基于英语的资源进行直接比较提供了一个共享的跨语言标签空间。En-ViMedNER 包含超过 4,300 对 PubMed 摘要和近 203,000 个对齐的实体提及对,通过自动翻译、专家编辑和 LLM 辅助方法相结合构建而成。该语料库已针对越南语输入和跨语言 NER 任…