PulseAugur
实时 02:17:51
实体 OpenAI Deep Research

OpenAI Deep Research

PulseAugur coverage of OpenAI Deep Research — every cluster mentioning OpenAI Deep Research across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
1
90 天内 10
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 2
层级分布 · 90 天
主题
关系
情绪 · 30 天

1 天有情绪数据

最近 · 第 1/1 页 · 共 10 条
  1. TOOL · CL_208538 ·

    DataSTORM系统提升了LLM在结构化数据库上的研究能力

    研究人员开发了DataSTORM,一个新颖的、基于LLM的代理系统,用于对大规模结构化数据库和互联网来源进行深度研究。与以往专注于非结构化网络数据的研究方法不同,DataSTORM采用了探索性数据分析和数据叙事的原理,以促进论文生成、量化推理和叙事发展。在InsightBench数据集上的评估显示,DataSTORM取得了新的最先进水平,在洞察力和摘要召回率方面有了显著提高。此外,在源自ACLED的真实世界数据集上,DataSTORM…

  2. RESEARCH · CL_169795 ·

    AI模型在辅助科学研究方面表现不一,研究发现 · 追踪2个来源

    一项发表在arXiv上的新研究分为两部分,探讨了大型语言模型(LLMs)在辅助科学研究方面的能力。第一篇论文详细介绍了2025年中期的模型如ChatGPT、Claude和DeepSeek在生成项目计划和评估提案方面的表现,发现尽管人类评审员对AI生成的提案的评价与人类撰写的提案相似,但AI评审员更偏爱AI生成的内容。第二篇论文侧重于文献综述辅助,显示2025年中期的LLMs仅选择了少量与人类专家重叠的参考文献,并且经常生成带有元数据错…

  3. COMMENTARY · CL_159207 ·

    Claude代码技能在复杂性和上下文处理方面面临挑战

    作者详细介绍了他们使用Claude代码技能的经验,这些技能是用于自动化复杂工作流程的Markdown文件。虽然他们九个技能中的大多数运行良好,但一个特别庞大且复杂的技能“feature-loop”却出现了问题。问题源于显著性稀释(salience dilution),即标记过多的指令为关键会压倒Claude的优先级排序能力,以及长上下文中的静默漂移(silent drift),即重要规则被累积的会话数据所掩埋。

  4. COMMENTARY · CL_142701 ·

    人们日益担忧人工智能会取代人类的思考和自主性

    日益依赖人工智能进行决策,从琐碎的选择到复杂的推理,引发了对人类自主性被侵蚀的担忧。一篇文章探讨了这一趋势,引用了刘慈欣的短篇小说《完美匹配》,其中一个AI助手管理着用户生活的方方面面。文章强调,像Claude fable和ChatGPT这样的AI工具,通过整合信息并提供直接答案,已经超越了传统的搜索引擎,这可能会削弱批判性思维的必要性。文章质疑,当个人过度将认知过程外包给AI时,最终是谁在做重要的生活决定。

  5. TOOL · CL_05303 ·

    Perplexity AI 提供其研究功能的进阶技巧和指南

    Perplexity AI 发布了旨在增强其研究能力的新功能和指南。该平台正在推广其“深度研究”功能,该功能允许用户提取比传统研究方法更深入的见解。此外,一份指南提供了47个技巧,帮助用户更有效地利用Perplexity进行研究任务。

  6. FRONTIER RELEASE · CL_11258 ·

    Google Gemini API 推出 Deep Research 更新,支持 MCP 和图表生成

    Google 发布的两个重要更新增强了其 Gemini API 的 Deep Research 功能。这些更新引入了更高的质量、对 MCP 的支持以及图表和信息图表的原生生成。Gemini API 现在提供两种模式:用于速度和效率的 Deep Research 模式,以及用于最高质量上下文收集和综合的 Max 模式,在 DeepSearchQA 和 HLE 上取得了强劲的基准测试分数。

  7. SIGNIFICANT · CL_01759 ·

    Google DeepMind 发布由 Gemini 3.1 Pro 驱动的自主研究代理

    Google DeepMind 推出了两款新的自主研究代理:Deep Research 和 Deep Research Max,均由 Gemini 3.1 Pro 驱动。这些代理旨在安全地分析用户提供或第三方数据,其中 Deep Research 针对交互式应用的性能进行了优化,而 Deep Research Max 则用于更详尽的后台任务。两款代理都能生成专业的、带有引用的报告和可用于演示的视觉效果,其中 Deep Research…

  8. RESEARCH · CL_02373 ·

    OpenAI推出具有增强安全措施的深度研究代理

    OpenAI发布了一份系统卡,详细介绍了为其新的“深度研究”功能所实施的安全措施。此代理功能由早期版本的o3模型提供支持,旨在进行多步互联网研究、分析各种数据格式以及执行Python代码。在向Pro用户发布之前,OpenAI进行了广泛的安全测试,包括外部红队测试和风险评估,以减轻诸如提示注入、不允许的内容、隐私问题和偏见等潜在问题。

  9. SIGNIFICANT · CL_00817 ·

    深度研究的创造者

    Google 发布了其 AI 产品“Deep Research”,该产品可作为代理使用,并利用 o3 和 Gemini 1.5 Flash 等定制调优的前沿模型。该工具旨在快速执行复杂的研究任务,用户将其输出质量与博士级别研究助理的水平相媲美。早期用户称赞其效率,指出它能在几分钟内完成需要数天的研究项目,并推测其有潜力重新定义互联网导航和知识工作。

  10. TOOL · CL_02135 ·

    OpenAI 为专业人士增强 ChatGPT,提供免费临床医生访问权限

    OpenAI 通过向经认证的美国临床医生免费提供 ChatGPT,并扩展其在客户成功、运营、营销、销售和研究等方面的功能,使其对各种专业团队更易于访问和使用。这些更新侧重于利用 ChatGPT 简化工作流程、改善沟通、综合信息和生成结构化输出,最终旨在提高这些专业领域的效率和效果。增强功能包括数据分析、带引用的高级网络搜索以及语音交互等功能,所有这些功能都旨在帮助用户更快地从原始信息转向可操作的见解和决策。