PulseAugur
实时 22:37:47
实体 abstract syntax tree

abstract syntax tree

PulseAugur coverage of abstract syntax tree — every cluster mentioning abstract syntax tree across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
6
90 天内 21
发布 · 30天
0
90 天内 0
论文 · 30天
2
90 天内 10
层级分布 · 90 天
主题
情绪 · 30 天

6 天有情绪数据

最近 · 第 1/2 页 · 共 21 条
  1. TOOL · CL_234897 ·

    AI 编码代理需要结构化理解,而不仅仅是反应式修补

    当前的 AI 编码代理通常像初级开发人员一样行事,将编译器视为昂贵的 REPL,并进行反应式错误修补,而不是理解代码库的结构。这种方法由于可能破坏上下文,因此对于企业来说在商业上是不可行的。为了解决这个问题,OmniForge Planning Engine 使用了 AST 优先拓扑和 DAG 规划来映射依赖关系并确保在执行代码之前的结构完整性,从而防止破坏性的反应式修补。

  2. TOOL · CL_224486 ·

    大型语言模型数学错误与安全风险:为什么 eval() 是个坏主意

    由于其概率性本质,使用大型语言模型进行数学计算是不可靠的,会导致错误的答案。开发者经常诉诸于在 JavaScript 或 Python 等语言中使用 `eval()` 作为快速修复方法,但这会通过启用任意代码执行来造成严重的安全漏洞。一种更健壮、更安全的方法是采用专用的确定性数学表达式求值器,它使用解析器构建抽象语法树 (AST),并根据严格的数学语法求值表达式,将大型语言模型的作用从计算器转变为接口。

  3. TOOL · CL_219141 ·

    新的ChipV-RTL框架增强了硬件设计的Verilog生成

    一篇新研究论文介绍ChipV-RTL,这是一个多智能体框架,旨在改进数字硬件设计的寄存器传输级(RTL)代码生成。该框架通过将任务分解为更小、可管理的子任务,解决了处理冗长、详细规范和生成冗长、语法正确的代码的挑战。在RealBench基准测试上的实验表明,ChipV-RTL的性能显著优于当前最先进的大型语言模型和智能体,通过率达到45.0%,而现有模型为21.6%。

  4. RESEARCH · CL_218149 ·

    AI智能体基准测试噪声审计,SIGMA框架应对多智能体鲁棒性

    两篇新研究论文探讨了AI智能体性能和鲁棒性方面的挑战。第一篇论文介绍了SIGMA,一个旨在通过考虑观测中的结构化噪声效应来改进多智能体强化学习的层级框架,并在《星际争霸II》中展示了改进的鲁棒性。第二篇论文审计了智能体基准测试中的测量变异性,特别检查了工具调用端点,发现提示扰动比重新运行引入了更显著的噪声,影响了准确性和故障模式。

  5. COMMENTARY · CL_207134 ·

    RAG 因文档结构问题在法律尽职调查中失败

    最近一篇文章强调了基础检索增强生成(RAG)在应用于复杂的法律文件时,尤其是在并购尽职调查中,所存在的不足。标准的 RAG 方法依赖于任意的 token 分块,可能会在不引起注意的情况下遗漏关键条款,例如 1400 万美元的赔偿例外条款。这种情况的发生是因为法律文件通常被视为有向无环图(DAG),而不是线性文本,这会导致边界截断,在大型语言模型(LLM)处理之前就切断了重要的上下文。作者提出,为法律应用构建具有零丢弃抽象语法树(AST…

  6. TOOL · CL_191069 ·

    Claude 代码 CLI 通过 OpenRewrite 实现确定性的 Java 现代化

    本文认为,由于可能引入隐蔽性错误,不应直接使用 Claude Code 等大型语言模型进行大规模 Java 代码现代化。文章提出改用 Claude Code CLI 来生成确定性的 OpenRewrite 无损语义树 (LST) 规则。当这些规则由 rewrite-maven-plugin 等工具执行时,可以确保类型安全且可复现的代码转换,从而防止语义漂移和编译器错误。

  7. TOOL · CL_165106 ·

    音频基础模型在无领域特定训练的情况下捕获系统发育信号

    一项发表在arXiv上的新研究调查了大型音频基础模型是否能在没有明确为此目的进行训练的情况下,从物种发声中捕获系统发育信号。研究发现,像CLAP和BEATs-bio这样的通用模型在恢复海洋哺乳动物和鸟类物种的系统发育距离方面表现出显著能力,其性能优于手工制作的特征。令人惊讶的是,像BirdNET这样的领域特定模型并未显示出更优越的性能,这表明在音频数据上进行广泛的预训练可能足以编码进化信息。

  8. TOOL · CL_160584 ·

    新工具可检测标准方法遗漏的AI生成代码重复

    一款名为Code Clone Detector MCP server的新工具已被开发出来,用于解决代码库中“影子重复”的问题。当Claude Code或Cursor等AI代理在代码的不同部分无意中创建相同或几乎相同的逻辑时,就会出现“影子重复”。标准的检测方法因依赖于字面字符串匹配而失效,会遗漏变量名或格式上的差异。新工具通过剥离注释、标准化空格和匿名化变量来规范代码,创建一个“结构骨架”,从而能够准确检测完全相同和功能相似的代码克隆。

  9. TOOL · CL_150523 ·

    Claude Code通过集成Eclipse JDT LS增强Java重构能力

    一份技术指南解释了如何通过模型上下文协议(MCP)将Claude Code与Eclipse JDT语言服务器(JDT LS)集成,以改进其Java重构能力。这种方法使Claude Code能够理解Java代码的抽象语法树(AST),从而避免诸如方法签名幻觉和构建失败等常见问题。通过实现语义AST搜索,开发人员可以确保AI代理准确解析复杂的代码结构,例如Spring Boot层级和@Qualifier注解,从而实现更可靠的代码生成和重构。

  10. TOOL · CL_134654 ·

    AI扫描器在Python AI框架中发现5个关键漏洞

    一位安全研究员开发了一款名为PyHunter的AI驱动漏洞扫描器,该扫描器成功在两个Python AI框架中发现了五个关键漏洞,包括未经身份验证的远程代码执行(RCE)漏洞。该工具融合了静态分析、污点跟踪和LLM推理来查找和验证错误,API使用成本约为100美元。研究员旨在以更小的规模复制Mythos等复杂平台的功能,专注于AI代理框架生态系统内的高危RCE漏洞。

  11. TOOL · CL_133930 ·

    Python工具使用LLM自动生成代码文档

    一位开发者创建了一个Python工具,该工具利用大型语言模型(LLM)为代码自动生成文档。该工具使用`ast`模块解析Python源代码,提取函数信息,包括是否已存在文档字符串。然后,它会提示LLM,指定一种Google风格的格式,以生成简洁的文档字符串。最后,该工具将生成的文档字符串修补回源代码的正确行号和缩进级别,确保幂等性并避免语法错误。

  12. RESEARCH · CL_131475 ·

    PatchOptic 接口通过经过验证的状态更新增强 LLM 工作流

    研究人员推出了一种名为 PatchOptic 的新颖接口,旨在管理大型语言模型 (LLM) 的共享状态工作流。该系统通过实现投影读取和经过验证的结构化更新来解决 LLM 上下文窗口的局限性,确保本地修改在全局状态内有效。PatchOptic 旨在通过强制执行工作流步骤之间的契约来降低代币成本并防止数据泄露,这已在 PatchBench 上进行了演示和基准测试。

  13. TOOL · CL_117545 ·

    LLM 代理通过新颖的验证工作流程处理 C 到 HLS-C 的转换

    研究人员开发了一种新颖的 LLM 代理,旨在将标准 C 程序转换为高层次综合工具链所需的 HLS-C(可综合 C 子集)。该代理通过将转换构建为一个闭环生成-验证-诊断-修复过程来解决现有系统的局限性。它包含一个渐进式不匹配定位链来精确定位错误,以及一个带有自演进修复卡池的类型化查询、两阶段检索增强生成系统,在实验结果中表现优于当前最先进的模型。

  14. TOOL · CL_99842 ·

    AI代理通过新的“逆境沙盒”工具进行压力测试

    本文介绍了一个名为Agent Profiler的“逆境沙盒”,旨在针对现实世界的生产挑战对AI代理进行压力测试。该工具模拟瞬态错误、“懒惰代理陷阱”以保持专注,并验证抽象语法树(AST)匹配,以确保代理可靠运行。目标是通过主动测试其在模拟混乱中的自我恢复机制来构建生产就绪的代理。

  15. TOOL · CL_98912 ·

    Bag of Dims:揭示训练无关的 Transformer 可解释性方法

    研究人员开发了一种名为“Bag of Dims”的新方法,该方法实现了 Transformer 模型训练无关的机械可解释性。该方法将 Transformer 隐藏状态内的单个维度视为独立的寄存器,其中维度的符号表示语义内容,其幅度表示置信度。该框架已在语言、视觉和音频领域的各种模型中得到验证,证明仅符号模式就能以高精度预测下一个 token 准确率并检测语义类别。此外,实验表明这些特征具有因果作用,意味着可以通过操纵它们的符号来抑制模…

  16. TOOL · CL_92837 ·

    Claude Code技能DeepFork解析仓库设计,用于干净房间重建

    DeepFork是新推出的Claude Code技能,旨在帮助开发者理解开源仓库的底层设计原则,而不仅仅是代码。它分五个阶段进行:检查许可证兼容性,使用Graphify生成仓库结构的知识图谱,询问图谱以识别核心抽象和设计选择,创建干净房间重建的蓝图,最后提供一个排序的实现计划。该工具旨在通过明确记录其设计,使开发者能够从受人尊敬的库中学习,从而在不重复代码的情况下实现独立重新实现。

  17. TOOL · CL_38026 ·

    开发者发现 SymPy 的 parse_expr 函数存在 RCE 漏洞

    一位开发者在 `sympy.parse_expr` 函数中发现了一个关键的安全漏洞,如果未得到妥善保护,可能允许任意代码执行。该函数默认使用 Python 的 `eval()`,继承了 `os.system` 等内置函数,这些函数可以通过伪装成数学公式的恶意输入来触发。为了缓解此问题,开发者实现了一个抽象语法树 (AST) 验证层,在 `sympy` 处理输入之前预先过滤掉潜在的危险构造,确保只允许安全的数学运算。

  18. RESEARCH · CL_18303 ·

    大语言模型框架通过定制化提示词增强智能合约安全性

    研究人员开发了一个新的框架,利用大语言模型(LLMs)来检测智能合约中的漏洞。该方法采用特定漏洞的提示词和上下文提取,为各种安全缺陷创建定制化检测器。该框架在包含超过31,000个已标注漏洞实例的数据集上进行了测试,在识别潜在问题方面表现出高效率。

  19. TOOL · CL_15763 ·

    大语言模型通过生成和优化视觉模型代码来辅助神经架构搜索

    研究人员开发了一个新颖的框架,利用大语言模型(LLMs)自动搜索视觉模型中的最优通道配置。该方法将神经架构搜索视为条件代码生成任务,LLM根据性能反馈优化架构规范。为了克服数据稀缺性,该系统通过抽象语法树变异生成了有效架构的语料库,使LLM能够学习架构模式。在CIFAR-100上的实验表明,这种由LLM驱动的方法改进了初始架构种群,发现了非标准通道宽度等领域特定的设计模式。

  20. RESEARCH · CL_06612 ·

    LLM 研究解决函数调用和系统传播中的不确定性问题

    两篇新研究论文探讨了大型语言模型(LLM)中不确定性的关键问题。第一篇论文研究了专门针对 LLM 函数调用的不确定性量化方法,发现简单的单样本方法可以有效,并且可以通过分析输出来改进。第二篇论文解决了复杂 LLM 系统中的不确定性传播问题,提出了一个框架来理解错误如何在各种系统组件和过程中累积。