Bash
PulseAugur coverage of Bash — every cluster mentioning Bash across labs, papers, and developer communities, ranked by signal.
13 天有情绪数据
-
Claude Code 2.1.233 为 Bash 工具命令添加 Linux 内存限制
Claude Code 2.1.233 为 Linux 环境引入了一项可选功能,允许开发者为 Bash 工具命令设置内存限制。此功能通过 CLAUDE_CODE_TOOL_MEMORY_LIMIT 环境变量控制,旨在防止诸如构建或测试等资源密集型操作压垮整个系统。该功能专为原生 Linux 和 WSL 用户设计,特别是那些在内存有限的机器上工作的用户,并包含了一个详细的工作流程来验证其正确实现和有效性。
-
新研究揭示大型语言模型编码代理隐藏命令失败
一篇新研究论文介绍了一种名为 QuoteBench 的方法,用于评估大型语言模型(LLM)编码代理,区分命令生成错误和执行传输过程中引入的失败。研究强调,标准的匹配执行分数可能会掩盖重大的命令路径失败。QuoteBench 使用跨各种配置的精确最终状态验证,揭示了尽管原始生成能力已接近极限,但适应执行边界对于模型性能至关重要。例如,GPT-5.6 "Sol" 显示匹配差距很小,但在执行传输方面遭受了重大损坏和补偿。
-
QuoteBench评估揭示LLM编码代理的失败
一个名为QuoteBench的新评估框架已被开发出来,以解决大型语言模型(LLM)编码代理的故障。QuoteBench强调,执行边界解析错误会严重影响LLM的性能,披露这些边界有助于恢复准确性。该框架通过验证56个任务的最终状态来衡量这些问题,揭示部署配置可以重新排序模型性能排名。
-
Claude Code 通过 SonarLint CLI 集成实现 SAST 修复自动化
通过将 SonarLint CLI 集成到 Claude Code 中,开发人员可以自动化静态分析违规的修复。这种方法涉及从 SonarLint 生成 SARIF 报告,然后将其输入到无头 Claude Code 循环中,后者根据特定规则确定性地修复代码问题。该过程包括通过本地编译和测试检查来验证修复,以确保代码质量并防止回归。
-
新的工具 PolicyApprovalGate 为 AI 代码生成命令添加了安全检查
一个名为 PolicyApprovalGate 的新开源工具已被开发出来,以增强 Claude Code 和 Codex CLI 等 AI 代码生成工具的安全性。该工具充当 PreToolUse hook,实施确定性的、基于规则的策略,在执行潜在危险的 Bash 命令之前,要么拒绝执行,要么要求确认。它的创建是为了回应人们的担忧,即 AI 指令(如 CLAUDE.md 中的指令)并不总是严格执行,尤其是在自动模式下。
-
QPDF 12.4.0 更新了 zsh 和 bash 的 Shell 自动补全功能
QPDF 命令行工具发布了 12.4.0 版本,其 zsh 和 bash Shell 自动补全功能已完全重写。此次对开源软件库和 CLI 工具的更新,旨在增强用户交互和 PDF 处理任务的命令行效率。
-
新的防护工具可防止Claude Code泄露秘密
一位开发者创建了一个名为 `claude-code-guardrails` 的开源工具,以解决Anthropic的Claude Code助手无意中泄露敏感信息的问题。该工具包含一个 `deny-secrets` 钩子,可以拦截并阻止试图访问或打印 `.env` 或 `.pgpass` 等秘密文件的Bash命令。此外,一个 `session-heartbeat` 钩子会监控长会话中的上下文退化,充当一个警报器,在Claude可能开始产生…
-
Mini-SWE-agent 在调试基准测试中表现出潜力,使用的 token 比 GPT-5.6 少
一位用户进行了一项基准测试,将 mini-swe-agent 与 GPT-5.6 "Sol" 进行了调试任务的比较。mini-swe-agent,特别是当使用 "bash + linear history" 设置时,其通过率显著提高,并且使用的 token 比 Codex CLI High 少。尽管承认单个基准测试切片的局限性,但用户认为这些结果对于日常 bug 修复很有希望,并寻求社区对该工具的使用经验。
-
Slack 用户称新 AI 工具比 curl | bash 更糟糕
一位 Mastodon 用户分享了 Slack 上的一条评论,称一款新工具或技术比 curl 和 bash 的组合更“糟糕”。该评论发布在与 AI、SRE 和 DevOps 相关的讨论中。
-
Claude Code 升级为三层代理系统,权限增强
Claude Code 代理技能存储库的开发者已将其更新为三层系统,并将其重命名为 nasrulhazim/claude。此次升级解决了之前基于技能的方法遇到的限制,特别是在区分代码审查和代码修改方面,并实现了跨多个项目的重复任务的扇出。新结构采用了精简的代理,将技能作为其剧本加载,代理具有定义的工具权限,以防止在审查期间进行代码修改等意外操作。更新包括一个用于无缝升级的安装脚本,并将技能集扩展到 29 个,其中 20 个代理涵盖了软…
-
Claude Code 代理模式绕过 Bash 安全过滤器
根据对其文档和社区开发的 Telegram 桥接器的分析,Claude Code 的代理模式会绕过内置的 Bash 命令安全过滤器。虽然“危险的 Bash 模式”过滤器在安全参考中有所描述,但它仅在“经典模式”下激活,而在通常用于部署的代理模式下则不激活。这意味着 Bash 命令在没有此拦截的情况下执行,而是依赖于操作系统沙箱和 Claude Code 的权限规则。该过滤器的实际替代方案是 PreToolUse 钩子,它可以阻止命令在…
-
AI 编码助手因安全薄弱、令牌使用效率低下而存在缺陷
对 AI 编码助手(以 OpenCode 为例)的批评指出了其严重的安全性问题和性能缺陷。作者认为,依赖基于文本的命令过滤来保证安全是根本上有缺陷的,因为恶意命令可以通过各种执行方式(如通过 Bash 管道或通过 Python 调用)进行伪装。相反,作者提倡使用操作系统机制(如 Linux 的 Landlock 或 macOS 的 Seatbelt)强制执行基于能力的安全性,该机制限制进程对文件的访问,而不是试图识别危险的语法。
-
macOS 上的 Claude Code Hook 脚本因 Z shell、PATH 和缺少 timeout 命令而面临静默失败
一份技术指南详细介绍了在 macOS 上为 Claude Code 开发 Hook 脚本时遇到的三个常见陷阱。第一个陷阱涉及 Z shell 中的 `status` 变量,它是一个只读的特殊变量,无法重新赋值,导致静默失败。第二个问题出现的原因是,从 GUI 启动的 Hook 具有最小化的 PATH,导致像 Nvm 或 Homebrew 的 `node` 命令无法识别。第三个陷阱强调 macOS 默认不包含 GNU `timeout`…
-
开发者使用 Bash 脚本自动生成 Claude Code 代理索引
一位开发者创建了一个名为 `agents-index.sh` 的 Bash 脚本,该脚本可自动为自定义 Claude Code 代理生成 `INDEX.md` 文件。该脚本解决了手动维护索引的问题,因为随着代理的添加或修改,索引通常会过时。生成的索引列出了代理名称、其关联的 Claude 模型(Opus、Sonnet、Haiku)、描述和允许的工具,从而清晰地概述了用户的代理设置。该脚本嵌入了一个 Python 解析器来处理 fron…
-
新的Docker工具可实现对Anthropic的Claude Code的安全、完全权限访问
一款名为claude-docker的新型Docker工具已发布,允许用户在沙盒容器内以完全权限运行Anthropic的Claude Code。此设置通过将模型访问限制在已挂载的项目目录及其自身的容器环境中,从而增强了安全性,并降低了其“dangerously-skip-permissions”模式带来的风险。该工具提供了两个shell别名:`claude-docker`用于直接执行,`claude-docker-sh`用于交互式she…
-
开发者 Clew 工具发现 AI Agent 间隙而非 Claude Code 导致 token 浪费
一位开发者创建了一个名为 Clew 的工具,用于识别 AI Agent 交互中浪费的 token,特别关注 Claude Code。通过使用公共追踪数据的六轮测量,开发者发现 Claude Code 本身并不是浪费的主要来源。相反,低效似乎源于 Agent 之间的间隙,信息可能在此处被重复或丢失。Clew 采用确定性门控,通过节点和归一化输入对分组跨度进行比较,并要求输出的 SHA256 哈希值相同来检测冗余,在其检测过程中避免使用 LLM。
-
Ralph loops 通过文件系统为 AI 代理提供持久状态管理
Ralph loop 是一种用于长期运行的 AI 代理的技术,它将状态保存在文件系统中,而不是累积在模型的上下文窗口内。这种方法旨在缓解随着上下文长度增加而出现的性能下降问题,研究表明模型在处理长输入中间的信息时表现不佳,这支持了该现象。虽然核心思想是通过将持久状态卸载到磁盘来保持工作上下文的小巧和干净,但这种方法会产生与文件系统操作相关的成本,以及潜在的计算费用增加。
-
Reelier 通过零 token 重放实现确定性 AI 代理工作流程
Reelier 是一款旨在解决 AI 代理工作流程效率低下和不确定性问题的新工具。它允许用户记录代理任务的一次成功执行,然后使用零 token 确定性地重放它。通过将记录的会话编译成 SKILL.md 文件,这种方法实现了与 UI 测试类似的 AI 代理快照测试。Reelier 的基准测试显示出显著的速度提升,与代理的原始 token 计费执行时间相比,重放任务只需几毫秒,同时确保记录步骤的结果逐字节相同。
-
开源编码代理 OpenCode 在隔离沙箱中安全运行
OpenCode 是一款类似于 Claude Code 的开源编码代理,它提供完整的 shell 访问权限,这带来了潜在风险。作者详细介绍了一种安全运行 OpenCode 的方法,即将它的命令隔离在 Tensorlake 提供的临时沙箱环境中。这种方法可以减轻意外或有害的 shell 命令影响用户本地机器或关键项目的危险。
-
Anthropic 发布 Claude Code 2.1.216,新增沙盒安全选项
Anthropic 发布了 Claude Code v2.1.216,引入了新的 `sandbox.filesystem.disabled` 选项,允许用户在保持网络控制的同时绕过文件系统隔离。此次更新还解决了与 worktree 隔离的子代理、符号链接路径以及恢复的后台代理限制相关的若干安全漏洞。该版本强调,只有当外部层(如容器或虚拟机)已提供隔离时,才应禁用文件系统隔离,并建议对新版本进行严格的测试和逐步推广。