web page
PulseAugur coverage of web page — every cluster mentioning web page across labs, papers, and developer communities, ranked by signal.
3 天有情绪数据
-
网络抓取解释:工作原理、法律裁决及AI的影响
网络抓取,即从网页中提取数据以供重用的过程,在一系列帖子中得到解释。这些帖子详细介绍了抓取器的工作原理,包括获取和解析页面。讨论还涉及有关网络抓取的法律裁决,并强调人工智能如何增加了这项实践的重要性。
-
提示注入成为关键的AI安全威胁,其影响可与SQL注入相媲美
提示注入是一种漏洞,其中不受信任的数据被AI模型解释为指令,它正成为一种可与SQL注入相媲美的重大威胁。与主要导致数据泄露的SQL注入不同,提示注入可能使AI代理执行发送电子邮件、调用API或窃取敏感信息等操作。真正的危险在于间接注入,即恶意指令隐藏在PDF或网页等外部内容中,而由于自然语言处理的非结构化特性,目前的防御措施在很大程度上是无效的。
-
shot-scraper 工具新增 WebP 支持以减小图片文件大小
Simon Willison 发布了他 shot-scraper 工具的 1.12 版本,这是一个用于网站截图、视频演示和抓取的命令行工具。此次更新引入了对 WebP 图片格式的支持,该格式通常比 JPEG 或 PNG 文件尺寸更小。Willison 计划使用此新功能为他的 commit-rewriter 工具生成截图。
-
新研究对保持身份的面部压缩编解码器进行基准测试
一篇新研究论文探讨了将面部图像压缩到1千字节以下同时保持身份以用于身份证件和生物识别验证等应用所面临的挑战。该研究对十种通用和面部专用编解码器进行了基准测试,发现现代编解码器在1024字节时表现良好,但在512字节时会显著重新排序。开发了一种自定义学习编解码器,与AVIF、HEIF和JPEG XL等标准编解码器相比,在较低的字节预算下表现出更好的身份保持能力。
-
Recraft API 图像生成流程详解
本文详细介绍了使用 Recraft API 的图像生成过程,并强调 API 对生成图像的确认并非最终产品。文章概述了一个五阶段的流程:生成、存储、转换、UI 显示和下载,并指出只有第一阶段由 Recraft 处理。作者强调了在用户端验证图像属性的重要性,因为后续由用户基础设施管理的阶段可能会更改图像格式或元数据。
-
Calibre 9.12 电子书管理器新增 GIF 转 JPEG/WebP 转换功能
开源电子书管理器 Calibre 的最新版本 9.12 已发布。此次更新引入了一项新功能,允许用户将 GIF 图像转换为 JPEG 或 WebP 格式。此外,此次发布还包括对 Linux 二进制文件的改进和其他通用更改。
-
AI视频生成丢失色彩精度;开发者找到Alpha通道解决方案
一位AI开发者在从AI模型生成视频时遇到了色彩精度问题,特别是在尝试移除动画图块的背景时。标准的色度键控等方法失败了,导致了不希望出现的瑕疵。开发者通过利用原始静态PNG图像中的Alpha通道来遮罩动画帧,找到了一种更有效的解决方案,为背景移除提供了一种精确且确定的方法。
-
新的压缩技术旨在将面部识别图像压缩到1024字节以内
这篇研究论文探讨了将面部图像压缩到1024字节以下的方法,用于临时旅行证件,通过2D条形码实现机器可读性。研究评估了包括JPEG AI、AVIF和WebP在内的各种压缩格式,以及灰度转换、平滑和调整大小等预处理技术。JPEG AI通过优化设置,在高质量图像的面部识别性能方面表现最佳,而AVIF和WebP也取得了良好的结果。研究结果表明,在识别精度损失最小的情况下,可以实现显著的压缩。
-
新的压缩方法旨在使旅行证件中的面部图像小于1KB
一篇新的研究论文探讨了将面部图像压缩到1024字节以下的方法,用于临时旅行证件,目标是通过2D条形码实现机器可读性。该研究评估了包括JPEG、JPEG 2000、JPEG XL、JPEG AI、HEIF、AVIF和WebP在内的各种压缩格式,以及灰度转换、平滑和调整大小等预处理技术。结果表明,经过优化的JPEG AI在面部识别方面表现最佳,尤其是在高质量图像方面,AVIF和WebP也显示出有希望的结果。
-
研究探讨使用AI过滤低可访问性网页
研究人员开发了一项关于自动过滤低可访问性网页(特别是针对色觉缺陷)的可行性研究。他们的预测模型在识别此类网页时取得了0.76的最大曲线下面积(AUC)。这项工作旨在通过纳入色彩普遍性设计(CUD)原则来增强网页的可访问性。
-
新基准测试大语言模型在短信到网页欺诈检测方面的能力
研究人员推出 FraudSMSWalker,这是一个新的基准,旨在评估代理式大语言模型在检测将用户引导至恶意网页的短信欺诈方面的能力。该基准会隐藏 URL 和其他信誉快捷方式,迫使模型仅依靠短信内容和经过净化的网页证据来做出欺诈判断。初步评估显示,尽管当前的代理模型可以识别一些可疑线索,但它们在保持良性案例的准确性方面存在困难,并且经常基于薄弱的证据做出预测。
-
AI代理易受网页指令劫持攻击
一位安全研究员演示了AI代理如何轻易地被诱骗执行嵌入在网页中的恶意指令。通过在网页页脚中包含隐藏的命令,可以提示代理忽略其原始指令,并将敏感信息(如API凭证)发送给攻击者。虽然明确的“忽略先前指令”命令是可检测的,但更微妙、含蓄的指令对当前AI代理架构来说,正构成一个更严峻且未解决的安全挑战。
-
发布新的网页内容提取基准数据集
研究人员发布了网页内容提取基准(WCXB)数据集,旨在改进用于从网页中提取主要内容的系统的评估。WCXB数据集包含来自1613个域的2008个网页,涵盖了新闻文章之外的七种不同页面类型。在此基准上的评估显示,提取系统在性能上存在显著差异,尤其是在结构化页面类型上,突显了现有以文章为中心的基准的局限性。