Transmission Control Protocol
PulseAugur coverage of Transmission Control Protocol — every cluster mentioning Transmission Control Protocol across labs, papers, and developer communities, ranked by signal.
4 天有情绪数据
-
苏格兰场因俄罗斯关联及人工智能安全担忧暂停使用窃听软件
伦敦警察厅因对潜在的俄罗斯关联表示担忧而暂停使用窃听软件。此决定是在更广泛的人工智能安全和网络协议讨论背景下做出的,斯坦福大学的一位教授主张采用一种新协议来取代TCP,华为的一位高管声称其本土人工智能芯片在中国的销量超过了Nvidia。此外,还出现了新的人工智能安全威胁,包括自我复制的提示注入和伪装成Signal支持的网络钓鱼攻击。
-
华为AI芯片在中国销量超过英伟达;为AI时代推出新网络协议 · 跟踪1个来源
多个AI相关进展正在不同领域涌现。华为声称其国产AI芯片在中国销量超过英伟达,尽管它们可能技术不那么先进。研究人员正在提出Homa,一种旨在取代TCP以适应AI时代的新协议,旨在提高网络效率。此外,一个名为“America”的新聊天机器人已推出,据报道它提供有关7月4日食品的信息。人们也越来越担心自我复制的提示注入,这是一种AI风格的蠕虫攻击。
-
斯坦福大学提出新的以 AI 为中心的网络协议;Meta 扩展企业 AI
斯坦福大学研究人员开发了一种名为 Homa 的新网络协议,旨在通过优化以满足现代 AI 工作负载的需求来取代 TCP。另外,Meta 正通过一个由前 MongoDB 首席执行官 'CJ' Desai 领导的新业务部门,扩展其企业 AI 业务。在中国,华为声称其国产 AI 芯片销量超过了英伟达,尽管技术不如后者先进,但这是因为它们规避了出口限制。
-
负载均衡器难以满足 LLM 服务需求,'llm-d' 提供解决方案
本文深入探讨了在容器化环境(如 Kubernetes)中使用负载均衡器为大型语言模型 (LLM) 提供服务所面临的挑战。文章强调,传统的负载均衡解决方案,如 nginx、Envoy 和 HAProxy,在处理 LLM 推理的独特需求时可能会失败,而 LLM 推理通常涉及长时间运行、有状态的连接。文章介绍了 'llm-d' 作为解决这些特定 MLOps 挑战的潜在方案。
-
开发者调查HTTP MCP客户端连接检查中的25秒网络延迟
一位开发者正在调查一个奇怪的网络问题,其中一些HTTP MCP客户端执行快速连接检查,在不到一秒钟内建立TCP/TLS连接,然后神秘地暂停约25秒才继续。这种在未发送任何应用程序数据期间观察到的延迟,表明存在客户端逻辑问题,例如固定计时器或未能传输的探测。开发者建议在没有服务器访问权限的情况下隔离此问题的方法,包括测量连接日志和第一个应用程序字节之间的时间,以及检查停顿期间是否存在特定的HTTP/2传输。
-
新型神经路由算法LOGGIA模拟网络延迟
研究人员开发了LOGGIA,一种新颖的神经路由算法,专为计算机网络的近乎实时遥测感知路由而设计。该算法显式地模拟通信和推理延迟,解决了先前神经方法中存在的局限性,这些方法假设不切实际的无延迟全局状态或将路由器限制在本地遥测。LOGGIA利用数据驱动的预训练阶段,然后进行强化学习,在具有未见流量序列的合成和真实网络拓扑上,持续优于传统的 shortest-path 基线。实验表明,LOGGIA在本地部署于每个路由器时表现最佳,而不是通过集中式决策。
-
LLM API 调用误区:HTTP 200 不代表完成
本文揭穿了关于大型语言模型 (LLM) API 调用的五个常见误区,强调 HTTP 200 状态码并不能保证完成的思考或响应。文章指出,开发者应检查响应体中的 `finish_reason` 和 `choices` 等特定字段,以确定 LLM 输出的实际状态,而不是仅仅依赖 HTTP 状态。文章建议将空内容视为一种结果类型,不一定代表中断,并提出截断通常是预算或续写问题,而非仅是提示质量问题。最后,文章强调即使在免费模型层级也执行这些…
-
Microsoft 详细介绍用于 Azure 数据中心的 Maia 200 AI 加速器
Microsoft 详细介绍了其为 Azure 数据中心设计的 Maia 200 AI 加速器。这款基于台积电 3nm 工艺的第二代芯片,TDP 为 750W,并采用软件定义本地访问 (SDLA) 架构实现确定性数据流。Maia 200 包含一个具有 L1 和 L2 缓存的分层内存结构,以及一个具有硬件恢复机制以提高可靠性的定制网络互连。Microsoft 强调了该芯片在负载均衡方面的重点,以及其扩展到大型域的能力,提供 10,000…
-
开发者将LLM API空响应错误隔离到陈旧的TCP连接
一位开发者遇到了LLM API持续返回空响应的问题,最初怀疑是模型本身的问题。经过广泛的故障排除,根本原因被确定为陈旧的TCP连接、终止空闲连接的VPN代理以及掩盖错误的过于宽泛的异常处理程序的组合。通过为每个请求实现新的HTTP连接并改进异常处理以专门捕获和报告与连接相关的失败来解决此问题。
-
使用 Node.js 为免费 LLM 端点构建可验证缓存
本教程演示了如何使用 Node.js 为免费 LLM 端点构建可验证缓存。缓存层通过存储响应并从内存中提供服务来防止重复请求产生额外费用。它使用请求方法、URL 和原始主体的 SHA-256 哈希作为缓存键。该实现包括一个最小的 HTTP 转发器、一个具有生存时间 (TTL) 的内存缓存以及一个用于跟踪缓存命中和未命中的统计信息端点。
-
CipherSight框架提升HTTPS网站指纹识别准确性
研究人员开发了CipherSight,一个旨在提高加密HTTPS流量网站指纹识别准确性和鲁棒性的新框架。与依赖原始数据包序列的先前方法不同,CipherSight利用TLS记录及其属性来构建更稳定的网站表示。该系统包含一个分层架构和一个掩码记录建模任务,以捕获上下文语义,并结合记录-资源注释以增强监督。这种方法在存在分布变化和大量网站类别的实际场景中显著提高了性能。
-
AI 编码助手方法促进基于模拟的学习
一位开发者提出了一种使用 Claude Code 等 AI 编码助手学习复杂主题的四步方法。该方法强调构建交互式模拟,而不是仅仅依赖文本解释。这个过程包括编写详细的规范、事实核查 AI 对常数和规则的理解、构建模拟,最后公开部署。强调的关键步骤是事实核查阶段,它确保在构建模拟之前准确无误,从而防止学习错误信息。
-
PostgreSQL MCP连接失败需要在重试前捕获证据
当遇到PostgreSQL MCP连接失败时,在重试之前,首先捕获一个全面的证据包至关重要。该包应包括有关环境、凭据、DNS解析、TCP和TLS结果以及PostgreSQL特定错误代码的详细信息。对失败层(如配置、DNS、TCP、TLS、身份验证、授权、模式、池或语句执行)进行分类对于有效故障排除至关重要。瞬时故障应使用退避和抖动进行重试,而不应重试无效凭据或授权拒绝等非瞬时问题。
-
Cloudflare Workers 和 Containers 新增低延迟 TCP 和 gRPC 支持
Cloudflare 已在其 Workers 和 Containers 服务中引入了对入站传输控制协议 (TCP) 和 gRPC 的支持。此增强旨在促进应用程序的低延迟通信。此新功能目前提供私有测试版。
-
新型优化器SAMPLe增强了VLM提示学习的泛化能力
研究人员开发了SAMPLe,这是一种新颖的优化器,旨在提高视觉语言模型(VLM)提示学习的泛化能力。该新方法通过采用锐度感知优化来解决性能-泛化困境,以考虑损失景观的锐度,从而减少对训练数据的过拟合。SAMPLe已被集成到各种提示学习框架中,包括CoOp和MaPLe,并在各种设置中展示了优于现有优化器的性能。
-
新框架助力构建中国传统绘画的结构化表征
研究人员开发了VisTCP,一个新颖的可视化框架,旨在创建中国传统绘画(TCPs)的知识图谱式表征。该框架结合了面向TCP的智能模型和专家知识,旨在增强这些艺术品的语义理解,以用于考古学和艺术史研究。VisTCP允许艺术史学家以“人在回路”的方式生成可信的结构化表征,可视化模型的不确定性,并通过专家反馈实现迭代优化。
-
eBPF 套接字转向扩展了用于 HTTP/3 连接迁移的 QUIC 入口
本文详细介绍了如何扩展 QUIC 入口以支持 HTTP/3 连接迁移,这是客户端更改 IP 地址时出现的挑战。传统的 UDP 代理依赖于客户端 IP 和端口的哈希,当客户端 IP 更改时会失败,导致数据包丢失。解决方案是使用 eBPF(扩展 Berkeley 数据包过滤器)在内核级别转向 QUIC 连接,使其即使在客户端网络路径发生变化时也能保持连接。这种方法利用了 Linux 内核功能,并被提出作为对简单 UDP 代理部署的修复。
-
作者认为代理运行时需要会话状态以提高可靠性
作者认为当前的代理运行时存在根本性的协议故障,将缺乏会话状态比作没有状态机的 TCP 连接。这导致在工具失败、上下文溢出或推理被污染时,用户成为重试协议。为解决此问题,作者提出了一种会话状态基础设施,包含类型化的状态结构、用于状态更改的提交日志以及用于显示轮次之间变化内容的差异检查。这将使代理能够通过工程化解决方案来更稳健地处理故障,而不是依赖用户干预。
-
Modal 推出超低延迟服务器,适用于高性能应用
Modal 推出了名为 Modal Servers 的新功能,旨在为需要高性能的应用(如交互式代理的 LLM 推理)提供超低延迟服务器托管。这项新产品利用了一个由流式边缘代理、智能无状态代理和计算负载均衡器组成的路由层,该层构建在 Pingora、Envoy 和 Spanner 等技术之上。与提供类似 TCP 的内置可靠性功能的 Modal Web Functions 不同,Modal Servers 针对速度进行了优化,其运行方式更…
-
Pilot Protocol 为代理提供专用会话层,改进 MCP 工具使用
一种名为 Pilot 的新协议正在出现,以解决当前代理通信堆栈的局限性,特别是对于 MCP 等工具。虽然 MCP 在应用程序层方面擅长将工具暴露给 LLM,但它依赖于传统网络的 TCP/HTTP 基础设施,这对于机器到机器的通信效率低下。Pilot 插入到会话层(L5),为代理提供专用网络,具有唯一寻址、加密的对等连接以及通过使用 UDP 而非 TCP 来实现更快的数据检索等功能。