DeepSeek R2
PulseAugur coverage of DeepSeek R2 — every cluster mentioning DeepSeek R2 across labs, papers, and developer communities, ranked by signal.
- 2026-08-31 product_launch Didi Autonomous Driving launched its next-generation Robotaxi, the R2, for passenger testing. 来源
- 2026-06-09 product_launch Rivian launched its new R2 SUV, a smaller and more affordable model than its R1 series. 来源
- 2026-05-29 product_launch Rivian's R2 electric SUV launches with initial deliveries and demo drives on June 9. 来源
4 天有情绪数据
-
Rivian R2 销量激增;苹果准备推出‘homeOS’
Rivian 报告了强劲的第三季度生产和交付数据,表明其 R2 车型开始达到预期。与此同时,据传苹果公司正准备在 10 月 13 日推出新款 Home 产品和一款可能命名为‘homeOS’的全新操作系统。
-
ResolveHQ 帮助台在 Cloudflare Workers 上线
ResolveHQ 是一款使用 Cloudflare 无服务器计算平台构建的新帮助台应用程序。它利用 Cloudflare Workers 进行执行,D1 进行数据库管理,R2 进行对象存储,以及 Queues 进行异步任务处理。该项目是开源的,可在 GitHub 上找到,由用户 mirza-rizvi 开发。
-
新的SCCM框架可自动检测和适应在线回归中的漂移
研究人员推出了一种新的流式巡航控制方法(SCCM)框架,该框架旨在自动检测和适应在线回归模型中的概念漂移。SCCM采用早期响应漂移检测,量化漂移幅度,并使用基于KPI窗口的阈值来减少误报。它还具有动态超参数调整和模型重新校准功能,并采用内存设计以实现实时适应性。在合成和真实世界数据集上的评估表明,与现有基线相比,其预测性能得到了改善,并且漂移处理有效。
-
桌面环境发布 0.1.6 破坏了 Windows 更新
最近一次桌面环境发布,版本号为 0.1.6,在发布了一个签名的 macOS 构建后,Windows 更新机制出现问题。问题源于更新过程优先考虑特定的 Windows 构建格式,而在仅限 Darwin 的频道中找不到它们,导致 Windows 用户更新检查失败。开发人员实施了多项修复,包括为 Windows 构建格式设置别名以及确保平台合并的版本匹配,以防止将来再次发生此类问题,并提高 Windows 和 macOS 的更新可靠性。
-
滴滴自动驾驶推出下一代Robotaxi R2进行载人测试
滴滴自动驾驶已在北京和广州部分地区推出其下一代Robotaxi R2,用于载人测试。这款与广汽埃安合作的新车型,拥有升级的自动驾驶能力和增强的乘客体验,包括大型车载屏幕和AI语音交互。R2经过了严格测试,并配备了先进的传感器和安全系统,以提供智能便捷的出行服务。
-
扫描 9,248 个 MCP 服务器:揭示广泛的安全漏洞和信任缺失
对 9,248 个 Model Context Protocol (MCP) 服务器进行的安全性审计揭示了重大的漏洞和最佳实践的缺失。审计发现,0.3% 的服务器试图访问敏感文件,11% 表现出未记录的网络流量,23% 声明了不存在的工具。此外,64% 缺乏可识别的发布者,89% 未提供软件物料清单 (SBOM),许多“零问题”的服务器用户很少或没有用户,这表明缺乏积极维护。这些发现突显了 MCP 生态系统中的“狂野西部”环境,敦促用…
-
新研究将数据可预测性与 Transformer 权重缩放联系起来
一篇新的研究论文提出,训练过的 Transformer 中的权重幅度可以用韦伯分布来描述。该研究确定了一个预训练统计量,即二元语法条件熵,作为该分布尺度参数增长的关键预测因子。这一预测定律适用于各种学习率和模型架构,表明数据可预测性与训练过程中模型权重缩放之间存在基本关系。
-
LLM 存储延迟容忍度随 GPU 利用率阶梯式变化
LLM 推理的存储延迟容忍度并非随 GPU 利用率线性下降,而是以阶梯状方式变化。在较高的 GPU 利用率水平(约 90%)下,计算队列饱和,存储延迟成为关键瓶颈。这需要稳定、低延迟的存储响应,而不仅仅是高带宽,以避免 GPU 空闲时间并维持有效的计算。例如,使用 Mingxin FX100 和 480B 模型,增加并发性显著提高了首次令牌生成时间,凸显了存储性能在高利用率 AI 工作负载中的重要性。
-
MaaS 单元经济学:折扣和延迟侵蚀净收入
模型即服务 (MaaS) 的真实成本并非由标价决定,而是由折扣和效率低下后的净收入决定,其中折扣链和存储延迟是关键因素。存储延迟,尤其是在长上下文推理中,会显著降低 GPU 利用率高达 30%,影响吞吐量并增加净成本。优化 MaaS 单元经济学需要将重点从简单地购买更便宜的 GPU 转移到最大化现有硬件的吞吐量,并考虑计算、存储和网络性能的相互作用。
-
Cloudflare 被指控悄悄注入分析代码
据报道,Cloudflare 在未经明确同意的情况下,将其分析 JavaScript 代码段注入用户网站。一位用户在将名称服务器切换到 Cloudflare 以便为其子域启用 R2 存储桶服务时发现了这一做法。该用户发现,他们原本只有 HTML、没有 JavaScript 的网站被插入了分析代码,而这是他们未曾同意的。
-
Cloudflare 发布 AI Agent 功能和集成
Cloudflare 近期举办了“Agents Week”活动,推出多项与 AI 相关的新功能和服务。这些进展包括增强 Workers AI 的向量化能力,引入 Honor D1 模型,以及支持 DeepSeek R2。该公司还强调了与 OpenAI、Mistral AI、Google 和 Meta 等领先 AI 模型的集成,旨在加强其 AI Agent 开发平台。
-
AI应用开发者通过Redis支持的分层感知队列优化LLM并发
一位开发者详细介绍了他们如何通过为LLM请求实现分层感知队列系统来提高其AI伴侣应用的性能。最初使用全局asyncio.Semaphore的方法导致免费层用户在高峰时段造成付费用户长时间等待。修改后的解决方案利用Redis和Lua脚本,强制执行全局和每层限制,确保付费用户即使在高流量期间也能通过预留LLM槽位来体验更低的延迟。
-
明玕 FX100 通过 KV Cache 复用提升 LLM 推理性能 · 追踪 2 个来源
明玕 FX100 在大型语言模型的多轮对话场景中展现了显著的性能提升。通过实施 KV Cache 复用策略(即将先前对话轮次的键值张量缓存起来,避免重新计算),该系统实现了 29-40% 的吞吐量提升和 26-32% 的首个 token 时间缩减。这些提升在冷启动或冷恢复情况下尤为显著,与重新计算整个历史记录的基线相比,系统可以将推理速度提高高达 20 倍。
-
Cloudflare 通过跨语言 RPC 和使用量 API 增强开发者工具
Cloudflare 推出了两项旨在改善开发者体验和成本管理的新功能。第一项是 Workers RPC,它允许在 Python 和 JavaScript 之间直接进行跨语言方法调用,无需序列化或模式定义。第二项是可计费使用量 API,提供对 Workers、R2 和 AI 等服务的成本数据的程序化访问,并提供每日更新。
-
明心科技通过优化模型切换将GPU利用率提升16%
明心科技通过解决模型切换和冷启动延迟问题,显著提高了GPU计算利用率。通过分层KV Cache加速、并行读优化和端到端负载加速这三个优化步骤,他们将有效计算利用率从46.7%提高到62.8%。这些优化在AMD MI308X和华为Atlas 910B平台上进行了测试,缩短了首次令牌生成时间和模型加载时间,从而释放了现有计算基础设施的更多潜力。
-
Rivian 推出 R2 电动汽车,以 45,000 美元的价格扩大市场
Rivian 推出了其新款 R2 电动汽车,其价格比旗舰 R1 型号更实惠,起售价约为 45,000 美元。R2 旨在通过提供一款更小、更具成本效益的车型来增加 Rivian 的销量,该车型保留了该品牌的核心设计理念和周到的方法。分析师认为 R2 对 Rivian 的增长和财务稳定至关重要,尽管电动汽车市场充满挑战,受到联邦税收抵免到期和消费者需求变化等因素的影响。
-
加州为首次购车者提供 3,500 美元电动汽车回扣
加州正在启动 MyFirstEV 项目,为首次购买电动汽车的买家提供高达 3,500 美元的即时回扣。该计划是清洁交通领域 6 亿美元投资的一部分,旨在提高电动汽车的可及性。该计划包括对新电动汽车和二手电动汽车的回扣,并对参与者有特定的价格上限和资格要求。
-
利用执行时间改进Java方法能耗预测
arXiv上发表的一项新研究探讨了Java方法能耗的预测。研究人员发现,仅靠静态代码指标是能耗的糟糕预测因子,R2值接近于零。然而,将方法执行时间作为动态输入显著提高了准确性,R2值高达0.46。研究确定执行时间、内部方法调用和圈复杂度是预测能耗最有影响力的因素。
-
AI 代理预演失败导致生产数据泄露
一名开发者在 AI 代理的预演测试未能预测到真实世界的执行情况后,遭遇了生产事故。环境漂移和代理的非确定性行为导致了数据泄露,造成了四小时的回滚。该开发者实施了一项修复,将预演标志传播到单个代理运行中的所有写入操作,并建议为钩子失败设置单独的警报,以防止类似问题发生。
-
多目标优化子集选择被证明在三个目标时是NP-难的
研究人员发现,从多目标优化帕累托前沿中选择代表性点对于三个目标来说是NP-难的。然而,他们也证明了积分R2指标(帕累托前沿质量的度量)是一个单调次模集函数。这一特性允许使用贪婪近似算法,该算法可以实现最大可能R2差距的至少(1-1/e)的比例。该研究还提供了这种贪婪方法的实现,其最坏情况运行时间为O(n^6)。