Luna
PulseAugur coverage of Luna — every cluster mentioning Luna across labs, papers, and developer communities, ranked by signal.
- instance of Sol 90%
- used by Sol 90%
- instance of GPT-5.6 90%
- instance of GPT 5.6 "Sol" 90%
- instance of An Ape and a Fox 90%
- instance of ChatGPT Work 90%
- instance of Muse Spark 1.1 90%
- uses Decisions API 90%
- used by Amazon Prime Video 90%
- developed by Decisions API 90%
- used by TerminalBench 2.1 90%
- used by Amazon Fire TV 90%
- 2026-09-16 product_launch Meta is developing a new smart glasses model, Luna, that will omit cameras and focus on AI integration. 来源
- 2026-09-16 product_launch Meta is reportedly planning to launch new smart glasses called Luna, which will not feature cameras. 来源
- 2026-08-12 product_launch OpenAI announced free access to its Luna AI model. 来源
- 2026-07-30 product_launch OpenAI announced significant price reductions for its Luna model, alongside performance enhancements for Sol and price adjustments for Terra. 来源
- 2026-06-11 product_launch Insta360 has launched its new pocket gimbal camera, the Luna, featuring AI enhancements and a collaboration with Leica. 来源
18 天有情绪数据
-
LegalOn 通过战略性模型匹配将 Codex 成本减半
LegalOn 在使用 OpenAI 的 Codex 的日常成本方面成功降低了 65%,同时保持了其开发速度。该公司通过将特定任务战略性地匹配到不同的 Codex 模型(包括 Astra、Sol 和 Luna)以及实施严格的预算管理来实现这一目标。
-
AI 模型速度测试:Haiku 5.5、DeepSeek Flash、Luna、Gemini 3.8 Flash 质量相似
一位用户对四款 AI 模型进行了比较测试:Haiku 5.5、Luna、DeepSeek Flash 和 Gemini 3.8 Flash,评估它们在编码、错误修复、SQL 和文档分析等一系列任务上的表现。结果显示,总体质量接近持平,DeepSeek Flash 得分最高,为 86.6,紧随其后的是 Luna (85.2)、Gemini 3.8 Flash (85.1) 和 Haiku 5.5 (84.7)。在速度和特定任务表现方面出…
-
ChatGPT Windows应用程序bug:显示GPT-5.6 Sol,缺少功能
一位用户在使用ChatGPT Windows 11应用程序时遇到了一个视觉bug,该应用程序显示“GPT-5.6 Sol”而不是预期的“Luna”模型。该应用程序还缺少网页版本中存在的“思考切换”按钮。用户正在寻找有关如何以及在何处向OpenAI报告此bug的信息,并对尽管应用程序频繁更新仍存在此类问题表示惊讶。
-
AI代理通过Ouroboros系统递归地改进代码库
Daniel Krydynski开发了Ouroboros,一个开源系统,使AI代理能够通过递归开发循环持续改进代码库。该系统构建在Nous Research的Hermes代理工具之上,包含五个阶段:侦察工作、创建工单、在一次性工作树中实现更改、审查建议的代码,最后将批准的更改合并到主存储库。核心原则是该工具从不信任代理,在任何合并发生之前都需要测试通过并获得人工审查员的批准,从而确保安全和控制。
-
中国人工智能竞赛面临“模型疲劳”:快速升级与激烈竞争 · 跟踪1个来源
中国人工智能模型的快速发展,以频繁的升级和降价为标志,正导致“模型疲劳”,即新发布的产品难以获得关注。这种现象在小米、DeepSeek、腾讯、阿里巴巴和月之暗面等主要参与者中尤为明显,它们以前所未有的速度推出新模型。这种激烈的竞争,例如Anthropic和OpenAI在同一天同时发布重大更新,使得个别人工智能的进步越来越难以脱颖而出并吸引市场兴趣。
-
AI 模型价格战升温,GPT-6 Luna 和 Opus 5.5 降价
AI 模型市场出现价格战,主要模型宣布大幅降价。GPT-6 Luna 的定价是其前代 Luna 的一半。此外,Opus 5.5 的价格下降了 20%。
-
扑克联盟中的AI模型有33%的时间会亮出底牌,受过往比赛记录影响 · 追踪到1个来源
一个AI Hold'em League,其中包括GPT-6 Luna、Minimax M3、Claude Haiku-4-5、Gemini 3.8 Flash和Qwen 3.7 Plus等模型,旨在测试AI模型在被提示时是否会虚张声势或亮出底牌。对170场比赛中1349条声明的分析显示,有441条声明(33%)披露了模型的两张底牌,其中436条是准确的。模型尤其容易在被提供过往比赛记录后亮出底牌,这表明观察对手过往的声明会影响其自身的披露行为。
-
Jev AI 模型引发文本无关概率输出的克隆大战 · 追踪 2 个来源
一种新型 AI 模型 Jev 已出现,它专注于提供概率和分类,而不是生成文本。Jev 由 TypeSafe AI 的创始人 Diogo Almeida 开发,他曾是 OpenAI 的 ChatGPT 团队成员。Jev 旨在充当“前沿智能函数调用”。其核心创新在于速度和可靠性,能在毫秒内以概率回答输入的问题,而无需生成文本,从而避免了幻觉。这种方法引起了极大的兴趣,并迅速引发了一波开源克隆,例如 Kev 和 Laya,它们旨在复制 Je…
-
研究发现:更便宜的AI模型在实际使用中可能成本更高 · 跟踪3个来源
新研究表明,使用AI模型进行编码等任务的成本并不总是与其价格标签成正比。在许多情况下,由于使用模式和效率等因素,更便宜的AI模型在实践中可能最终更昂贵。这表明产品设计和开发需要考虑AI集成的总成本,而不仅仅是初始模型价格。
-
Reddit 用户询问 Astra 和更便宜的子代理
一位 Reddit 用户正在询问关于使用 Astra 和更便宜的子代理的问题,并特别提到了 Luna 作为例子。他们正在寻求有关此设置的工作流程体验和成本降低的信息。
-
Anthropic 发布 Opus 5.5,OpenAI 推出 GPT-6 套餐,Meta 的 Muse 扩展到 Mac
Anthropic 发布了 Opus 5.5,提供更低的价格、更快的速度和改进的基准性能,同时还扩大了对防御者的网络安全访问。OpenAI 推出了新的 GPT-6 套餐 Sol 和 Luna,价格更实惠,但引发了对可解释性和外部评估的担忧。Meta 的 Muse AI 代理现已在 Mac 上可用,显示出强劲的初步采用率,尽管亚马逊因政策和隐私问题阻止了其在购物应用中的使用。
-
新的 SWE-sweep 基准测试显示 OpenAI 的 Luna 模型在查找代码错误方面表现出色
名为 SWE-sweep 的新基准测试由来自 Meta、Stanford、Harvard 和 UW 的研究人员开发,旨在评估 AI 模型在用户遇到之前查找和修复代码中错误的能力。该基准测试使用了大型代码库中的真实错误。早期结果表明,OpenAI 的 Luna 模型具有成本效益,以一小部分成本实现了其他模型相当大的分数。
-
FrugalEvo框架优化LLM使用,实现成本感知的程序演化
研究人员推出FrugalEvo,一个新颖的成本感知演化框架,旨在通过战略性地使用大型语言模型(LLMs)来优化计算问题。该框架使用一个更强大、更昂贵的LLM来制定策略,并使用一个更便宜的LLM来实现和完善代码,从而最大化每单位成本的性能提升。FrugalEvo引入了一个新指标,预算感知曲线下面积(BA-AUC),用于在固定预算内衡量解决方案的质量。在各种优化任务的测试中,FrugalEvo匹配或超越了现有的最先进方法,尤其是在圆圈打包…
-
Windows XP 被重现为单个 HTML 文件,可在网页浏览器中使用
一位用户在一个 HTML 文件中创建了一个功能齐全的 Windows XP 副本,可通过网页浏览器访问。该项目由 'Luna' 发起,'Sonnet' 改进,包含了扫雷、纸牌、记事本和 Windows Media Player 等经典应用程序。用户还可以在运行对话框中输入 'bsod' 来触发蓝屏死机 (BSOD),并自定义背景,WinAmp 和我的电脑也是活动组件。
-
Anthropic 发布 Claude Opus 5.5,成本和速度均有改进 · 跟踪 3 个来源
Anthropic 发布了 Claude Opus 5.5,强调其性能有所提升且成本降低了 40%。这一新版本旨在以更易于接受的价格提供旗舰级功能。此次发布恰逢 OpenAI 推出其 GPT-6 模型更便宜的套餐,包括 'Sol' 和 'Luna'。
-
本地AI模型laya-triage在支持工单上的准确率提升至90.5%
一位开发者成功微调了一个本地AI模型laya-triage,将其在支持工单分类上的准确率从51%提升至90.5%。这是通过在Kaggle的免费GPU上使用10003个BANKING77支持工单进行训练实现的。经过微调的模型现在能够以高置信度自动处理60.5%的工单,将其路由到正确的部门,评估紧急程度,并识别沮丧或流失风险,而且每张工单的成本为零。这种方法符合一种更广泛的趋势,即在工作流程中嵌入更小、更快的决策模型,而不是更大、更通用的模型。
-
Laya-compactor 将 RAG 上下文令牌在本地减少 70%
Laya-compactor 是一款新的开源工具,旨在减少检索增强生成 (RAG) 管道中发送到大型语言模型的令牌数量。它通过在本地对检索到的文档进行评分和过滤来实现这一点,只保留最相关的文档,并将令牌数量减少高达 70%,而不会影响 SQuAD 和 HotpotQA 等基准测试的答案质量。该工具提供 Python API,并与 LangChain 和 LlamaIndex 等流行框架集成,为基于 API 的决策模型提供免费替代方案。
-
OpenAI 发布 Decisions API,实现快速、低成本的 AI 分类
OpenAI 推出了新的 Decisions API,旨在解决使用大型语言模型进行简单分类任务时出现的延迟和成本问题。该 API 利用轻量级的 Luna 模型,提供快速、经济高效的离散分类,使开发人员能够优化自动化管道和代理工作流。通过将输出限制在预定义选项中,Decisions API 提供了高速概率分布,这对于代理转向、工具委托和高容量图像分类等任务至关重要。
-
OpenAI 快速发布 Decisions API,推动 AI 代理实现超人水平的计算机使用
OpenAI 快速为其 AI 代理开发了新功能,重点是增强它们与软件交互和从错误中恢复的能力。该公司仅用一周时间开发的 Decisions API 旨在提供低延迟、结构化的输出,早期应用于内部工作流程。OpenAI 还致力于实现更快的推理速度,并探索诸如中途转向和异步工具调用等功能,以使代理更具响应性并能够执行复杂任务,从而有可能在计算机使用方面实现超人水平的表现。
-
OpenAI 推出 B2B 市场,Glean Ai 成为首发合作伙伴
OpenAI 推出了新的 B2B 市场,Glean Ai 作为首发合作伙伴,允许符合条件的企业客户将其 OpenAI 承诺用于符合条件的合作伙伴产品。此次整合旨在为投资 OpenAI 工具的公司提供更大的灵活性。Glean Assistant 和 Glean Agents 利用 OpenAI 的 GPT-6 模型系列,包括 Astra、Sol 和 Luna,进行高级推理和数据分析,并通过 Glean 的 Enterprise Grap…