PulseAugur
中
实时 06:09:54
实体 Apache Software License 2.0

Apache Software License 2.0

PulseAugur coverage of Apache Software License 2.0 — every cluster mentioning Apache Software License 2.0 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
283
90 天内 283
发布 · 30天
0
90 天内 0
论文 · 30天
35
90 天内 35
层级分布 · 90 天
主题
关系
情绪 · 30 天

18 天有情绪数据

最近 · 第 1/10 页 · 共 200 条
  1. TOOL · CL_285015 ·

    Meta AI 开源 Rebalancer,用于解决大规模赋值问题

    Meta AI 已开源 Rebalancer,这是一个带有 Python 接口的 C++ 库,旨在解决复杂的赋值问题,例如大规模数据中心的资源分配。该工具将问题规范与其解决方案分开,为较小的问题提供最优求解器,为较大、NP-hard 的实例提供可扩展的局部搜索求解器。Rebalancer 每天能够处理约 4000 万个分配问题,并包含一个名为 Rebalancer Explorer 的调试 UI。

  2. TOOL · CL_284924 ·

    Matryoshka 项目为编码代理提供无需 LLM 的文档处理方案

    Matryoshka 是一个开源的 TypeScript 项目,它为编码代理处理大型文档提供了一种新颖的方法。与传统的切片文件或使用 RAG 索引等方法不同,Matryoshka 将整个文档保存在服务器上,并为代理提供一种与之交互的查询语言。这种方法受到 Recursive Language Models 论文的启发,旨在通过返回数据的“句柄”而不是原始文本来显著减少 token 的使用。该项目的 MCP 服务器 lattice-mc…

  3. TOOL · CL_284516 ·

    Fiorillo v0.5 开放模型发布,用于随机试验分析

    一款名为 Fiorillo v0.5 的新开源模型已发布,旨在以概率输出来回答有关随机试验的问题。该模型基于 Qwen3-4B-Base,并添加了适配器和决策头,在允许重新使用的许可文章上进行了微调。Fiorillo v0.5 在 Evidence Inference 2.0 基准测试中取得了强劲表现,达到了预先注册的准确性和校准标准,并且在对数损失方面优于 Gemma 4 31B-it。

  4. FRONTIER RELEASE · CL_283503 ·

    Google DeepMind 发布 EmbeddingGemma 2 多模态嵌入模型

    Google DeepMind 推出了 EmbeddingGemma 2,这是一个基于 Gemma 4 架构构建的 7.4 亿参数的开源多模态嵌入模型。该模型能够将文本、代码、图像、视频和音频处理并嵌入到单一的 768 维向量空间中,从而实现跨模态检索和设备端应用。其模块化设计允许灵活部署,仅文本版本需要 2.7 亿参数和 191MB RAM,使其适用于智能手机和笔记本电脑等消费级硬件。EmbeddingGemma 2 已在 Hugg…

  5. SIGNIFICANT · CL_283915 ·

    Google DeepMind 发布 EmbeddingGemma 2 多模态模型

    Google DeepMind 发布了 EmbeddingGemma 2,这是一款专为设备端嵌入设计的新型开源、原生多模态模型。该模型超越了文本处理能力,能够在一个共享空间内处理和统一代码、图像、音频和视频。EmbeddingGemma 2 拥有 7.4 亿个参数,在各种基准测试中表现出竞争力,甚至超越了一些更大的专业模型,并根据 Apache 2.0 许可提供。

  6. SIGNIFICANT · CL_283805 ·

    Google 发布 EmbeddingGemma 2,一款多模态端侧嵌入模型

    Google 发布了 EmbeddingGemma 2,一个开源、轻量级且多模态的嵌入模型。该新模型基于 Gemma 4 架构,超越了文本处理能力,能够在一个共享的嵌入空间中处理图像、视频和音频。它在代码和多模态性能方面取得了显著改进,同时保持了端侧应用的效率,并利用 Matryoshka Representation Learning 来减少存储需求并支持 8K 令牌上下文窗口。

  7. FRONTIER RELEASE · CL_283178 ·

    Mistral AI 发布 Mistral Large 4,采用开放权重和 100 万上下文 · 跟踪 4 个来源

    Mistral AI 发布了 Mistral Large 4,这是一款新的 40 亿参数密集型 LLM,以更低的推理成本提供具有竞争力的性能。该模型可通过托管 API 和可下载的检查点获得,采用宽松的许可证,允许本地或边缘部署。主要优势包括由于其尺寸适合单个 GPU 而具有成本效益的扩展、开放权重许可证(与 Apache 2.0 兼容)以及通过与 OpenAI 兼容的端点和与 LangChain 和 LlamaIndex 等工具的集成…

  8. SIGNIFICANT · CL_282953 ·

    美国公司Reflection's Beam发布了参数量为501B的开源大语言模型

    一款名为Reflection's Beam的美国新开源大语言模型已发布。它拥有5010亿参数,其中230亿参数处于活跃状态,并采用Apache 2.0许可。虽然它优于其他西方开源模型,但其速度被认为不如GLM 5.3、Kimi K3和DeepSeek V4.1等模型。

  9. TOOL · CL_280883 ·

    CortHeXis 2.0 发布,修复 AI 代理内存的静默故障

    CortHeXis 2.0,一个旨在解决 AI 代理内存静默故障的开源引擎已发布。该引擎的开发源于创建者观察到内存可能在不引发错误的情况下退化的多种方式,例如服务器中断、笔记损坏、信息重复以及模型更新引起的问题。CortHeXis 2.0 旨在通过确保相关笔记持续提供给代理和子代理,并实施每小时审查以检查各种内存完整性问题,提供可操作的见解和修复建议,来防止这些问题。

  10. TOOL · CL_280681 ·

    DecisionTune 1.0:发布用于小型决策的本地编码器

    DecisionTune 1.0 是一个新发布的 395M 参数编码器模型,专为本地决策任务设计,资源需求极低。由 /u/Abe238 开发,它可以在 Apple 芯片上使用 MLX 后端,在大约 10 毫秒内处理短决策,内存占用约 1.7 GB。该模型能够从提供的选项中进行选择或回答是/否问题,而无需生成文本,使其适用于需要离线处理小型、频繁决策的代理栈。

  11. TOOL · CL_279726 ·

    业务术语表提高了文本到 SQL 代理的准确性,学习到的术语无效

    当为文本到 SQL 代理提供全面的业务术语表时,其性能得到了显著提升,与不使用术语表相比,准确率提高了 28 个问题。然而,从过去用户问题中自动学习到的术语表并未显示出任何改进,这表明手动整理的术语对于增强代理对特定业务语言的理解以及其正确映射术语到数据库模式的能力至关重要。该工具 schemagate 1.2.0 还包含访问控制,以防止术语表术语向未经授权的用户泄露敏感的表或列信息。

  12. TOOL · CL_279560 ·

    Cloudflare/clef 图像到文本模型在 Hugging Face 上获得关注

    一款名为 Cloudflare/clef 的开源图像到文本模型在 Hugging Face 上获得了关注,在发布后的 30 天内实现了 2.6k 下载量和 1k 点赞。该模型是在宽松的 Apache Software License 2.0 下发布的。

  13. TOOL · CL_279369 ·

    Google 发布开源 DiarizationLM-Gemma-4-E4B-v1 模型

    Google 发布了 DiarizationLM-Gemma-4-E4B-v1,这是一个采用 Apache 2.0 许可的开源模型。这个拥有 40 亿参数的模型旨在通过一种新颖的保留局部性的监督方法来修正自动语音识别 (ASR) 和说话人分割的输出。量化版本,如 GGUF (Q4_K_M),可通过 llama.cpp 进行本地推理。

  14. TOOL · CL_278666 ·

    Aleph Alpha发布Kolibri模型;预算上限引发争论

    Aleph Alpha发布了Kolibri模型,这是一个拥有780亿参数和100万token上下文窗口的模型,采用Apache 2.0许可证发布,其权重可在Hugging Face上获取。该模型包含“弃权训练”功能,用于指示模型何时缺乏信息,尽管其有效性受到争议。同时,关于AI服务(尤其是编码代理)是否有必要设置硬预算上限以防止意外成本的讨论也随之出现。然而,由于计费数据延迟和云服务提供商支持有限,实施此类上限面临技术挑战。

  15. FRONTIER RELEASE · CL_278227 ·

    Aleph Alpha发布Kolibri,一个支持德语和英语的主权开源模型 · 跟踪8个来源

    Aleph Alpha推出了Kolibri,这是一款新的开源、混合专家模型,总参数为781亿,但每个token仅有34.6亿活跃参数。Kolibri在德国开发,专为英语和德语任务设计,重点关注在公共管理和工业等监管行业的自主部署。该模型支持高达100万token的上下文窗口,并在Hugging Face上根据Apache 2.0许可证提供。

  16. COMMENTARY · CL_278002 ·

    Granite Guardian 在多语言和受监管的 LLM 安全性方面优于 Llama Guard

    Llama Guard 和 Granite Guardian 是两个用于 LLM 的开源安全分类器,但它们在功能和许可方面存在显著差异。Llama Guard 在内容安全方面表现出色,适用于英语应用程序,而 Granite Guardian 则提供更强大的开箱即用多语言支持,并包含接地性(groundedness)和推理检测(rationale detection)等关键功能,使其在受监管的行业中更加健壮。文章强调,Llama Gua…

  17. SIGNIFICANT · CL_277978 ·

    Aleph Alpha 发布 Kolibri,一个德语和英语的开源大语言模型

    Aleph Alpha 发布了 Kolibri,一个专为德语和英语设计的开源大语言模型。这个专家混合模型拥有 781 亿参数,每个 token 仅激活一小部分。Kolibri 在大约 24 万亿个 token 上进行了训练,其中很大一部分是德语,使用了位于德国和芬兰的 768 个 NVIDIA B200 GPU。该模型在 Apache 2.0 许可下可用,其权重可在 Hugging Face 上找到。

  18. SIGNIFICANT · CL_278398 ·

    Aleph Alpha发布Kolibri-1,支持100万token上下文窗口

    Aleph Alpha发布了Kolibri-1,一个拥有780亿参数的语言模型,其中34.6亿为活跃参数。该模型支持高达100万token的上下文窗口,并根据Apache 2.0许可证发布。此次发布包含一份详细介绍其能力的技??报告。

  19. TOOL · CL_277639 ·

    Chroma:用于原型设计的轻量级向量数据库,而非生产环境

    Chroma 是一款开源嵌入式数据库,被介绍为一种轻量级、易于使用的解决方案,非常适合原型设计和个人项目。它通过 Python 和 Rust 提供快速设置、本地嵌入模型,并与 LangChain 和 LlamaIndex 等流行框架集成。然而,Chroma 设计用于单节点使用,由于其在可扩展性、数据持久性和安全功能方面的限制,不建议用于具有大型数据集或严格持久性要求的生产环境。

  20. TOOL · CL_276344 ·

    Datalab推出OmniExtractBench以标准化AI文档提取评估

    Datalab推出了OmniExtractBench,这是一个旨在解决结构化文档提取任务中偏差和不透明性问题的开放基准。该新基准评估AI系统从PDF文档填充JSON模式的准确性,并使用提供决策解释的确定性评分器。OmniExtractBench旨在提供一种标准化和可审计的评估方法,这与Datalab认为难以比较或验证的供应商创建的排行榜形成对比。该基准包含来自各种来源的620份文档,并采用基于内容的配对方法和匈牙利算法进行准确的表格对齐。