Yi-34B
PulseAugur coverage of Yi-34B — every cluster mentioning Yi-34B across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
01.AI 的 Yi 模型通过更大的上下文窗口和 Apache 2.0 许可进行升级
01.AI 发布了其 Yi 模型的多个迭代版本,具有不同的上下文窗口大小和许可条款。最初于 2023 年 11 月发布的 Yi-6B 和 Yi-34B 模型具有 4,096 个 token 的上下文窗口,以及要求注册才能商业使用的社区许可。后续版本,包括 Yi-6B-200K 和 Yi-34B-200K 等长上下文变体,提供了高达 200,000 个 token。后来,所有模型(包括 2024 年 5 月发布的更新的 Yi-1.5 系…
-
新基准量化 AI 模型干预的意外副作用
研究人员开发了 RippleBench-Maker,一个旨在识别和量化针对性干预对语言模型涟漪效应的自动化流程。该系统利用维基百科等现有知识库,生成与源概念在不同语义距离的问题。当应用于 Llama3-8B-Instruct 等模型的八种不同的遗忘方法时,该系统显示准确性下降在目标概念附近最大,并随着语义距离的增加而减小。值得注意的是,这些涟漪效应的传播特征在不同的基础模型中被发现是一致的,这表明它们是遗忘方法本身的属性。
-
2026年二手RTX 3090为本地大语言模型提供最佳价值
对于希望在2026年运行大型本地语言模型的个人而言,二手NVIDIA RTX 3090显卡提供了极具吸引力的价值主张。尽管已是三代产品,其24GB显存使其能够容纳高达340亿参数的模型,这是同等价位较新GPU所不具备的能力。文章提供了浏览二手市场的指南,强调显存容量是关键因素,并就如何识别因挖矿或重度游戏而过度磨损的显卡提供建议,以确保安全购买。
-
NVIDIA RTX 5090 GPU 凭借 32GB 显存提升 LLM 性能
NVIDIA RTX 5090 于 2025 年初发布,其 32GB GDDR7 显存相比 RTX 4090 的 24GB GDDR6X,为本地 LLM 用户带来了显著的升级。增加的显存使得 5090 能够更流畅地运行更大规模的模型,例如以更高量化级别运行 34B 参数模型,甚至以较低量化级别运行 70B 模型,而这些在 4090 上是无法实现的。虽然 5090 的价格更高,约为 2000 美元,但对于需要运行更大模型或需要更多显存来…