open LLMs
PulseAugur coverage of open LLMs — every cluster mentioning open LLMs across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
新研究探究开放式大语言模型中英孟性能差距
一篇新的arXiv论文调查了开放式大语言模型(LLMs)中英语和孟加拉语之间性能差异的原因。研究人员开发了一个一致的流程将8个英语基准测试翻译成孟加拉语,并评估了10个开放式大语言模型。研究发现,脚本碎片化(分词器将孟加拉语的字母音节分解成更小的部分)和评估格式遵循是导致性能差距的因素。虽然孟加拉语文本比英语消耗更多的token,但这种成本和序列长度与模型得分仅显示出弱相关性。
-
Workshop Days 2026 涵盖 AI Agents、Open LLMs 等
在拉珀斯维尔的OST – 瑞士东部应用科学大学举行的 Workshop Days 2026,在为期三天的知识分享和开源活动后圆满结束。本次活动涵盖了广泛的主题,包括 AI Agents、Agentic Coding、Open LLMs、Kubernetes、软件架构和机器学习,并设有关于 Java 25、Python、PostgreSQL、Docker 和 Podman 的会议。下一届活动定于 2027 年 8 月 31 日至 9 月…
-
本地部署的开源大模型Text-to-SQL:Qwen2.5和Llama-3.x领先,生成能力胜过模型尺寸
一项新的基准研究评估了本地部署的开源大模型在Text-to-SQL任务上的性能,比较了不同的模型家族和尺寸。研究发现,较新一代的模型,如Qwen2.5-Coder和Llama-3.x,在相同尺寸下显著优于CodeLlama等旧模型。研究还强调,自纠正技术以最小的计算成本提供了显著的改进,而模式链接和自洽性方法则显示出有限的益处。
-
西门子内部部署开源LLM,引发采用疑问
据报道,西门子正在内部使用开源大型语言模型(LLM)进行各种应用。文章对更多科技公司没有采取类似策略表示沮丧。这种方法表明,企业利用开源LLM满足其特定需求的趋势日益增长。