tokenspeed
PulseAugur coverage of tokenspeed — every cluster mentioning tokenspeed across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
Qwen3.8-27B 开源模型在基准测试中可与 Claude Opus 相媲美
Qwen 发布了其 Qwen3.8-27B 模型,这是一个开源模型,在各种基准测试中,尤其是在编码和代理任务方面,其性能可与 Claude Opus 4.6 Max 等更大、专有的模型相媲美。这个拥有 270 亿参数的模型设计用于在消费级 GPU 上运行,提供 262K 的原生上下文窗口,可扩展至 100 万个 token。它还具有原生多模态能力,能够处理图像、PDF 甚至视频,并具有可定制的推理深度以提高效率。
-
Thinking Machines 发布 Inkling,一款拥有 1T 参数和 1M 上下文的多模态大语言模型
Thinking Machines 发布了 Inkling,这是一款拥有约 1 万亿参数和 100 万 token 上下文窗口的大型多模态语言模型。该模型原生处理文本、图像和音频输入,并具备智能体能力。Inkling 基于具有混合注意力机制的仅解码器专家混合(Mixture-of-Experts)架构构建,并提供开放权重以供研究和微调。
-
阿里巴巴的Qwen3.5在代理工作负载上达到创纪录的580 tps
阿里巴巴的Qwen团队在TokenSpeed引擎上为代理工作负载创造了每秒580万亿个token的新纪录。这一显著的性能提升是在几家关键合作伙伴的帮助下实现的。这一成就凸显了AI模型在复杂任务效率方面的进步。
-
增长最快的AI项目涵盖从提示工程到研究 · 跟踪10个来源
重点介绍了一系列快速发展的开源AI项目,展示了从提示工程工具包到AI研究平台的各种应用。值得注意的项目包括用于提示编译的"leaked-llm-prompts",用于微调优化的"lora-speedrun",以及用于普及AI研究的"open-science"。其他特色工具包括像CamelAI这样的AI编码助手,像WorkBuddyGuide这样的工作指导工具,以及像Prompt Architect这样的提示分析应用程序。