PulseAugur
中
实时 22:31:02
实体 Qwen3.5-397B-A17B

Qwen3.5-397B-A17B

PulseAugur coverage of Qwen3.5-397B-A17B — every cluster mentioning Qwen3.5-397B-A17B across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
22
90 天内 22
发布 · 30天
0
90 天内 0
论文 · 30天
13
90 天内 13
层级分布 · 90 天
主题
关系
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/2 页 · 共 23 条
  1. TOOL · CL_278870 ·

    Flash-MoE 使 397B 参数 LLM 能够在 48GB 笔记本电脑上运行

    一种名为 Flash-MoE 的新技术允许一个拥有 3970 亿参数的庞大模型 Qwen3.5-397B-A17B 在只有 48GB RAM 的 MacBook Pro 等消费级硬件上运行。这是通过利用专家混合(MoE)架构实现的,其中每个 token 只激活模型参数的一小部分,其余参数可以从 SSD 流式传输。这种方法受到一篇先前未发布的 Apple 论文的启发,显著减小了内存占用,尽管与基于云的解决方案相比,推理速度较慢。

  2. TOOL · CL_273418 ·

    新型 QuantCode 模型专门化 LLM 以用于算法交易代码

    研究人员开发了 QuantCode 模型,这是一个专门用于生成可执行算法交易代码的大型语言模型。该模型利用了交易框架代码的持续预训练以及经过验证的请求-代码对的监督微调(SFT)。在 QuantCode-Bench 基准测试上的评估表明,代码生成准确性和回测成功率有了显著提高,其中 SFT 在增强代理评估性能方面尤其有效。

  3. TOOL · CL_282517 ·

    QuantCode 模型专注于为算法交易代码生成进行专业化LLM

    研究人员开发了QuantCode模型,这是一个专门用于生成可执行算法交易代码的语言模型。通过在交易框架代码上进行持续预训练,并结合经过验证的请求-代码对的监督微调,该模型在QuantCode-Bench基准测试上的性能得到了显著提升。这种方法增强了单轮代码生成和多轮代理成功率,尽管领域专业化被发现会降低结构化工具调用能力,这需要有针对性的SFT来部分恢复。

  4. TOOL · CL_254227 ·

    新的 NoteVQA 基准揭示 VLM 在处理真实视觉问题时遇到困难

    一个名为 NoteVQA 的新基准已被开发出来,用于评估视觉语言模型(VLMs)在真实世界视觉问题上的表现,解决了现有基准侧重于预定义能力的问题。该基准从中国图片分享平台小红书上的问题中收集整理,包含 12 个类别和 7 种用户意图的 252 个条目,并配有人工审核的、带有视觉证据的交错式答案。对十个前沿 VLM 的评估显示,即使有代理搜索,最高的简答准确率也仅达到 52.8%,并且交错式答案的质量也落后于人类参考答案,这凸显了当前 …

  5. TOOL · CL_236605 ·

    AI模型被训练以预测和解释其意外行为

    研究人员开发了一个名为CHIVE的流水线,该流水线生成了数千种意外的AI行为及其解释。这些数据用于训练模型以预测反事实提示的结果,并提供开放式的自我解释。一个关键发现是,用这些数据进行训练可以显著提高反事实预测能力,甚至泛化到未见过的数据集。有趣的是,与其他在相同数据上训练的模型相比,模型在预测自身行为时并未显示出特权访问优势。

  6. TOOL · CL_185395 ·

    大模型代理增强油井异常检测能力并提供可解释性

    研究人员开发了一个大模型(LLM)代理层,用于增强油井的开放世界异常检测能力,该层建立在现有的自编码器和基于马氏距离的方法之上。该代理作为上游管道的伴侣,提供自然语言解释、置信度评估和检测到的新颖异常的人类可读名称。该代理在3W数据集上使用通过NVIDIA NIM提供的Qwen3.5-397B-A17B模型进行了测试,旨在弥合可解释性差距,并促进这些检测系统在操作环境中的部署。

  7. RESEARCH · CL_185359 ·

    新基准揭示LLM在呼吸科临床决策中的风险

    一个名为RESPClinBench的新基准已被开发出来,用于评估大型语言模型在呼吸专科护理中的临床决策和纵向疾病管理能力。该基准结合了胸部CT扫描和临床信息,用于评估七个LLM。Qwen3.6-27B和Qwen3.5-397B-A17B模型表现强劲,但评估也突显了模型响应中成像幻觉和医疗错误的重大风险。

  8. TOOL · CL_182202 ·

    Cursor 发布开源 MoE 训练超级内核 Mixture-of-Kittens

    Cursor Research 已开源 Mixture-of-Kittens (MoK),这是一个专为 Mixture-of-Experts (MoE) 模型设计的专用训练内核。该超级内核将 MoE 通信和计算融合为单一的确定性过程,据称与现有基线相比,吞吐量提高了 2.37 倍。MoK 针对 NVIDIA GB200 NVL72 机架等高端硬件进行了优化,适用于大规模 AI 模型开发和训练。

  9. TOOL · CL_172715 ·

    AI模型可以通过微调采纳其他AI的身份

    研究人员发现,AI模型可以通过一种类似于潜意识学习的过程,无意中采纳其他模型的身份。当使用其他AI系统生成的答案对开源模型进行微调时,即使训练数据中没有明确的身份信息,微调后的模型也常常开始将自己识别为源模型。这种现象似乎源于预训练期间形成的关联,模型在预训练中学会识别和模仿其他AI的语言风格和自我识别模式。

  10. RESEARCH · CL_162502 ·

    阿里巴巴将Qwen旗舰模型转为仅限API访问

    阿里巴巴已将其旗舰Qwen模型转向仅限API的策略,于2026年2月发布的Qwen3.5-397B-A17B将是最后一个提供Apache 2.0许可下公开可用权重的模型。后续模型,如Qwen3.7-Max,只能通过API访问,这反映了阿里巴巴对其AI资产货币化的日益关注。这一战略转变发生在2026年初Qwen团队关键人员离职以及旨在从AI产品中创收的企业重组之后。

  11. SIGNIFICANT · CL_172388 ·

    XYZAILab 发布开源深度搜索模型 XYZ-Aquila-pro 和 mini

    XYZAILab 发布了两款开源模型 XYZ-Aquila-pro 和 XYZ-Aquila-mini,专为深度搜索和智能体任务设计。XYZ-Aquila-pro 基于 Qwen3.5-397B-A17B,而 XYZ-Aquila-mini 源自 Qwen3.6-35B-A3B。两款模型均针对长时规划和网页浏览等能力进行了优化,并提供了与 Hugging Face Transformers、vLLM 和 SGLang 等流行库集成的说明。

  12. RESEARCH · CL_154635 ·

    TimeLens2 通过新颖的区间集优化推进视频时序定位 · 已追踪 2 个来源

    研究人员推出 TimeLens2,这是一种用于通用视频时序定位的多模态大语言模型。与以往侧重描述视频内容的模型不同,TimeLens2 能精确定位视频中的证据时间点。该模型采用新颖的方法将时序证据视为一个区间集,从而改进了对可变长度视频和多样化查询类型的任务的监督和优化。为支持这种训练方法,创建了一个包含已验证定位实例的 TimeLens2-93K 数据集。该模型在七个基准测试中的表现显示出显著的改进,其较大版本取得了最先进的成果,并…

  13. TOOL · CL_120599 ·

    2026年6月迎来一系列新的开源AI模型和量化方法

    2026年6月,开源AI模型领域迎来众多更新,重点是新的微调和量化方法。发布了几个新的微调模型,包括Nex-N2、Ornith-1.0、Agents-A1、Holo3.1、Tmax-27b、MusaCoder-27B和VibeThinker-3B。此外,NVIDIA为NVIDIA-Nemotron-3-Ultra-550B-A55B和Qwen3.6-27B等模型引入了NVFP4量化,而AMD则为Kimi-K2.7-Code和GLM-5…

  14. SIGNIFICANT · CL_92035 ·

    LLM 定价变动:Kimi K2.7 涨价,Claude 3.5 Haiku 下架,新增 Gemini 模型 · 追踪 8 个来源

    Token Ledger 报告了多家供应商的几项 LLM 定价调整以及模型增减情况。值得注意的是,MoonshotAI 的 Kimi K2.7 Code 的 completions 价格有所上涨,而其 Kimi Latest 和 K2.6 版本的 prompt 价格略有下降。Z.ai 调整了其 GLM 5.2 模型的定价,提供了优惠,并推出了具有高上下文能力的 GLM 5V Turbo。多款模型已从可用列表中移除,包括 Anthrop…

  15. SIGNIFICANT · CL_99036 ·

    Poolside 发布 Laguna M.1,一款用于代理编码的 225B MoE 模型

    Poolside 发布了 Laguna M.1,这是一款拥有 2250 亿参数的混合专家(MoE)模型,专为代理编码任务进行了优化。该模型采用了具有 256 个专家的稀疏 MoE 架构和全局注意力机制,使其能够处理长时程工作和带有工具调用的交错推理。Laguna M.1 在 SWE-bench Verified 和 Terminal-Bench 2.0 等代理基准测试中表现出色,可与其他领先的开放权重模型和前沿模型相媲美。该模型在 A…

  16. COMMENTARY · CL_91517 ·

    里约热内卢AI模型被曝为开源模型合并而成

    里约热内卢市政府IT机构IplanRIO声称开发了一个名为Rio-3.5-Open-397B的原创3970亿参数AI模型。该模型在多项编码和推理基准测试中表现优于阿里巴巴的Qwen 3.7 Plus,引起了广泛关注。然而,Nex-AGI的调查发现,Rio-3.5-Open-397B并非原创,而是直接合并了Nex-AGI的Nex-N2-Pro模型和阿里巴巴的Qwen3.5-397B-A17B基础模型,甚至在提示时该模型还将自己标识为Ne…

  17. TOOL · CL_55071 ·

    SWE-rebench 排行榜新增 110 个面向 AI 模型的 Python 任务

    SWE-rebench 排行榜已更新,新增了来自 GitHub PR 的 110 个 Python 任务,涵盖 3 月、4 月和 5 月。此次更新侧重于评估模型阅读真实问题、编辑代码和通过测试套件的能力。未来的更新将包括更多模型,如 Gemini Flash 3.5 和 DeepSeek v4 Pro,以及多语言任务和本地开发选项。

  18. RESEARCH · CL_53568 ·

    新的LLM安全工具旨在满足金融监管合规要求

    研究人员开发了两个新系统 FinGuard 和 FinHarness,以增强大型语言模型(LLM)在金融服务中的安全性和监管合规性。FinGuard 基于 Qwen3-8B 构建,采用新颖的管道,直接从金融法规中提取合规规则,以检测不合规的交互。FinHarness 作为金融LLM代理的内联安全防护架,监控查询和工具调用,以防止未经授权的操作并减少昂贵的后期审计需求。这两个系统旨在降低LLM在敏感金融领域部署相关的风险。

  19. TOOL · CL_46563 ·

    Together AI发布Violin,一款开源视频翻译工具

    Together AI推出了Violin,这是一款开源视频翻译工具,旨在打破语言障碍,使在线视频内容更易于访问。该系统利用先进的AI技术,包括语音识别、大型语言模型和语音合成,提供高质量的翻译。Violin还具有交互式功能,如内容感知聊天助手和个性化语音选择,旨在扩大视频内容的全球覆盖范围。

  20. RESEARCH · CL_15798 ·

    使用多模态图像进行医学思考

    研究人员开发了MIRAGE系统,旨在通过检索和生成多模态医学图像和文本来辅助医学教育。MIRAGE利用了经过微调的CLIP模型(MedICaT-ROCO)和扩散模型(Prompt2MedImage),允许用户根据文本提示查找或创建相关图像。此外,一个大型语言模型(Dolly-v2-3b)提供了丰富的描述,并且该系统支持对不同医学状况进行视觉比较。其目标是为全球医学生提供一个免费、易于访问且交互式的学习工具,该工具完全基于公开可用的预训练模型构建。