Hunyuan Model
PulseAugur coverage of Hunyuan Model — every cluster mentioning Hunyuan Model across labs, papers, and developer communities, ranked by signal.
- 2026-07-15 product_launch Tencent's Hy3 large model has seen a significant increase in usage and achieved a top ranking on OpenRouter. 来源
4 天有情绪数据
Hunyuan's HPC-Ops engine shows significant performance gains
Tencent's Hunyuan AI has upgraded its open-source inference engine, HPC-Ops, demonstrating substantial performance improvements. The engine addresses key bottlenecks like attention latency and memory transfer costs, outperforming existing open-source alternatives on mainstream platforms.
Hunyuan LoRA training tutorial for Windows users to drive adoption
A new tutorial demonstrates how to train the Hunyuan LoRA model on Windows using WSL. This increased accessibility for Windows users could lead to broader adoption and community-driven fine-tuning of the Hunyuan model.
Hunyuan's HPC-Ops inference engine shows competitive performance gains
Tencent's recent upgrade to the Hunyuan AI inference engine, HPC-Ops, demonstrates significant performance improvements by addressing key engineering bottlenecks like attention latency and memory transfer costs. This suggests Hunyuan's inference capabilities are becoming more competitive with other leading open-source alternatives, particularly on mainstream platforms.
Hunyuan LoRA training accessibility to expand on Windows
The release of a detailed tutorial for training Hunyuan LoRA models on Windows via WSL indicates a strategic effort to broaden the accessibility of Hunyuan's fine-tuning capabilities. This could lead to increased adoption and community contributions for custom Hunyuan model development.
-
中国公布人工智能、太空和材料科学重大突破
中国宣布在人工智能、太空和材料科学等多个领域取得了一系列重大技术进步。关键进展包括华为的盘古3.0、百度的ERNIE 4.0、阿里巴巴的通义千问2.0、智谱AI的Glm 4以及腾讯的混元模型等新人工智能模型。该国还公布了高端钢材生产和人工智能驱动的实验卫星方面的突破,旨在减少对外国技术的依赖并重塑市场格局。
-
中国人工智能生态系统展现协调的尖端能力 · 跟踪到 1 个来源
对中国近期人工智能进展的集体分析表明,这是一个强大且具有竞争力的前沿人工智能生态系统,而非孤立的成功。DeepSeek、Moonshot AI (Kimi K3)、阿里巴巴 (Qwen)、腾讯 (Hunyuan)、智谱 AI 和 MiniMax 等公司共同展示了世界一流的能力。这种生态系统方法与美国将这些发展视为独立公司成就的倾向形成对比,可能低估了中国战略性的长期技术进步及其获得全球竞争优势的能力。
-
中国 AI 实验室在原生多模态前沿模型训练上出现分歧
中国 AI 实验室正根据原生多模态能力来区分其前沿模型。Moonshot AI 的 Kimi K3 和阿里巴巴的 Qwen3.8-Max 正在采用原生多模态训练,为复杂的代理任务定位。相比之下,DeepSeek V4、智谱 AI 的 Glm 4 和腾讯的 Hunyuan 仍仅支持文本,可能在未来的发展中落后。
-
RouteAI 为中国大语言模型提供统一的 OpenAI 兼容 API
RouteAI 推出了一个兼容 OpenAI 的 API 网关,旨在简化对各种中国大语言模型的访问。该服务允许开发者使用单个 API 密钥和端点与 DeepSeek、Qwen、Kimi 等提供商的模型进行交互,从而无需为每个模型单独管理账户和账单。该平台提供按使用量付费定价、新模型发布的当天访问以及可审计的按请求日志,旨在减少与这些特定模型系列合作的团队的集成摩擦。
-
腾讯的 HiLS Attention 将 LLM 上下文扩展至 400 万 token
腾讯的 Hunyuan 团队在一篇新论文中详细介绍了一种名为 HiLS Attention 的新型稀疏注意力机制。该方法通过使用总结块内容的标志性 token,使块选择成为模型可学习的一部分。这种方法使模型能够在领域内长度上保持全注意力质量,同时将上下文扩展到训练长度的 64 倍以上,在 512K token 时实现 13-15 倍的加速。HiLS Attention 机制已在 Hugging Face 上提供,并开源了代码。
-
CachedSearch 通过新颖的缓存加速视频扩散模型搜索
研究人员开发了 CachedSearch,一种新颖的、无需训练的方法,用于加速视频扩散模型的测试时搜索。该技术通过积极缓存中间结果,显著降低了生成高质量视频输出的计算成本,使每次运行速度提高 2-3 倍,而质量没有明显下降。CachedSearch 通过缓存探索候选结果,然后仅以完整计算重新生成最佳结果,从而在降低成本的同时捕获了完整搜索超过 94% 的收益。该方法已被证明在各种模型尺寸和架构(包括 Wan、LTX、CogVideoX…
-
DeepSeek 永久性地将 V4-Pro 模型价格下调 75%
DeepSeek 已将其 V4-Pro 模型 75% 的促销折扣永久化,大幅降低了其旗舰 AI 模型的成本。每百万个输入 token 的价格现为 0.435 美元,低于之前的 1.74 美元;每百万个输出 token 的价格为 0.87 美元,低于之前的 3.48 美元。此外,访问上下文缓存的成本降低了 120 倍,使得具有相似前缀的重复查询成本显著降低。
-
腾讯合并AI模型团队以提高研究效率
腾讯已将其大语言模型和多模态模型团队合并,成立新的基础模型部门,由首席AI科学家姚舜宇领导。此次整合旨在提高模型研发效率,并探索多模态AI的全部潜力。新部门将建立在腾讯现有的模型矩阵之上,该矩阵包括图像、视频、语音和3D生成模型。最近发布的Hunyuan 3大语言模型在性能上取得了显著提升,并正在被整合到腾讯的各种产品中,可通过腾讯云等平台进行API访问。
-
Google开发新AI芯片;北京规划“通证工厂”;腾讯发布AI Agent · 追踪1个来源
Google正在开发一款代号为“Frozen v2”的新AI服务器芯片,以提升其Gemini模型的性能,目标是显著提高每单位能量的token处理能力,优于其当前的TPU。与此同时,北京正规划建立“通证工厂”和分发平台,以促进通证经济的发展和应用,并大幅提升智能算力。此外,腾讯混元AI已推出Hyra-1.0,这是一个为研究和工程任务设计的自改进Agent,能够迭代各种开放场景下的策略。
-
阿里巴巴推出Qwen大语言模型,加剧中国AI竞赛
阿里巴巴集团已推出其Qwen大语言模型,这是中国快速发展的AI领域的一项重要进展。此举使阿里巴巴跻身于百度、腾讯和智谱AI等其他中国主要科技公司之列,这些公司都在开发自己的强大AI模型。Qwen的推出标志着这些科技巨头在中国开发和部署先进AI技术方面展开了竞争。
-
Stable Diffusion 用户为新的 16GB GPU 寻求模型推荐
一位 Reddit 用户正在为使用新的显卡(RX 6800 XT,拥有 16GB 显存)寻求 Stable Diffusion 模型推荐。他正在从 RX 6600 升级,并有兴趣探索各种图像和视频生成模型。用户特别提到了对 SDXL、Flux、SD 3.x、Hunyuan、Wan 和 CogVideoX 的兴趣,并对其他适合增加内存容量的模型持开放态度。
-
腾讯Hy3模型使用量激增,登顶OpenRouter榜首
腾讯混元大模型Hy3使用量显著增长,总调用量是其前代Hy2的68倍以上。该模型在预览发布一周后,已登上OpenRouter全球大模型调用量排行榜首位。另外,前五矿证券研究部主管葛军已加盟财达证券,可能将领导其新成立的研究院。
-
TokenPAPA 通过单一 API 统一了包括 GPT-5、Claude、DeepSeek 在内的 10 多个 AI 模型
TokenPAPA 推出了一个统一 API,将包括 DeepSeek、Qwen、GPT-5 和 Claude 在内的 10 多个 AI 模型提供商聚合到一个兼容 OpenAI 的单一端点。该服务旨在通过消除对多个账户、API 密钥和计费系统的需求来简化开发流程。开发人员可以通过更改代码中的简单字符串在模型之间切换,从而实现 A/B 测试、回退链和成本优化。TokenPAPA 还消除了访问中国模型(例如需要 VPN 或本地支付方式)的障…
-
腾讯聘请前OpenAI研究员田涌泷开发VLM
腾讯已聘请前OpenAI研究员田涌泷加入其大语言模型部门。田涌泷将专注于开发视觉语言模型(VLM)和多模态AI。此前,腾讯已从OpenAI招募了包括现任腾讯首席AI科学家姚舜宇在内的AI人才。
-
新基准TSHA和CAREBench揭示LLM安全漏洞
发布了两个新的基准来评估语言模型的安全能力。TSHA使用超过66,000个问答对,侧重于评估视觉语言模型在真实室内环境中识别安全隐患的能力。而CAREBench则专门针对语言模型,评估其识别明确滥用内容之外的上游儿童安全风险的能力,包含十二个类别的500个提示。这两个基准都突显了当前前沿模型在安全意识方面存在的显著不足。
-
Hunyuan3D 在与商用AI 3D生成器对比中面临可靠性挑战
一项生产可靠性测试将开源AI 3D生成器Hunyuan3D与商用工具Meshy和Tripo进行了对比。虽然Hunyuan3D提供了本地控制且无成本,但其可靠性较低,清理后可用资产的成功率为60%,而商用工具的成功率在70%以上。商用选项虽然基于订阅,但提供了更高的导入成功率、一致的输出以及可管理的API可靠性,用金钱换取了节省的时间和更少的失败。
-
通过 WSL 为 Windows 用户提供 Hunyuan LoRA 训练教程
本教程详细介绍了在 Windows Subsystem for Linux (WSL) 中安装 Diffusion-Pipe 以训练 Hunyuan LoRA 模型的过程。该指南涵盖了在 Windows 操作系统上的设置过程,使用户能够利用 Linux 环境进行 AI 模型训练。
-
腾讯Hunyuan升级AI推理引擎;WPS文档集成微信助手
腾讯的Hunyuan AI发布了升级版的开源推理引擎HPC-Ops,旨在增强对动态工作负载的适应性并提高复杂操作的性能。此次更新解决了注意力延迟、内存传输成本和跨卡通信等关键工程瓶颈,在主流推理平台上显示出比现有开源替代品显著的性能提升。此外,WPS文档集成了微信助手功能,使移动用户能够直接在微信小程序中进行AI驱动的文档创建和数据处理。
-
LLM的“思考”提高了规划能力,但降低了指令遵循的精确度
一项新的研究论文调查了大型语言模型中的“思考”机制如何影响指令遵循。研究发现,虽然整体性能变化很小,“思考”过程改变了错误模式,改善了某些指令,但恶化了其他指令。具体来说,“规划”约束从思考中受益,而“精确度”约束则持续下降。对模型追踪的分析揭示了在这些约束类型中,追踪相关性与最终答案合规性之间存在不同的相关性。
-
腾讯AI主管:AI竞赛是长期的,新市场正在涌现
腾讯首席AI科学家姚舜宇表示,该公司并未在AI竞赛中落后,他将当前阶段比作个人电脑的早期。他认为,在编码代理和具身智能等领域的新机会代表着巨大的、未被开发的市场。姚舜宇曾是OpenAI的研究员,他还表示,像ChatGPT和Claude Code这样的当前领先AI应用不会是唯一的统治平台,他预计将出现新的创新。