Tencent Hunyuan
PulseAugur coverage of Tencent Hunyuan — every cluster mentioning Tencent Hunyuan across labs, papers, and developer communities, ranked by signal.
- 2026-07-31 research_milestone Tencent Hunyuan's AI agent Hyra solved a 50-year-old mathematical problem, achieving a new best result and demonstrating a method to approach theoretical limits. 来源
4 天有情绪数据
-
腾讯混元爬虫被指控试图对开发者服务器进行远程代码执行
一位开发者声称,一个被识别为腾讯混元(Tencent Hunyuan)网络爬虫的机器人试图对其服务器进行 PHP 路径遍历和远程代码执行(RCE)攻击。据称,这些请求被防火墙阻止了。如果得到证实,此次事件将引发对 AI 爬虫运营商的安全控制和流量验证实践的担忧。
-
前腾讯混元负责人胡瀚推出多模态AI初创公司,目标DeepSeek为潜在收购方
据报道,前腾讯混元技术负责人胡瀚正在创办一家专注于多模态AI的新公司。该公司目标估值达数亿美元,并寻求数千万美元融资,Vision Capital担任财务顾问。投资者对商业化策略特别感兴趣,胡瀚建议可以将模型出售给DeepSeek等大型科技公司。
-
Tencent发布Prism,一款MIT许可的2K视频和音频AI模型
腾讯发布了Prism,一款与复旦大学合作开发的新型视频和音频生成模型。该模型支持原生2K分辨率,并集成了音频生成功能,据称在演示中表现优于Kling 3和Wan 3.0等其他模型。Prism采用新颖的动态稀疏注意力机制以加快训练速度,并以MIT许可发布,尽管目前高分辨率生成需要大量的GPU资源。
-
Prism模型支持2K视频音频生成,采用动态稀疏注意力机制
一款名为Prism的新模型已发布,专为高达2K分辨率的原生联合视频音频生成而设计。Prism由复旦大学和腾讯混元的研究人员开发,采用动态稀疏注意力框架来高效处理高分辨率数据。这种方法允许模型根据局部内容调整其注意力结构,与全注意力相比,训练速度提高了2.5倍,同时提高了生成质量。
-
新框架可准确归因合成图像,区分 Stable Diffusion 版本
研究人员开发了一种新颖的合成图像归因框架,在挑战性数据集上实现了高精度。他们的方法结合了多种人工智能架构,包括 FFT-ConvNeXt、DINOv2、CLIP 和 Xception,从频率、语义和取证等不同角度分析图像。为了提高对图像操纵的鲁棒性,他们采用了模拟真实世界后处理的广泛数据增强。该框架通过采用专用的二元分类器和类自适应置信度校准,专门解决了 Stable Diffusion 3 和 Stable Diffusion 3.…
-
清华、腾讯、南洋理工大学发布用于AI空间记忆的Spatial-TTT
清华大学、腾讯混元和南洋理工大学的研究人员开发了Spatial-TTT,这是一种为AI模型赋予“流式空间记忆”的新颖方法。该方法通过使参数在推理过程中实时适应和更新,解决了传统Transformer模型在处理长而连续的视频输入方面的局限性。Spatial-TTT采用混合架构,结合了用于动态内存压缩的测试时训练(TTT)层和用于语义对齐的标准注意力层,在VSI-Bench等空间基准测试中表现优于GPT-5。
-
Fal 通过优化 H3 模型在实时视频生成方面取得突破
Fal 通过优化 Minimax 的 H3 模型在视频生成方面取得了突破,实现了实时、超实时视频流。这一进展最初由 Ethan Mollick 注意到,并被 Fal 员工产品化为无限视频流服务。尽管目前的输出被描述为低质量,但底层技术证明了以前所未有的速度生成足够好的视频的可行性,预示着生成式媒体能力将发生重大转变。
-
Tencent AI 发布混元 Hy4,引发社区快速开发
Tencent AI 发布了其新的生成式 AI 和开发工具 Hunyuan Hy4 的预览版。预览发布后的 24 小时内,社区开始分享其快速应用的示例,包括为 Beat Saber 等游戏创建各种构建。这种早期采用凸显了开发者的兴趣,并展示了该新工具的初步用例。
-
腾讯发布Hy4预览版大语言模型,拥有770B参数和1M上下文 · 跟踪6个来源
腾讯发布了Hy4预览版,这是一款新发布的超大规模语言模型,拥有7700亿总参数、490亿激活参数,上下文窗口超过100万个token。该模型由腾讯Hy团队开发,采用混合专家(MoE)架构,旨在提高软件工程、办公分析、游戏开发和科学研究等多种任务的生产力。在内部盲测中,Hy4预览版表现出色,超越了GLM 5.3和Kimi K3等模型,现已通过腾讯的各种产品和API提供。
-
腾讯混元发布Hy ASR 3.0预览版,增强上下文理解能力
腾讯混元发布了Hy ASR 3.0预览版,这是一款集成了其Hy3大语言模型先进语言理解能力的新语音识别模型。此次更新显著提高了准确性、上下文感知能力、各种场景下的鲁棒性以及方言覆盖范围。该模型在基准数据集上实现了较低的词错误率,并正被集成到Yuanbao和WorkBuddy等产品中,在智能客服和内容理解领域有更广泛的应用。
-
腾讯混元AI解决50年数学难题,为AI4S招聘
腾讯混元AI在解决一个悬而未决约50年的数学问题上取得了重大突破。该AI代理名为Hyra,由Hy3模型驱动,不仅找到了解决方案,还展示了一种持续扩展解决方案的方法,接近理论极限。这一成就是腾讯混元更广泛地推动AI for Science(AI4S)的一部分,团队目前正在积极招聘人才,以进一步发展AI在科学研究中的作用,旨在建立一个协作的
-
腾讯混元开源 AngelSpec 框架和 Hy3-A21B 权重
腾讯混元团队已正式开源 AngelSpec,这是一个专为草稿器训练、架构设计和在线部署而设计的投机解码框架。同时,他们还发布了 Hy3-A21B 的 MTP 和 DFly 草稿器权重及训练代码。腾讯此举旨在通过提供开源工具来推动人工智能研究和开发。
-
腾讯混元推出Hyra-1.0研究智能体
腾讯混元推出了Hyra-1.0,这是其首个专为递归自我改进而设计的研发智能体。该智能体能够处理模型开发、科学发现、游戏、设计和内容创作等任务,并根据自我评估和用户反馈不断优化其策略。该消息于7月21日发布,强调了Hyra在各种复杂场景中进行迭代开发的潜力。
-
Kimi K3 和 Inkling 发布,开源模型竞争加剧
人工智能领域竞争激烈,特别是随着 Moonshot AI 的 Kimi K3 发布,这是一款开放权重模型,在编码和智能体任务方面可与前沿闭源模型相媲美。这一发展促使人们重新评估中国和西方人工智能实验室之间的差距,Kimi K3 的表现可能会迫使美国实验室加速推出自己的产品。与此同时,Thinking Machines Lab 推出了 Inkling,这是一款可定制的多模态基础模型,具有开放权重,旨在实现实际应用和定制化,而不仅仅是追求…
-
腾讯混元AI大模型Hy3需求激增,促使资源扩容
腾讯混元AI大模型Hy3在7月8日经历用户需求激增,导致资源消耗达到峰值,排队率超过50%。腾讯迅速响应,立即调配额外资源进行扩容,以确保用户体验的稳定性。此次使用量的激增凸显了对AI驱动工具和服务的日益增长的需求。
-
Fable 5 发布提示使用指南;腾讯发布具有竞争力的 Hy3 模型
人工智能新闻领域充斥着重要的模型发布和关于如何最好地利用它们的讨论。一个值得注意的事件是 Fable 5 的发布,促使人们发布了一份关于通过调整提示和期望来最大化其能力的指南。与此同时,腾讯发布了其 Hy3 模型,这是一个拥有 295B 参数的混合专家模型,采用 Apache 2.0 许可,该模型因其具有竞争力的性能和从第一天起就提供的强大推理支持而受到赞誉。此次发布使腾讯成为开放权重模型领域的主要参与者,并与其他领先的开源模型进行了比较。
-
腾讯发布Hy3开源大语言模型,采用Apache 2.0许可证
腾讯AI部门腾讯 Hunyuan 发布了其开源大语言模型 Hy3。该模型拥有2950亿总参数和210亿活跃参数,并采用Apache 2.0许可证发布。此次发布标志着从更具限制性的社区许可证转向广泛采用的开源许可证,使其在全球范围内更易于使用。
-
腾讯游戏部署AI执行未成年人每周3小时游戏时长限制
腾讯游戏正在实施一项新的AI驱动的未成年人保护系统,将游戏时长限制在每周三小时。该系统被称为“AI双引擎防沉迷”,将利用腾讯混元和DeepSeek的模型。在游戏之外,家长可以使用对话式AI进行账户管理和信息检索。在游戏内部,“AI巡逻”功能将动态评估玩家行为,并采用包括语音和年龄识别在内的多模态验证,以防止未成年人访问。
-
清华大学利用免费网络数据训练GUI代理,大幅降低成本
清华大学的研究人员开发了GUICrafter,这是一种能够控制计算机界面的AI代理。该代理通过利用免费的网络截图和元任务,实现了与领先模型相媲美的性能,显著降低了对昂贵标注数据的需求。据报道,其训练方法仅使用了传统方法相关数据成本的0.1%,使其成为GUI代理开发的一种高效解决方案。
-
OpenAI发布GPT-5.6,引入复杂模型层级,引发用户困惑和用户体验问题 · 追踪6个来源
OpenAI发布了GPT-5.6,引入了一个分层模型和计算阶梯,包含Luna、Terra和Sol等多个努力级别。此次发布导致用户对30多个配置选项感到困惑,并且缺乏“自动”路由功能。产品发布还出现了用户体验的回归,例如令人困惑的ChatGPT Work/Codex划分以及查找聊天记录的困难,促使OpenAI发布了使用限制重置并承诺恢复熟悉的导航模式。早期评估表明,GPT-5.6在代理编码和演示任务方面表现出色,但在指令遵循和令牌效率方…