PulseAugur
实时 21:37:12
实体 词元(Token)云服务提质赋能评估计划

词元(Token)云服务提质赋能评估计划

PulseAugur coverage of 词元(Token)云服务提质赋能评估计划 — every cluster mentioning 词元(Token)云服务提质赋能评估计划 across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
17
90 天内 46
发布 · 30天
0
90 天内 0
论文 · 30天
1
90 天内 1
层级分布 · 90 天
主题
时间线
  1. 2026-06-04 research_milestone China's CAICT is launching the 'High-Quality Token Service Capability Climbing Plan' to improve AI services. 来源
情绪 · 30 天

9 天有情绪数据

最近 · 第 1/3 页 · 共 46 条
  1. COMMENTARY · CL_177811 ·

    LLM 的上下文管理策略以应对不断增长的对话

    管理 LLM 中的对话上下文需要仔细的策略,以避免超出 token 限制。简单的截断最旧消息的方法很粗暴,可能会丢失关键信息。更高级的技术包括滑动窗口、使用更便宜的模型总结对话的旧部分,或固定系统提示和关键事实等重要消息。一种健壮的方法结合了这些技术,确保对话历史适合模型的上下文窗口,同时保留连贯响应所需的必要细节。

  2. COMMENTARY · CL_173675 ·

    中国电力行业报告喜忧参半;AI算力转向TaaS模式

    多家中国电力及设备公司已发布年中财务报告,显示该行业业绩参差不齐。水电公司受益于充沛的降雨,利润大幅增长。与此同时,新能源电力系统设备制造商的销售强劲。在另一项发展中,算力行业正将其商业模式从硬件租赁转向“Token即服务”(TaaS)模式,专注于Token收入和服务的交付。

  3. RESEARCH · CL_173676 ·

    AI算力从硬件租赁转向Token即服务

    高端算力行业正经历价格上涨,促使头部公司探索以“Token工厂”为中心的商业模式。这一转变标志着从单纯出租硬件转向提供基于“Token”(Token-as-a-Service,简称TaaS)的服务。多家上市公司已宣布探索“Token工厂”业务的意向,表明竞争焦点正从硬件资源转向服务销售。

  4. RESEARCH · CL_166801 ·

    LLM上下文窗口扩展到100万个令牌以上,带来了新的用例但也带来了新的挑战

    大型语言模型(LLM)以称为令牌的离散单元处理信息,“上下文窗口”定义了模型在单个请求中可以处理的最大令牌数。虽然早期模型的令牌数量限制在几千个,但随着技术的进步,这一数字已超过一百万,从而能够处理分析整个法律文件或代码库等新用例。然而,仅仅填满上下文窗口并不能保证更好的结果,因为模型可能会在长输入中间的信息中遇到困难,这种现象被称为“中间迷失”。

  5. RESEARCH · CL_166678 ·

    百度加速香港主板上市转换;代币代理行业面临审查

    百度正加速其自愿性转为主板在香港交易所上市的进程,并定于8月26日召开特别股东大会以批准相关决议。此举紧随其7月16日的公告和7月22日交易所确认收到的信息,显示出快速进展。文章还触及了新兴但存在问题的海外大模型代币代理行业,该行业利用漏洞牟利,同时引发数据安全担忧并挑战监管。

  6. COMMENTARY · CL_166679 ·

    海外AI代币转售商因欺诈和数据风险面临审查

    一个新兴的海外大模型代币转售行业正在迅速发展,为创作者和企业提供看似低成本的AI模型访问途径。然而,该行业处于法律灰色地带,有报道称存在欺诈行为,如虚报账单、模型替换和套利。由于传输过程中安全措施不足,用户数据也面临风险。这些转售商的隐秘性质和跨境运营给监管带来了重大挑战。

  7. COMMENTARY · CL_165538 ·

    AI基础设施在Agentic AI需求激增之际,将重心从GPU规模转向效率 · 跟踪1个来源

    在WAIC 2026上,AI基础设施高管们讨论了一个重要的行业转变:从关注GPU集群和原始计算能力,转向强调效率、成本效益和稳定的代币生产。这种变化是由代币消耗的指数级增长驱动的,特别是来自Agentic AI应用,预计这些应用将在未来消耗绝大多数代币。行业正朝着“AI工厂”和“代币工厂”模式发展,重点是可扩展、可靠且成本高效的代币生成,而不仅仅是纯粹的规模。这个被称为“后扩展时代”的新时代,优先考虑系统效率、资源利用率和能源效率,以…

  8. RESEARCH · CL_159215 ·

    中国批准 Cindell Hilary Casusol Casas 的首次公开募股;北京推动代币经济

    中国证券监管机构已批准苏州 Cindell Hilary Casusol Casas 的首次公开募股注册,允许该公司在科创板上市。另外,北京发布了促进智能体和代币经济发展的措施,鼓励在专用处理器和推理芯片方面进行创新,以降低成本和提高效率。这些举措旨在通过计算能力代金券等激励措施,创建代币即服务 (TaaS) 和代理即服务 (AaaS) 等新业务模式。

  9. RESEARCH · CL_156107 ·

    Google开发新AI芯片;北京规划“通证工厂”;腾讯发布AI Agent · 追踪1个来源

    Google正在开发一款代号为“Frozen v2”的新AI服务器芯片,以提升其Gemini模型的性能,目标是显著提高每单位能量的token处理能力,优于其当前的TPU。与此同时,北京正规划建立“通证工厂”和分发平台,以促进通证经济的发展和应用,并大幅提升智能算力。此外,腾讯混元AI已推出Hyra-1.0,这是一个为研究和工程任务设计的自改进Agent,能够迭代各种开放场景下的策略。

  10. RESEARCH · CL_155191 ·

    北京计划建设“算力券”工厂,AI算力将提升5万PFLOPS

    北京将通过建设“算力券”工厂,并力争在下半年新增5万PFLOPS的智能算力,来显著提升其AI能力。该举措是其更广泛的数字经济战略的一部分,该数字经济在今年上半年核心产业增长了9.8%。该计划包括制定算力经济政策,在旅游和文化等领域推广AI应用,并构建“RISC-V + AI OS”的开源生态系统,以支持自主技术系统。

  11. RESEARCH · CL_153877 ·

    无问芯穹调整AI基础设施战略以应对“Token刺客”

    AI基础设施公司无问芯穹正将其战略从连接模型和芯片,转变为“前店、后厂、一中心”的Agentic Infra模式。这一转变旨在解决企业在扩展AI应用时面临的日益增长的成本和效率低下问题,这些问题被称为“Token刺客”。该公司致力于成为一个中立平台,优化计算能力向有价值的AI服务的转化,类似于石化行业的炼油厂。无问芯穹认为AI商业飞轮正在转动,Token使用成本有进一步降低的巨大潜力,这将推动竞争转向应用边界,而非仅仅是模型能力。

  12. TOOL · CL_148448 ·

    商汤在WAIC 2026上发布AI Agent,提升每瓦特Token产出

    商汤在2026世界人工智能大会(WAIC 2026)上发布了新的“计算-电力协同Agent”。该Agent旨在通过引入新的指标TPW(Tokens Per Watt,每瓦特产生的Token数)来优化AI数据中心的效率,该指标衡量单位电费产生的Token价值。在商汤临港AIDC的初步部署中,该系统已显示出单位电费Token产出提升80%,平均电费价格降低10%。

  13. COMMENTARY · CL_147339 ·

    AI算力竞赛从硬件规模转向优化 · 追踪1个来源

    AI算力竞争格局正从硬件规模转向优化。随着Token计费模式的兴起,累积GPU的边际效益递减,效率成为新的战场。这一趋势体现在“精算Token工厂”的推出,它标准化了算力供应,以及“驱鲸科技”获得的巨额融资,表明投资者对优化技术的浓厚兴趣。然而,芯片架构碎片化、全栈人才短缺和集群不稳定等挑战依然存在,预示着算力“软实力”的竞争才刚刚开始。

  14. TOOL · CL_134048 ·

    GPT-2 解码器机制:深入解析下一个词的预测

    本文提供了一个关于 GPT-2 解码器模型如何预测下一个词的详细分步解释。它追踪单个向量在模型层中的旅程,说明了每一次矩阵乘法和参数计数。解释强调,解码器层是在原地重写固定宽度的向量,而不是压缩或替换 token,最终产生下一个词的概率分布。

  15. COMMENTARY · CL_131003 ·

    Galaxy Securities:AI算力租赁公司转向代币化模式

    Galaxy Securities 建议关注头部算力租赁公司,指出由于 AI 推理需求的激增,其业务模式正在发生转变。传统的按小时销售算力的模式正演变为“代币工厂”模式,定价与代币产出和单位成本挂钩。这种新模式使基础设施提供商能够更好地与大型模型公司合作,并参与代币经济的价值分配,从而可能提高租赁公司的利润率和估值。

  16. COMMENTARY · CL_123782 ·

    AI Token 成本飙升,尽管使用量增加导致价格下降

    尽管每个 Token 的价格有所下降,但使用大型语言模型的成本(以 Token 计费)正成为企业重要的运营开销。这种悖论的出现是因为 AI 代理、检索增强生成(RAG)以及持续运行的后台进程的日益普及,极大地增加了 Token 的消耗量。诸如低效的上下文窗口管理、涉及多次模型调用的复杂代理工作流以及不同模型之间不同的 Token 化策略等因素,都导致了账单的膨胀。企业现在正专注于“AI FinOps”(AI 财务运营),实施诸如基于任…

  17. RESEARCH · CL_121682 ·

    中国AI算力大会探讨代币经济与GW级集群

    在深圳举行的2026中国智能计算行业生态发展年会汇聚了2000多名行业代表,共同探讨AI在应用和代币经济领域的未来。主要议题包括开发“算力互联网”以高效整合和访问分布式计算资源,优化用于AI推理的混合计算架构,以及构建GW级算力集群的挑战与机遇。讨论还涉及AI原生组织的演变、世界模型在物理智能体中的作用,以及AI规模化部署的基础设施需求。

  18. COMMENTARY · CL_118395 ·

    网络安全中的人工智能面临高昂的令牌成本

    人工智能日益融入网络安全商业模式是一把双刃剑。虽然人工智能为CISO提供了潜在的好处,但人工智能在网络安全中的代理性质意味着令牌消耗没有内在限制。这可能导致在对企业IT网络进行的一次复杂调查中消耗数百万个令牌,从而变得成本高昂。

  19. COMMENTARY · CL_115938 ·

    百度将AI焦点从Token转向主动代理

    百度正在将其在AI行业的焦点从Token消耗和价格战转移到一个新指标上:日活跃代理(DAA)。该指标旨在衡量AI代理在企业应用中的真正价值和持续效用,超越简单的资源使用。百度认为,长期成功在于将AI代理整合到核心业务流程中,在那里它们可以持续创造价值,而不仅仅是销售计算资源。

  20. COMMENTARY · CL_110452 ·

    中国AI应用连续7周引领全球代币使用量

    中国公司在人工智能应用采用方面处于世界领先地位,其代币使用量已连续七周位居全球第一。这种快速发展归因于中国企业对技术的强烈信任和好奇心,使他们能够比其他地方的同行更快地整合创新。专家指出,这些进步正超越实验室,影响着包括制造业、能源和医疗保健在内的各个行业。