British Library
PulseAugur coverage of British Library — every cluster mentioning British Library across labs, papers, and developer communities, ranked by signal.
1 天有情绪数据
-
AI开发见证LLM底层优化回归
作者反思了AI开发中底层优化(特别是针对大型语言模型LLM)的复兴。他回忆起自己早期在8位机器上优化矩阵乘法的经历,以及后来在2008年为大英图书馆构建的一个神经网络,该网络依赖于相同的基本操作:矩阵乘法和激活函数。作者指出,这个核心概念仍然是现代LLM的关键,知识被编码在权重矩阵中,类似于突触。作者还分享了一个关于为GPU开发HLSL着色器程序的轶事,这项技能在多年后他开始构建自己的推理引擎时出乎意料地派上了用场。这个引擎最初是用H…
-
Meta、Alibaba 的 AI 机器人几乎摧毁了 LGBT 历史档案库
来自 Meta 和 Alibaba Group 的 AI 爬虫几乎导致了志愿者运营的 LGBT History Project(自 2011 年以来浏览量超过 5000 万)瘫痪。大量的机器人流量显著减慢了网站速度并增加了运营成本。该档案库已被大英图书馆保存,但由于此次抓取活动,其可访问性面临严重威胁。
-
英国国家图书馆通讯涵盖人工智能、开放科学和文化遗产
英国国家图书馆的学术交流通讯七月刊已发布,重点介绍了恢复的 EThOS 平台和联合国教科文组织开放科学平台。该通讯还包括有关文化遗产、开放基础设施、人工智能和开放数据的新闻。
-
Meta AI 爬虫耗尽小型社区网站资源
Meta 的 AI 网络爬虫通过发出过多的请求,对小型、志愿者运营的社区网站造成了不成比例的影响,导致网站所有者托管成本增加。作者经营着 LGBT History Project 网站,发现一个 Meta 爬虫在一日半内发出了超过 230,000 次请求,消耗了该网站近一半的带宽并使其产生费用。这种行为源于 AI 对所有 URL 的不加区分地抓取,包括低价值的重复内容和机器生成的页面,如编辑历史和差异页面,而更复杂的爬虫会忽略这些。