Cosine
PulseAugur coverage of Cosine — every cluster mentioning Cosine across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
公布了用于 Gromov-Wasserstein 嵌入的新归纳式框架
研究人员开发了一种新的 Gromov-Wasserstein 多维标度 (GW-MDS) 归纳式框架,该框架允许映射未见过的样本。这种方法称为重心蒸馏,它使用教师模型从训练数据中学习潜在表示和最优传输计划。然后,学生神经网络通过利用重心投影来学习显式的样本外映射,从而有效地将传导式 GW 嵌入与归纳式神经网络映射联系起来。实验表明,这种蒸馏模型在新数据上保留了教师的几何结构,并且优于直接的神经网络 GW 训练。
-
新的归纳框架支持对未见数据的GW-MDS映射
研究人员开发了一种用于Gromov-Wasserstein多维缩放(GW-MDS)的归纳框架,该框架能够对未见样本进行映射,克服了先前方法的转导限制。这种新方法称为重心蒸馏,包括一个GW-MDS“教师”模型,该模型从训练数据中学习潜在空间和最优传输计划。然后,“学生”神经网络通过重心投影将教师的耦合转换为样本对齐的目标,从而学习显式的样本外映射。实验表明,这种蒸馏模型能够有效地在新数据上保留教师的几何特性,并且优于直接的神经GW训练。
-
新理论解释了混合 Sobolev 空间中的浅层神经网络逼近
研究人员开发了一个新的理论框架,用于理解浅层神经网络如何在混合 Sobolev 空间中逼近函数。该框架建立了一个与激活函数无关的傅里叶块原理,该原理规定逼近率取决于目标函数的混合光滑度和激活函数的单变量逼近阶数。该研究还引入了一个结构化的单变量逼近条件,用于验证该原理对 ReLU^k、ELU 和余弦等特定激活函数,从而深入了解它们的最优逼近指数。
-
BanglaMed-QA系统上线,旨在改善孟加拉语使用者的医疗服务可及性
研究人员开发了BanglaMed-QA,一个旨在提供孟加拉语医疗支持的新型问答系统。该系统利用了涵盖多个医疗类别的4400多个问答对的知识库,并整合了领域特定的语言工具,如词根词典和词性标注。评估显示,在自动化测试中达到了95%的F1分数,并获得了高的人类满意度评分,表明其有潜力弥合孟加拉语使用者的医疗信息鸿沟。
-
新的RareSense框架增强了交易数据中的异常检测能力
研究人员开发了RareSense,一个用于交易数据异常检测的新型框架。该系统解决了传统相似性度量(如Jaccard和Cosine)的局限性,这些度量常常受到频繁属性的偏倚。RareSense识别并利用最小稀有项集来创建关联规则,将对象映射到配置文件中,然后使用加权Jaccard相似性进行比较。在各种基准数据集上的实验表明,RareSense在检索性能上显著优于现有方法,特别是在异常表现出可重复的稀有高阶结构时。
-
文本嵌入的几何形状决定了最优相似度度量
研究人员确定了文本嵌入的几何特性,这些特性决定了比较它们的最佳相似度度量。虽然余弦相似度是标准度量,但研究表明在某些条件下其他度量可以表现得更好。一项针对各种编码器和数据集的综合实证研究表明,如果编码器均匀分布其方差,则余弦相似度是最佳选择。然而,当方差集中到主导方向(各向异性)时,基于秩和 L1 型的度量比余弦有显著改进。
-
新AI模型CoSiNE通过模拟进化增强抗体工程
研究人员开发了CoSiNE,一种用于抗体工程的新型深度学习模型,它超越了传统方法。与将抗体序列视为独立样本的方法不同,CoSiNE明确地模拟了进化过程,并纳入了亲和力成熟的信息。这使得它能够更好地捕捉复杂的上位相互作用,并将选择与体细胞高突变区分开来,在变异效应预测方面优于当前的语言模型。
-
英国启动6.75亿美元基金,以促进国内AI初创公司和创新
英国政府已启动一项新的5亿英镑(合6.75亿美元)主权AI基金,以支持国内AI初创公司。该计划旨在促进创新、创造就业机会,并将英国定位为AI发展的领导者。该基金将提供资本、超级计算资源以及简化的签证流程以吸引全球人才,同时提供数据访问和产品验证支持。
-
Cosine Genie 利用 GPT-4o 微调成为顶级编码代理
Cosine 推出了 Genie,一个编码代理,在 SWE-Bench 基准测试中取得了最高排名,显著超越了之前的领先者。这一成功归功于在数十亿个合成生成的代码和运行时错误 token 上微调 OpenAI 的 GPT-4o 模型。OpenAI 与 Cosine 在微调过程的规模和细节方面进行了合作,包括 LoRA 适配器的动态调整。Genie 采用四阶段工作流程,旨在以适合直接集成到代码库的格式输出代码。
-
OpenAI 发布 GPT-4o,支持微调和增强的多模态能力
OpenAI 已为其 GPT-4o 模型推出了微调功能,允许开发者针对特定应用定制其性能和语气。此功能适用于付费套餐,为开发者提供了提高准确性和降低成本的机会,并在软件工程和 SQL 生成方面取得了初步成功。此外,OpenAI 宣布在 9 月 23 日之前,为组织提供 GPT-4o 每天 100 万个训练 token 的免费访问权限,GPT-4o mini 为 200 万个。