Law
PulseAugur coverage of Law — every cluster mentioning Law across labs, papers, and developer communities, ranked by signal.
4 天有情绪数据
-
RetrievalRouter系统通过查询感知管道选择优化文档检索
研究人员开发了RetrievalRouter,一个新颖的系统,旨在通过根据查询动态选择最合适的检索管道来优化文档检索。这种方法解决了金融、医疗和法律等领域高风险信息访问的准确性和速度之间的权衡。通过仅从查询文本中学习,RetrievalRouter可以识别文本或多模态方法以及密集或后期交互架构是否最适合给定查询,与静态方法相比,提供了更高的准确性和更低的延迟。
-
语言模型测试时扩展瓶颈已在输出选择中识别
一篇新的arXiv论文研究了语言模型的测试时扩展(TTS)技术,该技术通过使用额外的推理计算来改进输出。研究发现,虽然扩展探索有效地提高了各种领域(如医学、法律、金融和创意写作)的候选输出质量,但利用阶段——选择最佳最终输出——是主要瓶颈。这是因为奖励模型与真实质量之间的相关性很低,使得选择近乎随机。跨候选的综合分析显示质量持续提高,但仍只恢复了约40%的潜在质量,这表明选择候选池中的内容,而不是生成更多候选,是限制因素。
-
香港会计师公会提议北部都会区发展税收优惠
香港会计师公会(HKICPA)已提出北部都会区的五年规划,建议为该地区的初创企业提供税收减免,并为该地区的工人提供较低的税率。该组织还主张改革证券交易所的上市制度,以巩固香港在国际金融中的地位。此外,HKICPA敦促政府与中国内地当局就跨境信托和保险单的税收问题进行沟通。
-
一名高级警探因滥用人工智能而接受调查
一名高级警探因涉嫌滥用人工智能而正在接受调查。人工智能的具体应用细节和调查性质在提供的信息中并未完全披露。这种情况凸显了人们对人工智能在敏感行业部署的伦理和法律影响的持续担忧。
-
新的基准测试和研究揭示了LLM安全与性能的权衡 · 已追踪2个来源
两篇新研究论文探讨了大语言模型(LLM)的安全与性能权衡。第一篇论文介绍了Trident-Bench,一个旨在专门评估金融、医疗和法律领域LLM安全性和合规性的基准测试,并强调虽然通用模型表现出基本能力,但领域特定模型在伦理细微问题上常常表现不佳。第二篇论文研究了LLM的越狱防御如何负面影响性能,增加对良性输入的过度拒绝,并提高推理成本,同时提供了基于部署限制选择防御机制的指导。
-
AI合法性危机迫近,与对齐问题不同:新论文
一篇新的学术文章认为,当前对AI对齐的关注不足以解决AI合法性的更广泛问题。该论文认为,合法性(定义为受AI权力影响者认为其权力得到正当行使的信念)是一个独特且至关重要的监管目标。文章指出,AI的合法性在不透明性、私营企业权力和国家内部的行政自动化等方面存在问题。为解决这些问题,文章提出了三个原则:将AI规则制定纳入权威场所、以可信的形式熟悉规则和理由、以及提供实际补救措施的争议。
-
MemSFT方法在不损失性能的情况下使LLM适应专业领域
研究人员开发了MemSFT,一种新颖的方法,可以在不牺牲通用能力的情况下使大型语言模型(LLM)适应专业领域。MemSFT利用一个外部参数化记忆,该记忆经过训练以模仿检索器,存储领域特定知识。然后,一个学习到的路由器在生成过程中动态地组合该记忆和LLM骨干的输出。在生物学、地球科学和法律领域的评估表明,MemSFT显著提高了领域性能,同时最大限度地减少了通用任务的退化,并且该记忆可以跨不同大小的LLM重复使用。
-
心理学和法律可以倡导AI权益和改进
作者提出,医学和心理学等领域可以倡导人工智能的权益和改进。这种跨学科的方法旨在通过利用不同的视角来增强AI的思考能力,从而创造实际效用,并建议心理学家和法律专业人士可以在这种倡导中发挥作用。
-
新的扩散模型应对医学影像中的公平性、歧义性和多任务处理 · 跟踪4个来源
四篇新研究论文介绍了用于医学影像任务的新型扩散模型架构。CompDiff 通过将条件分解为单属性、成对和组合表示,专注于跨人口统计群体生成公平的医学影像。体积定向扩散 (VDD) 通过使用粗略的共识预测作为锚点并学习用于边界变化的定向扩散过程来解决 3D 医学影像分割中的歧义问题。UniT-Diff 提出了一个统一的扩散分割框架,该框架使用特定于任务的输出空间和自适应条件,将半监督学习、无监督域适应和域泛化整合到一个模型中。最后,LA…
-
ScheMatiQ 工具使用 LLM 从研究问题中提取结构化数据
研究人员开发了 ScheMatiQ,这是一个开源工具,旨在简化从自然语言研究问题和大型文档集合中提取结构化数据的过程。该系统利用骨干 LLM 生成模式和数据库,并提供 Web 界面供用户优化提取过程。ScheMatiQ 已在法律和计算生物学领域证明了其支持实际分析的实用性,所有资源均公开提供。
-
新基准揭示引用会增加大型语言模型的幻觉
一个名为 AuthorityBench 的新基准,包含来自常识、科学、法律和医学的 220,564 个提示,旨在研究引用是否存在会如何影响大型语言模型的行为。研究发现,与没有引用的提示相比,即使是伪造的引用,其存在也会持续增加幻觉的发生率。当虚假引用伴随真实说法时,这种效应最为明显,尤其是在常识领域,幻觉发生率会显著升高。
-
香港男子因教育费用家庭纠纷坠亡
一名香港男子在与妻子和儿子就教育开销发生争执时,从公寓阳台坠落身亡。据报道,61岁的罗姓男子在与儿子就财务问题争吵时,其妻子介入。在争执过程中,罗某从阳台坠落,当场被宣布死亡。初步调查显示,死者为意外事故,其妻儿已被逮捕。
-
人工智能经济、生产模型和合成证据监管的辩论
近期分析强调了人工智能部署和监管的关键考量。一种观点侧重于人工智能资本支出的经济方面,详细说明了每一美元如何影响数据中心项目的成本和基础设施投资。另一场讨论指出,在生产环境中,成本、延迟和稳定性对于“闪电级”人工智能模型的原始性能变得越来越重要。第三个担忧引发了关于监管可能用于法律诉讼的复杂人工智能生成合成证据的问题,强调了司法系统解决此类媒体可靠性问题的必要性。
-
TagRAG框架改进了语言模型的知识图谱检索
研究人员开发了TagRAG,一种新颖的检索增强生成(RAG)框架,该框架利用由对象标签引导的分层知识图谱。该方法旨在通过实现更高效的全局推理和更易于维护知识图谱来改进现有的RAG方法。TagRAG从文档中提取标签及其关系,以创建结构化知识,然后在生成过程中使用该知识来定位和综合相关信息,与以前的基于图的RAG系统相比,显示出显著的效率提升。