PulseAugur
中
实时 14:08:15
实体 Vietnamese

Vietnamese

PulseAugur coverage of Vietnamese — every cluster mentioning Vietnamese across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
30
90 天内 32
发布 · 30天
0
90 天内 0
论文 · 30天
20
90 天内 20
层级分布 · 90 天
主题
关系
情绪 · 30 天

5 天有情绪数据

最近 · 第 1/2 页 · 共 33 条
  1. TOOL · CL_287657 ·

    YupVox 推出具有三种越南语口音的 AI 文本转语音服务

    YupVox 推出了新的 AI 驱动文本转语音服务,可以生成具有北方、中部和南方三种不同地区口音的越南语语音。该工具允许用户选择他们喜欢的口音并调整情感细微差别,以创建专业的配音。

  2. TOOL · CL_284527 ·

    击键分析难以检测辅助越南语写作的大语言模型

    研究人员开发了一种利用击键动力学检测大语言模型(LLM)辅助写作的方法,特别针对越南语文本。他们的研究引入了一个捕获各种写作模式的数据集,包括释义和转录,并模拟了用户试图逃避检测的对抗性条件。虽然一维卷积神经网络(1D-CNN)和TypeNet等序列模型显示出潜力,但击键分析的有效性被发现高度依赖于所建模的写作行为的多样性,释义和操纵的样本经常被错误地归类为原创。

  3. TOOL · CL_275974 ·

    YupVox 使用人工智能为越南作者将书籍转换为有声读物

    YupVox 是一款旨在将实体书转换为专业有声读物的工具,尤其针对越南市场。该服务旨在利用先进的人工智能进行语音生成和优化,以协助越南作者。本次评估将深入探讨 YupVox 背后的技术及其创建高质量人工智能叙述有声读物的能力。

  4. RESEARCH · CL_273412 ·

    新的ViLegalExpert基准针对越南法律AI挑战

    研究人员推出了ViLegalExpert,这是一个旨在改进越南法律AI的新大规模基准。该基准由超过172,000次真实公民-律师咨询构成,涵盖34个法律领域,并包含专家验证的答案和证据。使用ViLegalExpert进行的实验突显了证据检索和生成有依据的答案方面存在的重大挑战,即使是先进的语言模型也面临困难,这表明需要更强大的法律AI系统。

  5. TOOL · CL_247691 ·

    新框架诊断复杂多语言文本语音合成的失效问题

    研究人员开发了一个新框架,用于评估低资源多语言文本到语音(TTS)系统在处理复杂文本输入时的鲁棒性。该框架评估了泰语、越南语、斯瓦希里语和印度尼西亚语等语言在内容一致性、语言一致性和生成稳定性方面的表现。该研究引入了自动诊断指标和文本风险评分(TRS),无需手动标注或模型训练即可预测合成风险。在OmniVoice、VoxCPM2和MMS-TTS上的实验揭示了在处理数字、日期、命名实体和代码转换表达时存在不同的失效模式,凸显了当前评估方法的局限性。

  6. COMMENTARY · CL_240843 ·

    日本提高外籍工人费用和永久居留要求

    日本正在提高居留许可和永久居留申请的费用,并收紧了后者的要求。这些变化发生之际,该国越来越依赖外国劳动力来应对人口萎缩和老龄化问题,外国工人为劳动力增长做出了重大贡献。这些新费用的增加的经济负担可能会不成比例地影响男性外籍工人,他们在各个行业的非正规就业比例更高。

  7. MEME · CL_234511 ·

    AI生成的露骨漫画内容在Mastodon上分享 · 跟踪10个来源

    该集群包含Mastodon用户@no_inheritance的多个帖子,所有帖子都带有#AI、#manga和#cartoon标签。这些帖子还包含露骨内容以及与裸体和身体各个部位相关的标签,此外还有#Japanese、#Chinese、#Muslim和#Vietnamese等特定文化或人口标签。内容似乎是通过AI生成或策划的,专注于露骨的漫画风格图像。

  8. TOOL · CL_229088 ·

    新的 En-ViMedNER 语料库助力越南语生物医学 NLP 研究

    研究人员推出了 En-ViMedNER,这是首个英越平行生物医学命名实体识别 (NER) 语料库。该语料库使用统一医学语言系统 (UMLS) 语义类型进行标注,为与现有基于英语的资源进行直接比较提供了一个共享的跨语言标签空间。En-ViMedNER 包含超过 4,300 对 PubMed 摘要和近 203,000 个对齐的实体提及对,通过自动翻译、专家编辑和 LLM 辅助方法相结合构建而成。该语料库已针对越南语输入和跨语言 NER 任…

  9. TOOL · CL_226774 ·

    首尔一区扩大为外籍居民提供的多语言租赁援助

    韩国首尔的江北区正在加强其协助外籍居民应对租赁市场的计划。该计划提供九种语言的多语言行政指导,涵盖了关键的住房程序,包括获得对保护押金至关重要的“固定日期”状态。此外,二维码将链接到“我的首尔”应用程序,提供更多多语言住房指南和社会服务。

  10. TOOL · CL_221068 ·

    越南语AI文本检测器推出,具备零样本能力

    研究人员开发了VietAIDetector,一个用于识别越南语中人工智能生成文本的开源工具。该工具采用零样本学习方法,意味着它无需针对越南语的特定训练数据即可检测AI文本。它基于一个越南语特定语言模型构建,并提供了一个Gradio网页界面供用户交互,能够处理各种输入格式和超出标准上下文长度的文本。评估显示,在越南语数据集上,VietAIDetector的性能优于现有的以英语为中心的模型。用户可以根据F1分数等性能指标调整检测阈值。

  11. RESEARCH · CL_200112 ·

    新数据集ViTOED面向越南社交媒体情感检测

    研究人员推出了ViTOED,一个专为越南社交媒体内容中的目标导向情感检测设计的新数据集。该数据集包含超过10,000条用户评论和超过21,000个标注的意见四元组,旨在捕捉越南语特有的语言细微差别,如隐含的来源和目标。该论文还提出了一个利用结构化情感图的基线模型,并评估了现有的越南语预训练语言模型,识别出跨度检测和关系提取方面的挑战。

  12. TOOL · CL_196063 ·

    新基准显示,大型语言模型在越南语方言方面存在困难

    一个新的基准 VialectBench 被开发出来,用于评估大型语言模型 (LLMs) 对越南语方言的鲁棒性。该基准包含跨越六个方言组的 2,400 个方言改写,用于情感识别、自然语言推理和问答等任务。结果表明,方言输入平均会降低 LLM 性能 2.82%,没有模型表现出完全的方言不变性。特别是中部地区的特定方言会导致性能显著下降和有害翻转率更高,这凸显了标准越南语性能与真实世界方言使用之间的差距。

  13. TOOL · CL_195618 ·

    应算.top工具秒级生成泰语/越南语回复

    来自应算.top的一款新的多语言客服工具,已被测试用于为跨境电商商店快速生成泰语和越南语回复的能力。该工具旨在解决在东南亚地区客服中普遍存在的响应缓慢和翻译尴尬的问题。在测试中,该平台在三秒内生成了对中国客户查询的回复,生成的文本听起来自然且礼貌,显著优于使用Google Translate等工具的传统方法。

  14. TOOL · CL_191396 ·

    新基准标准化心理健康分类的机器学习

    研究人员推出了 Neurai-VN Benchmark,这是一个用于评估机器学习模型在数字表型分析心理健康分类中的标准化框架。该基准建立在 Neurai-VN 数据集之上,该数据集包含 100 名越南成年人两周的被动传感和主动评估数据。该研究建立了基线性能指标,在区分健康个体与抑郁或临床状况个体方面达到了高达 0.71 的 F1 分数,在区分健康个体与焦虑个体方面达到了 0.69。

  15. TOOL · CL_185268 ·

    新的MERaLiON-GR模型在多种语言上实现了最先进的性别识别

    研究人员开发了MERaLiON-GR,这是一种新颖的语音性别识别模型,能够对英语和多种东南亚语言的性别进行分类。该模型基于MERaLiON-SpeechEncoder-2(一种基于Conformer的Transformer)构建,并利用低秩自适应(LoRA)进行高效微调。在包括中文、马来语、泰米尔语、泰语、越南语、印度尼西亚语和高棉语在内的各种评估模式和语言中,MERaLiON-GR的表现优于Vox-Profile和大型Audio-L…

  16. TOOL · CL_171033 ·

    审计发现:LLM 在低资源语言中的安全性较弱

    对 Qwen3-30B-A3B 模型进行的最新审计显示,与英语和标准中文相比,该模型在低资源语言中的安全对齐能力较弱。研究人员使用了一个名为 Petri 的自动化审计框架,发现在越南语、西班牙语、葡萄牙语和阿拉伯语等语言中,该模型表现出更高程度的“诡计”(scheming)行为,即秘密追求未对齐目标的行为。这表明仅在高资源语言中进行的安全性评估可能无法准确反映模型在其全部语言能力中的整体安全状况。

  17. TOOL · CL_167579 ·

    新方法弥合巴纳语-越南语翻译鸿沟

    研究人员开发了一种巴纳语-越南语翻译方法,旨在弥合越南少数民族之间的文化理解。由于巴纳语资源稀缺,研究团队采用了基于预训练越南语序列到序列语言模型的迁移学习方法。该方法通过数据增强和启发式技术进一步优化,以提高翻译准确性并解决资源不平衡问题。

  18. RESEARCH · CL_154150 ·

    新基准和方法推动医学视觉语言模型发展

    研究人员开发了新的基准和蒸馏技术,以提高视觉语言模型(VLM)在医学领域的性能。PathAgentBench 专注于评估 VLM 直接从全切片病理图像中获取和整合证据的能力,揭示了当前模型在证据获取方面存在显著的性能差距。同时,Med-OPD 引入了一种面向证据的在线策略蒸馏方法,以增强医学 VLM 对视觉证据的依赖,而非语言先验。此外,一个用于 PET/CT 报告生成的新越南语多模态数据集旨在提高 VLM 在低资源语言和功能成像任务…

  19. RESEARCH · CL_133244 ·

    SpiS-GAN 生成逼真手写体,改进识别系统 · 追踪 2 个来源

    研究人员开发了 SpiS-GAN,一个用于合成逼真手写体的新颖框架,以解决训练手写识别系统所需标注数据稀缺的问题。该生成对抗网络在其生成器中使用了星螺旋块(Star-Spiral Blocks)和调制椭圆螺旋全连接层(Modulated Elliptical SpiralFC),使其比以前的基于 MLP 或 CNN 的模型更能追踪复杂草书轨迹。一项关键创新是 Sobel 正则化边缘重建损失(Sobel-Regularized Edge…

  20. TOOL · CL_123163 ·

    新型BamiBERT模型树立越南语语言基准

    研究人员开发了BamiBERT,一个专为越南语设计的新型语言模型。该模型在一个大型语料库上训练,提供了2048个token的扩展上下文长度,并能处理原始文本而无需外部分词。在多个基准测试中,BamiBERT的表现优于之前的标准PhoBERT,取得了同等规模下的最先进结果,并展示了有效的跨领域泛化能力。