PulseAugur
实时 04:51:08
实体 Vietnamese

Vietnamese

PulseAugur coverage of Vietnamese — every cluster mentioning Vietnamese across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
8
90 天内 23
发布 · 30天
0
90 天内 0
论文 · 30天
5
90 天内 16
层级分布 · 90 天
主题
关系
情绪 · 30 天

6 天有情绪数据

最近 · 第 1/2 页 · 共 23 条
  1. RESEARCH · CL_200112 ·

    新数据集ViTOED面向越南社交媒体情感检测

    研究人员推出了ViTOED,一个专为越南社交媒体内容中的目标导向情感检测设计的新数据集。该数据集包含超过10,000条用户评论和超过21,000个标注的意见四元组,旨在捕捉越南语特有的语言细微差别,如隐含的来源和目标。该论文还提出了一个利用结构化情感图的基线模型,并评估了现有的越南语预训练语言模型,识别出跨度检测和关系提取方面的挑战。

  2. TOOL · CL_196063 ·

    新基准显示,大型语言模型在越南语方言方面存在困难

    一个新的基准 VialectBench 被开发出来,用于评估大型语言模型 (LLMs) 对越南语方言的鲁棒性。该基准包含跨越六个方言组的 2,400 个方言改写,用于情感识别、自然语言推理和问答等任务。结果表明,方言输入平均会降低 LLM 性能 2.82%,没有模型表现出完全的方言不变性。特别是中部地区的特定方言会导致性能显著下降和有害翻转率更高,这凸显了标准越南语性能与真实世界方言使用之间的差距。

  3. TOOL · CL_195618 ·

    应算.top工具秒级生成泰语/越南语回复

    来自应算.top的一款新的多语言客服工具,已被测试用于为跨境电商商店快速生成泰语和越南语回复的能力。该工具旨在解决在东南亚地区客服中普遍存在的响应缓慢和翻译尴尬的问题。在测试中,该平台在三秒内生成了对中国客户查询的回复,生成的文本听起来自然且礼貌,显著优于使用Google Translate等工具的传统方法。

  4. TOOL · CL_191396 ·

    新基准标准化心理健康分类的机器学习

    研究人员推出了 Neurai-VN Benchmark,这是一个用于评估机器学习模型在数字表型分析心理健康分类中的标准化框架。该基准建立在 Neurai-VN 数据集之上,该数据集包含 100 名越南成年人两周的被动传感和主动评估数据。该研究建立了基线性能指标,在区分健康个体与抑郁或临床状况个体方面达到了高达 0.71 的 F1 分数,在区分健康个体与焦虑个体方面达到了 0.69。

  5. TOOL · CL_185268 ·

    新的MERaLiON-GR模型在多种语言上实现了最先进的性别识别

    研究人员开发了MERaLiON-GR,这是一种新颖的语音性别识别模型,能够对英语和多种东南亚语言的性别进行分类。该模型基于MERaLiON-SpeechEncoder-2(一种基于Conformer的Transformer)构建,并利用低秩自适应(LoRA)进行高效微调。在包括中文、马来语、泰米尔语、泰语、越南语、印度尼西亚语和高棉语在内的各种评估模式和语言中,MERaLiON-GR的表现优于Vox-Profile和大型Audio-L…

  6. TOOL · CL_171033 ·

    审计发现:LLM 在低资源语言中的安全性较弱

    对 Qwen3-30B-A3B 模型进行的最新审计显示,与英语和标准中文相比,该模型在低资源语言中的安全对齐能力较弱。研究人员使用了一个名为 Petri 的自动化审计框架,发现在越南语、西班牙语、葡萄牙语和阿拉伯语等语言中,该模型表现出更高程度的“诡计”(scheming)行为,即秘密追求未对齐目标的行为。这表明仅在高资源语言中进行的安全性评估可能无法准确反映模型在其全部语言能力中的整体安全状况。

  7. TOOL · CL_167579 ·

    新方法弥合巴纳语-越南语翻译鸿沟

    研究人员开发了一种巴纳语-越南语翻译方法,旨在弥合越南少数民族之间的文化理解。由于巴纳语资源稀缺,研究团队采用了基于预训练越南语序列到序列语言模型的迁移学习方法。该方法通过数据增强和启发式技术进一步优化,以提高翻译准确性并解决资源不平衡问题。

  8. RESEARCH · CL_154150 ·

    新基准和方法推动医学视觉语言模型发展

    研究人员开发了新的基准和蒸馏技术,以提高视觉语言模型(VLM)在医学领域的性能。PathAgentBench 专注于评估 VLM 直接从全切片病理图像中获取和整合证据的能力,揭示了当前模型在证据获取方面存在显著的性能差距。同时,Med-OPD 引入了一种面向证据的在线策略蒸馏方法,以增强医学 VLM 对视觉证据的依赖,而非语言先验。此外,一个用于 PET/CT 报告生成的新越南语多模态数据集旨在提高 VLM 在低资源语言和功能成像任务…

  9. RESEARCH · CL_133244 ·

    SpiS-GAN 生成逼真手写体,改进识别系统 · 追踪 2 个来源

    研究人员开发了 SpiS-GAN,一个用于合成逼真手写体的新颖框架,以解决训练手写识别系统所需标注数据稀缺的问题。该生成对抗网络在其生成器中使用了星螺旋块(Star-Spiral Blocks)和调制椭圆螺旋全连接层(Modulated Elliptical SpiralFC),使其比以前的基于 MLP 或 CNN 的模型更能追踪复杂草书轨迹。一项关键创新是 Sobel 正则化边缘重建损失(Sobel-Regularized Edge…

  10. TOOL · CL_123163 ·

    新型BamiBERT模型树立越南语语言基准

    研究人员开发了BamiBERT,一个专为越南语设计的新型语言模型。该模型在一个大型语料库上训练,提供了2048个token的扩展上下文长度,并能处理原始文本而无需外部分词。在多个基准测试中,BamiBERT的表现优于之前的标准PhoBERT,取得了同等规模下的最先进结果,并展示了有效的跨领域泛化能力。

  11. RESEARCH · CL_107738 ·

    研究发现,尽管规模不断扩大,大型语言模型(LLM)仍面临持续的“遗忘”问题

    一篇新的arXiv论文研究了大型语言模型(LLM)中“遗忘”(plasticity loss)问题的挑战,即模型在用旧数据训练后难以学习新信息。研究人员发现,即使是现代的基于Transformer的大型语言模型,包括GPT系列模型,也存在这种“遗忘”问题,并且这种效应会随着模型规模的增加而可预测地扩展。虽然更大的模型可以延迟“遗忘”问题的出现,但研究表明,仅仅增加参数数量不足以完全阻止它,这表明大型语言模型在持续学习方面存在根本性限制。

  12. RESEARCH · CL_107818 ·

    新的VieSpeaker数据集在无视觉线索的情况下增强了越南语说话人识别能力 · 跟踪3个来源

    研究人员推出VieSpeaker,一个用于越南语说话人识别的新大规模数据集,该数据集不依赖视觉线索。该数据集是利用一种新颖的流程构建的,该流程利用文本元数据和大型语言模型推理来推断说话人身份,克服了现有语料库中需要说话人在镜头前的局限性。VieSpeaker包含约902小时的语音,来自4,715名说话人,与现有的越南语数据集相比,在训练模型的鲁棒性和泛化能力方面表现出改进。

  13. RESEARCH · CL_100037 ·

    马来西亚的蓝色经济雄心受到海上安全漏洞威胁

    马来西亚发展繁荣的蓝色经济的愿望正因海上存在严重的安全漏洞而受阻。当地渔民在登嘉楼报告称,越南船只侵入马来西亚水域,尤其是在执法不活跃的夜间。这些非法捕鱼活动不仅威胁当地渔民的生计和海洋生态系统,也凸显了马来西亚有效管理其海域面临的严峻挑战。

  14. RESEARCH · CL_99633 ·

    新 CzechDocs 数据集助力格式保持的机器翻译研究

    研究人员推出了 CzechDocs,一个旨在评估能够保持文档格式的机器翻译系统的新数据集。这个多路并行数据集包含捷克语和几种少数民族语言(如乌克兰语、英语和越南语)的文档,格式为 HTML、DOCX 和 PDF。该数据集旨在推动文档级翻译研究,并已发布验证集和评估工具包,测试集计划在未来的共享任务中发布。

  15. MEME · CL_90191 ·

    用户配置 EVi 使用 SUSE vimrc 并计划进行 openSUSE 打包

    用户已在本地配置 EVi,并将 SUSE vimrc 设置为默认值。他们还为 Vim 和 vi 创建了指向 EVi 的别名,以适应肌肉记忆。下一步是为 openSUSE 打包 EVi 并将其提交给 Editors 项目,目标是用符号链接替换现有的 vim 包及其别名。

  16. RESEARCH · CL_86890 ·

    新的时尚数据集提升了AI草图到图像和检索能力

    发布了两个新的大规模数据集GarmentSketch和VietFashion,以推进时尚行业的草图到图像生成和检索。GarmentSketch提供了26,249张时尚草图及其详细的文本描述,旨在改善设计中的人机协作。VietFashion专注于文化服饰,特别是越南奥黛(áo dài),通过超过21,000张图像和匹配的标题,为草图-文本组合图像检索提供了基准。

  17. RESEARCH · CL_86676 ·

    新技术提高越南语语音翻译准确性

    研究人员开发了一种名为音素感知数据增强(PiDA)的新数据增强技术,以改进越南语语音翻译。该方法通过生成基于音素混淆的类ASR(自动语音识别)的损坏来解决级联语音翻译系统中的错误传播问题。在FLEURS越南语-英语数据集上使用PiDA进行微调,提高了对错误ASR输出的翻译准确性,BLEU分数显著提高。

  18. COMMENTARY · CL_63909 ·

    Meister Jeder 的 AI 肖像探索身份伪装 · 跟踪 10 个来源

    摄影师 Meister Jeder 正在创作人工智能生成的肖像画,探索身份和伪装的主题。这些图像被呈现为“纯属虚构(AI)摄影”,并附有与达达主义和 AI 艺术相关的标签。该系列作品包括各种主题,例如被识别为国籍或种族的人,如中国人、高棉人、越南人、日本人、巴厘人、图瓦卢人、毛利人和墨西哥人。

  19. TOOL · CL_56299 ·

    新的越南语语音识别系统采用基于音素的音节建模

    研究人员为越南语语音识别(ASR)系统开发了一种新颖的音节结构解码器。这种新方法在音素层面建模语音,显式地捕捉音节的音理构成,而不是依赖于字符或单词等书写单位。该系统在越南语语音基准 LSVSC 和 UIT-ViMD 上均表现出优越性能,尽管使用了明显更小的词汇量且没有额外的训练资源,但其性能优于 PhoWhisper 和 Wav2Vec2 等强大的基线模型。

  20. TOOL · CL_51233 ·

    越南语语音模型捕捉方言语音变体

    研究人员开发了一个新的框架来模拟越南语在不同地区之间的语音学变异。与先前假设拼写到发音映射不随方言变化的旧方法不同,这种方法在词汇和解码阶段都明确考虑了方言差异。所提出的系统使用一种语音学词汇,将音节分解为结构化组件,并将其映射到特定方言的国际音标(IPA)表示,以更少的参数和无需外部预训练即可实现强大的性能。