Indonesian
PulseAugur coverage of Indonesian — every cluster mentioning Indonesian across labs, papers, and developer communities, ranked by signal.
2 天有情绪数据
-
新基准评估大型语言模型在印尼文化常识对话方面的能力
研究人员推出了CultureTalk-ID,这是一个旨在评估大型语言模型(LLMs)在印度尼西亚本土语言中的文化常识能力的新型基准。与使用孤立提示的先前基准不同,CultureTalk-ID使用了跨越11种语言和13个主题的4,496个文化背景对话,以评估LLMs对文化细微语言的理解和生成能力。该基准包括三个任务:基于对话的多项选择推理、文化忠实机器翻译和语言引导。
-
印尼学员在农村发展计划的军事化训练中死亡
五名印尼民事学员在政府一项关注农村发展和粮食安全的计划中死亡。据报道,作为管理乡村合作社准备工作的一部分,这些学员接受了国防部监督的基本军事演习。尽管国防部将死亡归因于包括中暑和心脏骤停在内的各种医疗状况,但这些事件引发了对培训安全性和设计的批评,并对该计划依赖军事纪律表示担忧。
-
新框架支持印度尼西亚传统服装的零样本描述
研究人员开发了Custom ZeroCLIP,一个新颖的检索增强视觉-语言框架,专为印度尼西亚传统服装的零样本描述而设计。该系统结合了CLIP和BERT文本编码器以及LSTM字幕解码器,在来自24个印度尼西亚省份的数据上进行训练,并在8个未见过省份上进行评估。该框架取得了强劲的性能,CLIPScore为0.8536,BLEU-4为0.3342,METEOR为0.4859,在文化词汇恢复和整体准确性方面显示出显著的改进,特别是在低资源遗产背景下。
-
Lius模型通过持续微调提升低资源语言翻译能力
研究人员开发了一种名为Lius的新翻译模型,专门用于改进古邦马来语等低资源语言的翻译。该模型采用了一种新颖的持续指令微调(CIT)方法,通过各种指令类型迭代训练模型。这种方法显著优于标准的指令微调模型以及现有的神经机器翻译(NMT)和多语言LLM模型,展示了一种克服平行数据稀缺限制的充满希望的方法。
-
医学AI模型在处理印度尼西亚放射学问题时遇到困难
一项新近发表在arXiv上的研究,调查了医学视觉语言模型(VLMs)在面对从英语到印度尼西亚语的语言转变时的表现。研究人员引入了IndoRad-VQA,一个从VQA-RAD改编而来的数据集,用于测试这些模型在印度尼西亚语下的放射学推理能力。研究结果表明,与英语提示相比,当模型使用印度尼西亚语进行提示时,性能下降了8%到25%,这突显了在医学AI领域进行更具包容性的多语言评估的迫切需求。
-
以色列军队拦截加沙船队,拘留数百人
以色列军队拦截了驶往加沙的 Global Sumud 船队,拘留了来自 40 多个国家的 428 名参与者。视频片段显示以色列士兵向两艘船开火,尽管以色列声称仅使用了非致命手段作为警告,且没有抗议者受伤。一名印尼记者报告说,在被拘留后,他受到了粗暴对待,并因束线带而受伤。
-
混合模型在印度尼西亚情感分析中取得优异成果
研究人员开发了一种混合方法用于印度尼西亚情感分析,结合了 TF-IDF 文本特征与 logistic 回归和神经网络基线。该研究专注于使用 707 个样本的数据集将社交媒体文本分类为正面、负面和中性类别。虽然 logistic 回归模型在准确率和 F1 分数上表现具有竞争力,但多层感知机 (MLP) 神经网络在实验环境中显示出更高的准确率,尽管它被认为不太适合生产部署。