PulseAugur
实时 23:26:14
实体 Indonesian

Indonesian

PulseAugur coverage of Indonesian — every cluster mentioning Indonesian across labs, papers, and developer communities, ranked by signal.

Show in brief
总计 · 30天
5
90 天内 15
发布 · 30天
0
90 天内 0
论文 · 30天
0
90 天内 7
层级分布 · 90 天
主题
情绪 · 30 天

4 天有情绪数据

最近 · 第 1/1 页 · 共 15 条
  1. COMMENTARY · CL_243738 ·

    印度主办金砖国家峰会,处理对华关系和去美元化

    印度即将在新德里主办金砖国家峰会,面临着管理一个多元化且不断扩大的国家集团的挑战。印度此行的主要目标是提升新兴经济体的集体影响力,并减少对美元的依赖,同时避免形成新的对华依赖。虽然共同的金砖国家货币不太可能实现,但该集团旨在促进使用本国货币进行更便捷的跨境支付和供应链合作,这可能有利于印度出口商,并为基于美元的交易提供替代方案。

  2. TOOL · CL_228404 ·

    印尼语 LLM 接受监督微调以遵循指令

    作者详细介绍了其 1.02 亿参数的印尼语语言模型 NovAI Base 的监督微调 (SFT) 过程。此步骤涉及教会预训练模型遵循指令,将其从基础模型转变为具备聊天能力的模型。该过程侧重于指令遵循,而非增加模型规模。

  3. TOOL · CL_206715 ·

    印尼毒品调查期间,马来西亚推迟试点引渡

    马来西亚正在推迟引渡一名在印尼因毒品罪被捕的马来西亚航空飞行员的请求。该飞行员于7月28日在苏加诺-哈达国际机场被捕,行李中携带有大量MDMA和甲基苯丙胺。马来西亚当局正在等待印尼完成调查,以确定该飞行员是单独行动还是更大犯罪网络的一部分,然后再进行任何引渡。

  4. TOOL · CL_195618 ·

    应算.top工具秒级生成泰语/越南语回复

    来自应算.top的一款新的多语言客服工具,已被测试用于为跨境电商商店快速生成泰语和越南语回复的能力。该工具旨在解决在东南亚地区客服中普遍存在的响应缓慢和翻译尴尬的问题。在测试中,该平台在三秒内生成了对中国客户查询的回复,生成的文本听起来自然且礼貌,显著优于使用Google Translate等工具的传统方法。

  5. TOOL · CL_185268 ·

    新的MERaLiON-GR模型在多种语言上实现了最先进的性别识别

    研究人员开发了MERaLiON-GR,这是一种新颖的语音性别识别模型,能够对英语和多种东南亚语言的性别进行分类。该模型基于MERaLiON-SpeechEncoder-2(一种基于Conformer的Transformer)构建,并利用低秩自适应(LoRA)进行高效微调。在包括中文、马来语、泰米尔语、泰语、越南语、印度尼西亚语和高棉语在内的各种评估模式和语言中,MERaLiON-GR的表现优于Vox-Profile和大型Audio-L…

  6. RESEARCH · CL_174020 ·

    大型语言模型难以准确评估项目难度,低估学习者的复杂挑战

    近期研究表明,虽然大型语言模型(LLMs)可以以中等准确度预测项目难度级别,但它们在识别真正困难的项目时却力不从心。研究发现,LLMs 倾向于低估因误解而对学习者构成挑战的项目难度,这种现象被称为“简单陷阱”。这表明当前的 LLMs 可能在近似课程难度而非认知难度,从而在教育评估和自适应系统中带来偏见的风险。

  7. RESEARCH · CL_170317 ·

    印尼考虑为技术型侨民提供有限双重国籍

    印尼正考虑对其国籍法进行有限改革,允许部分侨民保留其国籍。拟议的变更将使被认为对国家发展至关重要的技能人才,如科学家和医学专家,能够拥有双重国籍。此举是在近年来数千名印尼人放弃其国籍的背景下提出的,他们放弃国籍的原因通常是与外国人结婚,这凸显了侨民希望与其祖国保持联系的愿望。

  8. TOOL · CL_160838 ·

    新基准评估大型语言模型在印尼文化常识对话方面的能力

    研究人员推出了CultureTalk-ID,这是一个旨在评估大型语言模型(LLMs)在印度尼西亚本土语言中的文化常识能力的新型基准。与使用孤立提示的先前基准不同,CultureTalk-ID使用了跨越11种语言和13个主题的4,496个文化背景对话,以评估LLMs对文化细微语言的理解和生成能力。该基准包括三个任务:基于对话的多项选择推理、文化忠实机器翻译和语言引导。

  9. RESEARCH · CL_120363 ·

    印尼学员在农村发展计划的军事化训练中死亡

    五名印尼民事学员在政府一项关注农村发展和粮食安全的计划中死亡。据报道,作为管理乡村合作社准备工作的一部分,这些学员接受了国防部监督的基本军事演习。尽管国防部将死亡归因于包括中暑和心脏骤停在内的各种医疗状况,但这些事件引发了对培训安全性和设计的批评,并对该计划依赖军事纪律表示担忧。

  10. RESEARCH · CL_86885 ·

    新框架支持印度尼西亚传统服装的零样本描述

    研究人员开发了Custom ZeroCLIP,一个新颖的检索增强视觉-语言框架,专为印度尼西亚传统服装的零样本描述而设计。该系统结合了CLIP和BERT文本编码器以及LSTM字幕解码器,在来自24个印度尼西亚省份的数据上进行训练,并在8个未见过省份上进行评估。该框架取得了强劲的性能,CLIPScore为0.8536,BLEU-4为0.3342,METEOR为0.4859,在文化词汇恢复和整体准确性方面显示出显著的改进,特别是在低资源遗产背景下。

  11. RESEARCH · CL_84342 ·

    Lius模型通过持续微调提升低资源语言翻译能力

    研究人员开发了一种名为Lius的新翻译模型,专门用于改进古邦马来语等低资源语言的翻译。该模型采用了一种新颖的持续指令微调(CIT)方法,通过各种指令类型迭代训练模型。这种方法显著优于标准的指令微调模型以及现有的神经机器翻译(NMT)和多语言LLM模型,展示了一种克服平行数据稀缺限制的充满希望的方法。

  12. RESEARCH · CL_68181 ·

    医学AI模型在处理印度尼西亚放射学问题时遇到困难

    一项新近发表在arXiv上的研究,调查了医学视觉语言模型(VLMs)在面对从英语到印度尼西亚语的语言转变时的表现。研究人员引入了IndoRad-VQA,一个从VQA-RAD改编而来的数据集,用于测试这些模型在印度尼西亚语下的放射学推理能力。研究结果表明,与英语提示相比,当模型使用印度尼西亚语进行提示时,性能下降了8%到25%,这突显了在医学AI领域进行更具包容性的多语言评估的迫切需求。

  13. RESEARCH · CL_43786 ·

    以色列军队拦截加沙船队,拘留数百人

    以色列军队拦截了驶往加沙的 Global Sumud 船队,拘留了来自 40 多个国家的 428 名参与者。视频片段显示以色列士兵向两艘船开火,尽管以色列声称仅使用了非致命手段作为警告,且没有抗议者受伤。一名印尼记者报告说,在被拘留后,他受到了粗暴对待,并因束线带而受伤。

  14. TOOL · CL_25581 ·

    混合模型在印度尼西亚情感分析中取得优异成果

    研究人员开发了一种混合方法用于印度尼西亚情感分析,结合了 TF-IDF 文本特征与 logistic 回归和神经网络基线。该研究专注于使用 707 个样本的数据集将社交媒体文本分类为正面、负面和中性类别。虽然 logistic 回归模型在准确率和 F1 分数上表现具有竞争力,但多层感知机 (MLP) 神经网络在实验环境中显示出更高的准确率,尽管它被认为不太适合生产部署。

  15. COMMENTARY · CL_199638 ·

    AI模型在非英语语言方面滞后,可能加剧数字鸿沟

    先进AI模型的开发严重偏向英语和少数几种主要语言,使得许多较小语种或“低资源”语言处于明显劣势。这些语言,包括粤语、越南语和印度尼西亚语,由于缺乏足够的数字数据来训练AI,导致模型生成的翻译和文本不准确或无意义。尽管Naver等公司以及印度尼西亚的合作项目正在努力创建针对特定语言和文化需求的AI,但全球AI格局仍可能加剧非英语使用者的数字鸿沟。