PulseAugur
实时 13:14:29
English(EN) AIriskEval-edu: New Dataset for Risk Assessment in AI-mediated K-12 Educational Explanations

新数据集训练LLM进行K-12教育风险评估 · 跟踪3个来源

研究人员开发了AIriskEval-edu-db2,这是一个旨在训练和评估大型语言模型(LLMs)用于评估K-12教育内容中教学风险的新数据集。该数据集包含来自ScienceQA问题的1600多个解释,其中包含人类编写的示例以及旨在展示特定风险的LLM生成的示例。它还包含了可解释性的结构化注释,在事实准确性、完整性、相关性、恰当性和意识形态偏见等维度上定位和描述风险。验证实验将专有模型与本地Llama 3.1 8B模型进行了比较,探索了微调后的本地模型在隐私保护的教育审计方面匹配或超越前沿模型的潜力。 AI

影响 该数据集可以提高人工智能生成的K-12学生教育内容的安全性与可靠性。

排序理由 该集群描述了一个新的学术数据集和相关的研究论文,而不是产品发布或重大的行业事件。

在 arXiv cs.CL 阅读 →

AI 生成摘要 · Google Gemini · 来自 3 个来源。 我们如何撰写摘要 →

新数据集训练LLM进行K-12教育风险评估 · 跟踪3个来源

报道来源 [3]

  1. arXiv cs.AI TIER_1 English(EN) · Javier Irigoyen, Roberto Daza, Francisco Jurado, Julian Fierrez, Ruben Tolosana, Alvaro Ortigosa, Enrique Blas, Aythami Morales ·

    AIriskEval-edu:用于AI辅助K-12教育解释中风险评估的新数据集

    arXiv:2607.01934v1 Announce Type: cross Abstract: This work introduces AIriskEval-edu-db2, a new dataset designed to train and evaluate auditors based on LLMs for an explainable pedagogical risk assessment in instructional content for grades K-12. The dataset comprises 1,639 expl…

  2. arXiv cs.CL TIER_1 English(EN) · Aythami Morales ·

    AIriskEval-edu:用于AI辅助K-12教育解释中风险评估的新数据集

    This work introduces AIriskEval-edu-db2, a new dataset designed to train and evaluate auditors based on LLMs for an explainable pedagogical risk assessment in instructional content for grades K-12. The dataset comprises 1,639 explanations from 170 curated ScienceQA questions, cov…

  3. Hugging Face Daily Papers TIER_1 English(EN) ·

    AIriskEval-edu:用于AI辅助K-12教育解释中风险评估的新数据集

    This work introduces AIriskEval-edu-db2, a new dataset designed to train and evaluate auditors based on LLMs for an explainable pedagogical risk assessment in instructional content for grades K-12. The dataset comprises 1,639 explanations from 170 curated ScienceQA questions, cov…