一项新近发表在arXiv上的研究评估了14个大型语言模型(LLMs)在提供化妆品化学和皮肤健康信息方面的准确性。研究发现,这些通用LLMs表现不佳,尤其是在定量推理和识别化学结构方面。虽然它们可以合理地回答一般的护肤问题,但其回答缺乏消费者做出明智决策所需的技术深度。研究表明,LLMs目前不是化妆品化学信息的可靠来源,并强调了听起来权威但技术上不准确的输出所带来的风险。 AI
影响 通用LLMs目前在化妆品化学等专业技术建议方面并不可靠,因其听起来权威但存在不准确之处而带来风险。
排序理由 评估LLM在特定领域表现的学术论文。[lever_c_demoted from research: ic=1 ai=1.0]
AI 生成摘要 · Google Gemini · 来自 1 个来源。 我们如何撰写摘要 →