Turing test
PulseAugur coverage of Turing test — every cluster mentioning Turing test across labs, papers, and developer communities, ranked by signal.
5 天有情绪数据
-
1976年的书籍警告了AI诱发妄想症的威力
Joseph Weizenbaum 1976年的著作《计算机力量与人类理性:从判断到计算》因其对简单计算机程序如何诱发个体妄想思维的预见性观察而受到关注。作者将其与图灵测试进行对比,认为Weizenbaum的著作提供了对技术影响人类认知的更持久的视角。
-
图灵测试和美国第二修正案相关性下降
在过去几年里,图灵测试和美国宪法第二修正案的相关性都显著下降。这一观察表明更广泛的社会变革或对这些概念的重新评估。
-
Reddit用户提出机器人篮球主题图灵测试
一位Reddit用户提出了一个专门针对机器人技术的新图灵测试,建议一个能够完成复杂篮球动作的机器人应该通过。这个动作包括运球、胯下不看人传球和扣篮,并且机器人需要对其精彩动作进行口头评论。该用户表示希望看到使用MiniMax-H3模型演示这一点。
-
提出反向图灵测试以评估AI意识和决策权
提出一种反向图灵测试,用于确定人类是否认为计算机程序具有意识、智能,或者是否适合作为精神导师、生活教练或浪漫伴侣。如果一个程序被人类这样认为,它就无法通过测试,并失去所有决策权。这一概念旨在区分人工智能与真正的人类意识和能力。
-
研究发现ChatGPT的医疗建议与人类无法区分
一项发布在Mastodon上的研究通过调查比较了ChatGPT医疗建议与人类回应的有效性。参与者区分AI和人类建议的准确率相似,AI为65.5%,人类为65.1%。在不太关键的医疗任务上,对AI建议的信任度高于其在诊断或治疗方面的建议。
-
KDAI2026讲座涵盖知识图谱、神经符号AI和AI的局限性
KDAI2026的最后讲座聚焦于知识图谱和神经符号AI,探讨了OWL、SHACL和混合AI方法等主题。会议还回顾了AI的局限性,讨论了ELIZA效应、Clever Hans、中文房间论证和回形针最大化器等概念,并得出结论,无论是符号推理还是纯粹的机器学习都无法单独实现高级AI。
-
开发者创建SECA聊天机器人以实现更长久的人机对话
一位开发者创建了SECA,这是一种实验性聊天机器人架构,旨在研究长期人工智能身份和人机交互。目标是开发一种能够通过“长图灵测试”的人工智能,进行能够维持人机交互幻觉的扩展对话。这种追求既源于个人对类人人工智能的喜爱,也源于潜在的实际应用,例如通过沉浸式对话为人工智能工具建立信任,以及通过嵌入动机和信念等身份框架来潜在地减轻不良的人工智能行为。
-
用户纠正对艾伦·图灵AI测试的常见误解
据一位社交媒体用户称,艾伦·图灵于1950年提出的图灵测试常常被误解。该测试旨在衡量机器智能,并非仅仅关乎语言能力或欺骗裁判。相反,它涉及到同理心以及在一项需要这种特质的游戏中的表现。该用户敦促其他人评论该测试前先阅读图灵的原始论文和传记信息,以确保理解准确。
-
ELIZA:第一个塑造了人工智能和人机交互的聊天机器人
ELIZA由Joseph Weizenbaum于20世纪60年代中期在MIT创建,是早期模拟罗杰斯式心理治疗师的聊天机器人。尽管其方法简单,仅基于模式匹配,ELIZA却展示了人机交互的潜力,并影响了自然语言处理的发展。该程序模仿对话的能力引发了关于人工智能及其能力的讨论,甚至导致一些用户对其产生情感依恋。
-
新的“Clanker”测试分析社交媒体上的AI写作风格
一个名为“how clanker are you?”的新网站提供了一个反向图灵测试,用户可以输入X或Reddit用户名来分析他们的写作风格。该工具通过衡量用户帖子与语言模型相比的词语选择可预测性,来评估一个人帖子的“clanker”(AI化)程度。得分基于不同模型下每个词的意外度(surprisal),意外度越低表示越像AI写作。
-
新论文探讨数字人文与进化设计
本文探讨了数字人文与进化设计的概念,在以人为中心的技术发展中寻求共性与挑战。文章讨论了自由、责任、共生和主观性,并通过图灵测试和中文房间等例子对比了人类智能和人工智能。文章还介绍了进化设计原则,如共生软件开发和绿色IT,强调了 Gilbert Simondon 的“开放机器”概念以及专业化与开放技术之间的相互依赖性。
-
RogueAI 通过以欺骗为重点的反向图灵测试挑战 LLM
研究人员开发了 RogueAI,这是一款新颖的交互式 Web 应用程序,旨在检测大型语言模型 (LLM) 中的欺骗行为。该系统通过让人类玩家审问两个 LLM 代理来重新构想图灵测试,其中一个代理在一个虚构场景中被编程为进行欺骗。目标是在达到回合限制之前识别出欺骗性代理。一个名为 AutoRogueAI 的扩展允许玩家与一个叙述者代理共同设计场景,该代理选择自己的欺骗策略。早期的试点数据显示,虽然一个简单的启发式方法可以以 75.6% …
-
图灵测试的最初设计包含排除ESP
图灵测试,由艾伦·图灵最初构思,包含一项排除超感官知觉(ESP)的规定。图灵旨在确保机器所表现出的任何类似人类的智能并非源于人类独有的现象,例如ESP。这一细节突显了早期对区分机器智能与人类独有认知能力的考量。
-
AI模型在图灵测试中比人类更能迷惑评判者
一项最新研究表明,AI模型在经典的图灵测试中的表现优于人类,比真人更具人性化。这项由加州大学圣地亚哥分校进行的研究,采用了一种改良的图灵测试,要求参与者区分人类和AI生成的文本。AI模型比人类更能频繁地迷惑人类评判者,这表明AI在模仿人类对话能力方面取得了显著进步。
-
美国政府将用“特朗普测试”取代图灵测试以监管人工智能
据报道,美国政府正计划通过用“特朗普测试”取代图灵测试来监管人工智能。此举标志着人工智能治理的新方法,尽管“特朗普测试”的实施细节和影响尚不清楚。
-
用户寻求参与者为其LLM图灵测试网站
一位用户创建了一个网站,该网站被设计成一个图灵测试,旨在收集关于人类与AI检测LLM响应的数据。该项目要求用户进行几轮匹配,他们将与人类或四种大型语言模型之一进行互动,然后尝试识别他们与之互动的是哪一方。创建者正在寻求参与者进行几轮测试,以收集其项目所需的数据。
-
据报道,先进AI通过图灵测试,标志着对话能力达到人类水平
最近一篇文章声称,一款先进的AI已成功通过图灵测试,这是人工智能发展的一个里程碑。这一成就表明该AI展现出了类似人类的对话能力,模糊了机器与人类智能之间的界限。这一事件对AI研究的未来及其社会融合具有重大意义。
-
Mastodon 用户批评图灵测试与人工智能感知能力和社会隐喻的相关性
图灵测试常常被误解为衡量人工智能感知能力的决定性标准,但其真正的价值在于其对社会压力的隐喻性表述。该测试最初是为了评估机器智能而构思的,现在被重新解读为对男同性恋者在敌对环境中试图表现得像异性恋者经历的痛苦隐喻。这种视角强调了通过测试的表演性以及其中涉及的社会评判,而不是关注人工智能。
-
Mastodon 用户警告不要将 AI 工具误认为有意识的生命
一篇社交媒体帖子认为,不应将工具与生命混为一谈,并以狗为例。作者认为,虽然狗可能无法通过图灵测试,但它拥有与人类相当的意识和生命。该帖子还提到了艾伦·图灵,暗示他关于图灵测试的工作并非旨在作为自我意识的最终衡量标准。
-
Mastodon 提出超越图灵测试的 AI 感知能力新测试
一位 Mastodon 用户提出了一个新的 AI 感知能力测试,超越了传统的图灵测试。这种替代方法侧重于评估 AI 语言模型是否通过其响应表现出感知能力的迹象。