人工智能在医疗保健领域的可靠性备受诟病
研究人员指出,人工智能在医疗保健领域的准确性严重不足。一项最新研究显示,即使答案看似可信,但其中近 50% 却是错误的。这一现象日益令医疗保健专业人士担忧。
如果人工智能无法解答所有问题呢?这正是这些英语国家的研究人员在一项关于聊天机器人(或称人工智能驱动的对话代理)的研究中提出的问题。来自美国、加拿大和英国的专家试图确定这些聊天机器人在回答健康相关问题时的可靠性。出乎所有人意料的是,大多数答案都可能是错误的,甚至完全错误。
为了进行这项实验,科学家们测试了 ChatGPT、Gemini、Meta AI、Grok 和 DeepSeek 等平台。他们在发表于《英国医学杂志开放版》(BMJ Open) 的研究中解释说,他们向聊天机器人提出了涵盖五个健康类别的十个问题,以评估它们的准确性和可信度。
研究过程中,专家发现聊天机器人提供的医疗建议中,超过一半被认为“有问题”。在这50%的错误答案中,有20%甚至被认为是“问题极大”。他们在研究中指出:“这些系统生成的答案看似可信,但实际上可能存在错误。”
然而,研究人员也注意到,聊天机器人对封闭式问题的处理能力更强,其答案“问题较少”。尤其是在癌症和疫苗相关问题上,人工智能的表现似乎比以往更加可靠。但在营养和干细胞方面,这些平台的表现则远不尽如人意。
面对这些令人担忧的结果,研究人员敦促用户务必保持高度谨慎。他们还指出,这些工具缺乏真实性,如果不加以有效控制,可能会“放大错误信息”。
需要提醒的是,每周有超过2亿人向人工智能咨询健康问题。这个数字持续增长,令医疗专业人士日益担忧,尤其是当用户表示他们更信任这些平台而非真正的医生时。
-
15:26
-
14:14
-
13:47
-
13:30
-
13:13
-
12:47
-
12:33
-
12:15
-
11:49
-
11:33
-
11:15
-
10:48
-
10:30
-
10:10
-
09:45
-
09:28
-
09:26
-
09:17
-
09:12
-
09:09
-
09:08
-
09:00
-
08:57
-
08:51
-
08:47
-
08:33
-
08:24
-
08:20
-
08:15
-
08:06
-
08:00
-
07:57
-
07:54
-
07:51
-
07:50
-
07:47
-
07:45
-
07:38
-
07:35
-
07:29
-
07:21
-
07:17
-
07:17
-
07:12
-
07:11
-
07:11
-
07:11