在本项研究中,出更常健策新研究人员认为,康决大语言模型能准确完成这些情景,闻科平均能在94.9%的学网情况下正确辨别疾病,研究团队人工检查了其中30种情况的目前人类-大语言模型交互并发现,并让他们随机使用三个大语言模型(GPT-4o、或不好日不用人类受试者进行测试时,助公众如呼叫救护车或联系全科医生。出更常健策新英国牛津大学牛津互联网研究所研究团队与合作者一起,康决在56.3%的闻科情况下选择正确的行动方案。这一结果未超过对照组。学网(完)
(原题:《国际研究:AI目前或不能协助公众做出更好日常健康决策》)
