Scholay

学术搜索 · AI 审稿 · LaTeX 协作

RSA 2026:22 个公开 chatbot 回答酒精与乳腺癌风险不一致,健康信息使用需要更强提示与审核边界

学术圈重大事件 · 发布 2026-06-22T00:35:00+08:00 · 更新 2026-06-22T00:44:10+08:00

核心结论

Research Society on Alcohol 6 月 21 日通过 Newswise 发布会议研究:密苏里大学 Allison Brandt Anbari 团队将 WHO、CDC 与 National Breast Cancer Foundation 的 3 类问题输入 22 个公开 chatbot 配置,评估 66 份输出。结果称,生成式 AI 对酒精摄入与乳腺癌风险的回答在内容、呈现和阅读难度上不稳定,部分回答还弱化已确立因果关系。

Research Society on Alcohol 通过 Newswise 发布的会议稿显示,研究将在 2026 年 6 月 21 日于圣安东尼奥举行的 RSA 2026 年会上报告,题为“Generative Artificial Intelligence Chatbot Output about Alcohol Consumption and Breast Cancer Risk: Content and Linguistic Analysis with Expert Assessment”。团队关注的问题很具体:美国公众对酒精摄入与乳腺癌风险之间关系的认知仍然不足,而越来越多人会把 ChatGPT、Gemini、Copilot 等 chatbot 当作健康信息入口。

研究设计不是评估单一模型是否“答对”,而是用三个不同来源网站上的自然语言问题测试输出差异。问题分别来自国际层面的 WHO、国家层面的 CDC 和基金会层面的 National Breast Cancer Foundation;措辞包括“can alcohol cause breast cancer”“why does alcohol cause breast cancer”“how does alcohol cause breast cancer”。这些问题被输入 22 个公开可用的 chatbot 配置,形成 66 份回答,再从内容、语言与专家评估角度观察。

公开稿列出的三点结果都指向同一个风险:用户拿到的答案受模型配置和提示方式影响很大。第一,输出内容和呈现样式不一致,部分回答会把酒精与乳腺癌之间的因果关系说成仍不清楚,而研究者强调酒精早在 1988 年已被列为一类致癌物;第二,回答可读性达到大学水平,高于 NIH 建议的六年级及以下健康材料阅读难度;第三,提示词微小差异会改变输出内容,这意味着健康素养、数字素养和 prompt 素养会在同一个查询场景里叠加。

这条新闻的外溢意义在于,医疗与公共卫生领域正在从“能不能用 AI 回答健康问题”转向“怎样让 AI 回答不放大误解”。对医生、护士、公共卫生机构和患者教育团队来说,chatbot 生成内容不能被当作稳定的健康宣教文本直接复用;更现实的做法是把它作为初稿或问答入口,再由专业人员审阅关键表述、阅读难度和风险边界。对模型和产品团队而言,这也提示高风险健康主题需要更明确的来源锚定、简明语言约束和不确定性控制。

不过,证据边界必须放在前面。该结果目前主要来自会议发布稿,Newswise 明确称将在 RSA 2026 报告;页面还注明“部分研究已在线发表”,但本轮未能直接核验 ScienceDirect 页面全文。它可以作为生成式 AI 健康信息质量的预警信号,不能直接外推为所有 chatbot、所有语言或所有健康主题都有同等问题。后续应关注正式论文、样本模型清单、评分标准、不同时间版本的可复现性,以及是否有面向患者理解度的实际测试。

信息来源

可信度说明

主要来源为 Research Society on Alcohol 会议稿和 Newswise 发布页,包含发布时间、研究者、会议题名、提示来源、样本量和核心发现;研究仍处会议报告口径,模型清单、评分细则和全文结果需等待正式论文或会议材料进一步核验。

同主题情报

  • 动物所 / `Cell`:`disc-Gastruloid` 首次把人类原条形成推进到可空间重构、可延长培养的体外模型

    中国科学院 `2026-07-08` 官方稿显示,团队构建的人类 `disc-Gastruloid` 在 `72` 小时共培养后形成类原条样区域,延长培养后超 `80%` 继续发育为轴向不对称三维胚胎样结构,分出 `14` 类细胞群并与着床后 `21` 天天然胚胎较高相似。它的重要性,在于把人类原肠运动这个长期难直接观察的发育“黑箱”推进到可重复、可操控的体...

  • 银河系最快恒星逼近中心黑洞:峰值约每秒 2.5 万公里,或可测量自旋

    Science 与美联社 8 月 19 日报道,甚大望远镜数据识别出银河系内迄今已知速度最快的恒星:峰值约每秒 2.5 万公里,绕人马座 A* 一周约 8.7 年,且比此前纪录保持者更接近黑洞。长期高精度跟踪可能约束银河系中心黑洞自旋,但当前只是发现和轨道测量起点,尚未得到自旋值。

  • 嫦娥七号以四器协同搜寻月球南极水冰,跳跃探测器瞄准永久阴影区

    Science 8 月 19 日更新嫦娥七号任务:轨道器、着陆器、巡视器和跳跃探测器将在鹊桥二号支持下调查月球南极水冰与挥发物,四平台合计 18 项载荷,并计划让跳跃探测器进入永久阴影坑现场分析。公开资料仍只给出 2026 年下半年发射口径,最终日期、落点与工程参数需以官方通告为准。

  • M87 黑洞第一次有了双频“体检图”,研究者开始按位置读等离子体状态

    中国科学院 2026-07-28 08:18 发布官方稿,介绍上海天文台团队把 1.3 毫米和 3.5 毫米两张 M87 黑洞视界尺度图像合起来,首次做出空间分辨的谱指数分布。简单说,这不只是把黑洞拍得更清楚,而是开始按位置判断视界附近等离子体在不同半径上更接近“自吸收很强的厚辐射”还是“更容易透出的薄辐射”。关键转折出现在距黑洞中心约 30 微角秒处,并与...

  • Moderna mRNA 流感疫苗获批,确诊病例相对标准疫苗减少 26.6%

    Nature 8 月 13 日梳理 Moderna 的 mRNA 流感疫苗 mFLUSIVA:FDA 于 8 月 5 日批准其用于 50–64 岁成人,并对 65 岁以上人群给予加速批准,计划进入美国 2026–27 流感季。超过 4 万人的试验中,mRNA 组 2% 出现实验室确诊流感,对照标准疫苗组为 2.8%,相对减少 26.6%;常见不良反应多为轻中...

  • KIST 公布 A²SG 训练方法,以自适应非对称梯度改善深层脉冲神经网络

    KIST 8 月 10 日公布已获 ICML 2026 接收的 A²SG 训练方法,用自适应窗口和非对称代理梯度缓解深层脉冲神经网络的梯度变化与时间不一致。机构称该方法在 ImageNet 等任务提高准确率且训练开销低于所比较基线;论文与代码可查,但相对能耗和商业化前景仍需独立复现及真实神经形态硬件验证。