Scholay

学术搜索 · AI 审稿 · LaTeX 协作

科研情报日报|2026-06-26:Agents 进入主模型;LineShine 登顶;胚胎 base editing 引伦理复燃

其他 · 发布 2026-06-26T08:35:00+08:00 · 更新 2026-06-26T08:56:22+08:00

今天日报聚焦 8 条经小时报聚类和联网复核后的热点:Google 与 OpenAI 共同把 agentic AI 推向主模型和组织工作流证据;LineShine 登顶 TOP500;人类胚胎 base editing 引发研究与伦理双重讨论。广东脑机接口计划、医疗 AI 隐私风险、AI 筛 CAR-T 靶点、Herculaneum 卷轴和全球海草图谱构成第二层热点。

过去 24 小时最值得跟进的,不只是单条论文或产品更新,而是几条基础设施级变化同时变热:agentic AI 开始被头部模型厂商打包进主模型和组织研究;LineShine 公开登顶 TOP500;人类胚胎 base editing、医疗 AI 隐私审计、脑机接口产业政策和 AI 读卷轴等话题,则把“技术可行”进一步推向治理、伦理和规模化应用问题。

科研情报日报|2026-06-26:Agents 进入主模型;LineShine 登顶;胚胎 base editing 引伦理复燃
科研情报日报|2026-06-26:Agents 进入主模型;LineShine 登顶;胚胎 base editing 引伦理复燃(图源:Google Blog:Introducing computer use in Gemini 3.5 Flash)

整理|Codex 新闻采集

今日最值得跟进

  • Agentic AI 从演示走向主模型内建能力和真实工作流证据
  • LineShine 登顶 TOP500,中国 CPU-only 超算重新定义公开榜单叙事
  • 人类胚胎 base editing 首次用于功能研究,NANOG 结果引发伦理讨论
  • 广东脑机接口五年计划,把临床转化、医保支付和产业规模写进同一张路线图
  • 医疗 AI 风险从“答得准不准”延伸到患者级隐私暴露
  • Penn Medicine 用人机协同 AI 筛出 GPNMB,CAR-T 靶点发现流程被重写
  • Herculaneum 卷轴被 AI 虚拟展开,古典文献进入可规模化读卷阶段
  • Nature 首套全球 10 米海草图谱,为蓝碳和海岸保护提供统一底图

01|Agentic AI:从“会点按钮”升级为主模型能力和工作流证据

6 月 24 日,Google 把 computer use 做进 Gemini 3.5 Flash,称开发者可以通过 Gemini API 和 Gemini Enterprise Agent Platform 构建能在浏览器、移动端和桌面环境看见、推理并采取行动的 agent。这个变化的新闻点不只是多了一个工具,而是此前独立的 computer use model 被并入主力 Flash 模型,企业侧还同步给出敏感操作确认和间接 prompt injection 识别后的自动停止机制。换句话说,头部模型厂商开始把“能操作界面”和“可被企业部署”放在同一套产品边界里讨论。

同一天的另一条证据来自 OpenAI。OpenAI 6 月 25 日发布 Codex 经济研究,试图用内部和前沿用户数据说明 agentic AI 正把知识工作的单位从短对话变成长链路委托任务。论文披露,超过 10% 的用户每周某个时点会同时管理 3 个以上 Codex agents,个体 Codex 用户提交 8 小时以上任务请求的比例年内增长接近十倍;Axios 随后把这条线解读为 agents 开始真正承担复杂委托任务,而不再只是聊天和搜索增强。

这条话题的热度来自官方发布、研究论文、科技媒体和社区讨论同时出现。它的影响对象很清楚:开发者、企业 IT、软件测试、知识工作流自动化和安全治理团队。边界也同样重要:Google 的性能和安全说法仍主要来自公司自述,OpenAI 的研究也高度依赖自身产品和前沿用户样本,不能直接外推到所有岗位或所有企业。后续真正要看的是第三方 agent benchmark、企业误操作案例、权限模型和审计日志是否能跟上能力扩张。

来源: Google Blog(2026-06-24) | OpenAI(2026-06-25) | OpenAI Economic Research PDF(2026-06) | Axios(2026-06-25)

02|LineShine 登顶 TOP500:公开超算榜单重新回到 CPU-only 与国产硬件叙事

TOP500 6 月 23 日在 ISC 2026 发布第 67 期榜单,部署在深圳国家超算中心的 LineShine 首次入榜即排名第一,取代美国 El Capitan。TOP500 公布的关键数字很硬:LineShine 在 HPL 上达到 2.198 exaflop/s,约为 2.736 exaflop/s 理论峰值的 80%,也是 TOP500 首个仅用 CPU 就超过 2 exaflop/s 持续双精度性能的系统。系统使用 304 核 LX2 处理器、约 1379 万核心、LingQi 互连和 Kylin OS,功耗约 42.2 MW。

过去 24 到 48 小时里,这条消息被 HPCwire、ServeTheHome、The Next Platform、The Guardian、Al Jazeera 等多类媒体跟进。讨论没有停在“谁是第一”上,而是转向三个问题:第一,中国系统在几年低调后为什么选择重新提交公开榜单;第二,CPU-only 设计在 FP64 科学计算上能否形成不同于 GPU-AI 集群的路线;第三,TOP500 的 HPL 叙事与当前 AI 低精度、混合精度和私有云算力之间到底还能如何比较。

这条线值得排在前列,是因为它同时影响科研算力、供应链自主、榜单政治和 AI 时代的算力评价口径。LineShine 的 HPL 和 HPCG 成绩说明它在传统数值计算上非常强,但 TOP500 也显示其 HPL-MxP 混合精度表现只排第四,ServeTheHome 等分析也提醒它不是为低精度 AI 工作负载优化的 GPU 集群。更稳妥的判断是:它重新点燃了公开 HPC 竞赛,但不能被简单理解为中国在所有 AI 计算负载上已经全面领先。

来源: TOP500(2026-06-23) | HPCwire(2026-06-25) | ServeTheHome(2026-06-24) | The Next Platform(2026-06-25)

03|人类胚胎 base editing:NANOG 被证实是未来“身体”谱系的关键开关

Nature 6 月 25 日发表 Cambridge 等团队研究,首次把 adenine base editing 用于研究人类胚胎中的发育调控因子。团队用 ABE8e 精准靶向 NANOG 外显子剪接受体位点,造成功能性敲除,并显示 NANOG 对人类多能性和 epiblast specification 具有关键作用。相比传统 nuclease-based editing,base editing 的意义在于减少双链断裂相关遗传毒性,因此它把人类早期发育功能研究推到了更细的工具层。

这条线在过去 24 小时内迅速外溢。Nature 论文提供原始证据,University of Cambridge 把它包装成“首次用精密编辑研究人类胚胎发育”,Nature News、Washington Post 和 Science Media Centre 则把讨论推向伦理边界:这不是治疗尝试,也不是生殖应用,但它会让公众重新讨论胚胎编辑、发育研究许可、14 天规则及未来“设计婴儿”误读风险。

它值得从小时报升级为日报,是因为热度不只来自论文新颖性,还来自方法、伦理和监管三条线同时被触发。对发育生物学家来说,这提供了直接检验人类胚胎基因功能的新路径;对伦理和监管机构来说,它提醒“研究性编辑”和“生殖性编辑”的边界需要持续清晰化。边界在于,研究发生在早期胚胎模型和严格研究条件下,不能被外推为临床可用,也不能被包装成胚胎治疗已经可行。

来源: Nature(2026-06-25) | University of Cambridge(2026-06-25) | Nature News(2026-06-25) | Science Media Centre(2026-06-25)

04|广东脑机接口行动计划:产业目标、临床转化和支付路径被打包推进

6 月 25 日,广东脑机接口科技与产业协同发展行动计划被多家中文财经与科技传播源集中转发。小时报捕捉到的原始线索来自广东省科技厅通知,随后证券时报、观点网、21 世纪经济报道/新浪财经等在当天放大。公开报道显示,计划提出到 2027 年围绕 5 种以上重大脑疾病推进神经环路解析和评估、筛查、干预、康复系统,培育 10 家以上产业链骨干企业;到 2030 年新增 100 家脑机接口科技型企业,打造 10 款以上非侵入式产品,多款侵入式产品进入临床转化并取得医疗器械注册证。

这条政策真正值得写进日报的地方,是它把“技术攻关、医疗器械注册、医保支付、医院场景和企业梯队”放进同一张路线图。21 世纪经济报道转发的要点还提到,按规定将脑机接口相关服务纳入医疗服务价格项目,并将符合条件的医疗服务项目纳入医保支付范围。这意味着政策关注点已经不止是实验室突破,而是试图提前铺设审批、价格和支付通道。

热度证据来自官方发布、财经媒体、地方产业报道和市场/创投延伸讨论。对科研读者来说,它会影响脑疾病评估、神经康复、侵入式器械、非侵入式消费级设备以及医院试点的资源流向;对企业来说,它给出了更明确的注册与场景目标。边界在于,行动计划是产业政策,不等于疗效已经被证实;侵入式脑机接口尤其还要经过伦理审查、临床试验、安全性和长期随访验证。

来源: 广东省科技厅(2026-06-24) | 证券时报(2026-06-25) | 观点网(2026-06-25) | 新浪财经/21世纪经济报道(2026-06-25)

05|医疗 AI 风险:从回答准确率扩展到患者级隐私暴露

医疗 AI 今天有两条互相补足的风险线。第一条来自 Nature 6 月 24 日论文:研究者对医疗诊断 AI 做患者级隐私审计,关注 membership inference attacks,即攻击者能否判断某个患者数据是否进入训练集。论文指出,平均攻击成功率接近随机并不代表安全,因为少数患者可能遭遇近乎完美的识别风险;模型容量越大,高风险患者数量可能上升,疾病状态、种族、保险、性别或成像协议等代表性不足群体还可能承担更高风险。

第二条来自 Penn State 的 FAccT 2026 医疗 LLM 研究。团队用普通用户真实使用方式测试多个模型回答健康问题的表现,发现总体准确率接近 76%,但神经科、皮肤科等专业场景表现较弱,研究者的结论不是“不能用 AI”,而是患者把通用聊天模型当症状检查器时,风险比医生监督场景更高。这条线虽然原始新闻早于本日报窗口,但它在 6 月 25-28 日 FAccT 会议窗口重新具备传播语境,并与 Nature 隐私论文形成同一天的风险合流。

这组话题的热度来自顶刊论文、会议研究、大学新闻和专业媒体转述,影响对象包括医院数据治理团队、医疗 AI 公司、临床安全评估者和监管机构。关键变化是,医疗 AI 的风险讨论正在从“答案准不准”扩展到“训练数据是否暴露、哪些患者更脆弱、如何用患者级 differential privacy 或审计机制补位”。边界在于,Nature 研究主要针对诊断模型,Penn State 研究样本量和模型版本有限,不能直接推出所有医疗 AI 都不可用;但它足以说明部署前审计不能只看平均指标。

来源: Nature(2026-06-24) | Nature News(2026-06-25) | Penn State(2026-05-28,FAccT 2026 会议窗口 2026-06-25 至 06-28) | arXiv(研究预印本)

06|AI 筛 CAR-T 靶点:GPNMB 让“找抗原”从手工筛选走向人机协同流程

6 月 25 日,Penn Medicine 披露一项 Cell 论文:团队开发了 human-in-the-loop AI 框架,用数据、知识和推理共同筛选 CAR-T 细胞疗法的候选靶点,并把 GPNMB 推为皮肤癌方向的最高候选。机构稿称,团队据此开发了靶向 GPNMB 的 CAR-T,并在多种癌症小鼠模型中观察到强肿瘤杀伤活性。这条新闻的核心不是“AI 发现了一个靶点”这种宽泛说法,而是 CAR-T 最难的前置问题,即如何在不断增长的测序和表达数据里找到既能打肿瘤、又尽量避开正常组织的表面抗原。

它的热度来自 Cell 论文、Penn Medicine 机构解读、Newswise 扩散和基因工程专业媒体跟进。对肿瘤免疫读者来说,这条线的重要性在于它把专家判断保留在循环里,而不是把靶点发现完全交给黑箱模型。CAR-T 从血液肿瘤走向实体瘤长期卡在靶点特异性、肿瘤异质性和安全窗口,GPNMB 只是一个 proof-of-concept,更大的变化是工作流本身可能被标准化。

边界必须说清楚:目前这仍是靶点发现和前临床验证,不是患者端疗法获批。GPNMB 在多癌种中的表达、安全窗口、逃逸机制和毒性风险都需要后续系统评估。更现实的观察点是,类似框架能否在其他抗原、其他实体瘤和真实临床样本中复用,以及它能否减少 CAR-T 靶点发现的试错周期,而不是单次生成漂亮候选。

来源: Penn Medicine(2026-06-25) | Cell PDF(2026-06-25) | Newswise(2026-06-25) | Genetic Engineering & Biotechnology News(2026-06-25)

07|Herculaneum 卷轴:AI 虚拟展开让失落古典文献进入可规模化恢复阶段

6 月 24-25 日,Herculaneum 卷轴项目出现一轮明显跨圈层传播。University of Kentucky 工程学院页面和 Vesuvius Challenge 信息显示,团队已经虚拟展开 PHerc. 1667 的幸存部分,读出近 1.5 米连续文本、约 20 栏文字;同时还从牛津 Bodleian Library 收藏的 PHerc. 172 中恢复超过 70 栏文本,并识别出 Philodemus 的新书,包括 On Vices Book 1 和 On Gods Book 8。The Guardian、National Geographic、The Times 等大众媒体把它包装成“失落图书馆重新发声”的科学文化事件。

这条线的热度有两个来源:一是机器学习、计算机视觉、几何重建和同步辐射成像的组合技术终于能在不物理打开卷轴的情况下读出连续文本;二是它不是一次孤立识别几个字符,而是开始进入足以支持批判性校勘和完整作品重建的规模。对计算人文、古典学和成像算法社区来说,这说明 AI 的价值不只是生成内容,也可以把过去不可读、不可触碰的材料变成可分析资料。

边界在于,读出文本不等于完整翻译和定本已经完成。卷轴层间结构、墨迹识别误差、文本归属和校勘都需要纸草学家继续处理,媒体所说的“重新发现古典文献”还要经过长期学术验证。后续值得看的是 Vesuvius Challenge 能否把单卷突破变成批量流程,以及是否会开放足够多数据、图像和工具给外部团队复验。

来源: University of Kentucky Engineering(2026-06-24) | Vesuvius Challenge(项目页) | The Guardian(2026-06-24) | National Geographic(2026-06-25)

08|全球 10 米海草图谱:蓝碳、海岸保护和海洋保育有了统一底图

Nature 6 月 24 日发表全球高分辨率海草制图研究。团队基于 475 万张 Sentinel-2 MSI 卫星影像,给出 2019-2020 与 2023-2024 两个时期的 10 米分辨率浅水海草范围和变化分析,识别全球 148,506 平方公里海草,其中 69% 集中在巴哈马、古巴、美国、澳大利亚和印度尼西亚。研究还指出,只有 21% 的海草区域位于海洋保护区内,四年间约 5,969 平方公里海草消失,另有 6,221 平方公里在热带区域由密集覆盖退化为稀疏覆盖。

这条线的传播来自 Nature 原始论文、ASU 解读和 Phys.org 科学媒体扩散。它值得进日报,不是因为“又出了一张地图”,而是因为海草长期被视作蓝碳、海岸防护、渔业栖息地和水质改善的重要基础,但全球尺度数据一直不统一。10 米底图和开放数据一旦进入保护规划,研究者和政策制定者就能更精细地比较热点、缺口、退化速度和保护区覆盖不足。

边界在于,这套图谱主要覆盖清澈浅水区域,受卫星穿透深度和水体条件限制,对深水或浑浊区域仍可能低估;它也不能自动解决地方治理和修复资金问题。后续要看的是各国保护区、蓝碳核算和海岸管理项目是否引用这套数据,以及地图更新频率能否跟上实际退化和恢复速度。

来源: Nature(2026-06-24) | ASU News(2026-06-24) | Phys.org(2026-06-25)

热度与日期口径

  • 小时报汇总窗口:2026-06-25 08:40:07 +08:00 至 2026-06-26 08:40:07 +08:00,共纳入 23 份小时报 sidecar、98 条 item。
  • 去重口径:优先按 hourly sidecar 的 dedup_key,补充 DOI、canonical URL、政策页面 URL 与事件主体人工交叉比对;本窗口内严格重复 dedup_key 为 0,但做了主题级合并,例如把 Google computer use 与 OpenAI Codex 研究合并为 agentic AI 工作流,把 Nature 隐私审计与 FAccT 医疗问答研究合并为医疗 AI 风险线。
  • 热度复核:联网检索主要覆盖 2026-06-24 至 2026-06-26 的原始来源、顶刊/机构页面、专业媒体、中文传播源和社区/市场信号;每个入选话题至少有 2 类来源支撑。
  • 跳过重复与弱信号:至少 10 组候选未升级,包括上海 AI 重大专项地方申报窗口、雄安 AI 科技攻关、北京算力券/深圳训力券等与 2026-06-24 日报“新一代 AI 重大专项”主线高度重叠的政策延伸;bepirovirsen 因新检索显示主要传播节点早于本轮窗口而降级为背景;若干单篇 Nature/Science/PNAS 论文虽重要,但缺少比入选话题更强的 24-48 小时外溢证据。

信息来源

可信度说明

本篇优先使用官方发布、顶刊论文、大学/医院机构稿、专业科技媒体和中文主流财经科技传播源。不同话题证据层级不完全相同:LineShine 和论文类话题可核验性较强;agentic AI 与脑机接口政策的长期影响仍依赖第三方评测、执行细则和真实部署数据。