关于青少年该不该使用生成式AI,公共讨论常常先有立场、后找证据。9月8日,OpenAI宣布投入总计500万美元,支持13至17岁青少年使用生成式AI及其发展影响的独立研究,单个项目最高可获100万美元。申请从当天开放至10月6日,项目将滚动评审,入选结果计划最迟在11月13日前通知。这个动作值得关注,但必须把它准确理解为“征集并资助研究”,而不是OpenAI已经证明ChatGPT对青少年有益或无害。

项目聚焦社会与情绪发展,包括情绪调节、韧性、身份、能动性、自尊、社交连接、友谊与家庭关系,也鼓励研究使用时长、用途、年龄、文化、语言和经济背景如何造成不同结果。技术干预、年龄适配设计、家长与教师支持、AI素养和健康使用方式同样在资助范围。官方接受定性、定量、实验、观察、理论、参与式与混合方法研究,研究可以用任何语言开展,但申请材料必须用英语提交。

钱买不到结论,只能买到更严谨的问题

500万美元听起来明确,真正困难的却是研究设计。青少年不是同质人群:13岁和17岁的认知、社交环境与自主能力差异很大;用AI查资料、练习外语、倾诉情绪或代写作业,也会产生完全不同的影响。简单比较“用过”和“没用过”的两组人,很容易把家庭支持、学校资源、原有心理状态与设备可得性误当成AI效果。可靠研究需要定义暴露程度、建立对照、跟踪长期变化,并说明哪些相关性不能推导因果。

OpenAI的评审标准把科学严谨性、现实相关性、可执行性、伦理保障、可行性、团队专长、代表性以及独立可信度列在一起。申请材料要求包含不超过一页的项目摘要、不超过三页的研究方案、时间表、预算、依赖与风险、团队信息,以及独立性和利益冲突披露。涉及未成年人、敏感信息或脆弱群体的项目,还必须提交伦理和保护说明。这些门槛说明资助对象不是一般公益活动或商业产品,而是要能经得住方法与伦理审查的研究。

尤其重要的是未成年人保护。申请者需要说明机构或独立伦理审查流程、知情同意与适龄同意如何执行、隐私和数据如何保存、遇到伤害或紧急风险披露时如何响应,以及团队是否具备儿童发展、临床或保护经验。收集心理健康和行为信息并不会自动让项目失去资格,但会增加审查、专业能力与时间要求。对研究者而言,这意味着“拿到一批聊天记录做分析”远远不够,数据最小化、匿名化、退出机制和危机转介都必须提前设计。

独立性要靠制度安排,而不是一行声明

资金由OpenAI Group PBC提供和管理,偏好涉及ChatGPT、跨学科团队、代表性不足人群或地区,以及能影响近期政策与产品决策的项目。项目结果可能直接影响资助方自身产品,因此独立性是整个计划最敏感的环节。官方要求披露财务关系和利益冲突,并把“无论结果是否有利于AI提供商,都能产生可信发现”列入评审标准,这是必要条件,但还不是充分保证。

真正有说服力的安排包括预注册研究问题和分析方案、在取得数据前明确主要终点、允许发表负面结果、公开方法与局限,并让外部同行能够复核。官方要求每个获资助项目提交最终报告,2027年第一季度还需提供中期进展;研究者被强烈鼓励通过同行评议论文、预印本或公共报告公开成果,但公开发表并非获得资助的硬性条件。正因为后者不是强制项,外界之后应关注有多少项目实际公开、数据与代码开放到什么程度,以及结果是否只以公司摘要出现。

经费也有清晰边界:全部项目合计最高500万美元,单项最高100万美元,间接成本或管理费最多占单项资助的10%。申请人需年满18岁,并与研究机构或组织有关联,或者具备儿童发展、福祉、人机交互、AI影响等相关经验。学生、研究生和博士后可以由项目经费支持,但该计划不优先资助营利性项目。

这项计划的价值不在于替社会迅速给出“AI好还是坏”的二选一答案,而在于把问题拆到具体年龄、用途、场景和干预措施。产品公司出钱支持外部证据建设是积极信号,可信度却要由研究协议、发表自由、样本代表性和结果复核来建立。今天可以确认的是申请窗口、预算与规则已经公布;青少年长期使用AI的净影响,仍要等研究真正完成后再判断。

评估结果时还要警惕“平均有效”掩盖少数群体受损。一个干预即使让多数参与者略有改善,也可能让处于孤独、焦虑或家庭支持不足状态的青少年承担更高风险。报告若只给总体均值、不呈现分组结果和退出样本,政策制定者仍无法知道应为谁设置更严格保护。长期随访、异常事件报告和按使用目的分层,将比一句总体满意度更有决策价值。