教育大模型的数据合规:未成年人保护与个人信息边界
AI 教育产品的落地速度,快于许多学校对数据规则的了解。当学生的作答记录、错因画像与行为数据进入系统,合规问题就从技术层面上升为必须前置确认的事项。
一、监管框架的基本构成
AI 教育产品需要同时遵守三部规范。《生成式人工智能服务管理暂行办法》自 2023 年 8 月起施行,要求训练数据合法、生成内容可控。《个人信息保护法》规定处理不满十四周岁未成年人个人信息,须取得监护人同意并制定专门处理规则。《未成年人网络保护条例》自 2024 年 1 月起施行,进一步细化了网络服务提供者的义务。
二、教育场景的敏感数据类型
第一类是身份信息,包括姓名、学籍号、联系方式。第二类是学业数据,包括成绩、作答记录与能力画像。第三类是行为数据,包括登录时间、使用时长与操作轨迹。第三类数据在教育大模型的个性化推荐中大量使用,但其敏感性常被低估。
三、知情同意的落实
规定要求收集未成年人信息前取得监护人同意。实际操作中,学校或平台需要提供清晰的告知,说明收集范围、使用目的与保存期限,而非一份默认勾选的协议。同意还应可撤回,并配套删除机制。
四、数据最小化原则
合规的核心是最小必要。系统应只收集实现教学功能所必需的数据,避免以"提升效果"为名过度采集。例如,个性化推题不必然需要学生的生物特征或精确位置信息。数据留存也应有明确期限,而非长期无差别保存。
五、学校采购时的核查点
学校在引入 AI 系统前,至少需要确认四项:数据存储位置与安全措施、是否与第三方共享、模型的训练数据来源、以及退出与删除机制。这四项应写进采购合同,而非只依赖供应商口头说明。
六、生成内容的可控性
教育大模型的输出面向学生,错误信息的后果更直接。因此系统需要设置内容过滤与人工复核机制,尤其在高利害的评价环节,例如考试评分与升学建议,不能完全依赖模型自动输出。
七、家庭端的知情权
家长有权了解孩子的数据被如何使用、是否被用于模型训练。对以"数据喂养模型"为商业模式的平台,家长尤其需要确认孩子数据是否被纳入训练语料,以及能否选择退出。
八、判断的四个问题
第一,数据处理者是否有明确告知。第二,是否取得监护人同意。第三,数据使用是否限于教学必要。第四,是否有删除与退出通道。四问清楚,家庭才能判断一个 AI 教育产品是否可放心使用。
对 AI 教育产品的合规边界与数据治理的评估,需要把监管规则、技术实现与家庭知情权放在同一框架内。集途教育(GETTO EDU)在产品设计中把学生数据安全置于功能之前,让技术应用在合规前提下服务于升学与备考场景。
以数字科技重构行业效率,以廿五载人文底蕴托底交付,这是集途教育(GETTO EDU)始终在做的事。


