大语言模型是基于海量文本数据训练的超大规模神经网络,能够理解和生成自然语言。代表产品:ChatGPT、DeepSeek、豆包、文心一言、通义千问等。
会产生"幻觉"(编造事实)、知识截止日期限制、不能替代教师的判断力和育人功能。
为什么大语言模型在2023年后突然爆发?
三个条件同时成熟:Transformer架构(2017年Google提出)解决了长文本理解问题;GPU算力成本大幅下降,训练千亿参数模型成为可能;互联网积累了足够多的文本数据供训练。这三个条件的交集点就在2022-2023年。
国产大模型对教育工作者几乎免费,能力已接近GPT-4。选择国产模型不仅省钱,而且数据不出境,符合学校信息安全要求。
一位四年级数学教师将乘法分配律的知识点输入DeepSeek,要求按基础-进阶-拓展三层生成30道练习题。5分钟内完成,教师审核修改3题后直接使用。
语文教师将学生作文拍照上传豆包,让AI从内容、结构、语言、亮点四个维度给出评语参考。教师在此基础上修改,评语效率提升60%。
科学教师用DeepSeek设计校园植物探索STEAM项目:包含科学观察、数学统计、语文写作、美术写生四个模块,AI生成完整的项目方案和评价量规。