大模型集群犹如一批高级教师,有的擅长讲课、有的擅长出题、有的擅长分析、有的擅长作图、有的擅长外语、有的擅长语法等等。大模型有的是开源的,有的要授权并且收费,有的要接入API。大模型有的是国内的,有的是国外的。合理有效的部署大模型,形成大模型集群专项服务校园或区域教学全过程,必将深度促进教学改革,极大的提升老师教学效率,提升学生学习效率。
以下是常用的大模型列表
(一)本地私有化开源模型(部署在校内大模型集群,学生学情原始数据不流出校园内网)
1,通用对话与基座模型
|
模型 |
建议规模 |
特点 |
|
Qwen3 / Qwen2.5 系列 |
7B / 14B / 32B / 72B |
中文强,工具调用好,Apache-2.0,适合教育问答、备课、助教 |
|
DeepSeek-V3 / DeepSeek-R1 |
671B MoE |
通用与推理强,MIT 许可,硬件要求高,可用蒸馏版 |
|
GLM-4 / GLM-4.5 系列 |
9B / 32B |
中文理解好,适合中文作文、文科问答 |
|
Llama 3.3 / Llama 4 系列 |
70B / MoE |
多语言强,Meta 许可,需注意商用条款 |
|
Mistral Small / Large |
24B / 123B |
多语言,Apache-2.0,推理效率高 |
|
Gemma 3 |
4B / 12B / 27B |
Google 开源,轻量,适合端侧或小服务器 |
|
InternLM2.5 / InternLM3 |
7B / 20B / 30B |
上海 AI 实验室,中文与长文本好 |
|
Yi-1.5 |
9B / 34B |
中文长文本好,适合长文档阅读 |
2,推理与数学解题模型
教育场景中数学、物理、化学、编程等需要强推理。
|
模型 |
建议规模 |
特点 |
|
DeepSeek-R1 及蒸馏版 |
7B / 14B / 32B / 70B / 671B |
数学、代码、逻辑推理强,MIT 许可 |
|
QwQ-32B |
32B |
Qwen 推理模型,中文数学与代码好 |
|
Qwen3 思考模式 |
4B / 14B / 32B |
支持思考/非思考切换,适合分层任务 |
|
GLM-Z1 系列 |
9B / 32B |
智谱开源推理模型,中文推理 |
|
Skywork-o1 |
7B / 14B |
昆仑万维推理模型,适合数学题讲解 |
3,多模态与 OCR / 试卷扫描模型
|
模型 |
建议规模 |
特点 |
|
Qwen2.5-VL / Qwen3-VL |
3B / 7B / 32B / 72B |
图文理解、公式、图表、OCR 强 |
|
InternVL2.5 / InternVL3 |
1B / 8B / 38B / 78B |
OCR 强,适合文档解析、试卷识别 |
|
MiniCPM-V 4.5 |
8B |
端侧多模态,适合扫描笔、学习机 |
|
Gemma 3 |
4B / 12B / 27B |
支持图像,轻量 |
|
Llama 3.2 Vision / Llama 4 |
11B / 90B |
图像理解 |
|
GLM-4V 开源版 |
9B |
中文图像理解 |
4,专用文档解析工具/模型:
MinerU:PDF/试卷转结构化文本、公式
PaddleOCR / PP-StructureV3:中文 OCR、表格识别
GOT-OCR2:通用 OCR 模型
Unstructured / Marker:文档解析
4. 嵌入与重排模型
用于知识点检索、题库 RAG、相似题推荐、作文相似度等。
|
模型 |
建议规模 |
特点 |
|
BGE-M3 |
560M |
多语言、多粒度,中文检索首选 |
|
bge-reranker-v2-m3 |
560M |
重排,提升 RAG 精度 |
|
bge-large-zh-v1.5 |
326M |
中文嵌入 |
|
Qwen3-Embedding |
0.6B / 4B / 8B |
中文强,适合教育知识库 |
|
gte-Qwen2 |
1.5B / 7B |
中文嵌入 |
|
multilingual-e5-large |
560M |
多语言嵌入 |
|
jina-embeddings-v3 / v4 |
570M |
多语言、长文本嵌入 |
|
jina-reranker-v2 |
278M |
重排 |
5,语音模型
用于口语评测、朗读、听力、课堂语音转写。
|
类别 |
模型 |
特点 |
|
语音识别 ASR |
Whisper large-v3 / v3-turbo |
多语言,开源,效果好 |
|
语音识别 ASR |
FunASR / Paraformer |
中文识别强,阿里开源 |
|
语音识别 ASR |
SenseVoiceSmall |
中文、多语,轻量 |
|
语音合成 TTS |
CosyVoice2 |
阿里开源,中英文自然 |
|
语音合成 TTS |
ChatTTS |
对话式合成,适合口语 |
|
语音合成 TTS |
Fish-Speech |
多语言 TTS |
|
多模态语音 |
Qwen2-Audio / Qwen2.5-Omni |
音频理解与语音交互 |
6,代码模型
用于编程教学、自动批改代码、生成代码讲解。
|
模型 |
建议规模 |
特点 |
|
Qwen2.5-Coder |
7B / 32B |
代码生成与解释强 |
|
DeepSeek-Coder-V2 |
16B / 236B |
代码与数学 |
|
CodeLlama |
7B / 13B / 34B |
代码补全 |
|
StarCoder2 |
3B / 7B / 15B |
代码生成 |
7. 内容安全与护栏模型
学生群体必须加内容安全。
|
模型 |
特点 |
|
Llama Guard 3 |
输入输出安全分类 |
|
ShieldGemma |
安全护栏 |
|
Qwen3Guard |
中文安全检测,如可用 |
|
本地规则引擎 + 敏感词库 |
结合使用 |
(二)API融入大模型
- 国内大模型 API
|
平台 |
模型 |
教育用途 |
|
阿里云百炼 |
Qwen3-Max / Qwen3-Plus / Qwen3-Turbo |
通用答疑、备课、长文本 |
|
阿里云百炼 |
Qwen-VL-Max / Qwen3-VL |
试卷 OCR、图像理解 |
|
阿里云百炼 |
text-embedding-v4 / rerank |
知识库检索 |
|
DeepSeek 开放平台 |
deepseek-chat / deepseek-reasoner |
数学、推理、编程 |
|
智谱 AI |
GLM-4.6 / GLM-4-Plus / GLM-4V-Plus |
中文问答、多模态 |
|
智谱 AI |
embedding-3 |
向量检索 |
|
字节火山方舟 |
Doubao-1.5-pro / lite / thinking-pro |
高并发答疑、推理 |
|
字节火山方舟 |
doubao-embedding / TTS / ASR |
检索、语音 |
|
百度千帆 |
ERNIE 4.5 / ERNIE Speed / Lite |
中文问答、作文 |
|
百度千帆 |
Embedding-V1 |
检索 |
|
腾讯云 |
混元 Hunyuan-Turbo / Large / T1 |
通用、推理 |
|
月之暗面 |
Kimi-K2 / moonshot-v1-128k |
长文档阅读、备课 |
|
MiniMax |
MiniMax-M2 / abab |
通用、语音 |
|
阶跃星辰 |
Step-2 / Step-1V |
通用、多模态 |
|
讯飞星火 |
Spark Max / Pro / Ultra |
作文批改、口语评测、OCR |
|
商汤日日新 |
SenseNova |
多模态、中文 |
还有图生视频、文生图、虚拟数字人等等大模型。