Skip to content

Repository files navigation

CET-6 Full-Process Learning

大学英语六级考试全流程学习工具

七大 AI 训练应用(六大题型 + 精读逐段翻译纠错)+ 自由学习离线工具

License: MIT Python Flask HTML5 DeepSeek


目录


📖 项目简介

本项目是一套覆盖 CET-6(大学英语六级考试)全部题型的备考工具,按 CET-6 题型划分为两类模块:

  • 做题训练(7 个 Flask 应用):六大题型应用(听力、选词填空、长篇阅读、仔细阅读、翻译、写作,各提供出题 → 做题 → 评分 → 倒计时闭环)+ 精读训练(关键词生成原文 → 逐段翻译 → AI 逐段纠错,专项提升阅读与翻译能力)。
  • 自由学习(离线工具):词汇筛选、语境句子播放、听力做题播放器等纯前端 HTML 工具,双击即用,无需服务器。

所有 AI 应用采用 Python(Flask) 后端 + HTML/JS/CSS 前端 架构:命题/评分提示词、DeepSeek 调用、JSON 校验、落盘保存都在后端完成,API Key 只存在服务端 .env,绝不进入浏览器

核心特性

特性 说明
🎯 全题型覆盖 听力 / 选词填空 / 长篇阅读 / 仔细阅读 / 翻译 / 写作六大题型,各一个独立训练应用
🤖 AI 出题 DeepSeek 现场生成与真题"相差无几"的题目,规格由 49 套真题(2019–2024)逐项统计校准
📊 评分闭环 客观题本地秒评 + 解析;写作/翻译由 AI 按考纲评分档次(14 档)点评
⏱️ 倒计时 每个应用内置限时倒计时(写作 30 / 翻译 30 / 阅读 15 / 选词 8 分钟,可调),支持严格模式自动收卷
🔊 智能语音 听力应用基于 Web Speech API,男女声分离、语速可调
🔒 密钥安全 API Key 仅存服务端 .env,已被 .gitignore 排除,绝不上传
📚 词汇合规 听力 / 选词填空 / 长篇阅读 / 仔细阅读 / 写作 / 精读训练 6 个应用生成后按「四六级大纲词表」扫描,DeepSeek 逐词裁定、只替换真超纲词(保留合法六级词),可开关

🎯 训练应用一览

应用 目录 端口 评分方式 默认限时 对应 Section
🎧 听力专项训练 听力专项训练/ 5555 AI 理解度评分 可选 30 分 听力(对话/篇章/讲座)
🔤 选词填空 选词填空/ 5556 本地评分 8 分 Section A
📄 长篇阅读 长篇阅读/ 5557 本地评分 15 分 Section B(段落匹配)
📖 仔细阅读 仔细阅读/ 5558 本地评分 15 分 Section C
🌐 翻译 翻译/ 5559 AI 评分 30 分 翻译(汉译英)
✍️ 写作 写作/ 5560 AI 评分(14 档) 30 分 写作
🔍 精读训练 精读训练/ 5561 AI 逐段纠错 不限时 阅读能力提升(非题型)

七个应用结构同构(app.py + templates/ + static/ + prompts/ + .env.example + requirements.txt),各自独立运行。学习时一次启动一个即可。


🔄 学习工作流

┌──────────────────────────────────────────────────────────────┐
│                CET-6 备考全流程                                │
├──────────────────────────────────────────────────────────────┤
│  ❶ 做题训练(六大题型,各一个 AI 应用)                        │
│  ┌─────────┐ ┌─────────┐ ┌─────────┐                        │
│  │  听力   │ │ 选词填空 │ │ 长篇阅读 │                        │
│  └─────────┘ └─────────┘ └─────────┘                        │
│  ┌─────────┐ ┌─────────┐ ┌─────────┐                        │
│  │ 仔细阅读 │ │  翻译   │ │  写作   │                        │
│  └─────────┘ └─────────┘ └─────────┘                        │
│        出题(AI) → 做题(限时) → 评分(本地/AI) → 解析/精听       │
│                                                              │
│  ❷ 自由学习(离线工具,巩固基础)                              │
│  词汇筛选 → 句子播放 → 听力做题 → 技巧/策略查阅                │
└──────────────────────────────────────────────────────────────┘

📱 做题训练:六大题型应用

通用快速开始(任一应用):

cd <题型文件夹>            # 如 仔细阅读
pip install -r requirements.txt        # Flask, requests(已装可跳过)
copy .env.example .env                 # Windows;macOS/Linux 用 cp
#   编辑 .env 填入 DEEPSEEK_API_KEY=sk-...
python app.py                          # 自动打开 http://127.0.0.1:<端口>

所有应用共享同一套界面风格(紫蓝主题、阶段进度条、倒计时条、选项三态色、评分环)。

🎧 听力专项训练

目录听力专项训练/ 端口:5555

以"理解力"为核心的听力专项训练:AI 现场生成与真题高度一致的听力原文,通过"盲听 → 自评理解 → 盲选 → AI 评分 → 逐句精听"的闭环,训练并量化真实听力理解程度。

功能亮点

功能 说明
AI 生成原文 选择长对话 / 听力篇章 / 讲话·报道·讲座三种题型,生成与真题高度一致的原文 + 题目与解析
自定义原文 粘贴自己的英文原文,AI 据此生成选项、答案与解析(原文保留不变)
两遍盲听 隐藏原文与背景,专注 listening;每遍后写下理解
盲选选项 两遍盲听后展示 A/B/C/D 选项,题干隐藏,仅凭听力作答
AI 理解度评分 原文 + 两遍理解文本 + 作答发给 DeepSeek,返回 0–100 分、主旨/细节/词汇点评、遗漏点与建议
逐句精听 开放原文并按句拆分,可单句播放或"从此处连续播放"
超纲词替换 生成后按大纲词表扫描,疑似超纲词交 DeepSeek 裁定替换(可关闭)
答题倒计时 可选答题倒计时(默认关闭),严格模式到点自动评分
三种题型规格 长对话(约 280–320 词 / 4 题 / W/M 交替)、听力篇章(约 240–260 词 / 3 题)、讲话·报道·讲座(约 370–430 词 / 3 题)

命题/评分提示词在 听力专项训练/prompts/ 软编码(system_generate.txt / system_evaluate.txt / types.json / spec_*.txt),改文件即时生效,无需改代码。


🔤 选词填空

目录选词填空/ 端口:5556 默认限时:8 分钟

Section A(Banked Cloze):AI 生成 250–300 词原文、10 个空、15 词词库(A–O,必含同根不同形词族陷阱)。本地评分

  • 做题:点词库选词 → 点文中空格填入(每词最多一次),点已填空格可清空。
  • 评分:逐空标对错,揭示每空的「所需词性 / 语法线索 / 语义线索」+ 同根词族讲解(notes)。

📄 长篇阅读

目录长篇阅读/ 端口:5557 默认限时:15 分钟

Section B 段落匹配:AI 生成约 1200 词、10–14 段原文 + 10 条陈述句(每条对某段落同义改写)。本地评分

  • 做题:双栏布局——左侧原文段落(A–N,可滚动),右侧 10 条陈述句各配段落字母选择器;选择时短暂高亮对应段落辅助定位。
  • 评分:逐句标对错,揭示「定位词 + 同义改写」解析,正确段落高亮。

📖 仔细阅读

目录仔细阅读/ 端口:5558 默认限时:15 分钟

Section C:AI 生成约 400–450 词原文 + 5 道四选一题(题干 What 占 ~80%)。本地评分

  • 做题:原文(可滚动)+ 5 道 MCQ 单选。
  • 评分:逐题标对错,揭示「定位句 + 干扰项错因」解析。

🌐 翻译

目录翻译/ 端口:5559 默认限时:30 分钟

段落汉译英:AI 生成 180–200 字中文段落(专有名词括注英文)+ 参考译文 + 术语解析。AI 评分

  • 做题:显示中文原文,英文翻译 textarea + 实时词数;可展开「术语提示」。
  • 评分:DeepSeek 对照参考译文评 准确性 / 流畅性 / 术语运用 / 语法句式,给分数、亮点、漏译术语与提升建议;评分后揭示参考译文、术语译法、难句翻译技巧。

✍️ 写作

目录写作/ 端口:5560 默认限时:30 分钟

议论文写作:AI 生成 Directions 题干(含"at least 150 words but no more than 200 words")+ 150–200 词范文 + 中文提纲 + 高级表达。AI 评分(考纲 14 档)

  • 做题:显示题干与写作思路,作文 textarea + 实时词数(目标 150–200,不足/超量变色提示)。
  • 评分:DeepSeek 按 14 档评 切题论点 / 结构连贯 / 词汇 / 语法句式,给分数、亮点、典型问题与建议;评分后揭示参考范文与高级表达。

🔍 精读训练

目录精读训练/ 端口:5561 限时:不限时(每日精读)

专项提升阅读 + 翻译能力的训练器:输入关键词(领域/方向/内容)→ AI 生成 CET-6 难度原文 → 你逐段翻译 → AI 逐段纠错,明确指出每处译错/漏译/不地道之处、错误类型与原因,并给建议译法。

  • 每日阅读量建议:默认 700 词(区间 600–800,切 6–8 段,可在 500/700/1000 词间选择)。这是每日一次、稳步提升六级阅读且不易疲劳的甜区——约为仔细阅读(450 词)的 1.5 倍、长篇阅读(1200 词)的 6 成。
  • 做题:每段一张卡(英文原文 + 翻译框 + 「🔍 评价本段」按钮),可按任意顺序逐段翻译。
  • 📖 译文·词组·技巧(可展开):每段下方默认隐藏,点「📖 译文·词组·技巧」按钮可展开/收起,查看该段中文翻译 + 关键词和词组释义 + 翻译技巧与难点;随时可查,默认隐藏不剧透。
  • AI 反馈:每段给出分数 + 逐处错误表(原文 / 你的译法 / 问题类型 / 原因 / 建议译法)+ 漏译信息 + 亮点;评价后自动展开该段译文·词组·技巧便于对照。
  • 保存:可把全文(原文 + 你的译文 + 纠错)导出到 my/

🧰 自由学习:离线工具

纯前端 HTML 工具,双击即用,无需服务器(位于 自由学习/ 目录)。

CET-6 听力练习应用(自由学习/CET-6 听力练习应用.html

加载本地 JSON 听力练习,用浏览器语音合成完整模拟 CET-6 考试播放流程(对话 → 10 秒间隔 → 题目),支持男女声分离、生词高亮、在线答题。适合用真题 JSON 做模考。

单词筛选应用(自由学习/单词筛选应用.html

逐词标记认识/不认识,导出 known_words.txt / unknown_words.txt / remaining_words.txt,支持断点续学与发音。

句子播放应用(自由学习/播放句子.html

把生词放入真实语境句子,四遍循环播放(英-英-中-英),男女声交替,强化记忆。

辅助资料

文件 内容
自由学习/技巧学习.md 频率副词百分比、程度表达递进、态度形容词光谱
自由学习/提示词.txt 各题型得分分析、75 分钟考试时间分配、答题策略
自由学习/男女声列表.txt Microsoft Natural TTS 语音名称参考(女声/男声)

🚀 快速开始

环境要求

要求 说明
Python 3.8+(运行六大题型训练应用的后端)
浏览器 Chrome / Edge(Web Speech API 与现代 JS)
DeepSeek API Key 训练应用出题/评分需要(听力/翻译/写作评分必用);获取:https://platform.deepseek.com/
离线工具 仅需浏览器,无需 Python 与 Key

启动一个训练应用

cd 仔细阅读                         # 进入任一题型文件夹
pip install -r requirements.txt     # Flask, requests
copy .env.example .env              # Windows;macOS/Linux 用 cp
#   编辑 .env:DEEPSEEK_API_KEY=sk-你的密钥
python app.py                       # 自动打开 http://127.0.0.1:5558

页面顶部状态栏会显示「后端已连接 / Key 已配置」。Key 未配置时给出清晰提示而非崩溃。每个应用可在 .env 中用 PORT 覆盖默认端口。

使用离线工具

直接双击 自由学习/ 下的 .html 文件即可(首次联网加载语音数据,之后可离线)。


📋 数据格式说明

听力练习数据(离线播放器 JSON)

{
  "title": "2024年6月六级听力真题 Section A",
  "topic": "日常对话",
  "dialogue": [
    {"speaker": "W", "content": "Have you heard about the new policy?"},
    {"speaker": "M", "content": "Yes, I think it's going to affect everyone."}
  ],
  "questions": [
    {"question": "What are the speakers mainly discussing?",
     "options": {"A": "...", "B": "...", "C": "...", "D": "..."},
     "answer": "A", "explanation": ""}
  ]
}

句子播放数据(JSON)

[
  {"covered_words": ["abstract", "concept"],
   "sentence": "The abstract concept of justice is difficult to define.",
   "translation": "正义这个抽象概念很难定义。"}
]

词汇文件(TXT)

每行一个单词(如 abandon / ability …)。

训练应用的输出(my/ 目录)

各训练应用生成的练习会落盘到 my/(已 gitignore):自动生成日志 <YYMMDD-HHMMSS><题型>生成.txt,手动保存 <YYMMDD><题型>.txt,均为完整 JSON。听力应用另存 <YYMMDD>听力专项.txt

各题型 AI 生成的 JSON 结构(字段含义)见对应 prompts/system_<题型>.txt 末尾的输出说明。


📁 项目结构

CET-6学习/
├── 听力专项训练/                  # 🎧 听力(端口 5555,AI 出题+评分+精听)
├── 选词填空/                      # 🔤 Section A(端口 5556,本地评分)
├── 长篇阅读/                      # 📄 Section B 段落匹配(端口 5557,本地评分)
├── 仔细阅读/                      # 📖 Section C(端口 5558,本地评分)
├── 翻译/                          # 🌐 汉译英(端口 5559,AI 评分)
├── 写作/                          # ✍️ 议论文(端口 5560,AI 评分 14 档)
├── 精读训练/                      # 🔍 逐段翻译+AI 纠错(端口 5561,不限时)
│   (每个训练应用文件夹结构相同:)
│   ├── app.py                     #    Flask 后端:代理 DeepSeek + 校验 + 落盘
│   ├── requirements.txt           #    Flask, requests
│   ├── .env.example               #    DEEPSEEK_API_KEY 配置模板(.env 本体已忽略)
│   ├── prompts/                   #    📝 软编码命题/评分提示词(随改随生效)
│   ├── templates/index.html       #    页面
│   └── static/{app.js,style.css}  #    前端逻辑与样式
│
├── 自由学习/                      # 🧰 离线工具(纯前端 HTML,双击即用)
│   ├── CET-6 听力练习应用.html     #    听力模考播放器
│   ├── 单词筛选应用.html           #    词汇分类筛选
│   ├── 播放句子.html              #    语境句子四遍循环
│   ├── 技巧学习.md                #    考试技巧速查
│   ├── 提示词.txt                 #    时间分配与答题策略
│   └── 男女声列表.txt             #    TTS 语音名称参考
│
├── 材料/                          # 📂 学习资料(gitignore,不上传)
├── my/                            # 📂 个人学习数据(gitignore,不上传)
│
├── .gitignore                     # Git 忽略配置
├── LICENSE                        # MIT 开源许可
└── README.md                      # 本文档

关于版本库内容:仓库只纳入自研代码与命题提示词(六大题型应用、自由学习/ 离线工具)。材料/(真题原文、PDF/MP3、提取数据、词表)与 my/(个人学习数据)一律通过 .gitignore 排除——既有版权与体积考量,也避免泄露个人数据;.env 等含密钥的文件同样被忽略。


⚙️ 自定义配置

软编码提示词(无需改代码)

每个题型应用的 prompts/system_<题型>.txt 是纯文本 system prompt。用任意编辑器修改后保存即生效——下一次生成就用新内容,无需重启。删除文件则回退到 app.py 内置默认值。

改 JSON 字段结构时,字段名要和 app.pyvalidate_exercise 一致,否则后端判定生成失败并自动重试。

倒计时与严格模式

各训练应用设置区可调「倒计时分钟」与「严格模式」勾选。严格模式下到点自动收卷评分。

模型选择

设置区「模型」下拉可选 deepseek-v4-flash(快·省,默认)或 deepseek-v4-pro(评分更细腻);留空用 .envDEEPSEEK_MODEL。亦可在 .envPORT / HOST / NO_OPEN_BROWSER

语音参数(离线工具)

在各离线 HTML 的语音合成方法中调整 utterance.rate(语速)/ pitch / volume,或听力播放器的 DIALOGUE_GAP / QUESTION_GAP


❓ 常见问题

Q: 需要安装 Python 吗? A: 六大题型训练应用需要 Python 3.8+ 与 Flask;自由学习/ 下的离线工具仅需浏览器。

Q: API Key 安全吗? A: Key 仅存于各应用文件夹的 .env(服务端),已被 .gitignore 排除,绝不上传 GitHub,也不会发往浏览器。

Q: 没配 Key 能用吗? A: 应用仍可启动,页面顶部提示「Key 未配置」;出题/评分请求返回清晰错误。客观题应用(选词/长篇/仔细)的做题界面需先出题,故仍需 Key 生成题目。

Q: 一次能开几个应用? A: 每个应用占一个端口(5555–5560),可同时开多个;学习时一般一次开一个即可。

Q: 生成的题目与真题一致吗? A: 命题提示词的规格(词数、题数、题干句式、干扰项类型)由 49 套真题(2019–2024)逐项统计得出,确保"相差无几"。

Q: 偶尔生成失败? A: 个别时候模型返回空内容,后端会自动重试一次;仍失败请再点一次「生成」即可。


🛠 技术实现

技术栈

技术 用途
Python + Flask 六大题型应用后端(代理 DeepSeek、校验、落盘)
DeepSeek API 出题与主观题评分(OpenAI 兼容协议,response_format: json_object
HTML5 + CSS3 + Vanilla JS 前端界面、状态机、倒计时、Web Speech 语音
Web Speech API 听力应用的语音合成(TTS)

核心设计

  • 后端代理:DeepSeek 调用、命题/评分提示词、JSON 容错解析(parse_json_loose)、业务校验、ApiError 状态码映射(401/429/422/502)全部在后端;前端只发参数、收结果、渲染。
  • 软编码提示词:提示词是 prompts/ 下的纯文本,每次请求重读,改文件即时生效。
  • 生成重试:JSON 不达标时自动拼「修正要求」重试一次;客观题服务端兜底统计正确率。
  • 前端状态机:阶段进度条(出题 → 做题 → 评分),.hidden 切换,选项三态色(选中/正确/错误),评分环(conic-gradient)。
  • 倒计时setInterval(1s) + Date.now() 差值,到点 toast 提示,严格模式自动收卷。
  • 视觉统一:六应用共享紫蓝主题(#667eea→#764ba2)与组件类名。

🤖 AI 协作开发

本项目采用 AI 辅助编程 + 人工审核调优 的协作开发模式。

AI 模型 贡献领域
💠 Claude Code (Anthropic) 整体架构、六大题型应用后端与前端、命题提示词校准、倒计时与评分模块
🅰️ GLM-4 (智谱AI) 基础离线工具实现、UI 卡片式布局、交互逻辑
🎤 Kimi (月之暗面) 语音功能增强、发音参数优化、用户体验

📌 版本更新日志

v3.3.0 (2026-06)

  • 🔍 精读训练:每段新增「📖 译文·词组·技巧」可展开面板(默认隐藏,按钮切换)——含中文翻译 + 关键词和词组释义 + 翻译技巧与难点;命题新增 techniques 字段;评价后自动展开便于对照纠错

v3.2.0 (2026-06)

  • 📚 词汇合规扩展到 5 个应用:选词填空 / 长篇阅读 / 仔细阅读 / 写作 / 精读训练 现均具备程序级 CET-6 词汇合规——克隆听力的 vocab.py(大纲词表扫描)+ DeepSeek 逐词裁定替换,生成后自动跑、可开关;扫描器只筛候选,DeepSeek 保留合法六级词、仅替换真超纲词。翻译因含专有名词/文化负载词,保持提示词软约束
  • 🔍 听力「播放题目」改为只读题干,不再朗读选项

v3.1.0 (2026-06)

  • 🔍 新增精读训练应用(精读训练/,端口 5561):输入关键词 → AI 生成 CET-6 难度原文 → 逐段翻译 → AI 逐段纠错(指出每处译错 + 错误类型 + 原因 + 建议译法),专项提升阅读与翻译能力
  • 📊 默认每日 ~700 词 / 6–8 段(可选 500/700/1000),按"每日一次、稳步提升"设计;每段附参考译文与重点词/短语

v3.0.0 (2026-06)

  • 🎯 全题型训练应用套件:新增选词填空 / 长篇阅读 / 仔细阅读 / 翻译 / 写作五个 Flask 应用,与既有「听力专项训练」同构,覆盖 CET-6 全部六大题型
  • 🔤 选词填空(端口 5556):词库填空交互 + 本地评分 + 词性/语法/语义线索解析
  • 📄 长篇阅读(端口 5557):双栏段落匹配 + 本地评分 + 定位词改写解析
  • 📖 仔细阅读(端口 5558):原文 + 5 题 MCQ + 本地评分
  • 🌐 翻译(端口 5559):汉译英 + AI 评分(准确/流畅/术语/语法),新增 system_evaluate_translation.txt
  • ✍️ 写作(端口 5560):议论文 + AI 14 档评分,新增 system_evaluate_writing.txt
  • ⏱️ 六应用统一内置倒计时模块(可调时长 + 严格模式自动收卷)
  • 📁 项目重组:按题型划分文件夹;离线工具收纳至 自由学习/阅读写作翻译/prompts/ 五题型提示词迁入各自应用;删除静态 翻译单词学习.html
  • 📝 命题提示词全部由 49 套真题(2019–2024)逐项统计校准,确保与真题"相差无几"

v2.3.0 (2026-06)

  • 📚 新增阅读写作翻译五大题型命题 system prompt(现已拆分迁入各题型应用)
  • 🎯 听力专项训练提示词按真题语料全面校准(讲座词数、题数、题干模板)
  • 🔒 强化 .gitignore

v2.2.0 (2026-06)

  • ✨ 新增听力专项训练模块(Flask 后端 + 拆分前端,首个接入在线 AI 的模块)
  • 🤖 盲听 → 盲选 → DeepSeek 评分 → 逐句精听闭环

v2.1.0 (2025-12)

  • ✨ 新增句子播放应用、技巧学习与考试策略辅助资料
  • 📁 项目更名为 CET6-Full-Process-Learning

v2.0.0 (2025-11-29)

  • ✨ 新增 CET-6 听力练习应用(10 秒间隔模拟考试、进度条、生词高亮)

v1.2.0 (2025-11-26)

  • ✨ 智能词汇筛选功能、语音一键播放、多状态批量管理

📄 开源许可

本项目基于 MIT License 开源。

Copyright © 2025 Kecoya


如果这个项目对你的六级备考有帮助,欢迎 ⭐ Star 支持!

About

CET-6全流程学习系统 - 专为大学英语六级考试设计的综合学习工具,集听力练习、词汇筛选、语音合成于一体,提供模考流程和智能学习体验。

Resources

Stars

16 stars

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages