FLEAN-FDE / DOCUMENT
以下正文由 README.md 直接渲染。相关概念与官网链接放在正文之外,Markdown 原文未被修改。

Lean-FDE 公开资料研究库

本目录保存对 Lean-FDE 官网公开内容的合规抓取、来源索引与结构化研究成果。

快速入口

直接双击根目录的 index.html,即可打开离线 FDE 知识作战地图。入口页提供七阶段全景、跨文档章节搜索、问题定位、角色阅读路线和资料跳转。

目录

  • docs/:FDE 系统知识、方法论、工具栈、模板与学习路径。
  • docs/FDE系统知识手册.md:便于搜索与离线阅读的单文件合订版。
  • pages/:由 Markdown 原文生成的静态 HTML 阅读页;目录结构与源文件对应。
  • assets/document.css / assets/document.js:HTML 阅读页的共享样式与交互。
  • assets/search-index.js:由核心 Markdown 章节生成的离线全文搜索索引。
  • sources/manifest.json:页面 URL、抓取时间、状态码、摘要文件与 SHA-256。
  • sources/raw-html/:公开页面原始 HTML 快照。
  • sources/clean-text/:从服务端 HTML 提取的正文文本。
  • sources/rendered-text/:对需要客户端渲染的公开页面所做的浏览器文本快照。
  • scripts/crawl_leanfde.py:可复现的限速爬虫。

重新抓取

python -m pip install -r requirements.txt
python scripts/crawl_leanfde.py --output sources --delay 0.6
python scripts/build_handbook.py
python scripts/build_html_docs.py

边界

  • 只抓取同域名、无需登录、由站内链接发现的公开 HTML。
  • 不提交表单、不抓取个人数据、不绕过登录/付费/访问控制。
  • robots.txtsitemap.xml 在本次抓取时均返回 404;爬虫仍会在站点后来提供 robots.txt 时遵循其规则。
  • docs/ 是对公开语料的归纳与二次组织,不代表网站官方认证标准,也不构成课程、就业或项目结果承诺。