面向初学者的数据科学课程孟加拉语版指南:10 周 20 课的项目驱动学习路线
2026/9/10 11:25:51 网站建设 项目流程

面向初学者的数据科学课程孟加拉语版指南:10 周 20 课的项目驱动学习路线

【免费下载链接】Data-Science-For-Beginners10 Weeks, 20 Lessons, Data Science for All!项目地址: https://gitcode.com/GitHub_Trending/da/Data-Science-For-Beginners

本篇指南以仓库中孟加拉语(Bengali)翻译版的课程主页 translations/bn/README.md 为骨架,系统介绍 Data Science for Beginners 课程的完整学习路径:从教学法设计、20 节课的知识地图、每课标准结构,到本地环境搭建(Codespaces / VS Code Dev Containers / Docsify 离线阅读)、测验应用运行与孟加拉语多语言支持。读完本篇,你将清楚如何以孟加拉语为界面语言,从零开始安装依赖、按周推进课程、运行 Jupyter 笔记本与测验应用,并利用稀疏检出(sparse checkout)快速获取无翻译的精简仓库。

课程概览:项目驱动 + 高频测验的双支柱教学法

该翻译版课程主页开篇即点明课程定位:由微软 Azure 云布道师团队提供,由 Jasmine Greenaway、Dmitry Soshnikov、Nitya Narasimhan、Jalen McGee、Jen Looper、Maud Levy、Tiffany Souterre、Christopher Harrison 等作者共同编写,并以孟加拉语全文翻译。课程遵循两条教学法原则:

  • 项目驱动(Project-Based):在"边构建边学习"中掌握技能。项目从简到繁,在 10 周周期内逐步提升复杂度,这正是让新技能"真正生根"的有效方式。
  • 高频测验(Frequent Quizzes):课前一个低压力测验用于设定学习意图,课后第二个测验用于强化记忆留存。

整套课程结束时,学习者将掌握数据科学的核心理念,涵盖:数据伦理、数据准备、处理数据的多种方式(关系型与非关系型)、数据可视化、数据分析、数据科学在真实世界中的应用案例等。课程设计刻意保持灵活,可以整体学习,也可以按需节选部分章节,因此既适合自学,也适合课堂讲授。

作为翻译版,孟加拉语主页与英文原版 README.md 保持同构结构:所有课程目录、作业、测验与源码引用均与英文版一一对应,孟加拉语学习者可以完全以母语完成全部学习流程。

孟加拉语多语言支持与仓库稀疏检出

仓库采用 GitHub Action(Co-op Translator)自动维护 50+ 语言的翻译,翻译结果按语言目录存放,孟加拉语内容位于:

  • 翻译文档:translations/bn/
  • 翻译图片:translated_images/bn/

由于 50+ 语言的翻译会显著增大仓库体积,主页提供了sparse checkout(稀疏检出)方案——跳过translationstranslated_images目录,只下载完成课程所需的全部核心内容,下载更快:

Bash / macOS / Linux:

git clone --filter=blob:none --sparse <repository-url> cd Data-Science-For-Beginners git sparse-checkout set --no-cone '/*' '!translations' '!translated_images'

CMD(Windows):

git clone --filter=blob:none --sparse <repository-url> cd Data-Science-For-Beginners git sparse-checkout set --no-cone "/*" "!translations" "!translated_images"

说明:--filter=blob:none实现按需拉取文件内容(blob),--sparse只检出顶层目录结构,git sparse-checkout set --no-cone配合/*!translations!translated_images精确圈定需要检出的路径。如果你需要孟加拉语版本学习,则应保留translations/bntranslated_images/bn目录,例如执行git sparse-checkout set --no-cone '/*' '!translations/!(bn)' '!translated_images/!(bn)'

开始之前:文档导航与入门资料

翻译版主页提供了完整文档索引(这些文件位于仓库根目录,链接已统一为仓库根相对路径):

文档用途
INSTALLATION.md面向新手的逐步环境配置指南
USAGE.md使用示例与常见工作流
TROUBLESHOOTING.md常见问题解决方案
CONTRIBUTING.md向项目贡献的规则
for-teachers.md教学指导与课堂材料
CODE_OF_CONDUCT.md社区行为准则

快速开始路径(主页推荐的 4 步):

  1. 查阅 INSTALLATION.md 配置环境;
  2. 查阅 USAGE.md 了解课程使用方式;
  3. 从第 1 课开始按顺序推进;
  4. 遇到问题先查 TROUBLESHOOTING.md。

对于完全零基础的学习者,主页强烈建议先进入 examples/README.md 的"初学者友好示例"目录——这些简单、注释详尽的脚本会在进入完整课程前帮你建立基本概念。

每课标准结构:从课前测验到课后作业

孟加拉语课程主页明确列出了每一课的统一组成部分,这也是课程可规模化复制的关键:

  • 可选的素描笔记(sketchnote)
  • 可选的补充视频
  • 课前热身测验(pre-lesson warmup quiz)
  • 书面课程(written lesson)
  • 项目型课程的逐步构建指南
  • 知识检查(knowledge check)
  • 挑战(challenge)
  • 补充阅读(supplemental reading)
  • 作业(assignment)
  • 课后测验(post-lesson quiz)

关于测验的说明:全部测验位于quiz-app文件夹,共 40 个测验,每个测验 3 道题。测验从课程内部链接,测验应用既可以在本地运行,也可以部署到 Azure,具体指令见 quiz-app/README.md。测验正逐步实现本地化——孟加拉语版课程即属于该多语言化进程的一部分。

20 课知识地图:六大学组全景

翻译版主页用一张完整的课程表列出 20 节课的分组、主题、学习目标与作者,以下为按六大学组整理的完整清单:

第一组:Introduction(1-Introduction)

课号主题学习目标
01Defining Data Science学习数据科学基本概念及其与人工智能、机器学习、大数据的关系
02Data Science Ethics数据伦理的概念、挑战与框架
03Defining Data数据如何分类及其常见来源
04Introduction to Statistics & Probability用概率与统计的数学技术理解数据

对应孟加拉语课程文档:translations/bn/1-Introduction/

第二组:Working With Data(2-Working-With-Data)

课号主题学习目标
05Working with Relational Data关系型数据入门,使用 SQL 探索与分析关系型数据
06Working with NoSQL Data非关系型数据入门,各类 NoSQL 与文档数据库查询分析
07Working with Python使用 Pandas 等库进行数据探索的 Python 基础
08Data Preparation清洗与转换数据的技术,应对缺失、错误或不完整数据

第三组:Data Visualization(3-Data-Visualization)

课号主题学习目标
09Visualizing Quantities使用 Matplotlib 可视化鸟类数据
10Visualizing Distributions of Data可视化区间内的观测与趋势
11Visualizing Proportions离散与分组百分比的可视化
12Visualizing Relationships数据集及其变量之间连接与关系的可视化
13Meaningful Visualizations让可视化对问题解决与洞察有价值的技巧与规范

第四组:Lifecycle(4-Data-Science-Lifecycle)

课号主题学习目标
14Introduction to the Data Science lifecycle数据科学生命周期及其第一步:数据获取与抽取
15Analyzing聚焦数据分析技术
16Communication以决策者易于理解的方式呈现数据洞察

第五组:Cloud Data(5-Data-Science-In-Cloud)

课号主题学习目标
17Data Science in the Cloud云端数据科学及其优势
18Data Science in the Cloud使用 Low Code 工具训练模型
19Data Science in the Cloud使用 Azure Machine Learning Studio 部署模型

第六组:In the Wild(6-Data-Science-In-Wild)

课号主题学习目标
20Data Science in the Wild真实世界中由数据科学驱动的项目

说明:以上链接路径均指向孟加拉语翻译目录,例如第 01 课对应 translations/bn/1-Introduction/01-defining-data-science/README.md,其余各课依此类推;英文原版结构见各课程分组目录下的 README.md、2-Working-With-Data/README.md、3-Data-Visualization/README.md、4-Data-Science-Lifecycle/README.md、5-Data-Science-In-Cloud/README.md、6-Data-Science-In-Wild/README.md。

环境搭建:三种入口任选

方式一:GitHub Codespaces(新手首选)

  1. 打开仓库页面,点击Code下拉菜单;
  2. 选择Codespaces标签页;
  3. 点击Create codespace on main
  4. 等待环境初始化(约 2-3 分钟),所有依赖已预装。

方式二:VS Code Remote - Containers

先在本地确保满足前置条件(例如已安装 Docker),然后二选一:

  • 容器卷克隆:使用 Remote-Containers 的Clone Repository in Container Volume...命令,将源码克隆进 Docker 卷而非本地文件系统(卷是容器数据持久化的首选机制);
  • 打开本地克隆:将仓库克隆到本地文件系统后,按F1选择Remote-Containers: Open Folder in Container...,选中克隆目录,等待容器启动即可开始动手。

方式三:本地安装(Linux 示例)

依据 INSTALLATION.md,本地安装的完整链路为:安装 Git → 克隆仓库 → 安装 Python 3.7+ → 创建虚拟环境 → 安装数据科学依赖 → 安装 Node.js/npm → 安装测验应用依赖 →(可选)安装 Docsify。核心命令如下:

# 创建并激活虚拟环境 python -m venv venv source venv/bin/activate # Windows 为 venv\Scripts\activate # 安装数据科学依赖 pip install jupyter pandas numpy matplotlib seaborn scikit-learn # 安装测验应用依赖 cd quiz-app && npm install && cd .. # 安装 Docsify(可选,用于离线文档) npm install -g docsify-cli

验证安装:启动jupyter notebook打开任意课程的.ipynb;在quiz-app下运行npm run serve,测验应用默认运行于http://localhost:8080;在仓库根目录运行docsify serve,文档站默认运行于http://localhost:3000

测验应用:本地运行与题库组织

测验是课程体验的核心组件,其实现位于 quiz-app/,是一个基于 Vue.js 的 SPA(入口见 quiz-app/src/main.js)。根据 quiz-app/README.md:

cd quiz-app npm install # 安装依赖 npm run serve # 本地开发,热重载,默认 http://localhost:8080 npm run build # 生产构建与压缩 npm run lint # 代码检查与修复

题库组织:共 40 个测验(编号从 0 到 39),每种语言一套题库,规范题库(canonical)位于assets/translations/en,其余语言按相同结构放在assets/translations/<locale>目录(从 quiz-app/src/assets/ 的目录结构可以看到每种语言 14 个 JSON 题库文件与对应index.js导入文件)。为测验应用新增翻译的流程为:创建对应语言题库目录 → 修改该目录index.js导入新题库 → 在assets/translationsindex.js中注册 → 在App.vue的语言下拉框中加入该语言 → 在课程测验链接中以查询参数指定语言(如?loc=bn)。测验应用同样可以部署到 Azure Static Web Apps,Azure/static-web-apps-deploy@v1动作会在仓库中生成.github/workflows/azure-static-web-apps-<name>.yml工作流完成构建与发布。

初学者示例:五步入门脚本

对于完全新手,examples/README.md 提供了五个按难度编号、带详尽注释、可独立运行的 Python 脚本:

文件主题覆盖技能
examples/01_hello_world_data_science.pyHello World用列表/字典构造数据集、max/min/sum 基本统计
examples/02_loading_data.py数据加载读取 CSV、查看前几行、基础统计、理解数据类型
examples/03_simple_analysis.py简单分析均值/中位数/众数、最值、计数、条件过滤
examples/04_basic_visualization.py基础可视化柱状图、折线图、饼图、保存图片
examples/05_real_world_example.py真实项目加载→清洗→分析→可视化→结论的完整工作流

05_real_world_example.py为例,它演示了完整的数据科学工作流:先定义待回答的问题(鸟击事件统计、时间模式、常见鸟种、损坏程度),随后通过pd.read_csv('../data/birds.csv')加载仓库 data/birds.csv 真实数据,用data.isnull().sum()检查缺失值,用value_counts()分析最常见鸟种,最后用 Matplotlib 生成birds_top_species.png等可视化并给出结论——这正是第 14-16 课"数据科学生命周期"思想的脚本化缩影。运行示例前只需pip install pandas numpy matplotlib(Python 3.7+)。

教师使用指南

主页为教师提供了专项指导 for-teachers.md,同时 USAGE.md 给出了一套建议的 10 周排课方案:

  • 第 1-2 周:Introduction(第 1-4 课)
  • 第 3-4 周:Working with Data(第 5-8 课)
  • 第 5-6 周:Data Visualization(第 9-13 课)
  • 第 7-8 周:Data Science Lifecycle(第 14-16 课)
  • 第 9 周:Cloud Data Science(第 17-19 课)
  • 第 10 周:真实世界应用与期末项目(第 20 课)

课堂上可用docsify serve在局域网内提供离线文档站(localhost:3000),学生无需联网即可阅读全部课程材料;作业评价可从学生笔记本完成度、测验成绩、以及基于数据科学生命周期原则评估的期末项目三方面展开。

离线访问与文档渲染

孟加拉语课程主页与英文版一致,推荐通过 Docsify 实现离线文档访问:fork 仓库并在本地安装 Docsify 后,在仓库根目录执行docsify serve,即可在localhost:3000阅读文档(站点配置见根目录 index.html 与 docs/_sidebar.md)。需要注意:Jupyter 笔记本不会被 Docsify 渲染,需要运行笔记本时应单独在 VS Code 中启动 Python 内核打开.ipynb文件(例如孟加拉语课程各课的 notebook,见 translations/bn/ 下的各课目录)。

后续行动清单

  1. 若需精简下载,按上文 sparse checkout 命令克隆仓库;若以孟加拉语学习,保留translations/bntranslated_images/bn目录;
  2. 依 INSTALLATION.md 完成 Python + Jupyter + quiz-app 依赖安装;
  3. 零基础者先从 examples/README.md 的 5 个脚本入门;
  4. 从孟加拉语第 01 课 translations/bn/1-Introduction/01-defining-data-science/README.md 开始,按"课前测验 → 阅读 → 笔记本练习 → 作业 → 课后测验"的节奏推进;
  5. 学习过程中遇到问题查阅 TROUBLESHOOTING.md,并参考 CONTRIBUTING.md 参与多语言内容的共建。

【免费下载链接】Data-Science-For-Beginners10 Weeks, 20 Lessons, Data Science for All!项目地址: https://gitcode.com/GitHub_Trending/da/Data-Science-For-Beginners

创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

需要专业的网站建设服务?

联系我们获取免费的网站建设咨询和方案报价,让我们帮助您实现业务目标

立即咨询