inflearn logo
Challenge
모집 마감

Xây dựng hệ sinh thái Hadoop tận dụng LLM

Trong thử thách này, chúng ta sẽ sử dụng AI Tutor và Vibe Coding để hiểu quy trình cài đặt Hadoop phức tạp một cách dễ dàng và nhanh chóng, đồng thời xây dựng từng bước các nền tảng cốt lõi của dữ liệu lớn như Hadoop, HDFS, YARN và Hive. Không chỉ dừng lại ở việc làm theo các câu lệnh đơn thuần, bạn sẽ được trải nghiệm một dự án thực tế, nơi bạn sử dụng AI tạo sinh để giải quyết các lỗi cài đặt, hiểu nguyên lý cấu hình cụm (cluster), cũng như lưu trữ và phân tích dữ liệu thực tế. Bạn sẽ được học những nội dung sau: Phương pháp xây dựng Hadoop sử dụng AI tạo sinh Cấu hình môi trường thực hành bằng VirtualBox và Linux (CentOS) Xây dựng Hệ sinh thái Hadoop (HDFS, YARN, MapReduce, Hive) Giải quyết lỗi cài đặt và các vấn đề phát sinh bằng AI Phân tích dữ liệu lớn dựa trên SQL bằng Hive Thực hành vận hành và quản lý nền tảng dữ liệu lớn Phương pháp tự học sử dụng AI Tutor Kinh nghiệm vận hành Hadoop thông qua dự án thực tế Đặc điểm của thử thách: ✔ Học cùng AI Tutor ✔ Thực hành dựa trên Vibe Coding ✔ Thực hành xây dựng theo từng bước ✔ Giải thích dễ hiểu ngay cả với người mới bắt đầu ✔ Thực hiện dự án tập trung vào thực vụ ✔ Xây dựng Hệ sinh thái Hadoop hoàn chỉnh

SQL
Hadoop
Linux
HeidiSQL
mapreduce

30개 수업 학습

라이브 1 회

무제한 복습, 내 것으로 만들어요.

지식공유자와 멘토링 혜택!

질문하고 즉시 답을 얻어요.

같은 기수와 교류하고 함께 성장해요.

ywjang23583님과 함께해요!

65

Học viên

3

Đánh giá

4

Trả lời

4.3

Xếp hạng

10

Các khóa học

Tôi đã đảm nhiệm công việc nhà phát triển tại LG Electronics, một công ty viễn thông, trong khoảng 27 năm. Sau khi nghỉ hưu, tôi đã tiến hành giảng dạy các khóa học lập trình phần mềm đại cương tại các trường đại học, cũng như tại các trường dạy nghề và cơ quan nhà nước. Hiện tại, tôi vẫn đang giảng dạy khóa học Internet vạn vật (IoT) tại một trường đào tạo nghề.

Tôi muốn ghi lại bài giảng với nội dung như dưới đây và chia sẻ nó.

1.Khóa học R thống kê Cơ bản/Nâng cao

2. Kỹ thuật công nghệ IoT vạn vật - Bộ phận thu thập dữ liệu cảm biến Arduino

3.Kỹ thuật Raspberry Pi

4. Khóa học cơ bản/nâng cao về ứng dụng AI (Hiểu thuật toán cơ bản và cách sử dụng công cụ)

5.Kỹ thuật triển khai nền tảng mang tính hệ thống để cấu hình trang trại thông minh (Smart Farm)

6. Kỹ thuật Tableau và PowerBI - các công cụ trực quan hóa dữ liệu

7. Kỹ thuật và phương pháp 6 Sigma trong thực tế công việc

8. Xây dựng hệ sinh thái Hadoop phân tích dữ liệu lớn

Thêm

Xây dựng nền tảng dữ liệu lớn Hadoop & Hive học qua thực hành

Giới thiệu thử thách

Đây là thử thách tập trung vào thực hành, nơi bạn sẽ trực tiếp xây dựng và vận hành Hadoop và Hive - những công nghệ cốt lõi trong kỷ nguyên dữ liệu lớn.

Đây không phải là bài giảng chỉ học mỗi lý thuyết.

Trong thử thách này, bạn sẽ được xây dựng một nền tảng dữ liệu lớn thực tế thông qua các bước thực hành từng bước, từ thiết lập môi trường ảo, cài đặt Hadoop, vận hành HDFS, tìm hiểu về MapReduce, cho đến xây dựng kho dữ liệu Hive và phân tích dữ liệu.

Chúng tôi cung cấp hướng dẫn thực hành từng bước để ngay cả những người mới bắt đầu cũng có thể theo kịp, đồng thời bạn có thể trực tiếp trải nghiệm các khái niệm cốt lõi của Hệ sinh thái Hadoop (Hadoop Ecosystem) đang được sử dụng trong thực tế công việc.


Khuyên dùng cho những đối tượng sau

  • Người mới bắt đầu lần đầu tiếp cận với nền tảng Big Data

  • Những ai muốn học Hadoop và Hive thông qua thực hành

  • Sinh viên mới tốt nghiệp đang chuẩn bị trở thành kỹ sư dữ liệu

  • Những người muốn học cách xây dựng môi trường phân tích dữ liệu

  • Các nhà phát triển và kỹ sư muốn mở rộng năng lực thực hành IT

  • Những người muốn học các công nghệ nền tảng về dữ liệu lớn dành cho AI và phân tích dữ liệu


Nội dung học trong thử thách

Tuần 1: Xây dựng nền tảng Hadoop

  • Tổng quan về Hadoop và hiểu về kiến trúc dữ liệu lớn (Big Data)

  • Cấu hình môi trường VirtualBox

  • Thiết lập máy chủ Linux

  • Cài đặt và thiết lập Hadoop

  • Hiểu cấu trúc HDFS

  • Cấu hình NameNode và DataNode

  • Thực hành lưu trữ và quản lý tệp tin HDFS

  • Cơ bản về vận hành cụm Hadoop

Tuần 2: Xây dựng môi trường phân tích dữ liệu Hive

  • Tổng quan về Hive và hiểu về kiến trúc

  • Cài đặt và thiết lập Hive

  • Cú pháp cơ bản của HiveQL

  • Tải và quản lý dữ liệu

  • Sử dụng bảng ngoại (external table) và bảng nội (internal table)

  • Viết truy vấn tổng hợp và phân tích

  • Thực hành phân tích dữ liệu log

  • Ứng dụng liên kết hệ sinh thái Hadoop


Vận hành phiên trực tiếp (Live Session)

Trong suốt thời gian diễn ra thử thách, các nội dung sau đây sẽ được thực hiện cùng nhau thông qua các buổi live session.

  • Hỗ trợ thiết lập môi trường thực hành

  • Giải quyết lỗi cài đặt

  • Chia sẻ bí quyết vận hành Hadoop

  • Huấn luyện thực hành HiveQL

  • Giải đáp thắc mắc trực tiếp (Q&A)

  • Phản hồi kết quả thực hành của học viên

Thông qua chia sẻ màn hình, chúng tôi sẽ trình diễn quy trình xây dựng thực tế, đồng thời cùng kiểm tra tiến độ thực hành của các học viên.


Kết quả đạt được sau khi tham gia

  • Khả năng xây dựng cụm Hadoop đơn nút (Single Node Cluster)

  • Khả năng vận hành và quản lý HDFS

  • Khả năng phân tích dữ liệu dựa trên Hive

  • Kinh nghiệm xây dựng môi trường Big Data dựa trên Linux

  • Đảm bảo năng lực thực hành cơ bản của kỹ sư dữ liệu

  • Khả năng hiểu và vận dụng Hệ sinh thái Hadoop


Chuẩn bị

  • Máy tính Windows 10/11

  • Khuyến nghị RAM 8GB trở lên (Khuyến nghị 16GB trở lên)

  • Môi trường có thể cài đặt VirtualBox

  • Nhiệt huyết đối với việc học tập


Giới thiệu giảng viên

Giảng viên Jang Young-wan đã thực hiện nhiều bài giảng và đào tạo thực hành trong các lĩnh vực Big Data, cơ sở dữ liệu và ứng dụng AI.

Thử thách này không chỉ dừng lại ở việc giải thích lý thuyết đơn thuần mà sẽ hướng dẫn bạn học tập trung vào thực hành Hadoop và Hive dựa trên kinh nghiệm xây dựng thực tế.

"Học thông qua việc trực tiếp xây dựng là phương pháp học tập nhanh nhất."

Thông qua thử thách lần này, hãy cùng nhau bắt đầu những bước đi đầu tiên trong việc xây dựng nền tảng dữ liệu lớn (Big Data).

강사 프로필
LIVE

함께 소통할 수 있는 라이브가 예정되어 있어요!

07.20.월

오전 10:00

하둡에코시스템을 응용하여 봅시다.

7월

19일

챌린지 시작일

2026년 7월 19일 오후 03:00

챌린지 종료일

2026년 7월 31일 오후 02:30

챌린지 커리큘럼

Tất cả

31 bài giảng ∙ (8giờ 50phút)

Tài liệu khóa học:

Tài liệu bài giảng
챌린지 전용 수업
Trực tiếp

챌린지에서 배워요

  • Cài đặt cụm Hadoop và xây dựng môi trường lưu trữ phân tán dựa trên HDFS

  • Xây dựng kho dữ liệu Hive và phân tích dữ liệu dựa trên HiveQL

  • Năng lực thực hành vận hành và quản lý nền tảng dữ liệu lớn

Khuyến nghị cho
những người này

Khóa học này dành cho ai?

  • Kỹ sư dữ liệu hoặc nhà phát triển đang chuẩn bị xây dựng nền tảng dữ liệu lớn

  • Nhà phân tích dữ liệu muốn áp dụng hệ sinh thái Hadoop vào thực tế

  • Nhân viên kỹ thuật IT muốn tích lũy kinh nghiệm xây dựng cơ sở hạ tầng dữ liệu lớn (Big Data)

Cần biết trước khi bắt đầu?

  • Kinh nghiệm sử dụng các lệnh cơ bản của Linux

  • Hiểu cú pháp cơ bản của SQL

  • Các khái niệm cơ bản về cơ sở dữ liệu hoặc xử lý dữ liệu

Đánh giá

Chưa có đủ đánh giá.
Hãy trở thành tác giả của một đánh giá giúp mọi người!

이 강의의 지난 수강평

Hỏi đáp thường gặp

취소 및 환불 규정
챌린지는 지식공유자가 설정한 수업 최소 정원이 충족되지 않을 경우, 폐강 안내가 고지되며 결제 내역이 자동취소됩니다.

Khóa học khác của ywjang23583

Hãy khám phá các khóa học khác của giảng viên!

Truy cập bị hạn chế đối với các khóa học không công khai.