โดยรวมแล้วเป็นคอร์สที่ดีทีเดียว บางช่วงเร็วไปหน่อยสำหรับฉัน แต่ตัวอย่างโดยทั่วไปก็ช่วยได้ คุ้มค่ากับเวลาที่ลงทุนไป
พื้นฐานวิศวกรรมข้อมูลด้วย Spark, Databricks, และ Delta Lake
เรียนรู้การสร้าง ปรับปรุงประสิทธิภาพ และจัดการไปป์ไลน์ข้อมูลสมัยใหม่โดยใช้ Apache Spark และ Delta Lake บนแพลตฟอร์ม Databricks Lakehouse
-
💬
ผู้สอน AI
ถามเกี่ยวกับบทเรียนใดก็ได้ แล้วรับคำตอบที่ชัดเจนทันที ทุกเมื่อ -
🕐
เริ่มเมื่อไรก็ได้
ไม่มีตารางหรือเดดไลน์ — เรียนตามจังหวะของคุณ เมื่อไรก็ได้ -
🌐
เป็นภาษาไทย
บทเรียน แบบฝึกหัด และใบรับรอง — ทั้งหมดเป็นภาษาของคุณอย่างครบถ้วน
เกี่ยวกับคอร์สนี้
ธุรกิจสมัยใหม่พึ่งพาไปป์ไลน์ข้อมูลที่แข็งแกร่งเพื่อเปลี่ยนข้อมูลดิบให้เป็นข้อมูลเชิงลึกที่นำไปปฏิบัติได้ ทำให้วิศวกรรมข้อมูลเป็นหนึ่งในทักษะที่สำคัญที่สุดในปัจจุบัน หลักสูตรนี้จะแนะนำแนวคิดหลักของสถาปัตยกรรม lakehouse ให้คุณ ซึ่งจะมอบรากฐานที่มั่นคงในการประมวลผลข้อมูลสมัยใหม่
คุณจะเปลี่ยนจากการทำความเข้าใจแนวคิดข้อมูลพื้นฐานไปสู่การอ่าน การเขียน และการดำเนินการไปป์ไลน์ข้อมูล ผ่านคำอธิบายที่เป็นลายลักษณ์อักษรที่ชัดเจนและตัวอย่างโค้ดที่มีโครงสร้างใน Python และ Scala คุณจะได้เรียนรู้วิธีประมวลผลชุดข้อมูลขนาดใหญ่ จัดการตารางข้อมูลที่เชื่อถือได้ และนำเวิร์กโฟลว์ข้อมูลที่เป็นมาตรฐานอุตสาหกรรมไปใช้
สิ่งที่คุณจะได้เรียนรู้:
- ทำความเข้าใจหลักการพื้นฐานของสถาปัตยกรรม Databricks Lakehouse และการประมวลผลแบบกระจาย (distributed computing) ด้วย Apache Spark
- สร้างไปป์ไลน์ข้อมูลที่เชื่อถือได้โดยใช้ Spark SQL, DataFrames และ APIs ทั้งใน Python และ Scala
- จัดการ Delta Tables โดยใช้คุณสมบัติขั้นสูง เช่น time travel, version history และ schema evolution
- ปรับปรุงประสิทธิภาพการสืบค้นข้อมูลโดยใช้ Delta caching, การจัดการไฟล์ และรูปแบบการจัดเก็บข้อมูลสมัยใหม่
- กำหนดค่าธรรมาภิบาลข้อมูล (data governance) และพื้นฐานการจัดเก็บไฟล์โดยใช้ Unity Catalog volumes
- ประยุกต์ใช้แนวทางการทดสอบและตรวจสอบไปป์ไลน์ข้อมูลเพื่อให้มั่นใจในคุณภาพข้อมูลและความน่าเชื่อถือของไปป์ไลน์
การเดินทางเริ่มต้นด้วยคำศัพท์วิศวกรรมข้อมูลที่จำเป็นและการตั้งค่า Spark ก่อนที่จะดำเนินการอย่างเป็นระบบผ่านการแปลง DataFrame, การโหลดข้อมูล, การดำเนินการ Delta Lake และการปรับแต่งประสิทธิภาพ คุณจะได้อ่านคำแนะนำโค้ดที่ครอบคลุมและฝึกฝนด้วยแบบฝึกหัดเชิงแนวคิดที่ออกแบบมาเพื่อเสริมสร้างการเรียนรู้ของคุณ
หลักสูตรนี้ออกแบบมาสำหรับวิศวกรข้อมูลที่ต้องการเป็นมืออาชีพ ผู้ดูแลระบบฐานข้อมูล และนักพัฒนาซอฟต์แวร์ที่เพิ่งเริ่มต้นกับเทคโนโลยี big data ไม่จำเป็นต้องมีประสบการณ์มาก่อนกับ Spark หรือ Databricks แม้ว่าความคุ้นเคยพื้นฐานกับ SQL และแนวคิดการเขียนโปรแกรมทั่วไปจะเป็นประโยชน์
เริ่มสร้างรากฐานวิศวกรรมข้อมูลของคุณวันนี้
สิ่งที่คุณจะได้รับ
-
📜
ใบประกาศนียบัตร
เพิ่มในโปรไฟล์ LinkedIn ของคุณ -
💬
ติวเตอร์ AI ส่วนตัว
ติดขัดในบทเรียน? ถามติวเตอร์ในตัวของคุณได้ทุกอย่าง ทุกเวลา -
🎧
รวมเวอร์ชันเสียง
เรียนได้ทุกที่ ไม่ต้องดูจอ -
♾️
เข้าถึงตลอดชีพ
กลับมาเรียนได้ตลอด ไม่มีหมดอายุ -
📱
โทรศัพท์หรือคอมพิวเตอร์
ใช้งานได้ทุกที่ ทุกอุปกรณ์ -
💸
คืนเงิน 14 วัน
ไม่ต้องอธิบาย -
⚡
กระชับและตรงประเด็น
2 ชม. 54 นาที เนื้อหาเชิงปฏิบัติ
รีวิว (3)
ได้เรียนรู้เยอะมาก และโครงสร้างก็ทำให้ตามได้ง่าย ชอบตัวอย่างการนำไปใช้จริงที่เขาให้มา
เป็นการแนะนำที่ดี โครงสร้างส่วนใหญ่ชัดเจนดี แต่ก็อยากให้มีตัวอย่างในโลกจริงมากกว่านี้หน่อย แต่ก็ได้เรียนรู้อะไรเยอะเลย
ผู้เรียนคนอื่นเรียน
🏆 ยอดนิยมมากที่สุด
🎓 มีใบรับรอง
รากฐานการจัดการข้อมูลด้วย Python, SQL และ Big Data
ใบรับรอง
ลงมือทำ
$14.99
→
🌟 ที่นิยมในหมู่ผู้เรียน
🎓 มีใบรับรอง
พื้นฐานการวิเคราะห์ระบบและคลังข้อมูล
ใบรับรอง
ลงมือทำ
$14.99
→
🎓 มีใบรับรอง
เทคนิคฐานข้อมูลเชิงสัมพันธ์สำหรับการทำ Data Warehousing
ใบรับรอง
ลงมือทำ
$14.99
→
🎓 มีใบรับรอง
พื้นฐานของบิ๊กเดต: คำศัพท์, สถาปัตยกรรม, และท่อน้ำมันสมัยใหม่
ใบรับรอง
ลงมือทำ
$14.99
→
คำถามที่พบบ่อย
ฉันต้องใช้อะไรในการเรียนคอร์สนี้? +
แค่โทรศัพท์หรือคอมพิวเตอร์ที่มีอินเทอร์เน็ต ไม่ต้องติดตั้งหรือใช้อุปกรณ์พิเศษ
ฉันชำระเงินอย่างไร? +
ผ่านบัตรด้วย Stripe เราไม่เก็บข้อมูลบัตร — Stripe จัดการอย่างปลอดภัย
ฉันขอคืนเงินได้ไหม? +
ใช่ — คืนเงินเต็มจำนวนใน 14 วัน ไม่ต้องอธิบาย
ฉันมีสิทธิ์เข้าถึงนานเท่าไร? +
ตลอดไป เมื่อซื้อแล้วคอร์สเป็นของคุณ กลับมาเรียนได้ตลอด
ฉันจะได้ใบประกาศนียบัตรไหม? +
ได้ เมื่อเรียนจบจะได้รับใบประกาศนียบัตรที่เพิ่มในโปรไฟล์ LinkedIn ได้
ออกแบบสำหรับผู้เรียนใน
เทคโนโลยี
ดีไซน์
การเงิน
การตลาด
สาธารณสุข
การศึกษา
ธุรกิจการบริการ
อุตสาหกรรม