ผลต่างระหว่างรุ่นของ "คลังข้อมูล"

เนื้อหาที่ลบ เนื้อหาที่เพิ่ม
Horus (คุย | ส่วนร่วม)
Xqbot (คุย | ส่วนร่วม)
โรบอต เพิ่ม: my:ဒေတာ ဝဲဟောက်စ်; ปรับแต่งให้อ่านง่าย
บรรทัด 5:
 
== ความแตกต่างจากฐานข้อมูล ==
โดยปกติแล้ว ฐานข้อมูลในองค์กรทั่วไปจะมีลักษณะที่ค่อนข้างทันต่อเหตุการณ์ เช่น ฐานข้อมูลพนักงานก็จะเก็บเฉพาะพนักงานในปัจจุบัน จะไม่สนใจข้อมูลพนักงานเก่า ๆ ในอดีต ซึ่งอาจจะมีข้อมูลอะไรบางอย่าง ที่มีประโยชน์สำหรับผู้บริหาร ในการวิเคราะห์ประสิทธิภาพและคุณลักษณะต่าง ๆ ขององค์กร. นอกจากนี้ ฐานข้อมูลแต่ละอันมักถูกออกแบบมาใช้เก็บข้อมูลเฉพาะด้าน จึงมีข้อมูลเฉพาะบางส่วนขององค์กรเท่านั้น ฉะนั้นคลังข้อมูลจึงถูกออกแบบมา เพื่อรวบรวมข้อมูลในทุกส่วนของทั้งบริษัท ทั้งเก่าและใหม่ไว้ด้วยกัน ไม่มีการลบทิ้งข้อมูลเก่า ๆ ที่ไม่จริงในปัจจุบัน
 
โดยสรุปคือ
บรรทัด 13:
ถ้าองค์กรมีคลังข้อมูลหลาย ๆ อันเพื่อใช้ในการวิเคราะห์ต่าง ๆ แตกต่างกันไป เช่น คลังข้อมูลด้านการเงิน และ คลังข้อมูลด้านทรัพยากรมนุษย์ เรามักเรียกคลังข้อมูลเฉพาะด้านเหล่านี้ว่า [[ตลาดข้อมูล]] ([[:en:data marts|data marts]])
 
อนึ่ง กระบวนการในการใช้ข้อมูลในคลังข้อมูลเพื่อการตัดสินใจ และวางแผนในทางธุรกิจ มักถูกเรียกว่า [[การบริหารธุรกิจอย่างชาญฉลาด]] ([[:en:business intelligence|business intelligence]]).
 
== ประเด็นที่ต้องพิจารณา ==
* ในการรวมฐานข้อมูล อาจมีปัญหาว่าฐานข้อมูลแต่ละอัน อาจถูกออกแบบจากผู้ออกแบบหลายๆ คนทำให้มี schema แตกต่างกันไป (schema ในที่นี้หมายถึงการออกแบบ [[:en:REA model|REA model]] ว่าจะมีกี่ตาราง แต่ละตารางเชื่อมกันอย่างไร มีอะไรเป็น [[:en:primary key|primary key]], [[:en:foreign key|foreign key]] เป็นต้น) ปัญหาใหญ่ก็คือจะนำฐานข้อมูลที่มีความแตกต่างกันมารวมกันได้อย่างไร
* เมื่อรวมกันแล้วต้องการให้ schema ของคลังข้อมูลมีลักษณะแบบไหน. การออกแบบคลังข้อมูลโดยทั่วไป มักจะออกแบบตรงข้ามกับฐานข้อมูลอย่างสิ้นเชิง
** การออกแบบฐานข้อมูลเรามักต้องการให้มี schema ที่ปรับปรุงได้ง่ายๆ (เพราะเราต้องประมวลผลบ่อย) คือในแต่ละตารางมี primary key น้อยๆ และมีตารางจำนวนมากเชื่อมต่อกัน นั่นคือใน REA model มักจะมีหลาย ๆ ตาราง
** ในคลังข้อมูลเราต้องการให้เรียกข้อมูลที่ต้องการดู ([[:en:query|query]]) ง่ายๆ และรวดเร็ว นอกจากนั้นเราไม่ค่อยได้แก้ไขปรับปรุงคลังข้อมูล จึงมักออกแบบให้มีตารางน้อยๆ schema ที่นิยมใช้ในคลังข้อมูลคือ [[:en:star schema|star schema]] (ดู Fig. 15-7)
 
== การวิเคราะห์ข้อมูลในคลังข้อมูล ==
บรรทัด 25:
=== Online Analytical Processing ===
Online Analytical Processing ([[:en:OLAP|OLAP]]) คือการใช้คำค้น (query) เพื่อค้นหาข้อมูลในคลังข้อมูลเหมือนในฐานข้อมูล เหตุผลที่เราไม่ค้นในฐานข้อมูล แต่มาทำในคลังข้อมูลแทนมีสองสาเหตุคือ
* ความเร็ว
* ความครอบคลุมของข้อมูลทั้งบริษัทที่มีอยู่ในคลังข้อมูล
 
บรรทัด 33:
รูปแบบการจัดเก็บข้อมูลที่ทรงประสิทธิภาพมีอยู่ 3 ชนิดที่ ([[:en:OLAP|OLAP]]) สามารถเข้าถึงข้อมูลได้
 
1. ฐานข้อมูลเชิงสัมพันธ์ (Relational DataBase) โดยทั่วไปแล้วระบบงานประจำมีการจัดเก็บข้อมูลแบบ [[RDBMS]] และ [[data warehouse]] ก็มีการจัดเก็บข้อมูลแบบ [[RDBMS]] ซึ่งอาจจะมีโครงสร้างข้อมูล แบบ [[star schema]] และอาจจะเป็นได้ทั้ง [[normalized & denormalized]]
 
2. ฐานข้อมูลหลายมิติ ( multidimentional database) ข้อมูลที่จัดเก็บในฐานข้อมูลหลายมิติอาจมาจากฐานข้อมูลเชิงสัมพันธ์ หรือระบบงานปัจจุบันโดยจะแปลง
การจัดเก็บข้อมูลเสียใหม่ โดยมีโครงสร้างการจัดเก็บแบบ array โดยทั่วไปแล้วฐานข้อมูลหลายมิติจะยอมให้สิทธิการเขียนข้อมูลลงในฐานข้อมูล ในช่วงเวลาหนึ่งเพียงคนเดียว แต่อนุญาตให้หลาย ๆ คน เข้าค้นหาข้อมูลในเวลาเดียวกัน หรือมิฉะนั้นก็อนุญาตให้ค้นหาข้อมูลเพียงอย่างเดียว
 
3. เก็บข้อมูลไว้ที่ client ลักษณะของfile (client-base files) ในกรณียอมให้client ดึงข้อมูลจำนวนไม่มากนักมาเก็บไว้ซึ่งเหมาะกับการประมวลผลแบบกระจาย
หรือการสร้างคำสั่งให้ข้อมูลปรากฏบน web
 
บรรทัด 51:
== ลักษณะเด่นของคลังข้อมูล ==
 
# ให้ผลตอบแทนจากการลงทุนที่สูง ถึงแม้ว่าจะมีการลงทุนที่ต่ำก็ตาม
# เนื่องจากมีการให้ให้ผลตอบแทนจากการลงทุนที่สูง จึงสามารถทำให้องค์กรเกิดความได้เปรียบคู่แข่งขันในแง่ของการได้รับข้อมูลและสารสนเทศก่อนคู่แข่งขันเสมอ จึงทำให้สามารถวิเคราะห์ข้อมูลเหล่านั้นเพื่อทำการกำหนดเป็นกลยุทธ์ และกำหนดทิศทางในการดำเนินงานได้ก่อนคู่แข่งขัน เช่น พฤติกรรมของผู้บริโภค ความต้องการทางตลาด และแนวโน้มความต้องการของผู้บริโภค
# เพิ่มประสิทธิภาพในการตัดสินใจของผู้ตัดสินใจ เนื่องจากคลังข้อมูลได้รับการให้ข้อมูลที่รับมาจากแหล่งข้อมูลที่แตกต่างกัน มีความสอดคล้องกัน และวิเคราะห์ตามประเด็นที่ผู้ตัดสินใจต้องการ อีกทั้งข้อมูลที่มีอยู่ในคลังข้อมูลก็มีปริมาณมากทั้งข้อมูลในอดีตและปัจจุบัน จึงทำให้การตัดสินใจมีประสิทธิภาพมากขึ้นอีกด้วย
# ทำให้สะดวกและรวดเร็วในการค้นหาข้อมูลต่างๆ และลดความซ้ำซ้อนกันของข้อมูลอีกด้วย
 
== ดูเพิ่ม ==
บรรทัด 83:
[[lv:Datu noliktava]]
[[ml:ഡേറ്റാ വെയർഹൗസ്]]
[[my:ဒေတာ ဝဲဟောက်စ်]]
[[nl:Datawarehouse]]
[[no:Datavarehus]]