Knowledge Engineering · Egress

โมเดลที่ดีที่สุดของคุณอยู่บน Cloud แต่ข้อมูลที่ดีที่สุดของคุณไปที่นั่นไม่ได้

คุณอยากได้คำตอบจากโมเดล Frontier บนข้อมูลที่สำคัญจริง ๆ แต่ข้อมูลชุดนั้นคือสิ่งเดียวที่คุณส่งออกไปไม่ได้ คุณจึงต้องเลือกข้าง ระหว่างส่งออกไปแล้วเสียการควบคุม กับกั้นทุกอย่างไว้ข้างในแล้วปล่อยให้เกณฑ์ข้อเดียวคุมทั้งหมด ทำไมถึงเป็นแบบนั้น? เพราะการตัดสินใจนี้เกิดขึ้นเพียงครั้งเดียว ครอบทั้ง Workspace โดยคนคนหนึ่ง ทางออกคือเลเยอร์ข้อมูลที่มี Governance ซึ่งย้ายการตัดสินใจนั้น ให้ Classification ของข้อมูลเองเป็นตัวตัดสินในทุกคำขอ ว่าต้องส่งข้อมูลให้โมเดลตัวไหนทำการประมวลผล

Infozense Knowledge Engineering · CISO · CIO · GRC · Head of Data · ~6 นาที

นี่คือบท Egress ของชุดบทความ Infozense Knowledge Engineering เลเยอร์ข้อมูลที่อยู่ใต้ Agent ของคุณมี Gate อยู่ห้าตัว: Input (ใครมีสิทธิ์ถาม) · Egress (อะไรออกไปได้) · Output (ปลอดภัยและเป็นจริง) · Action (ใครอนุมัติ) · Operational (พิสูจน์ได้ภายหลัง) บทความนี้ว่าด้วยตัวที่สอง: Egress ซึ่งเป็น Gate ที่ตัดสินว่าอะไรได้รับอนุญาตให้ออกนอกรั้วของคุณ และออกไปหาโมเดลตัวไหน

เมื่อยังไม่มีเลเยอร์ข้อมูลที่มี Governance Workspace เดียวมีเนื้อหาที่มีระดับความอ่อนไหวต่างกันปนอยู่ กติกาข้อเดียวถูกตั้งไว้ที่ระดับเข้มที่สุดเท่าที่มีอยู่ แล้วส่งทุกอย่างไปที่ฮาร์ดแวร์ของคุณเอง และแม้แต่คู่มือที่เผยแพร่ต่อสาธารณะแล้ว ก็ไปถึงโมเดล Frontier ไม่ได้
คู่มือที่เผยแพร่ต่อสาธารณะถูกกั้นไว้เข้มเท่ากับเนื้อหาที่อ่อนไหวที่สุดที่วางอยู่ข้าง ๆ ไม่มีอะไรปลอดภัยขึ้น และคุณไม่ได้อะไรกลับมาจากข้อจำกัดนั้น

ที่ไหนสักแห่งในองค์กรของคุณ มีการตัดสินใจหนึ่งที่เกิดขึ้นเพียงครั้งเดียว อย่างเงียบ ๆ และกำกับทุกอย่างมาตั้งแต่นั้น

มีสองทาง คือ แพลตฟอร์ม AI ของคุณเรียกใช้โมเดลภายนอกได้ หรือเรียกไม่ได้

  • ถ้าคำตอบคือได้ ความรู้จำนวนมากของคุณก็เปิดให้ระบบที่คุณไม่ได้เป็นคนดูแลเข้าถึงได้แล้ว
  • ถ้าคำตอบคือไม่ได้ คุณก็สร้างทุกอย่างไว้ในรั้วของคุณเอง และทุกคำถามที่คนของคุณถาม ก็ได้คำตอบโดยไม่ได้ผ่านโมเดลที่คุณอยากใช้จริง ๆ

คำตอบทั้งสองทางมีเหตุผลรองรับได้ สิ่งที่ไม่มีเหตุผลรองรับคือการที่การตัดสินใจนั้นเกิดขึ้นเพียงครั้งเดียว ครอบทุกอย่าง โดยคนคนหนึ่ง ในห้องประชุม ก่อนที่ใครจะรู้ด้วยซ้ำว่าจะมีคำถามอะไรบ้าง

บทความนี้เขียนถึงใคร

องค์กรส่วนใหญ่ไม่จำเป็นต้องคิดเรื่องนี้ ถ้าข้อมูลที่คุณถืออยู่ไม่มีชิ้นไหนที่จะสร้างปัญหาหากหลุดออกไปข้างนอก ก็ส่งออกไปเลย แล้วรับคำตอบที่ดีกว่าไปเต็ม ๆ นั่นคือการตัดสินใจที่ถูกต้อง และบทความนี้ไม่ได้เขียนถึงคุณ

คุณต้องการสิ่งนี้เมื่อสองอย่างเป็นจริงพร้อมกัน คือข้อมูลบางส่วนของคุณไปหาโมเดลภายนอกไม่ได้จริง ๆ และคุณอยากได้คำตอบที่ดีที่สุดเท่าที่มีกับข้อมูลส่วนที่เหลือ นั่นคือธุรกิจภายใต้การกำกับดูแลแทบทุกราย เป็นธนาคารที่เอกสารผลิตภัณฑ์เป็นเรื่องน่าเบื่อ แต่ข้อมูลลูกค้าไม่ใช่ เป็นโรงพยาบาลที่แนวทางเวชปฏิบัติเป็นเอกสารเผยแพร่ต่อสาธารณะ แต่บันทึกผู้ป่วยไม่ใช่ เป็นองค์กรใดก็ตามที่ความรู้ชุดเดียวกันมีเนื้อหาซึ่งมีระดับความอ่อนไหวต่างกันมาก ซึ่งก็คือแทบทุกองค์กร

การกั้นทุกอย่างไว้ข้างในไม่ได้ทำให้คำตอบแย่

มีข้ออ้างแบบหนึ่งที่บอกว่าการเลือกเก็บทุกอย่างไว้ในองค์กรแปลว่าต้องยอมรับคุณภาพที่ด้อยกว่า และข้ออ้างนั้นไม่จริง คุณรันโมเดลขนาดใหญ่ที่เก่งจริงบนฮาร์ดแวร์ของคุณเองได้ องค์กรจำนวนมากก็ทำอยู่ ถ้าใครบอกคุณว่าการเก็บข้อมูลไว้ในรั้วของคุณแปลว่าต้องยอมรับคำตอบที่แย่ คนนั้นกำลังขายอะไรบางอย่างให้คุณ สิ่งที่ขายคือความเชื่อว่าคุณมีแค่สองทางให้เลือก คือส่งออกไปทั้งหมด หรือเก็บไว้ข้างในทั้งหมด

ประเภทข้อมูลของคุณไม่ได้เหมือนกันทั้งหมด แต่กติกาที่คุณเขียนกลับเหมือนกันทั้งหมด

เมื่อการตัดสินใจข้อเดียวกำกับข้อมูลทั้ง Workspace มันต้องถูกตั้งไว้ที่ระดับเข้มที่สุดเท่าที่ Workspace นั้นมีอยู่ ยกตัวอย่างเช่น คู่มือผลิตภัณฑ์ นโยบายที่เผยแพร่แล้ว บันทึกการเปลี่ยนแปลงเวอร์ชัน สไลด์อบรม และเนื้อหาส่วนใหญ่ที่ไม่อ่อนไหวเลยในคลังความรู้ของคุณ หากถูกจัดเก็บร่วมกับข้อมูลที่อ่อนไหว ก็จะถูกจัดกลุ่มอยู่ในระดับความอ่อนไหวสูงสุดเดียวกัน

นั่นไม่ใช่ความปลอดภัยที่เพิ่มขึ้น ไม่มีอะไรปลอดภัยขึ้นเลยจากการที่คู่มือผลิตภัณฑ์ถูกดูแลอย่างระมัดระวัง ต้นทุนที่แท้จริงมีสองอย่าง อย่างแรกคือค่าเสียโอกาส เนื้อหาแบบนั้นส่งไปหาโมเดลที่ดีกว่าได้อย่างปลอดภัย แต่การตัดสินใจข้อเดียวทำให้ไปไม่ถึง อย่างที่สองคือค่าใช้จ่าย ฮาร์ดแวร์ของคุณเองต้องแบกงานที่ไม่เคยจำเป็นต้องอยู่ในรั้วของคุณตั้งแต่แรก

ความสูญเปล่านี้ไม่มีใครมองเห็น จึงอยู่รอดมาได้ ไม่มีใครเปิดใบงานเพื่อบอกว่าคำตอบเรื่องนโยบายที่เผยแพร่แล้วน่าจะดีกว่านี้ได้ พวกเขาแค่ได้คำตอบที่แย่กว่าไปตลอด และไม่มีวันรู้ว่าพลาดอะไรไป

การตัดสินใจเป็นของข้อมูล ไม่ใช่ของการติดตั้งระบบ

เมื่อมี Infozense Knowledge Engineering คำขอหนึ่งประกอบความรู้ที่มีระดับความอ่อนไหวต่างกันเข้าด้วยกัน Classification ที่เข้มที่สุดเท่าที่มีอยู่เป็นตัวตัดสินปลายทาง โดยเนื้อหาสาธารณะไปถึงโมเดล Frontier ได้ เนื้อหาที่เป็นความลับอยู่บนฮาร์ดแวร์ของคุณเอง ส่วนเนื้อหาที่จำกัดที่สุดจะถูกปฏิเสธ ในภาพนี้ระดับที่เข้มที่สุดคือความลับ คำขอจึงอยู่บนฮาร์ดแวร์ของคุณเอง
สิ่งที่เข้มที่สุดในคำขอเป็นตัวตัดสิน ไม่มีคนไหนคัดแยกให้ เพราะไม่มีคนไหนทำได้

ทางแก้ไม่ใช่การเลือกว่ากั้นทุกอย่างไว้ข้างในหรือส่งออกไปประมวลผลภายนอกทั้งหมด แต่คือการย้ายจุดตัดสินใจที่เลือกว่าจะส่งข้อมูลไปประมวลผลภายนอกหรือภายใน

ในเลเยอร์ข้อมูลที่มี Governance ระดับความอ่อนไหวเป็นคุณสมบัติของตัวความรู้เอง ติดอยู่กับเนื้อหา ไม่ใช่ติดอยู่กับการติดตั้งระบบ คำขอหนึ่งอาจประกอบด้วยข้อมูลที่มี Classification ต่างกันได้ แล้วเลเยอร์ข้อมูลที่มี Governance จะใช้ Classification ที่เข้มที่สุดในคำขอนั้นเป็น Classification ของทั้งคำขอ ไม่ใช่ค่าเฉลี่ย ไม่ใช่ตัวแรก ไม่ใช่ค่าที่ตั้งไว้ที่ Workspace แต่คือค่าสูงสุดของสิ่งที่อยู่ตรงหน้าจริง ๆ ในครั้งนั้น

ค่าเดียวนั้นเป็นตัวกำหนดว่าคำขอได้รับอนุญาตให้ไปที่ไหน ผู้ดูแลระบบจับคู่ระดับความอ่อนไหวแต่ละระดับเข้ากับปลายทางเพียงครั้งเดียว เช่นเนื้อหาสาธารณะไปหาโมเดล Frontier ได้ เนื้อหาที่เป็นความลับอยู่บนฮาร์ดแวร์ของคุณเอง และเนื้อหาที่จำกัดที่สุดจะไม่มีการส่งไปประมวลผลใด ๆ จากนั้นทุกคำขอจะถูก Route ไปยังปลายทางที่ Classification ของคำขอนั้นกำหนดไว้

ผลก็คือสิ่งที่คุณต้องการทั้งสองอย่างเป็นจริงพร้อมกัน คำถามเรื่องนโยบายที่เผยแพร่แล้วไปถึงโมเดลที่ดีที่สุดเท่าที่มี ส่วนคำถามที่แตะข้อมูลที่อ่อนไหวที่สุดไม่เคยออกนอกอาคาร ไม่มีมนุษย์คนไหนคัดแยกให้ เพราะไม่มีมนุษย์คนไหนทำได้ทันกับความเร็วและปริมาณคำถามที่ AI ถูกถาม

และนั่นก็จัดการต้นทุนอย่างที่สองไปด้วย ระดับความอ่อนไหวแต่ละระดับชี้ไปที่ปลายทางของตัวเอง โมเดลบนฮาร์ดแวร์ของคุณเองจึงต้องรองรับแค่เนื้อหาที่จำเป็นต้องอยู่ตรงนั้นจริง ๆ คุณไม่ต้องซื้อกำลังประมวลผลเกินกว่าความต้องการใช้

แล้วสิ่งที่ออกไปไม่ได้ จะเป็นอย่างไร

กรณีที่น่าสนใจคือกรณีสุดท้าย และเป็นจุดที่ระบบส่วนใหญ่ล้มเหลวอย่างเงียบ ๆ

คำขอที่มีเนื้อหาอ่อนไหวเกินกว่าที่ปลายทางใดจะรับได้ ต้องถูกปฏิเสธ ไม่ใช่เปลี่ยนไปส่งที่ปลายทางอื่นแทน ไม่ใช่ตัดทอนแล้วส่งไปอยู่ดี แต่ถูกปฏิเสธ ในฐานะผลลัพธ์จริงที่การออกแบบเตรียมรองรับไว้ ไม่ใช่ข้อผิดพลาดที่ระบบเดินไปสะดุดเอาเอง

มีคุณสมบัติสองข้อที่ทำให้การปฏิเสธนั้นเชื่อถือได้ และทั้งสองข้อตรงข้ามกับสิ่งที่ระบบซึ่งสร้างกันเองมักทำ

สิ่งที่ไม่มี Classification จะถูกถือว่าอ่อนไหวที่สุด ไม่ใช่ถือว่าปลอดภัย ความรู้ที่เข้ามาโดยไม่มี Classification หรือมีค่าที่เลเยอร์ไม่รู้จัก หรือมีอะไรที่ผิดรูปอยู่ตรงที่ควรมี Classification จะถูกจัดการในฐานะสิ่งที่จำกัดที่สุดเท่าที่มันอาจเป็นได้ ช่องว่างใน Metadata ของคุณทำให้เลเยอร์ระมัดระวังมากขึ้น ไม่ใช่น้อยลง นั่นคือหลักการที่สำคัญที่สุดในการออกแบบ เพราะในทุกระบบที่เคยรั่ว มีบางอย่างที่ไม่มี Classification และมีการทึกทักว่านั่นแปลว่าไม่เป็นไร

Route ที่ตั้งค่าผิดทำให้อะไรกว้างขึ้นไม่ได้ ปลายทางแต่ละแห่งมีเพดานของตัวเองว่าจะรับอะไรได้บ้าง และเพดานนั้นถูกบังคับใช้อยู่ใต้การจับคู่ที่ผู้ดูแลระบบตั้งไว้ ถ้าใครจับคู่ระดับความอ่อนไหวเข้ากับปลายทางผิด ปลายทางนั้นก็จะปฏิเสธเนื้อหาอยู่ดี การจับคู่ทำให้ระบบเข้มกว่าที่ตั้งใจได้ แต่ทำให้หลวมกว่าไม่ได้

ข้อสรุป

จริง ๆ แล้วคุณไม่เคยเลือกระหว่างโมเดลที่ดีกว่ากับข้อมูลที่ปลอดภัยกว่าเลย สิ่งที่คุณเลือกคือความถี่ของการตัดสินใจ

การตัดสินใจครั้งเดียวครอบทุกอย่าง คือสิ่งที่บังคับให้ต้องแลก มันทำให้เนื้อหาที่อ่อนไหวน้อยที่สุดของคุณต้องอยู่ใต้กติกาของเนื้อหาที่อ่อนไหวที่สุด แล้วเรียกสิ่งนั้นว่าความปลอดภัย ทั้งที่จริงมันเป็นเพียงเครื่องมือหยาบ ๆ ที่ถูกทิ้งไว้อย่างนั้นเพราะไม่เคยมีอะไรที่ละเอียดกว่าให้ใช้

เมื่อตัดสินใจเป็นรายคำขอ การได้อย่างเสียอย่างนั้นก็หมดไป ระดับความอ่อนไหวของข้อมูลเองเป็นตัวกำหนดปลายทางทุกครั้ง โดยไม่ต้องผ่านคน และคำตอบที่คุณได้คือคำตอบที่ดีที่สุดเท่าที่ Classification ของข้อมูลนั้นอนุญาต

คุณไม่ได้สร้างมัน คุณแค่ตั้งค่ามัน

นี่ไม่ใช่โมเดลที่คุณต้องเทรน และไม่ใช่ Rule Engine ที่คุณต้องเขียน Infozense Knowledge Engineering ส่งมอบเลเยอร์ข้อมูลที่มี Governance พร้อม Egress Gate ติดตั้งไว้แล้ว คุณกำหนด Classification ให้ความรู้ของคุณ แล้วจับคู่ระดับความอ่อนไหวแต่ละระดับเข้ากับปลายทางเพียงครั้งเดียว จากนั้นทุกคำขอจะถูก Route ไปยังปลายทางที่ Classification ของคำขอนั้นกำหนดไว้ สิ่งที่เข้มที่สุดในคำขอเป็นตัวตัดสิน เนื้อหาที่ไม่ได้ติด Classification ถูกถือว่าจำกัดที่สุด และปลายทางจะปฏิเสธทุกอย่างที่เกินเพดานของมัน ไม่ว่าการจับคู่ที่ตั้งไว้จะบอกว่าอย่างไร

โมเดลที่ดีที่สุดของคุณยังใช้ได้อยู่ ข้อมูลที่ออกไปไม่ได้ก็ไม่ออกไปไหน และไม่มีใครต้องเลือกอีก

Infozense Knowledge Engineering

ถือข้อมูลที่ส่งไปหาโมเดลภายนอกไม่ได้ แต่ก็อยากได้คำตอบที่ดีกว่านี้อยู่หรือเปล่า?

นี่คือเรื่องที่เราถนัดที่สุด เพียงนำ Workspace จริงมาหนึ่งชุด แล้วเราจะไล่ดูไปด้วยกันว่าอะไรจะถูก Route ไปที่ไหน

คุยกับเรา →

contact@infozense.com  |  +66-82-242-4008  |  Bangkok, Thailand