ที่ปรึกษา · AI · งานส่งมอบ

AI แบบ On-Premise พร้อมใช้ตั้งแต่วันแรก

คุณต้องการใช้ AI กับเอกสารและข้อมูลที่สำคัญจริง ๆ แต่ข้อมูลเหล่านั้นส่งไปยังบริการ Cloud ไม่ได้ ทางออกคือแพลตฟอร์ม AI ที่ทำงานบนฮาร์ดแวร์ของคุณเอง ภายในเครือข่ายของคุณ ข้อมูลจึงไม่ต้องออกไปไหน เราประเมินขนาด กำหนดสเปก ติดตั้ง และส่งมอบในสภาพที่ใช้งานได้ทันที พร้อมฝึกทีมของคุณให้ดูแลต่อได้เอง

วันแรกใช้งานได้ตั้งแต่วันส่งมอบ
หลายผู้ผลิตสเปกที่มากกว่าหนึ่งยี่ห้อเสนอได้
ในเครือข่ายของคุณข้อมูลอ่อนไหวไม่ออกไปข้างนอก
Dev สู่ Productionมีเส้นทางสู่ฮาร์ดแวร์ระดับ Server

คำถามที่งานนี้ตอบ

พรุ่งนี้พนักงานของคุณใช้ AI กับเอกสารลับและข้อมูลส่วนบุคคลได้หรือไม่ โดยไม่มีข้อมูลใดออกนอกเครือข่ายของคุณเลย

สำหรับองค์กรส่วนใหญ่ คำตอบคือไม่ได้ ใช้บริการ AI บน Cloud กับข้อมูลอ่อนไหวไม่ได้ โครงการ AI จึงหยุดชะงัก หรือพนักงานก็นำข้อความลับไปวางในแชตบอตสาธารณะอยู่ดี การซื้อเครื่องที่มี GPU อย่างเดียวไม่ได้แก้ปัญหานี้ ยังต้องมีคนประเมินขนาด สร้างแพลตฟอร์มที่ทำงานได้ต่อเนื่อง ติดตั้งโมเดลที่ใช้ภาษาไทยได้ และส่งมอบระบบที่ทีมของคุณดูแลเองได้

แต่ไม่ได้หมายความว่าทุกอย่างต้องย้ายมาทำงานภายใน งานที่เป็นข้อมูลสาธารณะหรือมีความอ่อนไหวต่ำยังส่งไปใช้โมเดลที่ดีที่สุดบน Cloud ได้ แพลตฟอร์มนี้มีไว้สำหรับงานที่ต้องอยู่ภายในองค์กร การแบ่งงานสองส่วนนี้ตัดสินได้ในทุกคำขอ ด้วย Classification ของตัวข้อมูลเอง ดูรายละเอียดได้ใน โมเดลที่ดีที่สุดของคุณอยู่บน Cloud

นี่คืองานส่งมอบในด้าน AI เป็นขั้นตอนที่เปลี่ยน ‘เราใช้ AI กับข้อมูลนี้ไม่ได้’ ให้เป็นแพลตฟอร์มที่ทำงานได้จริงภายในองค์กรของคุณ

สิ่งที่คุณจะได้รับ

สิ่งส่งมอบหกรายการ ฮาร์ดแวร์เป็นของคุณ แพลตฟอร์มเป็นของคุณ และรหัสผ่านทุกชุดก็เป็นของคุณ

1 · การประเมินขนาด

ขนาดโมเดลที่คุณต้องใช้ หน่วยความจำ GPU ที่โมเดลนั้นต้องการ และจำนวนคนที่ถามพร้อมกันได้ รวมถึง CPU, RAM และพื้นที่จัดเก็บสำหรับทุกอย่างที่ทำงานรอบโมเดล บันทึกเป็นเอกสารพร้อมวิธีคำนวณ

2 · สเปกพร้อมสำหรับการจัดซื้อ

สเปกที่ผู้ผลิตมากกว่าหนึ่งรายเสนอได้ เขียนในรูปแบบที่การจัดซื้อจัดจ้างภาครัฐต้องการ จะจัดซื้อผ่านกระบวนการของคุณเองหรือผ่านเราก็ได้ สเปกนี้ไม่ผูกคุณไว้กับยี่ห้อใด

3 · แพลตฟอร์มที่ออกแบบให้ทำงานตลอด 24 ชั่วโมง

แพลตฟอร์ม Virtual Machine บนพื้นที่จัดเก็บแบบ ZFS มีดิสก์ระบบแบบ Mirror พื้นที่จัดเก็บ VM ที่ทนต่อดิสก์เสียได้ Snapshot และสำเนา Backup ทั้งบนเครื่องและนอกเครื่องตามหลัก 3-2-1 ส่วน GPU จัดสรรให้ VM ที่ต้องใช้เข้าถึงได้โดยตรง

4 · AI พร้อมใช้ตั้งแต่วันแรก

ระบบให้บริการโมเดล โมเดลที่คัดเลือกแล้วว่าใช้ภาษาไทยได้ หน้าจอแชตสำหรับพนักงาน ชุดเริ่มต้นให้ AI ตอบคำถามจากเอกสารของคุณเอง และ API ที่นักพัฒนาของคุณนำไปต่อยอดได้

5 · เส้นทางจาก Dev สู่ Production

แยก Environment ตั้งแต่เริ่มต้น เมื่อ Production ย้ายไปอยู่บนฮาร์ดแวร์ระดับ Server เครื่อง Workstation นี้จะกลายเป็นเครื่องสำหรับพัฒนา แทนที่จะต้องเปลี่ยนทิ้ง

6 · การส่งมอบ

Runbook ที่เขียนสำหรับทีมของคุณ การฝึกอบรมแบบลงมือทำ และเงื่อนไขการสนับสนุนที่กำหนดเป็นลายลักษณ์อักษร ว่าครอบคลุมอะไร ในช่วงเวลาใด และตอบกลับเร็วแค่ไหน

ขั้นตอนการทำงาน

1
คุยกำหนดขอบเขต จะใช้ทำอะไร มีคนใช้พร้อมกันกี่คน และข้อมูลใดที่ต้องไม่ออกไปข้างนอกเลย การประเมินขนาดเริ่มจากคำตอบสามข้อนี้
2
ประเมินขนาดและทำสเปก เรานำคำตอบมาคำนวณขนาดและทำเป็นสเปกที่ผู้ผลิตหลายรายเสนอได้ ฝ่ายจัดซื้อของคุณนำไปใช้ได้ทันที
3
จัดซื้อ ผ่านกระบวนการของคุณหรือผ่านเรา ในฐานะพันธมิตรระดับ Lenovo 360 Authorized เราจัดหาอุปกรณ์และโซลูชันโครงสร้างพื้นฐานของ Lenovo และช่วยประสานงานเรื่องการรับประกันกับ Lenovo ให้คุณได้ ส่วนสเปกยังเปิดกว้างสำหรับทุกยี่ห้อที่ผ่านเกณฑ์ ระยะเวลาส่งมอบฮาร์ดแวร์ขึ้นอยู่กับตลาด ไม่ได้ขึ้นอยู่กับเรา เราจึงแจ้งระยะเวลาล่าสุดให้ทราบก่อนสั่งซื้อ
4
ติดตั้งและตรวจรับ ติดตั้งแพลตฟอร์ม พื้นที่จัดเก็บ ระบบ Backup และชุด AI แล้วทดสอบกับการใช้งานที่คุณระบุไว้ตอนคุยกำหนดขอบเขต
5
ส่งมอบและฝึกอบรม ส่งมอบ Runbook ฝึกอบรมแบบลงมือทำแก่ผู้ที่จะดูแลระบบ และเงื่อนไขการสนับสนุนเริ่มมีผล

สิ่งที่รวมและไม่รวมในขอบเขต

อยู่ในขอบเขต

  • การประเมินขนาด การทำสเปก และการสนับสนุนการจัดซื้อ
  • แพลตฟอร์ม Virtual Machine พื้นที่จัดเก็บแบบ ZFS, Snapshot และ Backup ตามหลัก 3-2-1
  • การจัดสรร GPU ให้ Virtual Machine เข้าถึงได้โดยตรง
  • ระบบให้บริการโมเดล โมเดลที่ใช้ภาษาไทยได้ หน้าจอแชต และ API
  • ชุดเริ่มต้นให้ AI ตอบคำถามจากเอกสารของคุณเอง
  • Environment สำหรับพัฒนาและสำหรับ Production ที่แยกจากกัน
  • Runbook การฝึกอบรม และเงื่อนไขการสนับสนุนที่เป็นลายลักษณ์อักษร

ไม่อยู่ในขอบเขต

  • การรัน Production ที่องค์กรขาดไม่ได้ตลอด 24 ชั่วโมงบนเครื่อง Workstation (ดูด้านล่าง)
  • การพัฒนาแอปพลิเคชัน AI ของคุณเอง ซึ่งเป็นงาน AI Development แยกต่างหาก
  • การย้ายหรือทำความสะอาดข้อมูลเดิมของคุณ
  • การเชื่อมต่อกับระบบภายในนอกเหนือจาก API
  • การ Route คำขอระหว่างโมเดลบน Cloud และโมเดล On-Premise ตาม Classification ของข้อมูล ซึ่งเป็นงาน Knowledge Engineering

Workstation คือจุดเริ่มต้นที่ใช่ แต่ไม่ใช่ปลายทางของทุกงาน

เครื่องระดับ Workstation เหมาะกับงานพัฒนา และงาน Production ระยะนำร่องที่ยอมให้หยุดได้ช่วงสั้น ๆ แต่ไม่เหมาะกับ AI ที่องค์กรขาดไม่ได้และต้องทำงานตลอด 24 ชั่วโมง งานแบบนั้นควรอยู่บนฮาร์ดแวร์ระดับ Server ที่มีแหล่งจ่ายไฟและชิ้นส่วนสำรอง

เราจะบอกคุณก่อนซื้อว่าคุณต้องใช้แบบไหน และแพลตฟอร์มที่เราสร้างย้ายไปอยู่บน Server ได้เมื่อถึงเวลา

ข้อมูลของคุณไปที่ไหน ระบุไว้อย่างตรงไปตรงมา

  • โดยค่าเริ่มต้นไม่มีข้อมูลใดออกนอกเครือข่ายของคุณ โมเดล เอกสาร และบทสนทนาอยู่บนเครื่องทั้งหมด การเชื่อมต่อกับสิ่งใดภายนอกเป็นการตัดสินใจที่คุณทำเองอย่างชัดเจน ไม่ใช่การตั้งค่าที่มีใครเปิดทิ้งไว้
  • Credential เป็นของคุณ รหัสผ่านผู้ดูแลระบบทุกชุดจะส่งถึงมือคุณพร้อมเอกสารบันทึกในวันส่งมอบ
  • การสนับสนุนจากระยะไกลเป็นทางเลือกของคุณ หากเงื่อนไขการสนับสนุนรวมบริการนี้ไว้ คุณเป็นผู้เปิดใช้ และปิดได้ทุกเมื่อ

งานนี้นำไปสู่อะไร

แพลตฟอร์มนี้สร้างมาเพื่อขยายต่อได้ แต่ละข้อด้านล่างคือขั้นตอนถัดไปที่กำหนดไว้ชัดเจน และคุณเลือกได้อิสระว่าจะทำเองหรือทำร่วมกับใครก็ได้

ผู้ใช้มากกว่าที่ประเมินไว้
ประเมินขนาดใหม่และเพิ่ม GPU หรือย้าย Production ไปอยู่บน Server โดยแพลตฟอร์มย้ายตามไปด้วย
องค์กรต้องพึ่งพา AI แล้ว
ย้าย Production ไปบนฮาร์ดแวร์ระดับ Server ที่มีชิ้นส่วนสำรอง และเก็บ Workstation ไว้เป็นเครื่องสำหรับพัฒนา
งานบางส่วนใช้โมเดล Frontier ได้อย่างปลอดภัย
Route แต่ละคำขอตาม Classification ของตัวข้อมูลเอง ข้อมูลสาธารณะไปที่ Cloud ข้อมูลลับอยู่ที่นี่ ดูว่าทำงานอย่างไร
คำตอบจากเอกสารและฐานข้อมูลพร้อมกัน
Knowledge Engineering ทำงานบนแพลตฟอร์มนี้ เพื่อค้นคืนข้อมูลจากทั้งเอกสารและฐานข้อมูลของคุณภายใต้ Governance
แอปพลิเคชัน AI ของคุณเอง
AI Development พัฒนาต่อยอดบน API ที่แพลตฟอร์มเปิดไว้ให้แล้ว

เราประเมินขนาดอย่างไร

คำถามสามข้อเป็นตัวกำหนดสเปกเครื่อง คือโมเดลต้องใหญ่แค่ไหนสำหรับงานนี้ โมเดลนั้นใช้หน่วยความจำ GPU เท่าไร และจะมีคนถามพร้อมกันกี่คน โมเดลถูกโหลดเพียงครั้งเดียว หน่วยความจำที่เหลือคือส่วนที่ใช้ตอบคนที่กำลังถาม และแต่ละคนต้องใช้ส่วนของตัวเอง

ตัวอย่างการคำนวณ

จำนวนคนที่ถามพร้อมกันได้ ตามหน่วยความจำ GPU ของการ์ดหนึ่งใบ (เกณฑ์วางแผน 2 GB ต่อผู้ถามหนึ่งคน)

  • โมเดล ~12B ใช้ ~7 GB
  • โมเดล ~70B ใช้ ~43 GB
  • โมเดล ~120B ใช้ ~65 GB

จำนวนคนที่ถามในเวลาเดียวกัน (ไม่ใช่จำนวนพนักงานทั้งหมด)

นำร่อง หนึ่งแผนก หลายแผนก ทั้งองค์กร 0 10 20 30 40 0 24 48 96 ~12B~7 GB ~70B~43 GB ~120B~65 GB

หน่วยความจำ GPU ของการ์ดหนึ่งใบ (GB)

ตัวเลขชุดเดียวกันในรูปตาราง

ขนาดโมเดล (4‑bit)โมเดลใช้24 GB48 GB96 GB
~12B~7 GB71739
~70B~43 GB——21
~120B~65 GB——10

คำนวณจากโมเดลแบบ 4-bit เผื่อหน่วยความจำประมาณ 2 GB ต่อผู้ถามหนึ่งคน และกันพื้นที่ 10% ของการ์ดไว้ให้ซอฟต์แวร์ ช่องที่เป็นขีดหมายถึงใส่โมเดลไม่ลง หรือไม่เหลือพื้นที่ให้ใครถาม

ตัวเลข 2 GB ตั้งเผื่อไว้โดยตั้งใจเพื่อใช้วางแผน ค่าจริงขึ้นอยู่กับการออกแบบของโมเดลและความยาวของแต่ละบทสนทนา ตั้งแต่ไม่ถึง 1 GB ไปจนถึงราว 3 GB ต่อคนสำหรับบทสนทนาทั่วไป และมากกว่านั้นเมื่อเป็นเอกสารยาว หน่วยความจำเป็นแค่เพดานด้านหนึ่ง อีกด้านคือความเร็วในการตอบเมื่อมีหลายคนถามพร้อมกัน และเราตรวจทั้งสองอย่างตอนประเมินขนาด

งานอัตโนมัติก็นับด้วย บอตทุกตัวหรืองานตั้งเวลาทุกงานที่ถาม AI จะใช้หนึ่งที่ เท่ากับคนหนึ่งคน

หน่วยความจำ GPU เป็นตัวกำหนดว่ารันโมเดลได้ใหญ่แค่ไหน และมีคนถามพร้อมกันได้กี่คน ส่วน CPU และ RAM เป็นตัวกำหนดว่าสร้างแอปพลิเคชันรอบโมเดลได้มากแค่ไหน

แถบขอบเขตบนกราฟเป็นเพียงแนวทางคร่าว ๆ ไม่ใช่คำสัญญา การ์ดหนึ่งใบรองรับได้มากแค่ไหนขึ้นอยู่กับว่าคนของคุณถามบ่อยเพียงใด

ตัวเลขอ้างอิงจากขนาดโมเดลที่เผยแพร่สาธารณะ ทบทวนล่าสุดเดือนกันยายน 2569

กรณีของคุณจะไม่ตรงกับตารางพอดี การคุยกำหนดขอบเขตจึงเริ่มจากตรงนี้

วิธีคิดราคา

กำหนดขอบเขตเป็นรายโครงการ และเสนอราคาก่อนซื้อสิ่งใด ฮาร์ดแวร์และบริการแยกราคากัน เพื่อให้คุณเห็นว่าแต่ละส่วนมีค่าใช้จ่ายเท่าไร

ค่าบริการกำหนดจากสามเรื่อง คือจำนวนคนที่ใช้พร้อมกัน ขนาดของโมเดลที่ต้องรัน และระดับการสำรองอุปกรณ์ที่คุณต้องการ เราจะได้คำตอบครบทั้งสามข้อจากการคุยกำหนดขอบเขต

บอกเราว่าคุณต้องการให้ AI ทำอะไร และทำกับข้อมูลใด แล้วเราจะส่งสเปกที่คำนวณขนาดไว้แล้วพร้อมใบเสนอราคาให้คุณ

ที่ปรึกษา · AI · งานส่งมอบ

บอกเราว่าข้อมูลใดที่ต้องไม่ออกไปข้างนอก

ประเมินขนาด ทำสเปก ติดตั้ง และส่งมอบในสภาพที่ใช้งานได้ ฮาร์ดแวร์เป็นของคุณ รหัสผ่านเป็นของคุณ และข้อมูลของคุณอยู่ที่เดิม

นัดคุยกำหนดขอบเขต →

contact@infozense.com  |  +66-82-242-4008  |  Bangkok, Thailand

Lenovo เป็นเครื่องหมายการค้าหรือเครื่องหมายการค้าจดทะเบียนของ Lenovo