tech
แชตบอต AI ยุคแรกรับมือได้แค่ข้อความ แต่โมเดล 'แนวหน้า' รุ่นใหม่สามารถรับรูปภาพ แผนภูมิ หรือคำถามที่พูดออกมา และตอบได้ทั้งหมด
โมเดลมัลติโมดัล (multimodal) คือระบบ AI ที่สร้างขึ้นเพื่อประมวลผลและทำความเข้าใจข้อมูลนำเข้ามากกว่าหนึ่งประเภท เช่น ข้อความ ภาพ เสียง และวิดีโอ ภายในระบบเดียวกันที่เป็นเอกภาพ แทนที่จะจำกัดอยู่แค่ภาษาเขียนแบบที่แชตบอทรุ่นก่อนเป็น สิ่งนี้ทำให้คุณสามารถแสดงภาพถ่ายและถามเกี่ยวกับมัน เปิดคลิปเสียงให้ฟัง หรือแชร์แผนภูมิ แล้วให้มันตอบสนองอย่างมีความหมายด้วยการเชื่อมโยงข้อมูลประเภทต่าง ๆ เหล่านั้นเข้าด้วยกัน
โมเดล open-weight คือโมเดล AI ที่มีการเผยแพร่พารามิเตอร์ภายในสู่สาธารณะให้ทุกคนดาวน์โหลดและใช้งานได้ ซึ่งเป็นแนวคิดที่ต่างกันเกี่ยวกับการเข้าถึงและใบอนุญาต มากกว่าจะเป็นเรื่องประเภทของข้อมูลนำเข้าที่โมเดลรองรับ โมเดลออฟไลน์เพียงแค่รันได้โดยไม่ต้องเชื่อมต่ออินเทอร์เน็ต ซึ่งเป็นคุณสมบัติที่ไม่เกี่ยวข้องกันอีกอย่างที่ไม่มีส่วนเกี่ยวข้องกับการจัดการหลายรูปแบบเลย
การผสมผสานประเภทข้อมูลนำเข้านี้เองที่ทำให้ผู้ช่วย AI สมัยใหม่สามารถอธิบายสิ่งที่เกิดขึ้นในภาพถ่าย สรุปแผนภูมิ หรือตอบคำถามที่พูดเกี่ยวกับวิดีโอได้ ความสามารถเหล่านี้ในอดีตต้องอาศัยระบบเฉพาะทางที่แยกจากกันโดยสิ้นเชิง เมื่อเพียงไม่กี่ปีก่อน
tech
บริษัทใดให้บริการโรโบแท็กซีเชิงพาณิชย์ไร้คนขับเต็มรูปแบบนี้?ในมาตรา SAE ที่รู้จักกันดี ตัวเลขระดับสูงสุดที่แทนการขับเคลื่อนอัตโนมัติเต็มรูปแบบคือเท่าใด?หุ่นยนต์ฮิวแมนนอยด์ที่เปิดตัวโดยผู้ผลิตรถยนต์เทสลามีชื่อว่าอะไร?บริษัทใดเป็นผู้บุกเบิกบริการส่งเวชภัณฑ์ด้วยโดรนนี้ในแอฟริกา?หุ่นยนต์คลังสินค้าของ Amazon เกิดจากการซื้อกิจการผู้ผลิตหุ่นยนต์รายใดในปี 2012?หุ่นยนต์ผ่าตัดที่ใช้กันแพร่หลายซึ่งผลิตโดย Intuitive Surgical มีชื่อว่าอะไร?ประโยชน์หลักที่เกษตรกรได้รับจากหุ่นยนต์กำจัดวัชพืชด้วยเลเซอร์เหล่านี้คืออะไร?เทคโนโลยีวัดระยะด้วยเลเซอร์นี้มีชื่อเรียกทั่วไปว่าอะไร?หุ่นยนต์ที่ออกแบบมาให้ใช้พื้นที่ทำงานร่วมกับมนุษย์เหล่านี้เรียกทั่วไปว่าอะไร?เซนเซอร์ชนิดใดที่ให้หุ่นยนต์มีประสาทสัมผัสและความรู้สึกถึงแรงกดในการจับนี้?เครื่องพิมพ์ลายแสง EUV สร้างแสงอัลตราไวโอเลตสุดขั้วนี้ขึ้นมาได้อย่างไรกันแน่?ตัวเลข "nm" ในโหนดกระบวนการผลิตชิปสมัยใหม่แท้จริงแล้วหมายถึงอะไร?Quration — Quration Play