Contact
Line : comsiam
Contact
Line : comsiam

Click to Do คือฟีเจอร์ AI บน Copilot+ PC ที่ช่วยวิเคราะห์ข้อความและรูปภาพซึ่งกำลังแสดงอยู่บนหน้าจอ แล้วเสนอคำสั่งที่เกี่ยวข้องให้ทำต่อได้ทันที เช่น คัดลอก ค้นหา สรุป Rewrite หรือส่งภาพไปแก้ไขในแอปที่รองรับ
จุดสำคัญคือ Click to Do จะเริ่มวิเคราะห์เมื่อผู้ใช้เรียกใช้งานเท่านั้น และการวิเคราะห์หน้าจอจะทำภายในเครื่องเป็นหลัก ไม่ได้ส่งข้อมูลออกไปโดยอัตโนมัติ เว้นแต่ผู้ใช้เลือก Action ที่ต้องใช้บริการออนไลน์ เช่น Search หรือส่งข้อมูลไปยัง Copilot
บทความนี้ comsiam จะอธิบายว่า Click to Do คืออะไร เปิดอย่างไร ใช้ทำอะไรได้บ้าง และต่างจาก Recall อย่างไร
Click to Do เป็นฟีเจอร์ AI ที่ช่วยให้ผู้ใช้ทำงานกับสิ่งที่กำลังเห็นบนหน้าจอได้เร็วขึ้น
เมื่อเปิด Click to Do ระบบจะวิเคราะห์ Screenshot ของหน้าจอ แล้วตรวจจับ
จากนั้นเมื่อคลิกสิ่งที่ต้องการ Windows จะแสดงคำสั่งที่เกี่ยวข้องขึ้นมาให้เลือก
ตามข้อกำหนดของ Microsoft ต้องใช้
ถ้าจะเปิด Click to Do จาก Snipping Tool ต้องใช้ Snipping Tool เวอร์ชัน 11.2411.20.0 หรือใหม่กว่า
วิธีง่ายที่สุดคือกด
Windows + Q
หรือใช้
Windows + คลิกเมาส์
บนสิ่งที่ต้องการในหน้าจอ
จากนั้น Click to Do จะเปิด Overlay ขึ้นมาบนหน้าจอและให้เลือกข้อความหรือรูปภาพเพื่อทำงานต่อ
ได้
สามารถค้นคำว่า
Click to Do
จาก Windows Search แล้วเปิดใช้งานได้
วิธีนี้เหมาะกับคนที่ยังจำคีย์ลัดไม่ได้
ได้
Click to Do สามารถเปิดจากเมนูของ Snipping Tool ในเวอร์ชันที่รองรับ
ข้อกำหนดคือ Snipping Tool ต้องเป็นเวอร์ชัน 11.2411.20.0 หรือใหม่กว่า
ได้
บนอุปกรณ์ Touch บางรุ่นสามารถปัดจากด้านขวาเพื่อเรียก Click to Do
เหมาะกับ
โดยไม่ต้องใช้เมาส์
เมื่อเปิดใช้งาน
Microsoft ระบุว่า Cursor จะเปลี่ยนเป็นสีน้ำเงินและขาวขณะ Click to Do ทำงาน
ระบบจะวิเคราะห์เฉพาะสิ่งที่มองเห็นอยู่บนหน้าจอในขณะนั้น
Microsoft ระบุว่า Click to Do
Action ที่มีให้จะขึ้นกับเวอร์ชันและสิ่งที่เลือก
ตัวอย่างเช่น
Microsoft ระบุว่า Action ข้อความอัจฉริยะหลายอย่างใช้โมเดล Phi Silica บนเครื่อง
เมื่อเลือกภาพ ระบบอาจเสนอ Action เช่น
Action ที่แสดงจริงขึ้นอยู่กับแอปที่ติดตั้งและ Windows เวอร์ชัน
เมื่อเปิด Click to Do แล้ว
ในเครื่องและเวอร์ชันที่รองรับ การสรุปข้อความสามารถใช้ Phi Silica บน Copilot+ PC เพื่อประมวลผลภายในเครื่อง
ได้ในระบบที่รองรับ
ตัวเลือกที่อาจมี เช่น
เหมาะกับการปรับ
โดยไม่ต้องคัดลอกข้อความไปเปิด AI อีกแอปก่อน
ในเวอร์ชันที่รองรับ เมื่อเลือกข้อความหรือรูปภาพ อาจมีตัวเลือก Ask Copilot
ผู้ใช้สามารถเพิ่ม Prompt ของตัวเอง แล้วส่งเนื้อหาที่เลือกเข้า Copilot เพื่อถามต่อได้
แต่เมื่อเลือก Action นี้ ข้อมูลที่เลือกจะถูกส่งไปยัง Copilot เพราะเป็นการกระทำที่ผู้ใช้สั่งเอง
สามารถใช้กับข้อความที่กำลังเห็นบนหน้าจอ และ Microsoft ยังรองรับ Action บางอย่างที่เชื่อมกับ Word ในสภาพแวดล้อมที่เหมาะสม
แต่ Action ที่เห็นจริงอาจต่างกันตาม
ดังนั้นไม่ใช่ทุกเครื่องจะเห็นคำสั่งเหมือนกันทั้งหมด
ได้
ถ้าเว็บไซต์กำลังเปิดอยู่บนหน้าจอ Click to Do สามารถตรวจจับข้อความและรูปภาพที่มองเห็นได้
ตัวอย่างเช่น
จึงมีประโยชน์เวลาทำ Research หรืออ่านเว็บจำนวนมาก
ได้ในลักษณะที่สิ่งนั้นแสดงอยู่บนหน้าจอ
ตัวอย่างเช่น PDF ที่เปิดใน Edge หรือโปรแกรมอ่าน PDF
สามารถเลือกข้อความหรือภาพที่มองเห็นแล้วใช้ Action ที่ระบบเสนอ
ไม่ได้หมายความว่า Click to Do วิเคราะห์ไฟล์ PDF ทั้งไฟล์โดยอัตโนมัติ แต่ทำงานกับสิ่งที่อยู่บนหน้าจอตอนนั้น
ได้
ถ้าหน้าจอมีภาพที่ต้องการ สามารถเปิด Click to Do แล้วคลิกภาพเพื่อดู Action ที่รองรับ
วิธีนี้ช่วยลดขั้นตอนจากเดิมที่ต้อง
บางงานสามารถเริ่ม Action ได้จากหน้าจอโดยตรง
Copy and Paste เพียงคัดลอกข้อมูล
แต่ Click to Do สามารถเข้าใจประเภทของสิ่งที่เลือก แล้วเสนอ Action ที่เกี่ยวข้อง
ตัวอย่าง
ถ้าเลือกข้อความ อาจมี Summarize
ถ้าเลือกรูป อาจมี Erase object
ดังนั้นเป็น Contextual Action มากกว่าการคัดลอกธรรมดา
สองฟีเจอร์นี้คนละหน้าที่
เน้นทำงานกับสิ่งที่กำลังอยู่บนหน้าจอ ตอนนี้
เน้นค้นหาสิ่งที่เคยเห็นบนหน้าจอ ในอดีต
พูดง่าย ๆ คือ
Click to Do = ทำต่อจากสิ่งที่เห็นตอนนี้
Recall = ย้อนกลับไปหาสิ่งที่เคยเห็น
ได้ในประสบการณ์ที่รองรับ
เมื่อค้นสิ่งที่ต้องการจาก Recall ได้แล้ว สามารถใช้ Click to Do เพื่อทำ Action ต่อกับข้อความหรือภาพนั้นได้
จึงเป็นฟีเจอร์ที่เสริมกัน
Recall ช่วย “หา”
Click to Do ช่วย “ทำต่อ”
การวิเคราะห์หน้าจอพื้นฐานทำภายในเครื่อง
Microsoft ระบุว่า Screenshot analysis ของ Click to Do จะทำ Local บนอุปกรณ์เสมอ และเริ่มเมื่อผู้ใช้เรียกใช้ฟีเจอร์เท่านั้น
ส่วน Action ที่ต้องใช้อินเทอร์เน็ต เช่น Web Search หรือ Ask Copilot จะมีการส่งข้อมูลเมื่อผู้ใช้เลือกทำ Action นั้นเอง
ด้าน Privacy มีข้อดีสำคัญคือการวิเคราะห์หน้าจอทำ Local
Microsoft ระบุว่า
ระบบสร้าง Screenshot ชั่วคราวเพื่อใช้วิเคราะห์
Microsoft ระบุว่าเมื่อส่งข้อมูลไปยังบางแอป อาจสร้างไฟล์ชั่วคราวใน
AppData\Local\Temp
แต่ไฟล์ดังกล่าวไม่ได้ถูกออกแบบให้เก็บระยะยาว และ Click to Do ไม่เก็บเนื้อหาหน้าจอไว้หลังการทำ Action เสร็จ
เมื่อผู้ใช้เลือก Action ที่ต้องใช้บริการภายนอก เช่น
จึงจะมีการส่งข้อมูลที่เกี่ยวข้องตาม Action นั้น
ไม่
ระบบไม่ได้วิเคราะห์หน้าจอตลอดเวลา
การวิเคราะห์เริ่มเมื่อผู้ใช้เปิด Click to Do และหยุดเมื่อออกจากฟีเจอร์
นี่เป็นจุดสำคัญที่ต่างจากความเข้าใจผิดว่า Windows ใช้ AI สแกนทุกอย่างตลอดเวลา
ได้
ไปที่
Settings > Privacy & security > Click to Do
จากนั้นเปลี่ยนเป็น Off
Microsoft ระบุว่า Click to Do เปิดไว้เป็นค่าเริ่มต้นบน Copilot+ PC แต่สามารถปิดได้ แม้ตัว Component จะไม่สามารถถอนออกแบบแอปทั่วไปได้
ไม่ตามปกติ
เมื่อปิด Click to Do
จะไม่สามารถเรียก Click to Do ได้
หากพยายามเปิดจาก Snipping Tool อาจพบข้อความว่าไม่สามารถเปิด Click to Do ได้
Microsoft ระบุว่า Click to Do เป็นส่วนหนึ่งของประสบการณ์ Copilot+ PC และไม่สามารถลบออกเหมือนแอปทั่วไป
แต่สามารถ Disable ได้จาก Settings
เพราะต้องวิเคราะห์ข้อความและภาพที่อยู่บนหน้าจออย่างรวดเร็ว
Copilot+ PC มี NPU สำหรับประมวลผล AI ภายในเครื่อง ซึ่งช่วยให้
Microsoft ใช้ NPU และ AI components ภายใน Windows เป็นพื้นฐานของฟีเจอร์อย่าง Click to Do
Phi Silica เป็นโมเดลภาษาขนาดเล็กของ Microsoft ที่ออกแบบมาเพื่อทำงานบนอุปกรณ์
Click to Do ใช้ Phi Silica สำหรับ Action ข้อความขั้นสูงบางอย่าง เช่น
ได้บางส่วน
เพราะการวิเคราะห์หน้าจอและ AI Action บางอย่างทำบนเครื่อง
แต่ Action ที่ต้องเชื่อมบริการออนไลน์ เช่น
ยังต้องใช้อินเทอร์เน็ต
ดังนั้นเป็นอีกตัวอย่างของ Hybrid AI บน Windows
NPU ถูกออกแบบให้รับงาน AI โดยเฉพาะ จึงช่วยลดภาระ CPU และ GPU
และเนื่องจาก Click to Do ไม่วิเคราะห์หน้าจอตลอดเวลา แต่เริ่มเมื่อผู้ใช้เรียกใช้งาน ผลกระทบต่อระบบในช่วงไม่ได้ใช้จึงควรมีจำกัด
เหมาะกับคนที่
โดยเฉพาะงานที่เดิมต้อง Copy ไปเปิดอีกแอปหนึ่ง Click to Do สามารถลดขั้นตอนได้
สมมติเปิดเว็บบทความอยู่
เดิมอาจต้อง
แต่ Click to Do สามารถ
ได้ทันทีในเวอร์ชันที่รองรับ
ถ้าเห็นรูปสินค้าบนหน้าจอและต้องการค้นหาข้อมูล
สามารถ
หรือใช้ Action ภาพอื่นที่ระบบแสดง
จึงลดขั้นตอน Capture ภาพก่อนค้นหา
ให้ตรวจสอบ
ถ้าเครื่องไม่ใช่ Copilot+ PC จะไม่รองรับฟีเจอร์นี้ในรูปแบบเดียวกัน
ลองตามนี้
ถ้ายังไม่ได้และเป็นเครื่องบริษัท อาจถูก Policy ขององค์กรปิดไว้
ได้
Microsoft รองรับ Policy สำหรับ Disable Click to Do ในอุปกรณ์องค์กร
ฝ่าย IT สามารถกำหนดได้ทั้งในระดับ Device และ User ผ่าน Windows AI Policy
ต้องใช้ Copilot+ PC หรือ Cloud PC ที่เข้าเกณฑ์ตามข้อกำหนดของ Microsoft
ไม่ วิเคราะห์เฉพาะเมื่อผู้ใช้เปิดใช้งาน และหยุดเมื่อออก
ได้บาง Action ที่ทำ Local แต่บริการออนไลน์ยังต้องใช้อินเทอร์เน็ต
ได้จาก Settings > Privacy & security > Click to Do
Click to Do ใช้ทำงานกับสิ่งที่เห็นตอนนี้ ส่วน Recall ใช้ค้นหาสิ่งที่เคยเห็นในอดีต
Click to Do คือฟีเจอร์ AI บน Copilot+ PC ที่ช่วยวิเคราะห์ข้อความและรูปภาพบนหน้าจอ แล้วเสนอ Action ที่เหมาะสมให้ผู้ใช้ทำต่อได้ทันที
สามารถเปิดได้จาก
การวิเคราะห์หน้าจอพื้นฐานทำ Local บนอุปกรณ์ และ Click to Do จะเริ่มวิเคราะห์เมื่อผู้ใช้เปิดใช้งานเท่านั้น ไม่ได้สแกนหน้าจอตลอดเวลา
สำหรับคนที่ต้อง Copy ข้อความ สรุปข้อมูล Rewrite หรือทำงานกับภาพบ่อย comsiam มองว่า Click to Do เป็นหนึ่งในฟีเจอร์ Copilot+ PC ที่มีโอกาสช่วยลดจำนวนขั้นตอนในการทำงานได้จริง โดยเฉพาะเมื่อนำไปใช้ร่วมกับ Recall และ Copilot