Skip to content
โมเดลและงานวิจัย

Anthropic เผยแพร่รายงาน Economic Index ฉบับที่สอง ว่าด้วยการใช้งาน Claude 3.7 Sonnet

Anthropic เผยแพร่รายงาน Economic Index ฉบับที่สอง วิเคราะห์พฤติกรรมการใช้งาน Claude 3.7 Sonnet ของผู้ใช้ ครอบคลุมโหมดคิดแบบขยายความ (extended thinking) ที่เปิดตัวใหม่ และข้อมูลการทำงานอัตโนมัติในระดับงานย่อย

โดย DigitalNeuron Deskอ่าน 1 นาที

คำตอบโดยย่อ

รายงาน Economic Index ฉบับที่สองของ Anthropic ระบุอะไรบ้างเกี่ยวกับพฤติกรรมการใช้งาน Claude 3.7 Sonnet ของผู้คน

รายงาน Economic Index ฉบับที่สองของ Anthropic พบว่าการใช้งาน Claude.ai ในด้านการเขียนโค้ด การศึกษา วิทยาศาสตร์ และสาธารณสุข เพิ่มขึ้นหลังการเปิดตัว Claude 3.7 Sonnet โดยโหมดคิดแบบขยายความถูกใช้มากที่สุดในสายอาชีพด้านเทคนิค ขณะที่สัดส่วนการใช้งานแบบเสริมศักยภาพ (augmentation) ยังคงทรงตัวอยู่ที่ 57% และ Anthropic ยังเผยแพร่ระบบจัดหมวดหมู่การใช้งานใหม่ 630 หมวด พร้อมข้อมูลการทำงานอัตโนมัติในระดับงานย่อยด้วย

ประเด็นสำคัญ

  • Anthropic ระบุว่าสัดส่วนการใช้งาน Claude.ai ในด้านการเขียนโค้ด การศึกษา วิทยาศาสตร์ และสาธารณสุข เพิ่มขึ้นในช่วง 11 วันหลังการเปิดตัว Claude 3.7 Sonnet เมื่อเทียบกับรายงาน Economic Index ฉบับแรก
  • Anthropic ระบุว่าโหมดคิดแบบขยายความถูกใช้มากที่สุดในงานด้านเทคนิค โดยมีสัดส่วนการใช้งานประมาณ 10% ในงานของนักวิจัยด้านคอมพิวเตอร์และสารสนเทศ และประมาณ 8% ในงานของนักพัฒนาซอฟต์แวร์
  • Anthropic รายงานว่าการใช้งานแบบเสริมศักยภาพยังคงคิดเป็น 57% ของการใช้งาน Claude.ai ทั้งหมด ไม่เปลี่ยนแปลงจากรายงานฉบับก่อน ขณะที่สัดส่วนการโต้ตอบเชิงการเรียนรู้เพิ่มขึ้นจากประมาณ 23% เป็นประมาณ 28%
  • Anthropic พบว่างานด้านการเขียนคำโฆษณาและงานบรรณาธิการมีสัดส่วนการทำงานแบบทำซ้ำสูงที่สุด ขณะที่งานด้านนักแปลและล่ามมีสัดส่วนการใช้งานแบบสั่งงานโดยตรงสูงเป็นอันดับต้น ๆ ซึ่งเป็นกรณีที่โมเดลทำงานให้เสร็จโดยมีมนุษย์เข้ามาเกี่ยวข้องน้อยที่สุด
  • Anthropic เผยแพร่ระบบจัดหมวดหมู่การใช้งานใหม่ 630 หมวด ที่สร้างขึ้นด้วยเครื่องมือวิเคราะห์ Clio พร้อมชุดข้อมูลการทำงานอัตโนมัติและการเสริมศักยภาพในระดับงานและระดับอาชีพ ซึ่งทั้งหมดสามารถดาวน์โหลดได้

Anthropic ได้เผยแพร่รายงานฉบับที่สองจากโครงการ Anthropic Economic Index ซึ่งบริษัทระบุว่าเป็นความริเริ่มที่จะเผยแพร่ข้อมูลและงานวิจัยอย่างสม่ำเสมอ ว่าด้วยผลกระทบของปัญญาประดิษฐ์ต่อตลาดแรงงานและระบบเศรษฐกิจ รายงานฉบับนี้ครอบคลุมข้อมูลการใช้งาน Claude.ai ที่เก็บรวบรวมหลังการเปิดตัว Claude 3.7 Sonnet ซึ่ง Anthropic ระบุว่าเป็นโมเดลใหม่ล่าสุดและมีความสามารถสูงที่สุดของบริษัท โดดเด่นด้านการเขียนโค้ดแบบเอเจนต์ (agentic coding) และมาพร้อมโหมดใหม่ที่เรียกว่า "การคิดแบบขยายความ" (extended thinking)

สิ่งที่ Anthropic วิเคราะห์

Anthropic ระบุว่าได้ตรวจสอบบทสนทนาที่ไม่ระบุตัวตนจำนวน 1 ล้านรายการจากผู้ใช้ Claude.ai ทั้งแบบฟรีและแบบโปร ในช่วง 11 วันหลังการเปิดตัว Claude 3.7 Sonnet บริษัทใช้เครื่องมือวิเคราะห์ที่ปกป้องความเป็นส่วนตัวชื่อ Clio เพื่อจับคู่แต่ละบทสนทนาเข้ากับหนึ่งในงานประมาณ 17,000 ประเภทในฐานข้อมูล O*NET ของกระทรวงแรงงานสหรัฐฯ จากนั้นจึงพิจารณารูปแบบการใช้งานตามสายอาชีพและหมวดหมู่อาชีพต่าง ๆ

การเปลี่ยนแปลงของการใช้งานหลังการเปิดตัว

Anthropic ระบุว่าสัดส่วนการใช้งานเพิ่มขึ้นเล็กน้อยในหลายหมวดอาชีพ ได้แก่ การเขียนโค้ด การศึกษา และวิทยาศาสตร์ รวมถึงการใช้งานด้านสาธารณสุข บริษัทระบุว่าสายอาชีพด้านคอมพิวเตอร์และคณิตศาสตร์มีสัดส่วนการใช้งานเพิ่มขึ้นสูงสุดในเชิงตัวเลขสัมบูรณ์ที่ 3 จุดเปอร์เซ็นต์ Anthropic ตั้งข้อสังเกตว่าการเพิ่มขึ้นด้านการเขียนโค้ดเป็นไปตามที่คาดไว้ เนื่องจาก Claude 3.7 Sonnet มีคะแนนการทดสอบด้านการเขียนโค้ดที่ดีขึ้น ขณะที่การเพิ่มขึ้นในหมวดอื่น ๆ อาจสะท้อนการยอมรับ AI ที่กว้างขึ้น การประยุกต์ใช้การเขียนโค้ดในรูปแบบใหม่ในสาขาเหล่านั้น หรือความสามารถของโมเดลที่เหนือความคาดหมาย

การใช้งานโหมดคิดแบบขยายความ

Anthropic รายงานว่าโหมดคิดแบบขยายความ ซึ่งเปิดให้โมเดลใช้เวลาคิดวิเคราะห์คำถามที่ซับซ้อนได้นานขึ้นเมื่อผู้ใช้เปิดใช้งาน ถูกนำไปใช้เป็นหลักในบริบทด้านเทคนิคและงานสร้างสรรค์ บริษัทระบุว่างานที่เกี่ยวข้องกับนักวิจัยด้านคอมพิวเตอร์และสารสนเทศมีสัดส่วนการใช้งานสูงสุดใกล้ 10% ตามมาด้วยนักพัฒนาซอฟต์แวร์ที่ประมาณ 8% ศิลปินสื่อผสมที่ประมาณ 7% และนักออกแบบวิดีโอเกมที่ประมาณ 6% ทั้งนี้ Anthropic กำลังเผยแพร่ชุดข้อมูลที่จับคู่งานแต่ละประเภทในระบบ O*NET กับสัดส่วนการใช้งานโหมดคิดที่เกี่ยวข้องบนแพลตฟอร์ม Hugging Face

การเสริมศักยภาพเทียบกับการทำงานอัตโนมัติ

Anthropic ระบุว่าสัดส่วนโดยรวมระหว่างการใช้งานแบบเสริมศักยภาพ เช่น การเรียนรู้หรือการทำงานร่วมกับโมเดลแบบทำซ้ำ กับการใช้งานแบบทำให้เป็นอัตโนมัติ เช่น การให้โมเดลทำงานหรือแก้ไขข้อผิดพลาดให้เสร็จสิ้นโดยตรง แทบไม่เปลี่ยนแปลงจากรายงานฉบับแรก โดยการเสริมศักยภาพยังคงคิดเป็น 57% ของการใช้งานทั้งหมด บริษัทรายงานว่าการโต้ตอบเชิงการเรียนรู้ ซึ่งผู้ใช้สอบถามข้อมูลหรือคำอธิบายจาก Claude เพิ่มขึ้นจากประมาณ 23% เป็นประมาณ 28% Anthropic ระบุว่างานด้านชุมชนและบริการสังคม รวมถึงการศึกษาและการให้คำปรึกษาแนะแนว มีสัดส่วนการเสริมศักยภาพเข้าใกล้ 75% ขณะที่สายงานการผลิตและสายงานคอมพิวเตอร์-คณิตศาสตร์อยู่ใกล้เคียงสัดส่วน 50-50 มากกว่า โดยบริษัทระบุว่าไม่มีหมวดอาชีพใดที่การทำงานอัตโนมัติมีสัดส่วนเด่นชัดที่สุด นอกจากนี้ Anthropic ยังระบุว่างานด้านการเขียนคำโฆษณาและงานบรรณาธิการมีสัดส่วนการทำงานแบบทำซ้ำร่วมกับโมเดลสูงที่สุด ซึ่งเป็นกระบวนการที่คนและโมเดลร่วมกันเขียนผลงาน ขณะที่งานด้านนักแปลและล่ามมีสัดส่วนพฤติกรรมแบบสั่งงานโดยตรงสูงเป็นอันดับต้น ๆ ซึ่งเป็นกรณีที่โมเดลทำงานให้เสร็จโดยมีมนุษย์เข้ามาเกี่ยวข้องน้อยที่สุด บริษัทระบุว่าบรรณารักษ์มีสัดส่วนการโต้ตอบเชิงการเรียนรู้สูงสุดที่ประมาณ 56% ส่วนนักเขียนคำโฆษณามีสัดส่วนการทำงานแบบทำซ้ำสูงสุดที่ประมาณ 58%

ระบบจัดหมวดหมู่การใช้งานแบบล่างขึ้นบนชุดใหม่

Anthropic ยังเผยแพร่สิ่งที่บริษัทเรียกว่าระบบจัดหมวดหมู่การใช้งาน Claude.ai แบบล่างขึ้นบนชุดแรกของวงการ ซึ่งสร้างขึ้นด้วย Clio จากชุดข้อมูลบทสนทนาชุดเดียวกัน ระบบนี้ประกอบด้วยกลุ่มย่อยที่ละเอียด 630 กลุ่ม จัดเรียงเป็นลำดับชั้น 3 ระดับ แต่ละกลุ่มมีคำอธิบาย ตัวชี้วัดความแพร่หลาย และการแจกแจงสัดส่วนระหว่างการทำงานอัตโนมัติกับการเสริมศักยภาพ Anthropic ยกตัวอย่างกลุ่มการใช้งาน เช่น การช่วยเหลือด้านระบบจัดการน้ำ การจำลองเชิงฟิสิกส์ การเลือกฟอนต์ เอกสารสมัครงาน คำแนะนำด้านเทคโนโลยีแบตเตอรี่ และการจัดการเขตเวลาในโค้ดโปรแกรม บริษัทระบุว่าชุดข้อมูลที่ใช้ในการวิเคราะห์ทั้งสองส่วนสามารถดาวน์โหลดได้ฟรี และวางแผนจะติดตามตัวชี้วัดเหล่านี้ต่อไปตามความก้าวหน้าของความสามารถของโมเดล นอกจากนี้ Anthropic ยังระบุว่ากำลังเปิดรับสมัครตำแหน่งนักวิจัยด้านผลกระทบทางสังคม วิศวกรวิจัย และนักเศรษฐศาสตร์

แหล่งที่มา: Anthropic, "Anthropic Economic Index: Insights from Claude 3.7 Sonnet," เผยแพร่เมื่อวันที่ 27 มีนาคม 2025

คำถามที่พบบ่อย

Anthropic Economic Index คืออะไร
Anthropic อธิบายว่าเป็นความริเริ่มที่เผยแพร่ข้อมูลและงานวิจัยอย่างสม่ำเสมอ ว่าด้วยผลกระทบของปัญญาประดิษฐ์ต่อตลาดแรงงานและระบบเศรษฐกิจในระยะยาว
รายงานฉบับที่สองนี้วิเคราะห์ข้อมูลอะไรบ้าง
Anthropic วิเคราะห์บทสนทนาที่ไม่ระบุตัวตนจำนวน 1 ล้านรายการจากผู้ใช้ Claude.ai ทั้งแบบฟรีและแบบโปร ในช่วง 11 วันหลังการเปิดตัว Claude 3.7 Sonnet โดยใช้เครื่องมือ Clio เพื่อจับคู่บทสนทนาเข้ากับงานในฐานข้อมูล O*NET ของกระทรวงแรงงานสหรัฐฯ
Anthropic พบอะไรบ้างเกี่ยวกับโหมดคิดแบบขยายความ
Anthropic ระบุว่าโหมดคิดแบบขยายความถูกใช้เป็นหลักในการแก้ปัญหาด้านเทคนิคและงานสร้างสรรค์ โดยนักวิจัยด้านคอมพิวเตอร์และสารสนเทศมีสัดส่วนการใช้งานสูงสุดใกล้ 10% ตามมาด้วยนักพัฒนาซอฟต์แวร์ที่ประมาณ 8%
สัดส่วนระหว่างการเสริมศักยภาพและการทำงานอัตโนมัติของ AI เปลี่ยนแปลงหรือไม่
Anthropic รายงานว่าสัดส่วนดังกล่าวแทบไม่เปลี่ยนแปลง โดยการเสริมศักยภาพยังคงคิดเป็น 57% ของการใช้งาน แม้ว่าการโต้ตอบเชิงการเรียนรู้จะเพิ่มขึ้นจากประมาณ 23% เป็นประมาณ 28% ของข้อมูลทั้งหมด

แหล่งข้อมูล

  1. Anthropic Economic Index: Insights from Claude 3.7 Sonnet \ AnthropicAnthropic
แท็กanthropicclaude-3-7-sonneteconomic-indexai-labor-marketextended-thinking-modeusage-data

อ่านเพิ่มเติม

MiniMax เปิดตัว Speech 2.8 พร้อมแท็กเสียงและการโคลนเสียง

MiniMax เปิดตัว Speech 2.8 โมเดลเสียงสังเคราะห์ที่มีแท็กเสียงในตัวสำหรับการหายใจและการลังเล การโคลนเสียงจากตัวอย่างเสียง 10 วินาที และกระบวนการที่มุ่งลดสัญญาณรบกวนและความผิดเพี้ยน บริษัทยังระบุว่าได้ปรับปรุงการสังเคราะห์เสียงข้ามภาษาสำหรับภาษาจีนกลางและภาษาญี่ปุ่น และเปิดให้ใช้งานโมเดลนี้ผ่านแพลตฟอร์มและผลิตภัณฑ์ Audio ของบริษัท

อ่าน 6 นาที

DeepSeek เปิดตัวโมเดลมัลติโมดัล V4-Flash-Vision-Exp

DeepSeek เปิดตัว DeepSeek-V4-Flash-Vision-Exp ซึ่งเป็นโมเดลมัลติโมดัลเชิงทดลองบนแพลตฟอร์ม API ของบริษัท บริษัทระบุว่าโมเดลนี้มีประสิทธิภาพเทียบเท่า DeepSeek-V4-Flash ในงานด้านข้อความ พร้อมทั้งเพิ่มความสามารถด้านการมองเห็น (vision) เข้ามา และอ้างว่ามีการก้าวกระโดดครั้งสำคัญในผลการทดสอบมาตรฐาน (benchmark) ของเอเจนต์แบบมัลติโมดัล เมื่อเทียบกับ V4-Flash โดยใกล้เคียงกับ Opus-4.8 นอกจากนี้ DeepSeek ยังได้เปิดตัว Files API ฟรี และ DeepSeek Harness 0.1.1 อีกด้วย

อ่าน 3 นาที

บริบทหน้าต่างคืออะไร และทำไมมันถึงเต็ม?

ขนาดหน้าต่างบริบทคือปริมาณข้อความสูงสุดที่วัดเป็นโทเคน ที่โมเดลสามารถพิจารณาในคำขอหนึ่งเดียวได้ มันเก็บคำสั่งระบบ คำสนทนาไปแล้ว เอกสารที่คุณวางไว้ และคำตอบที่กำลังสร้าง เมื่อรวมทั้งหมดเกินขีดจำกัด จะต้องทิ้งหรือสรุปบางส่วน

อัปเดต อ่าน 8 นาที