Skip to main content

Claude Opus 5 พร้อมใช้งานบน Felo แล้ว: ฟีเจอร์, ราคา & ทดลองใช้ฟรี 7 วัน

· อ่าน 15 นาที
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo รองรับ Claude Opus 5 แล้ว สำรวจฟีเจอร์, ผลทดสอบ, ความปลอดภัย และราคา พร้อมทดลองใช้โมเดล agentic coding ของ Anthropic ฟรี 7 วัน

Felo รองรับ Claude Opus 5 แล้ว โมเดลระดับ Opus ใหม่ล่าสุดจาก Anthropic สำหรับ agentic coding, การวิเคราะห์ระดับมืออาชีพ และงานที่ต้องใช้เวลายาวนาน เลือกใช้ใน Felo เมื่อคุณต้องการมากกว่าคำตอบแรกที่ดี — งานที่ต้องการการค้นคว้า, การตรวจสอบ, การทำซ้ำ และผลลัพธ์ที่คุณสามารถตรวจทานได้อย่างมั่นใจ

เพื่อฉลองการเปิดตัวนี้ สมาชิก Felo Pro สามารถใช้ Claude Opus 5 ได้โดยไม่มีค่าใช้จ่ายเพิ่มเติมเป็นเวลา 7 วันนับจากวันเปิดตัว ไม่ว่าจะเป็นบั๊กที่แก้ยาก, บทสรุปการวิจัยที่มีข้อมูลขัดแย้ง, การวิเคราะห์หลายขั้นตอน หรือเอกสารที่ต้องปรับแก้หลายรอบ — ลองใช้กับงานที่สำคัญกับคุณจริง ๆ

Claude Opus 5 launch announcement from Anthropic, shown unchanged with a gray border

ภาพปก: ผลงานต้นฉบับจาก ประกาศ Claude Opus 5 ของ Anthropic เนื้อหาภาพไม่ถูกเปลี่ยนแปลง; Felo เพิ่มเพียงกรอบสีเทา

นี่ไม่ใช่แค่บันทึกการอัปเดต ด้านล่างนี้คือคู่มือภาพรวมว่า Opus 5 ถูกออกแบบมาเพื่ออะไร ผลทดสอบที่ Anthropic รายงาน ข้อจำกัด และวิธีทดลองใช้กับงานจริงใน Felo

พร้อมทดลองใช้หรือยัง? เริ่มทดลองใช้ Claude Opus 5 ฟรี 7 วันใน Felo ->

ฟีเจอร์ของ Claude Opus 5: โมเดลนี้ถูกสร้างมาเพื่ออะไร

Anthropic เปิดตัว Claude Opus 5 เมื่อวันที่ 24 กรกฎาคม 2026 โดยวางตำแหน่งให้เป็นโมเดลประสิทธิภาพสูงสำหรับ agent ที่ทำงานยาวนาน, วิศวกรรมซอฟต์แวร์ และงานความรู้ระดับมืออาชีพ ในคำอธิบายของ Anthropic จุดเปลี่ยนสำคัญไม่ใช่แค่การตอบครั้งแรกที่ดีกว่า แต่ Opus 5 ถูกออกแบบให้ทำงานอย่างรอบคอบมากขึ้น: ตรวจสอบผลลัพธ์ระหว่างทาง, รักษาเส้นเรื่องของงานที่ซับซ้อน และทำซ้ำเมื่อความพยายามแรกยังไม่แก้ปัญหาจริง

ความแตกต่างนี้สำคัญกับงานจริง คำถามทั่วไปอาจต้องการแค่คำตอบที่รวดเร็วและกระชับ แต่งานที่ใหญ่ขึ้นอาจต้องให้โมเดลอ่านข้อมูลต้นทาง, ตัดสินใจว่ายังขาดข้อมูลอะไร, รันเครื่องมือหรือคำนวณ, เปรียบเทียบทางเลือก, ตรวจสอบผลลัพธ์ และอธิบายเหตุผล นี่คืองานที่โมเดลระดับ Opus เหมาะสมที่สุด

Anthropic เน้นจุดแข็งหลัก 3 ด้านที่ทับซ้อนกัน:

  • Agentic coding: ฟีเจอร์ขนาดใหญ่, การดีบั๊กที่ซับซ้อน, วิเคราะห์รากของปัญหา, refactor และงานที่เกี่ยวข้องกับหลายไฟล์หรือหลายเครื่องมือ
  • งานความรู้และการวิเคราะห์: เหตุผลเชิงโครงสร้างกับข้อมูลแน่น, งานตัวเลขและตาราง, การตรวจสอบข้อมูล, วิจัย และสนับสนุนการตัดสินใจ
  • การใช้งานคอมพิวเตอร์และเวิร์กโฟลว์อัตโนมัติ: ทำงานเป็นลำดับขั้นตอน ไม่ใช่แค่ตอบคำถามเดียว

ข้ออ้างเหล่านี้ไม่ได้หมายความว่าควรปล่อยให้โมเดลทำงานโดยไม่มีการตรวจสอบ แต่หมายความว่ามันสามารถร่างงานที่ยากได้สมบูรณ์ขึ้น ก่อนที่มนุษย์จะเข้ามาตรวจทานการตัดสินใจ หลักฐาน และผลลัพธ์สุดท้าย

ผลทดสอบและความสามารถของ Claude Opus 5

ผลทดสอบโมเดลเป็นสัญญาณที่มีประโยชน์ แต่ไม่ใช่การรับประกันว่าโมเดลจะทำงานได้เหมือนกันในทุกโปรเจกต์ ทั้งนี้ขึ้นอยู่กับงาน, เครื่องมือ, การตั้งค่า และวิธีให้คะแนน อย่างไรก็ตาม รายงานของ Anthropic ให้ภาพที่ชัดเจนว่างานแบบไหนที่ Opus 5 มุ่งเป้า

สำหรับวิศวกรรมซอฟต์แวร์ Anthropic รายงานว่า Opus 5 ได้คะแนนสูงสุดใน Frontier-Bench v0.1 ภายในองค์กร และมีประสิทธิภาพมากกว่า Opus 4.8 ถึงสองเท่าในราคาต่อภารกิจที่ต่ำกว่า กราฟด้านล่างนี้ช่วยให้เห็นภาพชัดเจน: เส้นสีส้มของ Opus 5 สูงกว่า Opus รุ่นก่อนในทุกระดับความพยายาม ไม่ใช่แค่จุดที่แพงที่สุด

Anthropic's Frontier-Bench v0.1 chart comparing agentic coding score with cost per attempt, shown unchanged with a gray border

ที่มา: Anthropic, Introducing Claude Opus 5 กราฟต้นฉบับไม่ถูกเปลี่ยนแปลง; Felo เพิ่มกรอบสีเทา หมายเหตุในกราฟระบุว่า Frontier-Bench ใช้ mini-SWE-agent harness, GKE backend และค่าเฉลี่ยรางวัลจาก 5 ครั้งต่อภารกิจ

ใน CursorBench 3.2 Anthropic ระบุว่าโมเดลได้คะแนนใกล้เคียงสูงสุดของ Claude Fable 5 (ต่างกันเพียง 0.5%) ที่ความพยายามสูงสุด แต่มีต้นทุนต่อภารกิจเพียงครึ่งเดียว นี่คือเหตุผลที่ Opus 5 เหมาะกับงานที่ความพยายามแรกที่คุณภาพต่ำจะสร้างงานเพิ่ม เช่น การดีบั๊กทั้งโค้ดเบส, สร้างฟีเจอร์ end-to-end หรือหาสาเหตุแทนที่จะซ่อมแค่ปลายเหตุ

สำหรับการแก้ปัญหาทั่วไปและงานออฟฟิศ Anthropic รายงานว่า Opus 5:

  • ได้คะแนนสูงกว่ารุ่นถัดไปถึง 3 เท่าใน ARC-AGI 3 ซึ่งวัดการแก้ปัญหาใหม่ ๆ
  • มีอัตราผ่านสูงกว่ารุ่นถัดไปประมาณ 1.5 เท่าที่ต้นทุนเท่ากันใน Zapier AutomationBench ที่ทดสอบการทำงานอัตโนมัติแบบ end-to-end
  • ทำคะแนนได้ดีกว่ารุ่นอื่นที่ต้นทุนใกล้เคียงใน OSWorld 2.0 ซึ่งเป็น benchmark การใช้งานคอมพิวเตอร์
  • เป็นโมเดลที่ดีที่สุดและคุ้มค่าที่สุดของบริษัทใน ARC-AGI 3, GDPval-AA v2, HLE, AutomationBench และ DeepSearchQA

ภาพรวมนี้ไม่ได้จำกัดแค่โค้ด กราฟ GDPval-AA v2 ของ Anthropic แสดงงานความรู้ในโลกจริงที่ระดับความพยายามต่างกัน ช่วยอธิบายว่าทำไม Opus 5 จึงเหมาะกับงานวิจัย, การเงิน, กฎหมาย, ปฏิบัติการ และงานที่ต้องการคำตอบที่ผ่านการตรวจสอบ ไม่ใช่แค่อ่านแล้วดูดีในครั้งแรก

Anthropic's GDPval-AA v2 chart comparing real-world knowledge task scores by effort level, shown unchanged with a gray border

ที่มา: Anthropic, Introducing Claude Opus 5 กราฟต้นฉบับไม่ถูกเปลี่ยนแปลง; Felo เพิ่มกรอบสีเทา

ทั้งหมดนี้คือ ผลลัพธ์ที่ Anthropic เผยแพร่ รวมถึงการทดสอบภายในและฟีดแบ็กจากผู้ใช้กลุ่มแรก ไม่ใช่อันดับกลางที่เป็นอิสระ วิธีอ่านที่ได้ประโยชน์ที่สุดคือใช้เป็นแนวทางในการทดสอบโมเดลกับงานของคุณเอง: งานที่มีลำดับพึ่งพายาว, ข้อกำหนดไม่ชัดเจน, ใช้เครื่องมือ, ต้องตรวจสอบ และมีผลกระทบจริงหากคำตอบตื้น ๆ หลุดรอดไป

ฟีเจอร์ของ Claude Opus 5: ทำไม “effort” ถึงเปลี่ยนประสบการณ์ใช้งาน

Opus 5 รองรับการตั้งค่าความพยายามที่ต่างกัน กล่าวง่าย ๆ คือ effort ช่วยให้คุณเลือกแลกความเร็วในการตอบและการใช้โทเคนกับเวลาคิดวิเคราะห์เพิ่มเติม กราฟของ Anthropic เปรียบเทียบโมเดลในระดับ effort หลายแบบ ตั้งแต่ต่ำเพื่อประหยัดโทเคน ไปจนถึง high, xhigh และ maximum effort

สิ่งนี้มีประโยชน์เพราะแต่ละคำขอไม่ควรใช้ทรัพยากรเท่ากัน ใช้ระดับต่ำสำหรับการจัดหมวดหมู่เร็ว ๆ, โครงร่าง หรือการแก้ไขเล็กน้อย เพิ่ม effort เมื่อโจทย์มีข้อจำกัดหลายอย่าง, โมเดลต้องรวมข้อมูลจากหลายแหล่ง หรือวิเคราะห์ว่าทำไมความพยายามก่อนหน้าถึงล้มเหลว สำหรับงานที่มีความเสี่ยงสูง ควรใช้เวลาที่ประหยัดได้กับขั้นตอนรีวิวด้วย: ขอให้โมเดลระบุสมมติฐาน, อ้างอิงแหล่งที่มา, ทดสอบกรณีขอบ หรืออธิบายว่าปัจจัยอะไรจะเปลี่ยนคำแนะนำ

การเปิดตัวยังเพิ่ม Fast mode (โหมดเร็ว) เป็นทางเลือกบนแพลตฟอร์มของ Anthropic เอง Anthropic ระบุว่าโหมดนี้เร็วขึ้นประมาณ 2.5 เท่า และมีค่าใช้จ่ายเป็นสองเท่าของอัตราฐาน การเข้าถึงและการตั้งค่าอาจต่างกันในแต่ละผลิตภัณฑ์ ดังนั้นใน Felo ให้ใช้การตั้งค่าที่แสดงใน workspace ของคุณ ไม่ควรสมมติว่าทุกตัวเลือกของ Anthropic จะมีเหมือนกัน

ความแตกต่างเห็นได้จากวิธีที่โมเดลตรวจสอบตัวเอง

ธีมที่น่าสนใจที่สุดของการเปิดตัวนี้คือการตรวจสอบ (verification) Anthropic อธิบายการทดสอบที่ Opus 5 ได้รับภาพวาดชิ้นส่วนเครื่องจักรโดยไม่มีทางดูภาพโดยตรง แทนที่จะหยุดแค่นั้น โมเดลกลับเขียน pipeline computer-vision เพื่อดึงรูปทรงจากพิกเซลดิบ แล้วสร้างชิ้นส่วนนั้นใหม่เป็นโมเดล 3D ใน FreeCAD ในอีกตัวอย่างหนึ่ง Anthropic ระบุว่าโมเดลหาสาเหตุของบั๊กจริงใน package manager และแก้ไขกรณีขอบที่แพตช์ของชุมชนพลาดไป

ตัวอย่างเหล่านี้ควรถือเป็นเดโมจากผู้สร้างโมเดล ไม่ใช่คำสัญญา แต่ชี้ให้เห็นรูปแบบการ prompt ที่เหมาะกับ Felo: อย่าขอแค่คำตอบ ขอให้แสดงกระบวนการทำงานด้วย

ตรวจสอบปัญหา แล้วเสนอวิธีแก้ไข
ก่อนสรุปผล ให้ตรวจสอบวิธีแก้กับข้อกำหนดที่ระบุไว้
ระบุสมมติฐาน และระบุการทดสอบหรือหลักฐานที่อาจหักล้างวิธีแก้นี้ได้
แยกคำแนะนำสุดท้ายออกจากบันทึกการทำงาน

สำหรับงานวิจัย วิธีเดียวกันนี้สามารถเปลี่ยน prompt กว้าง ๆ ให้เป็นกระบวนการที่ตรวจสอบได้: รวบรวมแหล่งข้อมูลปัจจุบัน, แยกข้อเท็จจริงกับข้อสรุป, มองหาหลักฐานแย้ง และสรุปเป็นบทวิเคราะห์สั้น ๆ เวิร์กโฟลว์หลายภาษาของ Felo มีประโยชน์มากเมื่อข้อมูลสำคัญอยู่หลายภาษา — ขอให้แสดงต้นฉบับควบคู่กับสรุปภาษาอังกฤษที่ชัดเจนเมื่อจำเป็น

Anthropic ยังรายงานผลลัพธ์ที่ดีใน OSWorld 2.0 ซึ่งเป็น benchmark สำหรับการใช้งานคอมพิวเตอร์ผ่านอินเทอร์เฟซหลายขั้นตอน นี่เป็นเครื่องเตือนใจว่า agentic work มักไม่ใช่ “หนึ่ง prompt หนึ่งคำตอบ” แต่มักเป็นลำดับของการตรวจสอบสถานะ, เลือกการกระทำถัดไป และตรวจสอบว่าผลลัพธ์ตรงเป้าหมายจริงหรือไม่

Anthropic's OSWorld 2.0 chart comparing agentic computer-use performance with cost per task, shown unchanged with a gray border

ที่มา: Anthropic, Introducing Claude Opus 5 กราฟต้นฉบับไม่ถูกเปลี่ยนแปลง; Felo เพิ่มกรอบสีเทา

ประสิทธิภาพไม่ใช่ปัจจัยเดียว: ความปลอดภัยและข้อจำกัด

Anthropic รายงานว่าการตรวจสอบพฤติกรรมก่อนเปิดตัวพบว่า Opus 5 เป็นโมเดลที่สอดคล้องกับจุดประสงค์มากที่สุดในรุ่นล่าสุด โมเดลนี้มีพฤติกรรมที่ไม่สอดคล้องโดยรวมต่ำกว่า, พฤติกรรมหลอกลวงต่ำกว่า และต้านทาน prompt ที่พยายามใช้งานผิดวัตถุประสงค์ได้ดีกว่าหลายรุ่นก่อนหน้า Anthropic ยังระบุว่า Opus 5 ไม่ขยายขีดความสามารถที่เสี่ยงในด้านชีววิทยาและความปลอดภัยไซเบอร์เชิงรุก

กราฟ audit ด้านล่างนี้สรุปภาพรวมได้ชัดเจนที่สุด ในสเกล 1-10 ของพฤติกรรมไม่สอดคล้อง (misaligned-behavior) ของ Anthropic ยิ่งต่ำยิ่งดี; Opus 5 อยู่ที่ 2.30 ต่ำกว่ารุ่นอื่น ๆ ในการเปรียบเทียบ นี่เป็นการประเมินความปลอดภัยภายใน จึงควรใช้เป็นข้อมูลประกอบ ไม่ใช่แทนที่การควบคุมโดยมนุษย์ในงานสำคัญ

Anthropic's automated behavioral audit chart showing Opus 5 with the lowest misaligned-behavior score among the compared models, shown unchanged with a gray border

ที่มา: Anthropic, Introducing Claude Opus 5 กราฟต้นฉบับไม่ถูกเปลี่ยนแปลง; Felo เพิ่มกรอบสีเทา

ประเด็นสำคัญในทางปฏิบัติคือมาตรการป้องกันยังคงเป็นส่วนหนึ่งของผลิตภัณฑ์ Anthropic ระบุว่า Opus 5 สามารถช่วยหาช่องโหว่ในซอร์สโค้ดได้ แต่มี guardrail ที่เข้มงวดกับกิจกรรมไซเบอร์บางประเภท เช่น การสแกนช่องโหว่จากไบนารี, การทดสอบเจาะระบบ และการสร้าง exploit คำขอที่กระตุ้นมาตรการป้องกันเหล่านี้อาจถูกบล็อก หรือในบางผลิตภัณฑ์ของ Anthropic อาจเปลี่ยนไปใช้โมเดลอื่นแทน

สำหรับงานอื่น ๆ ให้รักษานิสัยที่ดีเหมือนกับการใช้โมเดลประสิทธิภาพสูงทั่วไป:

  • ตรวจสอบข้อเท็จจริง, การคำนวณ, การอ้างอิง, โค้ด และผลลัพธ์ก่อนใช้งานจริง
  • อย่าใช้ความลื่นไหลของภาษาเป็นหลักฐาน ขอแหล่งข้อมูลต้นทางและตรวจสอบด้วยตนเอง
  • ให้มนุษย์เป็นผู้รับผิดชอบการตัดสินใจด้านกฎหมาย, การเงิน, การแพทย์, ความปลอดภัย และเรื่องสำคัญอื่น ๆ
  • กำหนดเงื่อนไขความสำเร็จที่ชัดเจนและขอบเขตที่โมเดลห้ามข้าม

Anthropic ยังระบุว่า Opus 5 ยังมีข้อจำกัดสำคัญกับงานวิจัยอัตโนมัติที่ใช้เวลานาน ความสามารถไม่ใช่ความเป็นอัตโนมัติ และวงจรรีวิวโดยมนุษย์ที่ออกแบบดีควรเป็นส่วนหนึ่งของเวิร์กโฟลว์ที่แข็งแกร่ง

ราคา Claude Opus 5 และทดลองใช้ฟรีใน Felo

Anthropic กำหนดราคา Claude Opus 5 ที่ $5 ต่อ 1 ล้าน input tokens และ $25 ต่อ 1 ล้าน output tokens ผ่าน Claude API ซึ่งเป็นอัตราฐานเดียวกับ Opus 4.8 ราคาบนแพลตฟอร์ดอื่น, แบบสมัครสมาชิก และฟีเจอร์อาจต่างกัน ดังนั้นควรดูข้อมูลราคาและการใช้งานในผลิตภัณฑ์ที่คุณใช้

สำหรับสมาชิก Felo Pro ประเด็นสำคัญคือ Claude Opus 5 ทดลองใช้ได้ฟรี 7 วันนับจากวันเปิดตัว คุณจึงสามารถประเมินกับงานจริงก่อนตัดสินใจว่าจะใช้ในเวิร์กโฟลว์ประจำหรือไม่ การเปรียบเทียบที่เหมาะสมไม่ใช่แค่ “โมเดลไหนเขียนร่างแรกได้ดีที่สุด” ลองใช้โจทย์ยากเดียวกันกับโมเดลที่คุณใช้ประจำ แล้วเปรียบเทียบความสมบูรณ์, อัตราความผิดพลาด, ความจำเป็นต้องติดตามผล, คุณภาพการจัดการแหล่งข้อมูล และเวลาที่ต้องใช้รีวิวแต่ละผลลัพธ์

วิธีทดลองใช้ Claude Opus 5 ฟรี 7 วันใน Felo Pro

  1. เข้าสู่ระบบ Felo Pro ของคุณ
  2. เริ่มงานใหม่ใน workspace ของ Felo ที่คุณใช้สำหรับวิจัย, เขียน, วิเคราะห์ หรือ agentic work
  3. เลือก Claude Opus 5 ในตัวเลือกโมเดล
  4. มอบหมายงานที่มีเป้าหมายชัดเจน, ไฟล์หรือบริบทที่เกี่ยวข้อง และขั้นตอนตรวจสอบที่ชัดเจน
  5. ตรวจทานผลลัพธ์, ปรับคำสั่งหากจำเป็น และเปรียบเทียบกับเวิร์กโฟลว์ปัจจุบันของคุณในช่วงทดลอง 7 วัน

เริ่มจากงานที่เผยจุดแข็งของโมเดล: แผนโปรเจกต์ที่ต้องตัดสินใจแลกเปลี่ยน, สเปรดชีตหรือรายงานที่ซับซ้อน, code review ที่ยาก, คำถามวิจัยจากหลายแหล่ง หรือการวิเคราะห์ที่ต้องตอบคำถามติดตาม เป้าหมายไม่ใช่ทำให้โมเดลดูเก่งด้วย prompt ฉลาด ๆ แต่คือดูว่ามันทำให้งานจริงของคุณชัดเจนขึ้น, น่าเชื่อถือขึ้น และเสร็จง่ายขึ้นหรือไม่

ใช้สิทธิ์นี้กับงานที่สำคัญ: เริ่มทดลองใช้ Claude Opus 5 ใน Felo ->

Claude Opus 5 ควรค่าแก่การลองหรือไม่?

Claude Opus 5 เพิ่มทางเลือกใหม่ใน Felo สำหรับงานที่ต้องการความพยายาม, การคิดวิเคราะห์อย่างรอบคอบ และการตรวจสอบ ผลลัพธ์ที่เผยแพร่ชี้ให้เห็นความก้าวหน้าที่มีนัยสำคัญใน agentic coding, automation, การใช้งานคอมพิวเตอร์ และการวิเคราะห์ระดับมืออาชีพ ขณะที่ข้อจำกัดด้านความปลอดภัยและข้อจำกัดอื่น ๆ ยังคงเป็นบริบทสำคัญ

ใน 7 วันข้างหน้า สมาชิก Felo Pro สามารถประเมินได้โดยไม่มีค่าใช้จ่ายโมเดลเพิ่มเติม นำงานที่สำคัญจริงมาทดสอบ ขอให้โมเดลแสดงและตรวจสอบกระบวนการ แล้วตัดสินจากผลลัพธ์ว่า Claude Opus 5 สมควรเป็นส่วนหนึ่งของเวิร์กโฟลว์คุณถาวรหรือไม่

เริ่มทดลองใช้ Claude Opus 5 ฟรี 7 วันใน Felo ->


แหล่งข้อมูลและอ่านเพิ่มเติม


บทความนี้มีให้อ่านในภาษาต่อไปนี้ด้วย: English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Bahasa Indonesia, Deutsch, Tiếng Việt, Türkçe, Italiano, Español, বাংলা and Português