Anthropic Opus 5: มันหมายถึงอะไรสำหรับ AI ขององค์กรในวันนี้

News

โดย Win.AI Editorial

Engineering team in a conference room reviewing an Opus 5 migration dashboard showing token usage and effort-level controls on a large monitor

Anthropic Opus 5 ให้ความสามารถระดับแนวหน้าแก่บริษัทต่างๆ ในราคาของ Opus 4.8 โดยการเพิ่มตัวควบคุมความพยายามที่แลกเปลี่ยนความลึกในการคิดกับการใช้โทเคน และการเปลี่ยนแปลงเพียงอย่างเดียวจะบังคับให้ผู้ซื้อมองว่าการอัปเกรดโมเดลเป็นการโยกย้ายที่บ่อยครั้งและไม่ใช่เรื่องง่าย Anthropic เปิดตัว Opus 5 เมื่อวันที่ 24 กรกฎาคม 2026 และเอกสารข้อมูลของแพลตฟอร์มและการรายงานข่าวของ Reuters แสดงว่าโมเดลนี้มีราคาเท่ากับ $5 ต่อหนึ่งล้านการป้อนข้อมูลและ $25 ต่อหนึ่งล้านการส่งออก เช่นเดียวกับ Opus 4.8 ขณะที่อ้างถึงประสิทธิภาพใกล้เคียง Fable ในหลายๆ การทดสอบ

Anthropic Opus 5: ความสามารถ, ต้นทุน, ความปลอดภัย

Opus 5 เปิดเผยพารามิเตอร์ output_config.effort ที่มีห้าระดับตั้งแต่ต่ำสุดไปสูงสุดเพื่อที่แต่ละคำขอจะแลกเปลี่ยนต้นทุนในการคิดอย่างลึกซึ้ง วัสดุการเปิดตัวของ Anthropic และคู่มือการโยกย้ายได้อธิบายว่า ตัวควบคุมนี้จะเปลี่ยนจำนวนโทเคนการคิดภายในและการเรียกเครื่องมือที่โมเดลใช้ ไม่ใช่เพียงแค่ขีดจำกัดโทเคนที่เข้มงวด ซึ่งอนุญาตให้ทีมสามารถดำเนินการทำงานประจำได้ในระดับความพยายามต่ำเพื่อให้ใช้โทเคนน้อยลงมาก จากนั้นเปลี่ยนเป็นความพยายามสูงสำหรับงานที่ซับซ้อน บริษัทได้เผยแพร่ข้อเรียกร้องการทดสอบที่เปรียบเทียบ Opus 5 กับ Opus 4.8 และกับ Fable 5; Reuters และ Fortune สรุปข้อเรียกร้องเหล่านั้นและกล่าวถึงการตัดสินใจที่ชัดเจนของ Anthropic ในการวางตำแหน่ง Opus 5 ว่าเป็นตัวเลือกที่ถูกกว่าสำหรับงานทางธุรกิจจริงหลายๆ งาน

การเปลี่ยนแปลงด้านความปลอดภัยนั้นเป็นแบบค่อยเป็นค่อยไป Opus 5 สืบทอดแนวคุ้มครองจาก Opus 4.8 และมีการเข้มงวดเกี่ยวกับการปฏิเสธที่เกี่ยวข้องกับไซเบอร์มากขึ้นเมื่อเปรียบเทียบกับการเปิดตัว Opus ก่อนหน้านี้ตามการรายงานข่าวของ Fortune เกี่ยวกับการเปิดตัว การศึกษาในทีมแดงอิสระยังคงเป็นวิธีตรวจสอบที่เชื่อถือได้ที่สุดกับข้อเรียกร้องของผู้จำหน่ายที่เกินจริง การประเมินทีมแดงล่าสุดที่เป้าหมาย Fable และโมเดล Opus ก่อนหน้านี้แสดงให้เห็นว่าความปลอดภัยอ่อนแอภายใต้การโจมตีที่ปรับเปลี่ยน ดังนั้นบริษัทต่างๆ ไม่ควรสันนิษฐานว่าการเพิ่มศักยภาพหมายถึงการจัดแนวที่แข็งแกร่งเท่ากัน

การโยกย้าย, เวอร์ชันและ MLOps

ผลกระทบจริงคือการเปลี่ยนแปลง หากคุณได้ทำการปรับแต่งโปรมต์, โซ่เครื่องมือ หรือโมเดลการตัดสินสำหรับ Opus 4.8 การสลับไปที่ Opus 5 อาจเปลี่ยนนับโทเคน, พฤติกรรมการเรียกเครื่องมือ และรูปร่างของผลลัพธ์ คู่มือการโยกย้ายของ Anthropic เตือนทีมอย่างชัดเจนให้ปรับแต่งการใช้โทเคนและความหน่วง จงคาดหวังให้มีสามกิจกรรมเหล่านี้ก่อนการโยกย้ายทั้งหมด: ทำการปรับแต่งการใช้โทเคนสำหรับการทำงานจริง, เล่นซ้ำการทดสอบอัตโนมัติที่ตรวจสอบการเรียกเครื่องมือและการฟื้นตัวจากความผิดพลาด และตั้งค่าระดับความพยายามตามแต่ละจุดสิ้นสุด

ผู้ซื้อหลายคนจะมองว่า Opus 5 เป็นการเพิ่มประสิทธิภาพต้นทุนไม่ใช่การเปลี่ยนที่แทนที่ได้ทันที ซึ่งก่อให้เกิดคำถามด้านการจัดซื้อ: ข้อตกลงในระดับบริการจะครอบคลุมถึงการตกต่ำทางความหมายในแต่ละรุ่นหรือไม่, และการควบคุมการเปลี่ยนแปลงของผู้จำหน่ายจะอนุญาตให้มีการยึดติดกับซอฟต์แวร์เวอร์ชันเฉพาะได้หรือไม่ ขั้นตอนการปฏิบัติที่สั้นคือการเพิ่มเกทเวอร์ชันของโมเดลไปยัง CI และกำหนดงบประมาณสำหรับการปรับแต่งซึ่งใช้เวลา 2 ถึง 6 สัปดาห์สำหรับการเปิดตัว Opus หลักแต่ละครั้ง สำหรับรูปแบบสถาปัตยกรรมที่แนะนำ ดูคู่มือ RAG ทางปฏิบัติของเราสำหรับองค์กร

เราสังเกตเห็นรูปแบบที่เกิดขึ้นซ้ำในการเปลี่ยนโมเดลเมื่อเร็วๆ นี้ สามารถกล่าวถึงได้สามประการ ประการแรก, การเปลี่ยนแปลงโปรมต์เล็กๆ ที่ทำงานได้ดีใน Opus 4.8 บางครั้งสร้างห่วงโซ่การคิดที่แตกต่างกันใน Opus 5 ประการที่สอง, ความพยายามต่ำมักลดการเรียกเครื่องมือที่มีค่าใช้จ่ายสูงด้วยการสูญเสียคุณภาพน้อยที่สุดสำหรับการสรุปและการดึงข้อมูล ประการที่สาม, ความปลอดภัยที่ลดลงเมื่อ Opus ปฏิเสธแล้วส่งต่อไปยังโมเดลที่เล็กกว่าจะสร้างการกระชากของความหน่วงที่ละเอียดอ่อนซึ่งต้องการการทดสอบภาระ

ลองด้วยตนเอง: โปรมต์

โปรมต์สองรายการต่อไปนี้จะแสดงวิธีการเปิดเผยตัวควบคุมความพยายามในที่ทำงานจริงและทดสอบการตรวจสอบตนเองของ Opus 5 คาดหวังว่าโมเดลจะใช้โทเกนมากขึ้นและผลิตการตรวจสอบภายในมากขึ้นในระดับความพยายามที่สูงขึ้น

โปรมต์นี้เปรียบเทียบงานทำความสะอาดข้อมูลตามปกติที่ใช้ความพยายามต่ำและการปรับปรุงโค้ดที่ซับซ้อนที่ใช้ความพยายามสูงสุด วางซ้ำสองครั้งโดยเปลี่ยนเพียงแค่ป้ายความพยายามเพื่อดูความแตกต่างในโทเคนและผลลัพธ์

Task: Repair and refactor this messy Python data pipeline to remove silent data loss, add unit tests, and summarize changes. Return a short changelog, the refactored function, and two test cases. Effort: low

โปรมต์นี้ขอให้โมเดลหาจุดผิดพลาดและแก้ไขมัน พร้อมทั้งอธิบายสิ่งที่เปลี่ยนแปลง ใช้นี่เพื่อตรวจสอบพฤติกรรมการตรวจสอบของ Opus 5 และว่าโมเดลสามารถฟื้นกลับได้โดยไม่ต้องใช้คำสั่งจากมนุษย์หรือไม่

Task: Write a 6-step plan to extract entities from a 10,000 row CSV, then run a self-audit listing possible failure modes and patch the plan. If you find a problem, rewrite the affected step. Effort: max

คำคัดค้านที่เห็นได้ชัดคือข้อเรียกร้องของผู้จำหน่ายจะถูกพูดเกินจริงจนกว่าการทดสอบที่เป็นอิสระจะทำซ้ำพวกมัน นั่นเป็นความจริง ถือว่าในตัวเลขของ Anthropic เป็นการชี้นำ ทำการทดสอบซ้ำโดยใช้การทำงานเดียวกัน และกำหนดงบประมาณสำหรับงานโยกย้ายแทนที่จะสันนิษฐานถึงความเข้ากันได้ที่เปลี่ยนได้ทันที

ที่เกี่ยวข้อง

อ่านบทความอื่น ๆ

นำหน้าคนที่ชอบตามกระแส

ดูทั้งหมด
News

เครื่องแปลภาษาที่ใช้ AI ของ Google ทำงานแบบออฟไลน์ แสดงให้เห็นว่า AI สถานที่ท้องถิ่นทำอะไรได้บ้างโดยไม่ต้องเชื่อมต่อคลาวด์

ปัญญาประดิษฐ์ไม่จำเป็นต้องมีศูนย์ข้อมูลเพื่อให้มีประโยชน์ เครื่องทดลองล่าสุดของ Google กับ Gemma Translator เป็นเครื่องแปลเสียงขนาดเล็กที่สามารถทำได้โดยไม่ต้องเชื่อมต่ออินเทอร์เน็ต.

News

สุริยุปราคาเต็มดวงวันที่ 12 สิงหาคม 2026: เกิดอะไรขึ้นและสิ่งที่มันเปลี่ยนแปลงไป

สุริยุปราคาเต็มดวงวันที่ 12 สิงหาคม 2026 ได้มาถึงแล้วและผ่านพ้นไป ทำให้เกิดภาพที่น่าทึ่ง การสังเกตทางวิทยาศาสตร์ และคำบอกเล่าจำนวนมากจากผู้เห็นเหตุการณ์.

News

สุริยุปราคาทั้งหมด 12 สิงหาคม 2026: วิดีโอสด, เวลาที่เกิดและสถานที่รับชม

เงาของดวงจันทร์ข้ามกรีนแลนด์, ไอซ์แลนด์ และสเปนตอนเหนือในวันนี้, สุริยุปราคาทั้งหมดครั้งแรกในยุโรปนับตั้งแต่ปี 1999. รับชมวิดีโอสด, เวลาแน่นอน, เส้นทางการเกิดสุริยุปราคาและขอแนะนำในการมองดูอย่างปลอดภัย.

เทมเพลตสุดไวรัล

สำรวจเทมเพลต AI สุดไวรัลของเราแล้วนำไปใช้กับรูปของคุณ

สำรวจเทมเพลต
Anthropic Opus 5: ต้นทุนขององค์กร, ความปลอดภัย, การโยกย้าย