Skip to content
โมเดลและงานวิจัย

Upstage เปิดตัว Solar Pro 4 สำหรับงานเอเจนต์แบบหลายขั้นตอน

Solar Pro 4 supports tool use, terminal tasks and long-document reasoning, with a 512K-token context window and multilingual input and output.

โดย DigitalNeuron Deskอ่าน 1 นาที

คำตอบโดยย่อ

Upstage ประกาศอะไรพร้อมกับ Solar Pro 4?

Upstage launched Solar Pro 4, an API-accessible model designed for multi-step agent work involving documents, tools and terminal tasks. The company says it supports a 512K-token context window, produces up to 128K output tokens, handles English, Korean and Japanese, and reports when supplied evidence cannot support an answer.

ประเด็นสำคัญ

  • Upstage says Solar Pro 4 is designed to complete multi-step work across documents, tools and terminal environments.
  • โมเดลนี้รองรับหน้าต่างบริบทขนาด 512K โทเค็น การสร้างผลลัพธ์สูงสุด 128K โทเค็น รวมถึงการรับข้อมูลเข้าและแสดงผลเป็นภาษาอังกฤษ ภาษาเกาหลี และภาษาญี่ปุ่น
  • Upstage lists standard API pricing of $0.30 per million input tokens, $0.06 per million cached input tokens and $1.20 per million output tokens.
  • Solar Pro 4 พร้อมใช้งานผ่าน Upstage Console, SolarChat, OpenRouter, Hermes Agent และ Upstage Studio อีกทั้งยังมีบริการติดตั้งใช้งานแบบเฉพาะองค์กรและภายในสถานที่ขององค์กรด้วย
  • The company says the model identifies unsupported claims and discrepancies rather than supplying unverified answers.

Upstage เปิดตัว Solar Pro 4 โมเดลภาษาแบบเอเจนต์ที่สร้างขึ้นสำหรับงานซึ่งครอบคลุมเอกสารหลายฉบับ การเรียกใช้เครื่องมือ และงานผ่านเทอร์มินัล บริษัทระบุว่าโมเดลนี้ได้รับการออกแบบให้ดำเนินงานที่ได้รับมอบหมายจนเสร็จสมบูรณ์เป็นชิ้นงาน พร้อมทั้งระบุกรณีที่หลักฐานที่มีอยู่ไม่เพียงพอจะรองรับคำตอบ

Solar Pro 4 รองรับหน้าต่างบริบทขนาด 512K โทเค็น และสร้างผลลัพธ์ได้สูงสุด 128K โทเค็น โดยรองรับภาษาอังกฤษ เกาหลี และญี่ปุ่น ทั้งสำหรับข้อมูลนำเข้าและผลลัพธ์ ผู้ใช้ยังปรับระดับการใช้เหตุผลได้ โดยเพิ่มระดับเพื่อการวิเคราะห์ที่ลึกขึ้น หรือลดระดับเพื่อการโต้ตอบที่รวดเร็วขึ้น

งานเอเจนต์และงานเอกสาร

Upstage รายงานว่า Solar Pro 4 ได้คะแนน 57.0 ใน Terminal-Bench v2.1, 23.0 ใน τ³-Banking และ 71.0 ใน AA-LCR บริษัทระบุว่าการประเมินเหล่านี้วัดความสามารถด้านการดำเนินงานผ่านเทอร์มินัล การใช้เครื่องมือในการโต้ตอบหลายรอบ และการใช้เหตุผลกับเอกสารขนาดยาวตามลำดับ พร้อมระบุว่าคะแนนทั้งสามมาจาก Artificial Analysis ณ เดือนสิงหาคม 2026 และจะมีการเผยแพร่รายการต่อสาธารณะในภายหลัง

บริษัทระบุว่า Solar Pro 4 ได้รับการฝึกด้วย OfficeVerse ซึ่งเป็นกระบวนการของบริษัทสำหรับสังเคราะห์งานสำนักงานจากข้อมูลสาธารณะ ครอบคลุม 11 ภาคอุตสาหกรรมและงาน 12 ประเภท โดยงานแต่ละชิ้นจะได้รับการประเมินว่าผ่านหรือไม่ผ่านจากผลงานขั้นสุดท้าย Upstage ระบุว่า Ko-GDPval ซึ่งเป็นเกณฑ์มาตรฐานสำหรับงานสำนักงานภาษาเกาหลีของบริษัท ก็พัฒนาขึ้นจากโครงการเดียวกัน

เพื่อสาธิตการทำงานของโมเดล Upstage ได้มอบหมายโจทย์สมมติเกี่ยวกับการเลือกทำเลร้านค้า ซึ่งประกอบด้วยเอกสารนโยบายหนึ่งฉบับและไฟล์ข้อมูลตลาดหกไฟล์ บริษัทระบุว่าได้ใช้พรอมต์สามรายการสั่งให้ Solar Pro 4 คัดกรองทำเลที่เป็นตัวเลือก 10 แห่ง แล้วจัดทำสมุดงาน Excel รายงานการตรวจสอบ และชุดสไลด์ตามลำดับ Upstage ระบุว่าค่าที่คำนวณในสมุดงานถูกนำไปใช้ในรายงานโดยไม่มีการเปลี่ยนแปลง

Upstage ยังเปิดตัวเอเจนต์สำหรับงานเจ็ดรายการผ่าน Solar Pro 4 Agent Cookbook ตัวอย่างเหล่านี้ครอบคลุมการสร้างสมุดงาน Excel รายงาน Word ที่อ้างอิงหลักฐาน และงานนำเสนอ PowerPoint พร้อมแผนภูมิและบันทึกสำหรับผู้นำเสนอ แต่ละตัวอย่างมีพรอมต์ระบบ ผลลัพธ์ และเกณฑ์การผ่าน

การจัดการหลักฐาน

Upstage ระบุว่า Solar Pro 4 สามารถแยกแยะได้ว่าคำตอบใดมีข้อมูลรองรับ และกรณีใดมีข้อมูลขาดหายหรือขัดแย้งกัน ในการทดสอบโดยใช้ข้อตกลงการให้บริการและใบเสนอราคาสมมติ บริษัทได้ตั้งคำถาม 10 ข้อ โดยครึ่งหนึ่งมีคำตอบอยู่ในเอกสารที่ให้มา บริษัทระบุว่าโมเดลอ้างอิงข้อกำหนดที่มีอยู่ ระบุว่าเนื้อหาที่ไม่พบไม่ได้อยู่ในเอกสาร และรายงานตัวเลขที่แตกต่างกันว่าไม่ตรงกัน

Cookbook ยังมีเอเจนต์สำหรับการวิจัย ซึ่ง Upstage ระบุว่าสามารถเชื่อมโยงทุกประโยคเข้ากับแหล่งข้อมูล และติดป้ายกำกับเนื้อหาที่ไม่สามารถหาแหล่งยืนยันได้ว่าไม่ได้รับการตรวจสอบ

การเข้าถึงและราคา

Solar Pro 4 พร้อมให้ใช้งานผ่าน Upstage Console API ภายใต้ชื่อโมเดล solar-pro4 โดย Upstage ระบุว่า API นี้เข้ากันได้กับ OpenAI นอกจากนี้ โมเดลยังให้บริการผ่าน SolarChat, OpenRouter, Hermes Agent และ Upstage Studio ส่วนการติดตั้งใช้งานแบบเฉพาะองค์กรและภายในสถานที่ขององค์กร สามารถติดต่อบริษัทได้โดยตรง

Upstage กำหนดราคาต่อหนึ่งล้านโทเค็นไว้ที่ 0.30 ดอลลาร์สำหรับข้อมูลนำเข้า 0.06 ดอลลาร์สำหรับข้อมูลนำเข้าที่แคชไว้ และ 1.20 ดอลลาร์สำหรับผลลัพธ์ บริษัทประกาศส่วนลด 90% สำหรับ Upstage Console จนถึงวันที่ 10 กันยายน เวลา 23:59 น. UTC และระบุด้วยว่าโปรโมชันลดราคา 90% บน OpenRouter จะมีถึงวันที่ 10 กันยายน ส่วนข้อเสนอแยกต่างหากสำหรับ Hermes Agent จะมีถึงวันที่ 15 กันยายน

แหล่งที่มา: ประกาศ “Solar Pro 4: The Agentic Model That Finishes the Job” ของ Upstage เผยแพร่เมื่อวันที่ 11 สิงหาคม 2026

คำถามที่พบบ่อย

Solar Pro 4 ออกแบบมาเพื่อทำอะไร?
Upstage describes Solar Pro 4 as an agentic model for multi-step work involving tool calls, terminal tasks and reasoning across long documents.
Solar Pro 4 รองรับขนาดบริบทและขีดจำกัดเอาต์พุตเท่าใด
The company says the model supports a 512K-token context window and up to 128K output tokens.
Solar Pro 4 รองรับภาษาใดบ้าง?
Upstage says Solar Pro 4 accepts and generates English, Korean and Japanese.
ลูกค้าสามารถเข้าใช้งาน Solar Pro 4 ได้อย่างไร?
Upstage lists access through its Console API, SolarChat, OpenRouter, Hermes Agent and Upstage Studio. It also offers dedicated and on-premises deployment.

แหล่งข้อมูล

  1. Solar Pro 4: The Agentic Model That Finishes the JobUpstage
แท็กupstagesolar-pro-4agentic-ailanguage-modelstool-usemultilingual-ai

อ่านเพิ่มเติม

แอนโทรปิกเผยวิธีที่ห้องปฏิบัติการวิจัยสร้างเอเจนต์วิทยาศาสตร์ที่ขับเคลื่อนด้วยโคลด

แอนโทรปิกเผยแพร่กรณีศึกษาเมื่อวันที่ 15 ม.ค. 2026 โดยอธิบายถึงห้องปฏิบัติการวิจัยสามแห่ง ได้แก่ โครงการไบออมนีของสแตนฟอร์ด ห้องปฏิบัติการชีสแมนของเอ็มไอที และห้องปฏิบัติการลุนด์เบิร์กของสแตนฟอร์ด ซึ่งสร้างระบบที่ขับเคลื่อนด้วยโคลดสำหรับงานต่าง ๆ เช่น การตีความกลุ่มยีน การวิเคราะห์ข้อมูลชีวการแพทย์ และการเลือกยีนที่จะนำไปศึกษาด้วยการทดลอง

อ่าน 8 นาที

Anthropic เผยแพร่รายงาน Economic Index ฉบับที่สอง ว่าด้วยการใช้งาน Claude 3.7 Sonnet

รายงาน Economic Index ฉบับที่สองของ Anthropic พบว่าการใช้งาน Claude.ai ในด้านการเขียนโค้ด การศึกษา วิทยาศาสตร์ และสาธารณสุข เพิ่มขึ้นหลังการเปิดตัว Claude 3.7 Sonnet โดยโหมดคิดแบบขยายความถูกใช้มากที่สุดในสายอาชีพด้านเทคนิค ขณะที่สัดส่วนการใช้งานแบบเสริมศักยภาพ (augmentation) ยังคงทรงตัวอยู่ที่ 57% และ Anthropic ยังเผยแพร่ระบบจัดหมวดหมู่การใช้งานใหม่ 630 หมวด พร้อมข้อมูลการทำงานอัตโนมัติในระดับงานย่อยด้วย

อ่าน 8 นาที

บทวิเคราะห์: เมื่อเกณฑ์มาตรฐานสาธารณะไม่อาจทำนายคุณภาพในการใช้งานจริงได้อีกต่อไป — วิธีสร้างชุดประเมินที่ทำได้

เกณฑ์มาตรฐานสาธารณะวัดงานที่มีขอบเขตแคบ ตายตัว และเผยแพร่อย่างแพร่หลาย อีกทั้งยังปนเปื้อนอยู่ในข้อมูลฝึกสอนมากขึ้นเรื่อย ๆ และถูกใช้เป็นเป้าหมายในการปรับโมเดลโดยตรง แต่คุณภาพในการใช้งานจริงขึ้นอยู่กับพรอมป์ของคุณ เอกสารของคุณ สคีมาของเครื่องมือ และระดับความผิดพลาดที่คุณยอมรับได้ ซึ่งไม่มีตารางจัดอันดับใดวัดได้ คำตอบที่ใช้ได้จริงคือชุดประเมินส่วนตัวที่ประกอบด้วยกรณีจริง 50 ถึง 300 กรณี พร้อมบันทึกพฤติกรรมที่คาดหวัง นำมาทดสอบทุกครั้งที่เปลี่ยนโมเดลหรือพรอมป์ โดยให้คะแนนด้วยการตรวจสอบแบบตรงตัวเมื่อทำได้ และใช้โมเดลผู้ตัดสินตามเกณฑ์การให้คะแนนเมื่อทำไม่ได้

อ่าน 15 นาที