คะแนน Benchmark ของ Grok 4.7: มันทำได้ดีกว่าโมเดลทั้งหมดหรือไม่?

Grok 4.7 ได้คะแนน 46 ในการวัดประสิทธิภาพ AA อยู่ในอันดับที่สี่ มีการปรับปรุงด้านการเขียนโค้ด แต่ค่าใช้จ่าย token เพิ่มขึ้น

22/09/2026 02:41อ่านประมาณ 9 นาที

SpaceXAI ได้เปิดตัว Grok 4.7 และการประเมินจากภายนอกจัดให้รุ่นนี้อยู่ในอันดับที่สี่ในกลุ่มห้องปฏิบัติการ AI ชั้นนำ

บริษัทวิเคราะห์มาตรฐาน Artificial Analysis ให้คะแนนโมเดลนี้ 46 ใน Intelligence Index ซึ่งสูงกว่า Grok 4.6 อยู่ 2 คะแนน อันดับที่สูงกว่าเป็นของ Claude Fable 5.1, GPT-6 Astra และ Claude Opus 5

Grok 4.7 ทำให้ SpaceXAI เข้าสู่สี่อันดับแรกของห้องปฏิบัติการ AI

ก่อนการเปิดตัว Elon Musk กล่าวว่า โมเดลนี้จะใช้ระบบพารามิเตอร์ 2.1 ล้านล้าน และเหนือกว่าโมเดลที่มีอยู่ทั้งหมด นอกจากนี้เขายังกล่าวว่ากระบวนการฝึกอบรมได้รวมข้อมูลจาก SpaceX

Grok 4.7 มาแล้ว

นี่คือการปรับปรุงที่โดดเด่นเหนือ Grok 4.6 ด้วยราคาและความเร็วเท่าเดิม pic.twitter.com/H3OTBbXyvO

— SpaceXAI (@SpaceXAI) 21 กันยายน 2026

สำหรับ AA-Briefcase ซึ่งเป็นมาตรวัดสำหรับงานอาชีพที่สมจริง Grok 4.7 ทำได้ 1657 Elo ซึ่งเพิ่มขึ้น 111 คะแนนจาก Grok 4.6 และทำให้โมเดลนี้มีประสิทธิภาพใกล้เคียงกับ Claude Opus 5

ในการประเมิน GDPval-AA โมเดลได้คะแนน 1695 Elo สูงกว่ารุ่นก่อนหน้า 90 คะแนน ผลการทดสอบการเขียนโค้ดก็มีแนวโน้มเพิ่มขึ้นเช่นเดียวกัน

เมื่อใช้ร่วมกับ Grok Build ซึ่งเป็นเอเจนต์การเขียนโค้ด Grok 4.7 ได้คะแนน 56 ใน Coding Agent Index สูงกว่า Grok 4.6 อยู่ 9 คะแนน

โมเดลนี้แซงหน้า GPT-5.6 Sol และตอนนี้ตามหลังเพียง Claude Fable 5.1 ของ Anthropic, GPT-6 Astra และ Opus 5

"Grok 4.7 ได้คะแนน 46 ใน Artificial Analysis Intelligence Index ทำให้ SpaceXAI เข้าสู่ 4 ห้องปฏิบัติการ AI ชั้นนำ ผลงาน Coding Agent Index ก็ดีขึ้นเช่นกัน แซงหน้า GPT-5.6 Sol" โพสต์ดังกล่าวอ่านว่า

ในด้านอื่นๆ ความคืบหน้าของโมเดลมีเพียงเล็กน้อย มันเพิ่มขึ้น 4.5 จุดเปอร์เซ็นต์ใน Terminal-Bench 4.0 และ 3 จุดใน GDP.pdf อย่างไรก็ตาม คะแนนลดลงในการทดสอบ AA-LCR และ AutomationBench-AA Grok 4.5 เคยเป็นอันดับหนึ่งใน AutomationBench ในเดือนกรกฎาคม ซึ่งสนับสนุนคำกล่าวอ้างของ Musk ที่ว่ามันเทียบเท่ากับ Claude Opus

การปรับปรุงมาพร้อมกับค่าใช้จ่าย Token

อัตราค่าบริการไม่เปลี่ยนแปลง Grok 4.7 ยังคงมีราคา $2 ต่อหนึ่งล้าน token รับเข้า และ $6 ต่อหนึ่งล้าน token ส่งออก Cache hits ยังคงมีส่วนลดที่ $0.50 และหน้าต่างบริบท 500,000 token ที่สืบทอดมาจาก Grok 4.6

อย่างไรก็ตาม โมเดลทำงานมากขึ้นอย่างมากต่อคำตอบ Artificial Analysis วัดจำนวน token ส่งออกประมาณ 81,000 ต่องาน Index เทียบกับ 36,000 สำหรับ Grok 4.6 และ 27,000 สำหรับ GPT-6 Astra ดังนั้น การกำหนดราคาต่อ token ที่คงที่ยังคงส่งผลให้ต้นทุนต่องานสูงขึ้น

ความอยาก token ดังกล่าวตกอยู่กับหน่วยงานที่รายงานผลขาดทุน 1.26 พันล้านดอลลาร์ ไปแล้ว ในขณะเดียวกัน Musk กล่าวเมื่อวันที่ 14 กันยายนว่า Grok 4.8 จะฝึกเสร็จภายในหนึ่งสัปดาห์

เขายังคาดหวังว่า Grok 5 จะเป็นโมเดลที่บรรลุปัญญาประดิษฐ์ทั่วไป การเปิดตัวครั้งต่อไปจะทดสอบว่า SpaceXAI สามารถไต่อันดับขึ้นไปได้โดยไม่ต้องมีค่าใช้จ่ายด้านการคำนวณเพิ่มเติมหรือไม่

แชร์ไปยัง

X (Twitter)Telegram

ข้อจำกัดความรับผิดชอบ: เนื้อหาในบทความนี้มาจากสื่อภายนอก ใช้เพื่อการอ้างอิงเท่านั้น และไม่ถือเป็นคำแนะนำการลงทุน คริปโตและผลิตภัณฑ์ทางการเงินอื่นมีความเสี่ยงจากความผันผวนของราคาสูง โปรดตัดสินใจอย่างรอบคอบ

บทความที่เกี่ยวข้อง

OpenAI และ Anthropic เปิดตัวโมเดล AI ราคาถูกลงท่ามกลางการถกเถียงเรื่องการชะลอตัว

Anthropic เปิดตัว Opus 5.5 และ OpenAI เปิดตัว GPT-6 Sol และ Luna ซึ่งทั้งสองมีราคาถูกลง หลังจากที่ซีอีโอของทั้งสองเรียกร้องให้ชะลอการพัฒนา AI

37 นาทีที่แล้วอ่านประมาณ 10 นาที

แนสแด็กปิดทำสถิติสูงสุด ขณะความหวังอิหร่านดันราคาน้ำมันดิบร่วง หนุนหุ้นเทคฯ

ดัชนี Nasdaq Composite และ Nasdaq 100 ปิดทำสถิติสูงสุด จากการที่ความหวังด้านการทูตกับอิหร่านกดราคาน้ำมัน ขณะที่ดาวโจนส์ร่วงและ S&P 500 ปิดทรงตัว

43 นาทีที่แล้วอ่านประมาณ 12 นาที

หุ้นยุโรปปิดบวกเล็กน้อย ขณะที่ความหวังสงครามเย็นลง

หุ้นยุโรปขยับขึ้นเล็กน้อย เนื่องจากความหวังที่จางลงเรื่องสันติภาพอิหร่านที่รวดเร็ว ชดเชยข่าวการโหลดน้ำมันของซาอุฯ ขณะที่อิตาลีและอังกฤษปิดลบ

5 ชั่วโมงที่แล้วอ่านประมาณ 2 นาที