
מחיר GPT-5.6 Sol ב-OpenRouter ירד ב-50%
בעמוד הדגם של GPT-5.6 Sol ב-OpenRouter מופיעה כעת הנחה של 50%: 2 דולר למיליון טוקנים בקלט ו-10 דולר למיליון טוקנים בפלט. ההנחה חלה על נקודות הקצה הסטנדרטית, Fast ו-Flex של OpenAI.
בעמוד הדגם openai/gpt-5.6-sol באתר OpenRouter מוצגת כעת הנחה של 50% בנקודות הקצה של OpenAI עצמה. בתעריף המוצג בראש העמוד כתוב 2 דולר למיליון טוקנים בקלט ו-10 דולר למיליון טוקנים בפלט — זה המחיר של נקודת הקצה הסטנדרטית של OpenAI לאחר ההנחה.
אילו נקודות קצה הוזלו
על פי טבלת הספקים, נקודת הקצה הסטנדרטית של OpenAI הציגה לפני ההורדה 4 דולר לקלט ו-20 דולר לפלט למיליון טוקנים, וכעת 2 ו-10 דולר. OpenAI Fast, האפשרות בעלת ההשהיה הנמוכה ביותר, ירדה מ-8/40 דולר ל-4/20 דולר, ו-OpenAI Flex ירדה מ-2/10 דולר ל-1/5 דולר. בשורות של Azure ו-Amazon Bedrock לא נראית הנחה: Azure גובה 5/30 דולר, Azure בארה"ב ובאיחוד האירופי — 5.50/33 דולר, ו-Amazon Bedrock בארה"ב — 4.40/22 דולר למיליון טוקנים.
כמה משלמים המשתמשים בפועל
OpenRouter מציג גם מחיר ממוצע משוקלל, שמשקף את מה שלקוחות משלמים למעשה ולא את המחיר הרשמי. נכון לעכשיו הוא עומד על 0.6271 דולר למיליון טוקנים בקלט ו-14.96 דולר למיליון טוקנים בפלט. את הפער מסבירה בעיקר שמירת מטמון: נקודת הקצה של OpenAI מרוכזת בה 83% מהתעבורה בעמוד, ושיעור הפגיעות במטמון מגיע ל-91.5%, מה שמוריד את מחיר הקלט האפקטיבי ל-0.4625 דולר למיליון טוקנים. לאחר ההנחה, קריאה מהמטמון עולה 0.20 דולר למיליון טוקנים בנקודה הסטנדרטית, 0.40 דולר ב-Fast ו-0.10 דולר ב-Flex.
מה מציע הדגם
GPT-5.6 Sol הוא דגם הדגל של סדרת GPT-5.6 של OpenAI. לפי OpenRouter הוא מתאים לחשיבה מורכבת, לקוד ולזרימות עבודה של סוכנים, וחזק במיוחד במשימות של שורת פקודה, קוד רב-שלבי ופתרון בעיות לאורך זמן. חלון ההקשר שלו עומד על 1.1 מיליון טוקנים, והוא שוחרר ב-9 ביולי 2026. אפשר לנתב בקשות בשלושה מצבים: Balanced (מחיר ומהירות), Nitro (הספק המהיר ביותר) ו-Exacto (הדיוק הגבוה ביותר בקריאה לכלים).
למה זה חשוב
הורדה של 50% מגיעה דווקא בתקופה שבה משימות סוכנים ארוכות הופכות את הוצאת הטוקנים לסעיף המרכזי בתקציב של צוותים שעובדים על דגמים מתארחים. הפער בין נקודת הקצה המהירה לסטנדרטית הוא כעת פי שניים, אף ש-Fast מציעה גם את ההשהיה הנמוכה ביותר בעמוד — 2.62 שניות — ואת התפוקה הגבוהה ביותר — 70 טוקנים בשנייה. Flex היא הזולה ביותר, אך עם השהיה של 13.14 שניות וזמינות של 88.21%, בעוד נקודת הקצה הסטנדרטית של OpenAI מדווחת על 99.43%.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.