
DeepSeek-V4-Flash יוצאת מהתצוגה המקדימה עם ביצועים חזקים יותר בסוכנים ותמיכה ב-Responses API
DeepSeek העבירה את ה-API של DeepSeek-V4-Flash לבטא ציבורית עם אותה ארכיטקטורה של התצוגה המקדימה ואימון מחדש בלבד, ובנוסף תמיכה מקורית בפורמט Responses API של OpenAI וב-Codex.
V4-Flash יוצאת מהתצוגה המקדימה
DeepSeek הוציאה את ה-API הרשמי של DeepSeek-V4-Flash בבטא ציבורית. אופן הקריאה לא השתנה: המפתחים משתמשים באותו endpoint ומגדירים את שם המודל deepseek-v4-flash. לפי יומן השינויים של החברה, נקודת השמירה ששוחררה — DeepSeek-V4-Flash-0731 — שומרת על אותה ארכיטקטורה וגודל כמו V4-Flash-Preview ועברה אימון מחדש בלבד, כך שהשיפור נובע מהאימון ולא מתכנון חדש.
את משפחת V4 חשפה החברה מוקדם יותר השנה בשתי דרגות, V4-Pro ו-V4-Flash, דרך ממשקי ChatCompletions של OpenAI ו-Anthropic. העדכון הנוכחי נוגע ל-Flash בלבד: לפי היומן, ה-API של V4-Pro ומודלי האפליקציה והאינטרנט לא השתנו, והשחרור הרשמי של V4-Pro יגיע בקרוב.
מדדי סוכנים וקוד
DeepSeek מפרסמת תוצאות במבחני סוכנים וקוד: Terminal Bench 2.1 — 82.7, NL2Repo — 54.2, CyberGym — 76.7, DeepSWE — 54.4, Toolathlon Verified — 70.3, Agents' Last Exam — 25.2 ו-Automation Bench (Public) — 25.1. במערכי הבדיקה הפנימיים החברה מדווחת על DSBench-FullStack 68.7 ו-DSBench-Hard 59.6.
החברה מציינת שמשימות Code Agent במערכי המבחן הציבוריים הורצו במצב המינימלי של DeepSeek Harness — תשתית שלפי החברה תשוחרר בקרוב — ברמת המאמץ המקסימלית, עם top_p 0.95 ו-temperature 1.0. DSBench-FullStack הוא מערך פנימי לפיתוח full-stack ו-DSBench-Hard מערך פנימי לבעיות קידוד קשות, כך ששניהם נתונים מדיווח עצמי.
תמיכה ב-Responses API וב-Codex
ה-API תומך כעת באופן מקורי בפורמט Responses API של OpenAI ומותאם במיוחד ל-Codex, עם סקריפט תצורה בקליק אחד בתיעוד. לפי DeepSeek, התוצאות עולות בהרבה על V4-Pro-Preview במבחני סוכנים — טענה שמקורה, כמו הטבלה שלעיל, בהרצה של החברה עצמה.
SiTech — פיתוח אתרים בכוח ה-AI
אנחנו בונים אתרים מהירים ומודרניים ומשלבים AI בתהליכי עבודה אמיתיים. יש לכם פרויקט או שאלה? נשמח לעזור.