DeepSeek-ը Flash մոդելին ավելացրեց պատկերների մուտքագրում OpenAI-համատեղելի API-ով

DeepSeek-ի API փաստաթղթերն այժմ նկարագրում են պատկերների մուտքագրումը Flash մոդելում՝ base64, հանրային հղում կամ վերբեռնված ֆայլ։ Ինչ սահմանափակումներ կան և ինչ է սա նշանակում փոքր թիմերի համար։
Ի՞նչ տեղի ունեցավ
DeepSeek-ի API փաստաթղթերում այժմ նկարագրված է պատկերների ընդունումը Flash մոդելի համար։ Ծրագրավորողները կարող են տեքստի հետ ուղարկել լուսանկար և խնդրել մոդելին նկարագրել պատկերը, կարդալ տեքստը սքրինշոթից կամ վերլուծել գրաֆիկ։ Փորձարարական deepseek-v4-flash-vision-exp անվանումը դեռ ընդունվում է, սակայն այդ մոդելը հանվել է շահագործումից. հարցումները սպասարկում է ամենանոր Flash մոդելը։
Ինչպես են ուղարկվում պատկերները
Ինտերֆեյսը մնում է OpenAI-համատեղելի. պատկերները փոխանցվում են որպես բովանդակության բլոկներ Chat Completions-ի ստանդարտ ձևաչափով, նույն հնարավորությունը կա նաև Responses API-ում։ Երեք եղանակ կա՝ ներկառուցված base64 data URL, հանրային http(s) հղում, որը մոդելն ինքն է ներբեռնում, կամ Files API-ի file_id։
Աջակցվող ձևաչափերն են JPEG, PNG, GIF և WebP. տեսակը որոշվում է ֆայլի բովանդակությամբ, ոչ թե անվանումով։ Սահմանափակումները հստակ են՝ 48 MiB հարցման մարմին, հղումով պատկերի համար՝ 32 MiB և 60 վայրկյան ներբեռնման ժամանակ, վերբեռնված ֆայլի համար՝ 64 MiB։ system կամ assistant հաղորդագրության մեջ դրված պատկերը վերադարձնում է 400 սխալ։
Ինչու է դա կարևոր
Արագ ու էժան մակարդակում հասանելի տեսողական ունակությունը փոքր թիմերին թույլ է տալիս կառուցել չեկերի մշակում, սքրինշոթերի վրա հիմնված աջակցություն և գրաֆիկների ընթերցում՝ առանց երկրորդ մատակարարի։ Արևմտյան API-ների վրա ապրանքներ թողարկող ստուդիաների համար ևս մեկ OpenAI-համատեղելի ուղի նշանակում է ավելի պարզ պահուստային տարբերակ — և սովորական հիշեցում. պատկեր ուղարկելը օգտատիրոջ տվյալները տեղափոխում է ուրիշի սերվերներ։