mimile
Басты бетке

DeepSeek V4-Flash-Vision-Exp эксперименттік мультимодальды моделін шығарды

ЖИ-дайджест

Материал бірнеше дереккөз негізінде жасанды интеллектпен дайындалды — түпнұсқаларға сілтемелер төменде.

DeepSeek V4-Flash-Vision-Exp эксперименттік мультимодальды моделін шығарды

Қытайлық DeepSeek жасанды интеллект компаниясы мәтіндік мүмкіндіктерге кескін түсінуді қосқан V4-Flash-Vision-Exp эксперименттік мультимодальды моделін шығарды. DeepSeek-тің ішкі бенчмарктері бойынша модель агенттік тапсырмаларда Opus 4.8-ден дерлік қалыспайды. Релиз визуалды агенттік сценарийлерге бағытталған, OpenAI және Anthropic API қолдауымен және жаңа тегін Files API-мен.

Негізгі фактілер

  • DeepSeek V4-Flash-Vision-Exp эксперименттік мультимодальды моделін шығарды, ол V4-Flash-ты кескін өңдеумен кеңейтеді.
  • DeepSeek-тің ішкі мультимодальды агенттік бенчмарктері бойынша модель Opus 4.8-ден дерлік қалыспайды.
  • Модель JPEG, PNG, GIF және WebP форматтарын қолдайды және форматты файл атауы немесе MIME-типі бойынша емес, мазмұны бойынша анықтайды.
  • Бір сұрау 600-ге дейін кескінді қамтуы мүмкін, жақтың максималды ұзындығы — 8 192 пиксель, 15 және одан көп кескінде 4 096 пиксельге дейін төмендейді.
  • Әрбір кескін 384 токеннен аспайды, тарифтеу V4-Flash ставкаларына сәйкес келеді.

Модель мүмкіндіктері

DeepSeek-V4-Flash-Vision-Exp DeepSeek-V4-Flash-ты кескін өңдеумен кеңейтеді, базалық модельдің пайымдау мен әлем туралы білімдегі мәтіндік өнімділігін сақтайды, деп мәлімдейді DeepSeek. Модель әртүрлі агенттік фреймворктармен жұмыс істеуге арналған және визуалды түсінуді құралдарды пайдаланумен біріктіреді. Іс жүзінде ол кескіндерді сипаттай алады, скриншоттардан мәтінді шығара алады және диаграммаларды талдай алады. JPEG, PNG, GIF және WebP форматтары қолдау табады, формат файл атауы немесе мәлімделген MIME-типі бойынша емес, нақты мазмұны бойынша анықталады, API құжаттамасына сәйкес.

API интеграциясы және бағалар

Модель OpenAI-дің Chat Completions және Responses API-лерімен және Anthropic-тің Messages эндпоинтімен үйлесімді. DeepSeek сонымен қатар жаңа модельді қораптан тыс қолдайтын Harness фреймворкінің 0.1.1 нұсқасын шығарды. Әзірлеушілер кескіндерді Base64, 32 МиБ-қа дейінгі ашық URL немесе 64 МиБ лимиті бар жаңа тегін Files API арқылы жібере алады. Қосымша detail өрісі кескіндерді 512 x 512 пиксельге дейін кішірейтеді, жоғары детализация қажет болмағанда токендерді үнемдейді. Өңдеу алдында модель кескіндерді арақатынасына байланысты шамамен 800 x 800 пиксельге дейін автоматты түрде қалыпқа келтіреді, әрбір кескін 384 токеннен аспайды.

1 дереккөз

DeepSeek V4-Flash-Vision-Exp эксперименттік мультимодальды моделін шығарды