Дипсик умеет смотреть на картинки, но не умеет их делать. С 29 апреля 2026 года в чате раскатывают отдельный режим распознавания изображений: загружаете фото и спрашиваете, что на нём. А сгенерировать снимок или отредактировать ваш нельзя ни в браузере, ни в приложении, ни через API — такой функции у сервиса нет вообще. Ниже — как отдать фото правильной кнопкой, что с ним реально получится, почему у половины людей загрузка отваливается и куда идти с задачей, которую дипсик не берёт.

Скрепка и режим распознавания — это два разных входа

Главная путаница темы в том, что картинку в дипсик можно отдать двумя способами, и они делают совершенно разное.

Скрепка (в приложении — плюс рядом с полем ввода). Это загрузка файлов, и подпись у неё честная: извлечение текста. Интерфейс сам называет рамки — до 50 файлов, каждый до 100 МБ. Кидаете сюда PDF, docx, txt или фотографию — сервис вытаскивает буквы, которые смог прочитать, а остальное игнорирует. Схему он тут не поймёт, кто на снимке — не скажет, разметку таблицы уронит.

Режим распознавания изображений. Отдельная кнопка в верхней части чата, рядом с быстрым и экспертным режимами. Здесь сеть смотрит на картинку целиком: объекты, интерфейс, график, сцену, а не только надписи. Раскатку начали 29 апреля 2026 года на части аккаунтов, 9 мая режим ушёл шире, а к 19 июня о нём писали уже как о работающей функции веб-версии и приложения.

Отсюда и половина жалоб. Человек находит гайд, написанный в январе 2026-го, — а таких в выдаче большинство, — прикрепляет фото скрепкой и получает пересказ подписей вместо разбора. Вывод: дипсик картинки не понимает. Понимает. Просто не через ту кнопку.

Как загрузить фото: телефон и браузер

  1. Откройте новый чат. Не догружайте фото в диалог, где вы час обсуждали текст: старый контекст тянет ответ к прошлой теме.
  2. Посмотрите на верх окна: есть кнопка режима распознавания — включайте, это правильный вход. Нет кнопки — работаем скрепкой и ждём от сети только текст.
  3. В браузере жмите скрепку слева от поля ввода, в приложении — плюс, дальше в меню «Фото» или «Файл».
  4. Дождитесь, пока превью догрузится полностью. Сообщение, отправленное на середине полоски, уходит без вложения — сеть отвечает по одному тексту и выглядит так, будто фото проигнорировала.
  5. Вопрос пишите в том же сообщении, а не следующим. Фото без вопроса даёт общее описание, которое почти никогда не то, что нужно.

Отдельно про поиск. Веб-поиск и загрузку файла в одном сообщении соединить не выходит: по описаниям интерфейса это взаимоисключающие кнопки. То есть «посмотри мой скан и сверь цены с магазинами» одним ходом не сработает — сначала разбираем картинку, потом отдельным сообщением включаем поиск и даём готовый текст.

Что дипсик с фото делает хорошо

Список короткий, зато честный. Всё, что ниже, — про чтение и разбор, не про изменение.

  • Печатный текст со снимка. Инструкция к стиральной машине, страница учебника, состав на упаковке, скан договора. Ровный шрифт при нормальном свете переносится почти без потерь.
  • Скриншот интерфейса и окно ошибки. Коллега прислал в мессенджере скрин с красной строкой из 1С — режим распознавания прочитает текст ошибки и предположит, куда смотреть.
  • График и диаграмма. Оси, подписи, единицы, направление тренда. Дальше можно спросить, какой вывод из графика делать нельзя — тут работает уже текстовая сильная сторона сети.
  • Схема и таблица. Структуру переносит, но цифры проверяйте глазами: перескок строки при переносе таблицы — самая частая тихая ошибка у всех сетей, не только у этой.
  • Задание по фото разворота. Обведённый ручкой номер сеть находит и разбирает, если в кадре не пять заданий сразу.

Полезный нюанс: в режиме распознавания глубокое размышление можно выключить и включить. Без него ответ приходит почти мгновенно — это режим «прочитай, что тут написано». С размышлением сеть думает дольше, зато заметно лучше держит пространственную логику: что где расположено, что к чему подключено, какая деталь чем перекрыта.

Почему фото не загружается: разбор причин

Сначала снимем главный миф: дело не в тарифе. У потребительского чата дипсика платной подписки не существует — ни Plus, ни Pro, ни лимитов «для бесплатных». Платный у компании только API для разработчиков. Поэтому статьи, где расписано «10 МБ на бесплатном и 50 МБ на Pro», описывают тарифы, которых нет. Единственные цифры, которые сервис называет о себе сам, — те 50 файлов по 100 МБ в подписи у скрепки.

  • Режима распознавания у вас пока нет. Раскатка шла волнами, часть пользователей видела сообщение о временной недоступности режима. Включить его руками нельзя: нет кнопки — значит, доступно только извлечение текста.
  • Формат. Уверенно проходят JPG и PNG. BMP и TIFF отваливаются. Отдельная ловушка у владельцев iPhone: телефон по умолчанию снимает в HEIC. В настройках камеры переключите форматы на «Наиболее совместимые» — и снимки пойдут в JPEG.
  • Размер. Подпись обещает 100 МБ, но тяжёлые файлы часто отваливаются молча: полоска дошла до конца, вложение не прикрепилось. Практика проще заявленного лимита — сжимайте до нескольких мегабайт. Кадр с телефона обычно и так весит 2–4 МБ, а вот скан разворота в 600 dpi лучше пересохранить.
  • Сервер занят. Классика дипсика, и починить это со своей стороны нельзя. Сервис китайский, разница с Москвой пять часов: китайский рабочий день — это наше раннее утро и первая половина дня. Наш вечер приходится на китайскую ночь, и по нашему опыту в это время загрузка проходит спокойнее. Гарантии нет, но проверить дешевле, чем чинить то, что не сломано.
  • Кривой скан или размытый кадр. Документ, снятый с наклоном и с бликом от лампы, даёт обрывочный результат. То же с фотографией экрана: муар съедает буквы, и сеть либо молчит, либо додумывает.
  • Расширения браузера. Блокировщики и приватные расширения иногда рубят сам запрос на загрузку. Проверка на минуту: приватное окно, где расширения выключены.

И немного истории, которая до сих пор портит выдачу. В феврале 2025 года дипсик разом отключил обработку PDF и картинок на волне наплыва пользователей — на вопрос «почему» сервис отвечал, что возможности его текущей версии ограничены. Функция потом вернулась, а статьи «дипсик больше не умеет файлы» остались и продолжают собирать людей, которые верят, что тут ничего не работает.

Генерации картинок в дипсике нет

Прямо и без «пока»: попросить дипсик нарисовать картинку или переделать вашу нельзя. Нет кнопки, нет скрытого режима, нет промта-отмычки. Всё, что сеть делает с изображением, — смотрит на него и рассказывает словами.

Путаницу создаёт то, что у самой компании модель для картинок есть. В январе 2025 года DeepSeek выложила Janus-Pro — открытые веса, которые тогда сравнивали с DALL·E 3 по бенчмаркам генерации. Но это именно веса на Hugging Face: их надо запускать самому или искать чужой веб-интерфейс, где кто-то уже поднял модель. В приложении и на сайте дипсика её нет, и потрогать её оттуда невозможно.

Так что если вы пришли за «сделай мне фото» — инструмент не тот. Не потому, что плохой: дипсик про текст, код и логику, и в этом он силён, что видно по сравнению в статье ChatGPT против DeepSeek. Картинки — не его специальность.

Если задача не «прочитать», а «сделать»

Разложим по тому, что люди обычно хотят от фотографии, и куда с этим идти. Ссылки ведут на наши карточки — там промт целиком, с примером результата.

  • Вытащить текст, включая рукопись. Печатное дипсик читает, на почерке плывёт. Письмо от бабушки или старую метрику отдавайте в Gemini: карточка расшифровки рукописного текста по фото расшифровывает построчно, честно ставит «неразборчиво» вместо догадки и в конце советует, как переснять спорную страницу.
  • Разобрать скриншот или окно ошибки. Готовая карточка разбора скриншота и графика для Kimi: перечисляет элементы и цифры, называет вероятную причину ошибки и прямо говорит, что на картинке нечитаемо.
  • Перенести таблицу с фото в таблицу. Карточка скриншот таблицы в markdown и CSV отдаёт данные двумя форматами, ставит вопросительные знаки на смазанные ячейки и считает контрольную сумму по денежной колонке — так проверка занимает минуту, а не полчаса.
  • Убрать или заменить фон. Дипсик файл не вернёт вообще. Карточка замены фона на фото в Gemini отдельно проговаривает места, где рвётся вырезка: пряди волос, дужки очков, пар, тень под предметом.
  • Фото товара для объявления. Карточка предметного фото для объявления в Qwen: чистый фон, мягкая тень, а сам товар перерисовывать запрещено — потёртости и швы остаются, покупатель видит реальное состояние.
  • Портрет под резюме из селфи. Карточка делового портрета из селфи держит главное правило: лицо остаётся тем же, убирается только временное — блеск, воспаление, катышки на воротнике. Родинки и седина остаются.
  • Восстановить старый снимок. Карточка реставрации старого фото в Qwen требует сохранить плёночное зерно и не додумывать утраченные черты лица: вылизанное до пластика фото сразу читается как подделка.
  • Домашка по фото задания. Карточка разбора домашки по фото написана для родителя: решает школьным способом того класса, даёт три наводящих вопроса ребёнку и полное решение отдельно, для самопроверки.

Два промта разверните прямо здесь. Первый — если текст с фото нужен, а дипсик на почерке спёкся.

Промт: Расшифровка рукописного текста по фото в Gemini
Разбери рукопись: письмо, дневник, метрику, врачебное назначение. Работай только с тем, что видно на загруженном изображении.

Что на фото: [ЧТО НА ФОТО: письмо от бабушки, чернила, примерно конец 1940-х, одна страница]
Язык: [ЯЗЫК: русский]
Что важнее всего: [ГЛАВНОЕ: имена, даты и названия городов]

Главное правило: не угадывай ради связности. Правдоподобная выдумка хуже пропуска. Не читается буква или слово — ставь [неразборчиво] или [возможно: вариант 1 / вариант 2] и иди дальше.

Порядок:
1. Оцени снимок: резкость, засветы, тени, обрезанные края. Если не разобрать больше половины — скажи сразу и не расшифровывай.
2. Построчная расшифровка с авторской орфографией, пунктуацией и сокращениями. Разбивку на строки оставь как в оригинале.
3. Та же запись современным языком: сокращения раскрыты, формулировки понятные.
4. Что видно помимо текста: тип документа, примерная датировка, чем писали, штампы, номера, пометки другой рукой.
5. Спорные места списком: фрагмент, твои варианты, почему сомневаешься.
6. Совет по пересъёмке: что именно снять заново и как — свет сбоку от окна, без вспышки, кадр по краю страницы.

Чего не делаешь: не дополняешь пропущенное по смыслу; не переводишь на другой язык без просьбы; если это врачебное назначение — разбираешь только написание слов и цифр как текст, а толкований, аналогов и советов по приёму не даёшь, с ними человек идёт к врачу или в аптеку.

В конце задай один вопрос: какие имена, фамилии или места мне известны заранее. С этими подсказками перечитаешь спорные места.

Открыть карточку: пример результата и разбор

Второй — под самую частую картиночную задачу, которую дипсик не берёт совсем: подготовить снимок товара к публикации.

Промт: Предметное фото для объявления в Qwen: чистый фон за минуту
Обработай фото товара для объявления. Фон замени на [ФОН: светло-серый градиент], тени под предметом оставь мягкие и естественные — товар не должен «висеть в воздухе». Сам предмет не перерисовывай: логотипы, швы, фактуру и потёртости сохрани как на исходнике, покупатель должен видеть реальное состояние. Свет выровняй без пересветов, цвет товара не сдвигай. Кадрируй по центру с полями [ПОЛЯ: около 10% с каждой стороны]. Без надписей, без водяных знаков, без декора. Результат: квадрат 1:1 для [ПЛОЩАДКА: Авито].

Открыть карточку: пример результата и разбор

Целые подборки под работу со своим фото: промты для Gemini, промты для Qwen, промты для Шедеврума. Если хочется читать не список, а разбор: обработка фото в Qwen и промты для фото в Gemini.

Чего дипсик с фото не умеет — без утешений

  • Не узнаёт людей в лицо. Показательный провал: журналисты подсунули режиму распознавания известное фото основателя DeepSeek Лян Вэньфэна — сеть назвала трёх других китайских публичных людей, включая главу Xiaomi. Лэй Цзюня отдельным снимком опознала спокойно, а собственного создателя нет: фотографий человека, который почти не появляется на публике, в обучающих данных слишком мало.
  • Не редактирует. Заменить фон, подтянуть свет, обрезать под квадрат, убрать лишнего человека из кадра — этого нет ни в каком виде. На выходе всегда текст, не файл.
  • Рукописное читает плохо. Аккуратный почерк ещё вытянет, скоропись или врачебное назначение — нет. И толковать назначение сеть не должна: с расшифровкой лекарства идите к врачу или в аптеку.
  • Не сохраняет вёрстку. PDF со сложной вёрсткой, плотными таблицами и врезками превращается в поток текста, где порядок блоков потерян. Многоколоночный документ читайте по частям, страницами.
  • Не берёт файлы под паролем. Защиту снимайте заранее, иначе просто потеряете время на загрузку.
  • Не даёт гарантий по данным. Всё уходит на серверы в Китае. Медкарту, паспорт, договор под NDA лучше не загружать — как и в любую другую чужую нейросеть. Если вопрос для вас принципиальный, уточните у своего юриста, какие документы вообще можно передавать сторонним сервисам.

Через API картинку не отправить

Для разработчиков ситуация однозначная. У моделей deepseek-v4-pro (сборка V4-Pro-0813, общедоступна с 13 августа 2026) и deepseek-v4-flash (сборка V4-Flash-0731) в документации нет ни vision, ни типа контента с изображением: заявлены JSON-вывод, вызов инструментов, Responses API и совместимость с интерфейсом Anthropic. Контекст у обеих — миллион токенов, но только текстовых.

Ещё два факта, которые ломают старые интеграции. Прежние имена deepseek-chat и deepseek-reasoner отключены 24 июля 2026 года — предупреждение вышло 24 апреля, с трёхмесячным запасом, но по чужим готовым скриптам эти имена всё ещё кочуют. И с 16 августа 2026 у API появились пиковые и непиковые часы: вне пика ставка вдвое ниже пиковой.

Практический вывод: распознавание картинок живёт только в чате. Нужны картинки внутри своего сервиса — берите отдельную vision-модель или OCR, а дипсику передавайте уже извлечённый текст.

Как написать промт к фото, чтобы дипсик не фантазировал

Главная беда любой сети на картинке — правдоподобная выдумка. Смазанная цифра превращается в удобную, обрезанное слово достраивается по смыслу, и заметить это можно только сверкой с оригиналом. Лечится не вежливостью, а прямым запретом и требованием отчёта.

Четыре правила, которые работают:

  1. Скажите своими словами, что на фото. «Квитанция ЖКХ за июль, снята под углом, правый край в тени» — и сеть перестанет угадывать тип документа по обрывкам.
  2. Назовите главное: суммы, даты, имена, артикул. Иначе получите ровный пересказ всего подряд, где нужное растворилось.
  3. Запретите достраивать. «Не читается символ — ставь вопросительные знаки на всю ячейку, похожий по смыслу не подбирай» экономит час перепроверки.
  4. Попросите отчёт о нечитаемом, с адресами: строка и колонка. Проверка превращается из вычитки всего документа в проверку пяти точек.

Каркас, который можно вставить как есть и заменить квадратные скобки:

Смотри изображение. Это [ЧТО ЭТО: квитанция ЖКХ за июль, снята под углом, правый край в тени].
Перенеси [ЧТО НУЖНО: все строки начислений с суммами] символ в символ, ничего не достраивая.
Символ смазан, обрезан или перекрыт бликом — ставь ??? на всю ячейку, похожий по смыслу не подбирай.
Пустая клетка — пиши «нет данных».
В конце: список всех ??? с адресом (строка, колонка) и одна фраза, что мешало читать.

И маленькая привычка, которая экономит больше всего времени: снимайте документ при свете сбоку, без вспышки, кадр по краю страницы. Половина случаев «дипсик не распознаёт фото» — это не сеть, это блик от люстры поверх нужной строки.

FAQ

Дипсик может генерировать фото?

Нет. Ни в веб-версии, ни в приложении, ни через API нет генерации изображений: сеть только читает и разбирает то, что вы загрузили. Своя картиночная модель у компании есть — Janus-Pro, выложенная открытыми весами в январе 2025 года, — но её надо запускать самостоятельно, а в самом дипсике её нет. За генерацией идите в Gemini, Шедеврум или Kandinsky.

Как отправить фото в дипсик с телефона?

В приложении откройте новый чат, нажмите плюс рядом с полем ввода и выберите «Фото». Если сверху есть кнопка режима распознавания — включите её до отправки, иначе сервис вытащит только текст. Дождитесь, пока превью догрузится полностью, и напишите вопрос в том же сообщении: снимок без вопроса даёт общее описание вместо нужного разбора.

Почему в дипсик не загружаются фото?

Чаще всего одно из шести: формат не JPG и не PNG (у iPhone это HEIC по умолчанию), файл слишком тяжёлый и отваливается молча, сервер перегружен, режим распознавания на ваш аккаунт ещё не раскатали, загрузку рубит расширение браузера или снимок настолько кривой, что читать нечего. Платная подписка тут ни при чём: у чата её вообще нет.

Дипсик распознаёт текст с фото?

Да, и это его самая надёжная работа с картинками. Ровный печатный текст со страницы, упаковки или скриншота переносится почти без потерь. Слабое место — рукописное: аккуратный почерк ещё вытянет, скоропись нет. Вёрстку сложного документа он тоже не сохранит, поэтому таблицы и многоколоночные страницы отдавайте по одной и проверяйте цифры глазами.

Что за режим фото в дипсике и как его включить?

Это режим распознавания изображений — отдельная кнопка сверху чата, рядом с быстрым и экспертным режимами. Раскатку начали 29 апреля 2026 года, 9 мая она пошла шире. Включается одним нажатием перед загрузкой снимка. Если кнопки нет, добавить её руками нельзя — раскатка идёт волнами, и до части аккаунтов доходила не сразу; тогда остаётся скрепка с извлечением текста.