3D-модель по фото в Gemini: как получить файл GLB или STL
Gemini рисует референс и показывает интерактивную 3D-сцену, но на просьбу выдать GLB или STL отвечает отказом. Файл дают модель image-to-3D или код на Python.
Содержание

Gemini не превращает картинку в файл 3D-модели одной кнопкой. По состоянию на 2 октября 2026 года приложение на прямую просьбу сделать из изображения GLB или STL ответило: «I cannot directly generate or export 3D geometry files like .glb or .stl». При этом от Gemini есть польза на трёх участках: он рисует чистый референс для модели image-to-3D, показывает интерактивную 3D-сцену прямо в чате и пишет код, который сам записывает STL.
Всё описанное ниже прогонялось 2 октября 2026 года на одном объекте — игрушечном роботе в форме кофейной кружки — по одному разу на каждый путь, в личном аккаунте Google без подписки Google AI.
Что было запущено:
- просьба к Gemini выдать GLB или STL из его же картинки — получен отказ и два совета;
- интерактивная 3D-визуализация в модели 3.1 Pro — виджет появился, но окно просмотра в тестовом браузере не запустилось из-за WebGL, вращения увидеть не удалось;
- картинка Gemini на входе открытой модели Hunyuan3D-2 — сетка на 675 188 граней построена за 7,67 секунды без входа в аккаунт;
- код на Python от Gemini, записывающий STL, — рабочий файл получился только после ручной сборки из двух сломанных ответов, и в нём нашлись дефекты.
Чего не делали: сетку из Hunyuan3D-2 не скачивали и не рассматривали, текстуру не генерировали, ни один файл не открывали в Blender или слайсере, ничего не печатали. Режим Deep Think из подписки Google AI Ultra и платные конвертеры не запускались. Поэтому точность формы и качество печати остаются неизвестными.
Какой «3D» вам нужен: картинка, сцена в чате, GLB или STL
Под словами «3D-модель из фото» скрываются четыре разных результата, и Gemini напрямую выдаёт только первые два.
| Что нужно | Что это на самом деле | Чем делается | Где ломается |
|---|---|---|---|
| Фото «как фигурка», объёмный рендер | Обычное изображение, которое выглядит объёмным | Генерация изображений в Gemini (Nano Banana) | Это не файл модели: в Blender или слайсер его не загрузить |
| Покрутить объект в браузере, чтобы разобраться | Интерактивная визуализация внутри ответа | Модель Pro в приложении Gemini | Нужен рабочий WebGL; кнопка «Копировать» отдаёт картинку, а не сетку |
| Ассет с текстурой для Blender, движка или AR | Файл GLB с сеткой (мешем) и материалами | Референс из Gemini плюс модель image-to-3D | Обратная сторона достраивается по догадке; у платных сервисов скачивание часто за подписку |
| Деталь с размерами для 3D-принтера | Замкнутая сетка в STL | Код от Gemini, который записывает геометрию, либо Deep Think в Google AI Ultra | Код даёт грубую заготовку из примитивов; сетку обязательно проверять |

Если нужна именно картинка-фигурка, файл модели не требуется вовсе: готовый шаблон и способы его правки разобраны в материале «Промпт Nano Banana для фигурки: копирование, настройка и исправление 3D-образа».
Сайты с Gemini в названии, которые обещают «Gemini image to 3D», — не продукты Google. Например, gemini3d.net в собственном описании называет себя независимым инструментом. Такие сервисы подключают чужие модели image-to-3D, и оценивать их нужно по их же условиям, а не по имени.
Что отвечает Gemini на просьбу выдать GLB или STL
Отказом и двумя советами. В тесте сначала была сгенерирована картинка, а затем в том же чате (модель 3.6 Flash) отправлен запрос:
Convert this image into a 3D model file (GLB or STL) that I can download and open in Blender.Ответ начался со слов «I cannot directly generate or export 3D geometry files like .glb or .stl». Ни файла, ни ссылки на скачивание не появилось. Дальше Gemini предложил два варианта:
- Загрузить изображение в ИИ-конвертер image-to-3D и импортировать результат в Blender через File → Import → glTF 2.0. Он сам назвал Tripo3D, Meshy, Rodin, CRM и CSM. Это список из ответа Gemini, а не проверенная подборка: ни один из этих сервисов в тесте не запускался.
- Смоделировать объект вручную в Blender, используя картинку как референс: цилиндр как основа, фаски, материал.
Это один запуск с одной формулировкой. Другая модель, другой тариф или другой запрос могут дать иной ответ, и два таких случая разобраны ниже: модель Pro строит интерактивную сцену, а Deep Think, по заявлению Google, создаёт файл для печати.
То же самое со стороны API: модели генерации изображений семейства Nano Banana возвращают изображения и текст, и в документации Gemini API по генерации изображений вывода в виде сетки, GLB или STL нет.
Интерактивная 3D-модель в чате: вращается, но сеткой не скачивается
Интерактивные визуализации в Gemini — это способ объяснить тему, а не генератор ассетов. Google представил их 9 апреля 2026 года как «функциональные симуляции», которые помогают лучше понять предмет вопроса, с примером ползунков скорости и гравитации. По описанию Google, нужно выбрать модель Pro в строке ввода и попросить «show me» или «help me visualize». Функция развёртывается для всех пользователей приложения, но для аккаунтов Education и Workspace пока недоступна. Об экспорте 3D-файла или о преобразовании загруженной картинки в этом анонсе ничего не сказано.
В тесте модель 3.1 Pro выбиралась и работала в аккаунте без подписки; сколько таких запросов доступно без подписки, не измерялось. Запрос был таким:
Show me an interactive 3D model of a small toy robot shaped like a coffee mug, with two short arms, two feet and an antenna with a ball on top. I want to rotate it.В ответе появился виджет «MugBot 3D»: окно просмотра, пять образцов цвета, три кнопки анимации (Idle Bob, Wave, Joy Hop) и переключатель «Hot Steam». Текст обещал вращение на 360 градусов перетаскиванием и масштабирование колесом.
Дальше — граница, о которую легко споткнуться. В тестовом браузере окно просмотра показало «3D Viewport Unavailable — Unable to initialize WebGL rendering context»: вкладка сообщала, что WebGL 1 доступен, а WebGL 2 — нет. Вращения модели увидеть не удалось. Это особенность конкретного браузера, а не обычное поведение функции, но вывод практический: если вместо сцены вы видите такое сообщение, дело в графике браузера, а не в запросе: проверьте, работает ли в нём WebGL, или откройте чат в другом браузере.
Под виджетом было два действия — «Копировать» и «Скачать». «Копировать» положило в буфер обмена PNG-снимок виджета размером 1416×1366, то есть не код и не 3D-файл. «Скачать» в тесте не нажимали, поэтому что именно сохраняет эта кнопка, неизвестно. Пункта экспорта в GLB, STL или OBJ в ответе не было.
Виджет строился по текстовому описанию. Принимает ли Gemini загруженное фото как основу для такой сцены, не проверялось.
Из картинки Gemini в GLB: референс рисует Gemini, сетку — image-to-3D
Рабочая связка для ассета с текстурой состоит из двух шагов: Gemini делает чистое изображение объекта, а отдельная модель image-to-3D восстанавливает по нему сетку. Так же описывают разделение ролей и сами конвертеры: Gemini создаёт изображение, сервис реконструирует из него трёхмерную сетку.
Референс: один объект, белый фон, ракурс в три четверти
Изображение для реконструкции должно содержать один предмет целиком, на однотонном фоне и при ровном свете. В тесте использовался такой запрос:
Generate an image: a single small toy robot shaped like a coffee mug with two short arms and a round antenna, matte orange plastic, three-quarter front view, plain white background, soft even studio lighting, whole object in frame, no text.Он задаёт то же, что советуют сами конвертеры: белый фон, студийный свет, ракурс в три четверти и единственный объект. Получился оранжевый робот-кружка на белом фоне.
Если у вас готовое фото с пёстрым фоном, сначала очистите его: варианты собраны в материале «Замена фона в Gemini: 7 способов удалить и изменить фон изображения (2026)». Как устроен сам процесс генерации, описано в руководстве «Генерация изображений в Gemini: инструкция для приложения и API», а приёмы формулировок — в статье «Как писать промпты для Nano Banana: практическое руководство и 50 проверяемых шаблонов».
Скачивайте изображение в полном размере, а не снимайте скриншот. По справке Google, без подписки приложение отдаёт 1K, с подпиской Google AI — 2K. Генерация без подписки доступна в пределах лимитов, которые зависят от нагрузки и не выражены фиксированным числом; подробности — в материале «Сколько картинок бесплатно в Gemini: лимиты по сервисам Google». Само приложение работает только в поддерживаемых Google странах и языках.
Запуск Hunyuan3D-2: 675 188 граней за 7,67 секунды без аккаунта
Публичная демо-страница Hunyuan3D-2 на Hugging Face (tencent/Hunyuan3D-2) открылась без входа в аккаунт и построила сетку по одной картинке. Порядок действий был таким:
- Загрузить изображение. В тесте это был фрагмент скриншота 934×720, а не файл в полном размере, — слабое место этого запуска.
- Оставить настройки по умолчанию: 30 шагов, разрешение октодерева 256, удаление фона включено.
- Нажать «Gen Shape» — построение одной формы, без текстуры.
Панель Mesh Stats показала 675 188 граней и 184 456 вершин. Общее время — 7,67 секунды: 1,01 секунды на удаление фона и 6,56 секунды на построение формы.
На вкладке Export есть выпадающий список типа файла (по умолчанию glb), флажок «Simplify Mesh» и ползунок «Target Face Number» со значением 10000. Упрощение понадобится почти наверняка: сотни тысяч граней избыточны для игрового движка или AR.
Что этот запуск доказывает и чего нет. Доказано одно: единственное изображение из Gemini вошло, и сетка вышла меньше чем за восемь секунд, без регистрации. Сетку не скачивали, встроенный просмотр в тестовом браузере не отрисовался, кнопку «Gen Textured Shape» не нажимали. Насколько форма совпадает с картинкой и как выглядит текстура, этот тест не показывает.
Демо-страницы — не гарантированный сервис: у них бывают очереди и квоты. В тот же момент официальная демо-страница TRELLIS отвечала ошибкой HTTP 503.
Какая нейросеть делает 3D-модель по фото, кроме Hunyuan3D-2
Вариантов несколько, и выбирать стоит по тому, есть ли у вас видеокарта и готовы ли вы платить за скачивание. Сведения ниже взяты со страниц самих проектов; запускался из них только Hunyuan3D-2.
| Инструмент | Что заявлено | Условия |
|---|---|---|
| Hunyuan3D-2 (Tencent), открытая модель | Две ступени: модель формы и модель текстуры; сохранение в glb, obj и другие форматы; есть вариант с несколькими ракурсами на входе | Локально: 6 ГБ видеопамяти на форму и 16 ГБ на форму с текстурой; есть демо-страница и хостинг |
| TRELLIS (Microsoft), открытая модель | Текст или изображение на входе; экспорт GLB с текстурой и PLY; поддержка нескольких изображений | Локально: видеокарта NVIDIA от 16 ГБ памяти; модели и большая часть кода под лицензией MIT |
| Meshy, коммерческий сервис | Скачивание в fbx, obj, usdz, glb, stl и blend | Бесплатный план: 100 кредитов в месяц, результаты под CC BY 4.0, низкий приоритет в очереди; Pro: 1 000 кредитов в месяц |
| Image3D.io, коммерческий сервис | Экспорт GLB, OBJ, STL или PLY | Бесплатный просмотр в браузере после входа, скачивание — на платном плане |
Источники: репозиторий Hunyuan3D-2, репозиторий TRELLIS, страница тарифов Meshy, страница Image3D.io — по состоянию на 2 октября 2026 года. Сколько кредитов Meshy списывает за одну модель, на странице тарифов видно не было, поэтому число моделей в месяц отсюда не вывести. Лицензия Hunyuan3D-2 требует отдельного чтения перед коммерческим использованием.
Перед тем как выбирать платный сервис, выясните главное: отдаёт ли бесплатный план сам файл или только предварительный просмотр.
Деталь для 3D-печати: Gemini пишет код, который записывает STL
Этот путь даёт настоящий STL без сторонних сервисов, но результат — заготовка из примитивов, а не копия картинки. После отказа в том же чате был отправлен запрос:
Then write the geometry as code instead. Give me one Python 3 script that uses only the standard library and writes robot_mug.stl (binary STL, millimetres, about 60 mm tall) approximating the robot in the image: mug-shaped cylindrical body, a handle, two short arms, two feet, and an antenna with a ball on top. The mesh must be made of closed solids so it can be 3D printed. Output only the script in one code block.Запрос просит один скрипт на Python 3 только на стандартной библиотеке, двоичный STL в миллиметрах высотой около 60 мм и замкнутые тела. Дальше события шли так:
- Первый ответ — один блок кода на 13 885 символов, непригодный к запуску в том виде, в каком пришёл: незаконченный черновик, затем второй скрипт внутри того же блока, а функция записи файла во втором скрипте перепутана. После перезагрузки страницы текст остался тем же.
- Второй ответ на просьбу прислать скрипт целиком — 4 741 символ. Функция записи файла цела, но скрипт обрывается посреди функции ручки, а в конце Gemini сообщает, что у него нет контекста, и спрашивает, какой объект нужен.
- Ручная сборка: функция записи из второго ответа плюс функции геометрии и основная функция из первого. Ни одна строка внутри функций Gemini не менялась.
На Python 3.12.1 собранный скрипт записал robot_mug.stl: 83 684 байта, 1 672 треугольника. Затем файл разобрал отдельный проверочный скрипт. Он читает двоичный STL, группирует треугольники в связные оболочки, считает рёбра, которые не принадлежат ровно двум треугольникам, и вычисляет знаковый объём каждой оболочки. Найдено следующее:
- габариты 54 × 40 × 70 мм — высота 70 мм вместо запрошенных примерно 60;
- пять оболочек; ручка и шар антенны замкнуты и ориентированы наружу;
- корпус, ноги и стержень антенны слились в одну оболочку, где два ребра не принадлежат ровно двум треугольникам: части касаются друг друга, а не объединены в одно тело;
- оба «бруска» рук замкнуты, но их знаковый объём отрицателен (−288 мм³ у каждого): грани смотрят внутрь;
- ног три, а не две;
- корпус — сплошной цилиндр, а не полая кружка; глаз, рта и прочих деталей с картинки нет;
- части пересекаются как отдельные тела, булева объединения не было.

Этот файл не открывали в слайсере или Blender и не печатали. Вывод ограничен тем, что измерено: получился читаемый STL, но до слайсера ему нужны исправление нормалей у рук, объединение тел и правка размеров. Оценка «непригоден к запуску» относится к двум конкретным ответам, а не к способности Gemini писать код вообще.
Когда этот путь оправдан: форма складывается из цилиндров, коробок и сфер, а важны размеры, а не сходство с картинкой, — кронштейн, подставка, корпус. Органическую форму вроде персонажа код из примитивов не передаст.
Deep Think в Google AI Ultra: эскиз в файл для 3D-печати
Единственное заявление Google о том, что режим Gemini сам создаёт файл для печати, относится к Deep Think. В анонсе обновления Gemini 3 Deep Think от 12 февраля 2026 года сказано, что он анализирует рисунок, моделирует сложную форму и генерирует файл для создания физического объекта 3D-печатью. Режим доступен подписчикам Google AI Ultra в приложении Gemini.
Этот режим не тестировался: подписки Ultra в проверке не было. Формат файла в анонсе не назван. По описанию издания CGWORLD.jp от 24 февраля 2026 года, Deep Think не рисует сетку напрямую, а пишет код, задающий форму математически — на OpenSCAD или Python, — и выполняет его; это пересказ прессы, а не формулировка Google. Механика похожа на путь с кодом выше, но судить о качестве по тесту на 3.6 Flash нельзя.
GLB, STL или OBJ: какой формат файла выбрать
Выбор определяет то, куда пойдёт модель.
- GLB — однофайловая двоичная форма glTF 2.0, несёт геометрию вместе с материалами и текстурами. Подходит для Blender, движков, веба и AR.
- STL хранит только треугольники: ни цвета, ни текстуры, ни единиц измерения. Это привычный формат для слайсера.
- OBJ хранит геометрию, а материалы и текстуры лежат в соседних файлах, которые нужно переносить вместе с ним.
Нужна текстура — берите GLB. Нужна печать — STL, и следите за масштабом при импорте, потому что единиц в файле нет.
Что проверить в сетке перед Blender и слайсером
Проверка зависит от цели, и ни один из описанных путей её не отменяет.
Для печати сетка должна быть замкнутой (герметичной): каждое ребро принадлежит ровно двум граням, а нормали направлены наружу. Тест с кодом показал оба типичных нарушения сразу — незамкнутые рёбра в местах касания частей и вывернутые грани у рук. Проверьте также габариты в миллиметрах и то, что отдельные тела объединены.
Для ассета сравните число граней с тем, что выдержит ваша сцена, и посмотрите на объект со всех сторон, прежде чем тратить время на текстуру.
Почему у 3D-модели по одной картинке неправильная обратная сторона
Потому что обратной стороны на картинке нет: модель image-to-3D достраивает её по догадке. Одно изображение в три четверти показывает перед и один бок, всё остальное — предположение о типичной форме такого предмета. Спина персонажа, дно кружки, вторая рука за корпусом оказываются упрощёнными или симметрично скопированными.
Способ уменьшить догадки — дать несколько ракурсов. У Hunyuan3D-2 есть вариант модели для нескольких видов, TRELLIS поддерживает несколько изображений на входе. Запуски с несколькими ракурсами не проводились, поэтому насколько это исправляет обратную сторону, остаётся открытым вопросом.
Можно ли скачать вращающуюся 3D-модель из чата Gemini
Как сетку — в тесте такой возможности не нашлось. «Копировать» под виджетом дало PNG-снимок, пункта экспорта в GLB, STL или OBJ не было, а что сохраняет «Скачать», осталось непроверенным. Если нужен файл для Blender или принтера, исходите из того, что виджет его не заменит, и идите через image-to-3D или код.
Какой путь выбрать под свою цель
- Нужна объёмная на вид картинка — оставайтесь в генерации изображений; файл модели не нужен.
- Нужно покрутить объект и понять устройство — модель Pro и запрос со словами «show me»; заранее убедитесь, что в браузере работает WebGL.
- Нужен ассет с текстурой и нет видеокарты — референс из Gemini и демо-страница открытой модели либо коммерческий сервис; сначала уточните, отдаёт ли бесплатный план файл.
- Есть видеокарта от 16 ГБ — Hunyuan3D-2 или TRELLIS локально, без очередей и квот.
- Нужна деталь с точными размерами — код от Gemini с обязательной проверкой сетки; при подписке Google AI Ultra можно попробовать Deep Think, но формат и качество его файла Google не описывает, а независимого запуска за этим советом нет.





