# 3D-модель по фото в Gemini: как получить файл GLB или STL

> Gemini рисует референс и показывает интерактивную 3D-сцену, но на просьбу выдать GLB или STL отвечает отказом. Файл дают модель image-to-3D или код на Python.

- URL: https://blog.laozhang.ai/ru/posts/gemini-image-to-3d
- Published: 2026-10-02
- Updated: 2026-10-02
- Author: LaoZhang AI Team (https://blog.laozhang.ai/ru/about)
- Category: Генерация изображений ИИ
- Tags: Gemini, 3D-модель по фото, Nano Banana, Hunyuan3D-2, GLB и STL

---
Gemini не превращает картинку в файл 3D-модели одной кнопкой. По состоянию на 2 октября 2026 года приложение на прямую просьбу сделать из изображения GLB или STL ответило: «I cannot directly generate or export 3D geometry files like .glb or .stl». При этом от Gemini есть польза на трёх участках: он рисует чистый референс для модели image-to-3D, показывает интерактивную 3D-сцену прямо в чате и пишет код, который сам записывает STL.

Всё описанное ниже прогонялось 2 октября 2026 года на одном объекте — игрушечном роботе в форме кофейной кружки — по одному разу на каждый путь, в личном аккаунте Google без подписки Google AI.

**Что было запущено:**

- просьба к Gemini выдать GLB или STL из его же картинки — получен отказ и два совета;
- интерактивная 3D-визуализация в модели 3.1 Pro — виджет появился, но окно просмотра в тестовом браузере не запустилось из-за WebGL, вращения увидеть не удалось;
- картинка Gemini на входе открытой модели Hunyuan3D-2 — сетка на 675 188 граней построена за 7,67 секунды без входа в аккаунт;
- код на Python от Gemini, записывающий STL, — рабочий файл получился только после ручной сборки из двух сломанных ответов, и в нём нашлись дефекты.

**Чего не делали:** сетку из Hunyuan3D-2 не скачивали и не рассматривали, текстуру не генерировали, ни один файл не открывали в Blender или слайсере, ничего не печатали. Режим Deep Think из подписки Google AI Ultra и платные конвертеры не запускались. Поэтому точность формы и качество печати остаются неизвестными.

## Какой «3D» вам нужен: картинка, сцена в чате, GLB или STL

Под словами «3D-модель из фото» скрываются четыре разных результата, и Gemini напрямую выдаёт только первые два.

| Что нужно | Что это на самом деле | Чем делается | Где ломается |
|---|---|---|---|
| Фото «как фигурка», объёмный рендер | Обычное изображение, которое выглядит объёмным | Генерация изображений в Gemini (Nano Banana) | Это не файл модели: в Blender или слайсер его не загрузить |
| Покрутить объект в браузере, чтобы разобраться | Интерактивная визуализация внутри ответа | Модель Pro в приложении Gemini | Нужен рабочий WebGL; кнопка «Копировать» отдаёт картинку, а не сетку |
| Ассет с текстурой для Blender, движка или AR | Файл GLB с сеткой (мешем) и материалами | Референс из Gemini плюс модель image-to-3D | Обратная сторона достраивается по догадке; у платных сервисов скачивание часто за подписку |
| Деталь с размерами для 3D-принтера | Замкнутая сетка в STL | Код от Gemini, который записывает геометрию, либо Deep Think в Google AI Ultra | Код даёт грубую заготовку из примитивов; сетку обязательно проверять |

![Четыре результата под словом «3D» в Gemini: картинка и сцена в чате получаются напрямую, GLB и STL — нет](https://blog.laozhang.ai/posts/ru/gemini-image-to-3d/img/four-3d-results.webp)

Если нужна именно картинка-фигурка, файл модели не требуется вовсе: готовый шаблон и способы его правки разобраны в материале «[Промпт Nano Banana для фигурки: копирование, настройка и исправление 3D-образа](https://blog.laozhang.ai/ru/posts/nano-banana-figurine-prompt-guide)».

Сайты с Gemini в названии, которые обещают «Gemini image to 3D», — не продукты Google. Например, gemini3d.net в собственном описании называет себя независимым инструментом. Такие сервисы подключают чужие модели image-to-3D, и оценивать их нужно по их же условиям, а не по имени.

## Что отвечает Gemini на просьбу выдать GLB или STL

Отказом и двумя советами. В тесте сначала была сгенерирована картинка, а затем в том же чате (модель 3.6 Flash) отправлен запрос:

~~~text
Convert this image into a 3D model file (GLB or STL) that I can download and open in Blender.
~~~

Ответ начался со слов «I cannot directly generate or export 3D geometry files like .glb or .stl». Ни файла, ни ссылки на скачивание не появилось. Дальше Gemini предложил два варианта:

1. Загрузить изображение в ИИ-конвертер image-to-3D и импортировать результат в Blender через File → Import → glTF 2.0. Он сам назвал Tripo3D, Meshy, Rodin, CRM и CSM. Это список из ответа Gemini, а не проверенная подборка: ни один из этих сервисов в тесте не запускался.
2. Смоделировать объект вручную в Blender, используя картинку как референс: цилиндр как основа, фаски, материал.

Это один запуск с одной формулировкой. Другая модель, другой тариф или другой запрос могут дать иной ответ, и два таких случая разобраны ниже: модель Pro строит интерактивную сцену, а Deep Think, по заявлению Google, создаёт файл для печати.

То же самое со стороны API: модели генерации изображений семейства Nano Banana возвращают изображения и текст, и в [документации Gemini API по генерации изображений](https://ai.google.dev/gemini-api/docs/image-generation) вывода в виде сетки, GLB или STL нет.

## Интерактивная 3D-модель в чате: вращается, но сеткой не скачивается

Интерактивные визуализации в Gemini — это способ объяснить тему, а не генератор ассетов. Google представил их 9 апреля 2026 года как «функциональные симуляции», которые помогают лучше понять предмет вопроса, с примером ползунков скорости и гравитации. По [описанию Google](https://blog.google/innovation-and-ai/products/gemini-app/3d-models-charts/), нужно выбрать модель Pro в строке ввода и попросить «show me» или «help me visualize». Функция развёртывается для всех пользователей приложения, но для аккаунтов Education и Workspace пока недоступна. Об экспорте 3D-файла или о преобразовании загруженной картинки в этом анонсе ничего не сказано.

В тесте модель 3.1 Pro выбиралась и работала в аккаунте без подписки; сколько таких запросов доступно без подписки, не измерялось. Запрос был таким:

~~~text
Show me an interactive 3D model of a small toy robot shaped like a coffee mug, with two short arms, two feet and an antenna with a ball on top. I want to rotate it.
~~~

В ответе появился виджет «MugBot 3D»: окно просмотра, пять образцов цвета, три кнопки анимации (Idle Bob, Wave, Joy Hop) и переключатель «Hot Steam». Текст обещал вращение на 360 градусов перетаскиванием и масштабирование колесом.

Дальше — граница, о которую легко споткнуться. В тестовом браузере окно просмотра показало «3D Viewport Unavailable — Unable to initialize WebGL rendering context»: вкладка сообщала, что WebGL 1 доступен, а WebGL 2 — нет. Вращения модели увидеть не удалось. Это особенность конкретного браузера, а не обычное поведение функции, но вывод практический: если вместо сцены вы видите такое сообщение, дело в графике браузера, а не в запросе: проверьте, работает ли в нём WebGL, или откройте чат в другом браузере.

Под виджетом было два действия — «Копировать» и «Скачать». «Копировать» положило в буфер обмена PNG-снимок виджета размером 1416×1366, то есть не код и не 3D-файл. «Скачать» в тесте не нажимали, поэтому что именно сохраняет эта кнопка, неизвестно. Пункта экспорта в GLB, STL или OBJ в ответе не было.

Виджет строился по текстовому описанию. Принимает ли Gemini загруженное фото как основу для такой сцены, не проверялось.

## Из картинки Gemini в GLB: референс рисует Gemini, сетку — image-to-3D

Рабочая связка для ассета с текстурой состоит из двух шагов: Gemini делает чистое изображение объекта, а отдельная модель image-to-3D восстанавливает по нему сетку. Так же описывают разделение ролей и сами конвертеры: Gemini создаёт изображение, сервис реконструирует из него трёхмерную сетку.

### Референс: один объект, белый фон, ракурс в три четверти

Изображение для реконструкции должно содержать один предмет целиком, на однотонном фоне и при ровном свете. В тесте использовался такой запрос:

~~~text
Generate an image: a single small toy robot shaped like a coffee mug with two short arms and a round antenna, matte orange plastic, three-quarter front view, plain white background, soft even studio lighting, whole object in frame, no text.
~~~

Он задаёт то же, что советуют сами конвертеры: белый фон, студийный свет, ракурс в три четверти и единственный объект. Получился оранжевый робот-кружка на белом фоне.

Если у вас готовое фото с пёстрым фоном, сначала очистите его: варианты собраны в материале «[Замена фона в Gemini: 7 способов удалить и изменить фон изображения (2026)](https://blog.laozhang.ai/ru/posts/gemini-image-background-change)». Как устроен сам процесс генерации, описано в руководстве «[Генерация изображений в Gemini: инструкция для приложения и API](https://blog.laozhang.ai/ru/posts/gemini-image-generation-complete-guide)», а приёмы формулировок — в статье «[Как писать промпты для Nano Banana: практическое руководство и 50 проверяемых шаблонов](https://blog.laozhang.ai/ru/posts/how-to-prompt-nano-banana)».

Скачивайте изображение в полном размере, а не снимайте скриншот. По справке Google, без подписки приложение отдаёт 1K, с подпиской Google AI — 2K. Генерация без подписки доступна в пределах лимитов, которые зависят от нагрузки и не выражены фиксированным числом; подробности — в материале «[Сколько картинок бесплатно в Gemini: лимиты по сервисам Google](https://blog.laozhang.ai/ru/posts/gemini-image-generation-free-limit-2026)». Само приложение работает только в поддерживаемых Google странах и языках.

### Запуск Hunyuan3D-2: 675 188 граней за 7,67 секунды без аккаунта

Публичная демо-страница Hunyuan3D-2 на Hugging Face (`tencent/Hunyuan3D-2`) открылась без входа в аккаунт и построила сетку по одной картинке. Порядок действий был таким:

1. Загрузить изображение. В тесте это был фрагмент скриншота 934×720, а не файл в полном размере, — слабое место этого запуска.
2. Оставить настройки по умолчанию: 30 шагов, разрешение октодерева 256, удаление фона включено.
3. Нажать «Gen Shape» — построение одной формы, без текстуры.

Панель Mesh Stats показала 675 188 граней и 184 456 вершин. Общее время — 7,67 секунды: 1,01 секунды на удаление фона и 6,56 секунды на построение формы.

На вкладке Export есть выпадающий список типа файла (по умолчанию glb), флажок «Simplify Mesh» и ползунок «Target Face Number» со значением 10000. Упрощение понадобится почти наверняка: сотни тысяч граней избыточны для игрового движка или AR.

Что этот запуск доказывает и чего нет. Доказано одно: единственное изображение из Gemini вошло, и сетка вышла меньше чем за восемь секунд, без регистрации. Сетку не скачивали, встроенный просмотр в тестовом браузере не отрисовался, кнопку «Gen Textured Shape» не нажимали. Насколько форма совпадает с картинкой и как выглядит текстура, этот тест не показывает.

Демо-страницы — не гарантированный сервис: у них бывают очереди и квоты. В тот же момент официальная демо-страница TRELLIS отвечала ошибкой HTTP 503.

### Какая нейросеть делает 3D-модель по фото, кроме Hunyuan3D-2

Вариантов несколько, и выбирать стоит по тому, есть ли у вас видеокарта и готовы ли вы платить за скачивание. Сведения ниже взяты со страниц самих проектов; запускался из них только Hunyuan3D-2.

| Инструмент | Что заявлено | Условия |
|---|---|---|
| Hunyuan3D-2 (Tencent), открытая модель | Две ступени: модель формы и модель текстуры; сохранение в glb, obj и другие форматы; есть вариант с несколькими ракурсами на входе | Локально: 6 ГБ видеопамяти на форму и 16 ГБ на форму с текстурой; есть демо-страница и хостинг |
| TRELLIS (Microsoft), открытая модель | Текст или изображение на входе; экспорт GLB с текстурой и PLY; поддержка нескольких изображений | Локально: видеокарта NVIDIA от 16 ГБ памяти; модели и большая часть кода под лицензией MIT |
| Meshy, коммерческий сервис | Скачивание в fbx, obj, usdz, glb, stl и blend | Бесплатный план: 100 кредитов в месяц, результаты под CC BY 4.0, низкий приоритет в очереди; Pro: 1 000 кредитов в месяц |
| Image3D.io, коммерческий сервис | Экспорт GLB, OBJ, STL или PLY | Бесплатный просмотр в браузере после входа, скачивание — на платном плане |

Источники: [репозиторий Hunyuan3D-2](https://github.com/Tencent-Hunyuan/Hunyuan3D-2), [репозиторий TRELLIS](https://github.com/microsoft/TRELLIS), [страница тарифов Meshy](https://www.meshy.ai/pricing), [страница Image3D.io](https://image3d.io/gemini-image-to-3d) — по состоянию на 2 октября 2026 года. Сколько кредитов Meshy списывает за одну модель, на странице тарифов видно не было, поэтому число моделей в месяц отсюда не вывести. Лицензия Hunyuan3D-2 требует отдельного чтения перед коммерческим использованием.

Перед тем как выбирать платный сервис, выясните главное: отдаёт ли бесплатный план сам файл или только предварительный просмотр.

## Деталь для 3D-печати: Gemini пишет код, который записывает STL

Этот путь даёт настоящий STL без сторонних сервисов, но результат — заготовка из примитивов, а не копия картинки. После отказа в том же чате был отправлен запрос:

~~~text
Then write the geometry as code instead. Give me one Python 3 script that uses only the standard library and writes robot_mug.stl (binary STL, millimetres, about 60 mm tall) approximating the robot in the image: mug-shaped cylindrical body, a handle, two short arms, two feet, and an antenna with a ball on top. The mesh must be made of closed solids so it can be 3D printed. Output only the script in one code block.
~~~

Запрос просит один скрипт на Python 3 только на стандартной библиотеке, двоичный STL в миллиметрах высотой около 60 мм и замкнутые тела. Дальше события шли так:

1. **Первый ответ** — один блок кода на 13 885 символов, непригодный к запуску в том виде, в каком пришёл: незаконченный черновик, затем второй скрипт внутри того же блока, а функция записи файла во втором скрипте перепутана. После перезагрузки страницы текст остался тем же.
2. **Второй ответ** на просьбу прислать скрипт целиком — 4 741 символ. Функция записи файла цела, но скрипт обрывается посреди функции ручки, а в конце Gemini сообщает, что у него нет контекста, и спрашивает, какой объект нужен.
3. **Ручная сборка**: функция записи из второго ответа плюс функции геометрии и основная функция из первого. Ни одна строка внутри функций Gemini не менялась.

На Python 3.12.1 собранный скрипт записал `robot_mug.stl`: 83 684 байта, 1 672 треугольника. Затем файл разобрал отдельный проверочный скрипт. Он читает двоичный STL, группирует треугольники в связные оболочки, считает рёбра, которые не принадлежат ровно двум треугольникам, и вычисляет знаковый объём каждой оболочки. Найдено следующее:

- габариты 54 × 40 × 70 мм — высота 70 мм вместо запрошенных примерно 60;
- пять оболочек; ручка и шар антенны замкнуты и ориентированы наружу;
- корпус, ноги и стержень антенны слились в одну оболочку, где два ребра не принадлежат ровно двум треугольникам: части касаются друг друга, а не объединены в одно тело;
- оба «бруска» рук замкнуты, но их знаковый объём отрицателен (−288 мм³ у каждого): грани смотрят внутрь;
- ног три, а не две;
- корпус — сплошной цилиндр, а не полая кружка; глаз, рта и прочих деталей с картинки нет;
- части пересекаются как отдельные тела, булева объединения не было.

![Итоги проверки файла robot_mug.stl: габариты 54 × 40 × 70 мм, пять оболочек, незамкнутые рёбра и вывернутые грани у рук](https://blog.laozhang.ai/posts/ru/gemini-image-to-3d/img/stl-mesh-check.webp)

Этот файл не открывали в слайсере или Blender и не печатали. Вывод ограничен тем, что измерено: получился читаемый STL, но до слайсера ему нужны исправление нормалей у рук, объединение тел и правка размеров. Оценка «непригоден к запуску» относится к двум конкретным ответам, а не к способности Gemini писать код вообще.

Когда этот путь оправдан: форма складывается из цилиндров, коробок и сфер, а важны размеры, а не сходство с картинкой, — кронштейн, подставка, корпус. Органическую форму вроде персонажа код из примитивов не передаст.

## Deep Think в Google AI Ultra: эскиз в файл для 3D-печати

Единственное заявление Google о том, что режим Gemini сам создаёт файл для печати, относится к Deep Think. В [анонсе обновления Gemini 3 Deep Think от 12 февраля 2026 года](https://blog.google/innovation-and-ai/models-and-research/gemini-models/gemini-3-deep-think/) сказано, что он анализирует рисунок, моделирует сложную форму и генерирует файл для создания физического объекта 3D-печатью. Режим доступен подписчикам Google AI Ultra в приложении Gemini.

Этот режим не тестировался: подписки Ultra в проверке не было. Формат файла в анонсе не назван. По описанию издания [CGWORLD.jp](https://cgworld.jp/flashnews/01-202602-Gemini3.html) от 24 февраля 2026 года, Deep Think не рисует сетку напрямую, а пишет код, задающий форму математически — на OpenSCAD или Python, — и выполняет его; это пересказ прессы, а не формулировка Google. Механика похожа на путь с кодом выше, но судить о качестве по тесту на 3.6 Flash нельзя.

## GLB, STL или OBJ: какой формат файла выбрать

Выбор определяет то, куда пойдёт модель.

- **GLB** — однофайловая двоичная форма glTF 2.0, несёт геометрию вместе с материалами и текстурами. Подходит для Blender, движков, веба и AR.
- **STL** хранит только треугольники: ни цвета, ни текстуры, ни единиц измерения. Это привычный формат для слайсера.
- **OBJ** хранит геометрию, а материалы и текстуры лежат в соседних файлах, которые нужно переносить вместе с ним.

Нужна текстура — берите GLB. Нужна печать — STL, и следите за масштабом при импорте, потому что единиц в файле нет.

## Что проверить в сетке перед Blender и слайсером

Проверка зависит от цели, и ни один из описанных путей её не отменяет.

Для печати сетка должна быть замкнутой (герметичной): каждое ребро принадлежит ровно двум граням, а нормали направлены наружу. Тест с кодом показал оба типичных нарушения сразу — незамкнутые рёбра в местах касания частей и вывернутые грани у рук. Проверьте также габариты в миллиметрах и то, что отдельные тела объединены.

Для ассета сравните число граней с тем, что выдержит ваша сцена, и посмотрите на объект со всех сторон, прежде чем тратить время на текстуру.

## Почему у 3D-модели по одной картинке неправильная обратная сторона

Потому что обратной стороны на картинке нет: модель image-to-3D достраивает её по догадке. Одно изображение в три четверти показывает перед и один бок, всё остальное — предположение о типичной форме такого предмета. Спина персонажа, дно кружки, вторая рука за корпусом оказываются упрощёнными или симметрично скопированными.

Способ уменьшить догадки — дать несколько ракурсов. У Hunyuan3D-2 есть вариант модели для нескольких видов, TRELLIS поддерживает несколько изображений на входе. Запуски с несколькими ракурсами не проводились, поэтому насколько это исправляет обратную сторону, остаётся открытым вопросом.

## Можно ли скачать вращающуюся 3D-модель из чата Gemini

Как сетку — в тесте такой возможности не нашлось. «Копировать» под виджетом дало PNG-снимок, пункта экспорта в GLB, STL или OBJ не было, а что сохраняет «Скачать», осталось непроверенным. Если нужен файл для Blender или принтера, исходите из того, что виджет его не заменит, и идите через image-to-3D или код.

## Какой путь выбрать под свою цель

- **Нужна объёмная на вид картинка** — оставайтесь в генерации изображений; файл модели не нужен.
- **Нужно покрутить объект и понять устройство** — модель Pro и запрос со словами «show me»; заранее убедитесь, что в браузере работает WebGL.
- **Нужен ассет с текстурой и нет видеокарты** — референс из Gemini и демо-страница открытой модели либо коммерческий сервис; сначала уточните, отдаёт ли бесплатный план файл.
- **Есть видеокарта от 16 ГБ** — Hunyuan3D-2 или TRELLIS локально, без очередей и квот.
- **Нужна деталь с точными размерами** — код от Gemini с обязательной проверкой сетки; при подписке Google AI Ultra можно попробовать Deep Think, но формат и качество его файла Google не описывает, а независимого запуска за этим советом нет.
