Genera imágenes a partir de entradas de texto. Genera espacio latente VQ-VAE, lo que permite generar escenas más complejas y mejorar la calidad de la imagen sintetizada.
Busca, compara y encuentra la herramienta adecuada para cada necesidad.
40.018 herramientas
Genera imágenes a partir de entradas de texto. Genera espacio latente VQ-VAE, lo que permite generar escenas más complejas y mejorar la calidad de la imagen sintetizada.
Un modelo de difusión incondicional entrenado a medida en un conjunto de datos original (pequeño) de más de 1300 paisajes y retratos de acuarela de 256 x 256 utilizando el cuaderno de [ajuste fino del modelo de difusión de OpenAI](https://colab.research.google.com/drive/1Xfd5fm4OnhTd6IHPMGcoqw54uhGT3HdF) de [Alex Spirin](https://twitter.com/devdef).
Generar diferentes tipos de imágenes con texto: realistas, caricaturescas, artísticas.
Se busca un objeto en la imagen a partir de una entrada de texto y este objeto se recortará en el cuadrado en la salida.
Mezcla de fotografías con el modelo StyleGAN. La calidad es baja.
Generar un SVG minimalista basado en su dibujo que coincida con la misma categoría.
Generar animación basada en una imagen dada y configuraciones ajustables
Personalizar un modelo 3D con texto: cambiar la textura y el color de cualquier modelo para modificarlo rápidamente
Reconstrucción de modelos 3D de personas a partir de fotos e imágenes. Funciona para varias personas a la vez.
Animación de paisajes mediante la creación de vídeos basados ??en una imagen con paisaje
Agregar nuevos objetos a la imagen, generar nuevas imágenes, crear objetos con bocetos y mapas de segmentación, aumentar la resolución
Creación de un vídeo con efecto 3D a partir de varias imágenes. Versión simplificada de baja calidad.
Genera arte mediante indicaciones de texto. Incluye la opción de simetría.
Generar imágenes particulares basadas en su entrada de texto con la posibilidad de agregar sus propias imágenes para lograr el estilo necesario
Realizar predicciones basadas en el análisis de la imagen, dividiéndola en una cuadrícula.
Generación de imágenes a partir de texto con la proporción necesaria de ancho y alto. Basado en DALL-E.
Turbo es un potenciador de animación 3D para el portátil Disco Diffusion v5 estándar, pensado para mejorar la coherencia de la imagen, pero con el efecto secundario de renderizados de animación generales más rápidos.
Generación de imágenes con una imagen de referencia (NN con codificador)
Genera arte mediante indicaciones de texto. Incluye la opción de simetría.
Edición de imágenes con diferentes parámetros. Trabajando con rostros, coches y vida silvestre.
Un modelo de texto a imagen a gran escala para DALL-E 2 Pytorch (no afiliado a OpenAI). Se está entrenando con el conjunto de datos LAION.
Cambiar el estilo de una imagen basándose en otra imagen como referencia. Inspirado en el estilo Deep Dream de deepdreamgenerator.com.
Cambiar el estilo de una imagen. Basado en pix2pix. Se puede aplicar a una amplia gama de tareas, como sintetizar fotos de mapas de etiquetas, generar fotos coloreadas a partir de imágenes en blanco y negro, convertir fotos de Google Maps en imágenes aéreas e incluso transformar bocetos en fotos.
Generación de imágenes artísticas impulsada por música con entrada de texto
Generar animación basada en una imagen dada y configuraciones ajustables
Al generar video con cuadros cambiantes, el resultado es más suave que en DiscoDiffusion habitual.
Edición de imágenes con bocetos y máscaras: dibuja sobre las partes que quieres que la red neuronal rellene.