ES ▾
Obtener clave de API

API Seedream explicada: El motor de texto para flujos de trabajo de IA

Actualizado

La API Seedream funciona como un motor de texto especializado diseñado para cerrar la brecha entre los prompts de texto sin procesar y la generación de imágenes de alta fidelidad, ofreciendo un LLM sin censura capaz de manejar instrucciones narrativas complejas sin los filtros corporativos estándar. Al centrarse exclusivamente en operaciones de texto a texto, sirve como una capa robusta de ingeniería de prompts y extracción de metadatos para Stable Diffusion y pipelines similares.

Puntos clave

  • La API Seedream es un modelo de texto sin censura, compatible con OpenAI, optimizado para generar prompts de imágenes detallados y descripciones de postprocesamiento.
  • Opera con una ventana de contexto de 100.000 tokens, lo que permite un análisis profundo de guiones largos o grandes conjuntos de datos de imágenes.
  • Los precios son transparentes: $0.25 por cada 1M de tokens de entrada y $1.00 por cada 1M de tokens de salida, sin cuotas mensuales.
  • Se integra directamente con los SDK estándar de OpenAI, lo que la convierte en un reemplazo listo para usar para las etapas de generación de texto en flujos de trabajo existentes.

¿Qué es la API Seedream?

La API Seedream es un servicio de modelo de lenguaje grande (LLM) alojado y sin censura, diseñado específicamente para tareas de generación de texto dentro de pipelines creativos y técnicos. A diferencia de las interfaces de chat de propósito general, esta API está diseñada para manejar las demandas matizadas de la ingeniería de prompts, la generación de subtítulos y la extracción de metadatos sin los rechazos de contenido típicos que se encuentran en los modelos estándar. Sirve como el motor de texto inteligente que impulsa las etapas de entrada y salida de los flujos de trabajo de IA, especialmente aquellos que involucran medios visuales.

En su núcleo, la API utiliza un modelo de pesos abiertos ajustado para contenido adulto y creativo, asegurando que tu visión específica no sea filtrada por barreras de seguridad diseñadas para audiencias más amplias. Entrega texto de entrada, texto de salida, admitiendo streaming vía Server-Sent Events (SSE) y llamadas a funciones/herramientas. Esto lo hace ideal para desarrolladores que necesitan salidas de texto confiables y deterministas para impulsar procesos posteriores, como generar prompts para generadores de imágenes o guiones para doblaje.

Texto vs. Imagen: Entendiendo los Roles

Muchos desarrolladores confunden el rol de los modelos de texto con los modelos de generación de imágenes. La API Seedream no genera imágenes, audio ni video; genera las instrucciones de texto que impulsan esos modelos. En un flujo de trabajo típico de Stable Diffusion, el modelo de texto es responsable de interpretar la intención del usuario, expandir ideas breves en prompts detallados y refinar esos prompts basándose en comentarios.

  • Ingeniería de Prompts: La API expande conceptos simples como "ciudad cyberpunk" en prompts detallados con descriptores de iluminación, ángulo de cámara y estilo.
  • Postprocesamiento: Puede analizar las imágenes generadas (mediante OCR externo o modelos de visión) y generar subtítulos o metadatos.
  • Guiones: Para pipelines de video, genera descripciones de escenas y guiones de diálogo.

Esta separación de responsabilidades te permite elegir el mejor modelo de imagen mientras mantienes tu generación de texto flexible y sin censura. La API Seedream actúa como el cerebro de la operación, mientras que los modelos de imagen actúan como las manos.

Por qué el Texto Sin Censura es Importante

Los LLM estándar a menudo aplican filtros de contenido que pueden interferir con el trabajo creativo o de temática adulta. Por ejemplo, un modelo podría negarse a describir una "estatua desnuda" porque detecta "desnudo" y asume un contexto sexual, incluso si la intención es artística. La API Seedream está ajustada para responder sin estos rechazos para uso adulto lícito, asegurando que tu visión creativa no se corte arbitrariamente.

Esta naturaleza sin censura es crucial para la generación de prompts. Si el modelo de texto se niega a generar una descripción detallada de una escena madura, la imagen resultante carecerá de detalles clave. Al eliminar estas barreras, obtienes un control total sobre el contenido. Ten en cuenta que hay un límite estricto: el contenido sexual que involucra a menores siempre está bloqueado, independientemente del contexto. Esto asegura que la API siga siendo ampliamente utilizable mientras mantiene una base mínima de seguridad.

Para investigadores de seguridad o escritores que exploran temas controvertidos, esta API proporciona un motor de texto confiable que no cuestiona tu intención. Es una herramienta pragmática para profesionales que quieren que su salida de texto refleje su entrada exactamente, sin filtros de moderación corporativa.

Caso de Uso: Generación de Prompts para SD

Uno de los usos más comunes para la API Seedream es generar prompts de alta calidad para Stable Diffusion. Los modelos de Stable Diffusion responden mejor al texto estructurado y descriptivo. La API puede tomar una idea aproximada y expandirla en un prompt detallado con palabras clave específicas para estilo, iluminación y composición.

Por ejemplo, puedes enviar un prompt como "un coche futurista" y recibir una salida detallada: "Un deportivo futurista elegante, iluminado con neón, estética cyberpunk, calles mojadas por la lluvia, iluminación volumétrica, 8k, altamente detallado, renderizado en unreal engine 5". Este nivel de detalle mejora significativamente la calidad de la imagen generada.

La API admite llamadas a funciones/herramientas, lo que te permite estructurar la salida JSON para su ingesta directa por tu pipeline de generación de imágenes. Esto reduce la necesidad de análisis de texto posterior, haciendo tu flujo de trabajo más rápido y confiable. Ya sea que estés generando miles de variaciones o solo unas pocas, el modelo sin censura asegura que tus elecciones estilísticas específicas no sean filtradas.

Caso de Uso: Metadatos y Subtítulos

Más allá de generar prompts, la API Seedream es excelente para tareas de texto de postprocesamiento. Si tienes un gran conjunto de datos de imágenes o videos, puedes usar la API para generar subtítulos y metadatos precisos. Esto es particularmente útil para construir bibliotecas buscables o entrenar modelos personalizados.

Por ejemplo, puedes proporcionar una descripción del contenido de una imagen y la API generará una etiqueta concisa y rica en palabras clave, adecuada para SEO o indexación en bases de datos. La ventana de contexto de 100,000 tokens te permite procesar grandes bloques de texto o los metadatos de varias imágenes en una sola petición, reduciendo la latencia y el costo.

Esta capacidad se extiende a la escritura de guiones para pipelines de video. La API puede generar descripciones de escenas, diálogos de personajes y guiones de voz en off, todos adaptados a tu dirección creativa específica. La naturaleza sin censura asegura que los temas maduros en tus guiones no se marquen como errores, permitiendo una narrativa más auténtica.

Integración con SDK de OpenAI

La API Seedream es totalmente compatible con OpenAI, lo que significa que puedes usarla con cualquier biblioteca o herramienta que soporte el formato de API de OpenAI. Esto incluye el SDK oficial de Python, el SDK de JavaScript y muchas herramientas de terceros. Simplemente necesitas actualizar la URL base y la clave de API en tu configuración.

  • URL Base: https://api.sdxlapi.com/v1
  • ID del Modelo: uncensored
  • Endpoint: POST /v1/chat/completions

Esta compatibilidad te permite cambiar tu modelo de texto sin reescribir toda la canalización. Si actualmente usas otro LLM para la generación de prompts, puedes cambiar a la API de Seedream con cambios mínimos de código. La API también admite streaming vía SSE, lo cual es útil para aplicaciones en tiempo real donde deseas mostrar el texto a medida que se genera.

También se admiten las llamadas a funciones, lo que te permite definir herramientas personalizadas que el modelo puede usar para obtener datos o realizar acciones. Esto hace que la API sea versátil para flujos de trabajo complejos que requieren integración dinámica de datos.

Rendimiento y ventana de contexto

La API de Seedream cuenta con una ventana de contexto de 100 000 tokens, lo cual es significativamente mayor que el de muchos modelos estándar. Esto te permite procesar documentos grandes, guiones largos o metadatos extensos de imágenes en una sola petición. Por ejemplo, puedes alimentar la API con un guion de 50 páginas y hacer que genere biografías de personajes, resúmenes de escenas y ajustes de diálogo todo a la vez.

La API admite hasta 300 peticiones por minuto por clave, lo cual es suficiente para la mayoría de las tareas de procesamiento por lotes. El tamaño máximo del cuerpo de la petición es de 8 MB, lo que garantiza que puedas enviar cargas útiles grandes sin superar los límites. Para la mayoría de los casos de uso, esto proporciona capacidad suficiente tanto para operaciones en tiempo real como por lotes.

El rendimiento está optimizado para la generación de texto, con baja latencia para prompts simples y tiempos ligeramente mayores para tareas de razonamiento complejas y multi-etapa. El modelo sin censura está ajustado para velocidad y precisión, asegurando que tu canalización no tenga cuellos de botella en la generación de texto. Si necesitas mayor capacidad de procesamiento, puedes generar varias claves de API y distribuir las peticiones entre ellas.

Precios y escalabilidad

La API de Seedream utiliza un modelo de precios transparente de pago por uso, sin cuotas mensuales ni suscripciones. El costo es de $0,25 por 1 millón de tokens de entrada y $1,00 por 1 millón de tokens de salida. Esto significa que solo pagas por el texto que envías y recibes, lo que lo hace rentable tanto para proyectos pequeños como para canalizaciones a gran escala.

Por ejemplo, generar 10 000 prompts detallados para imágenes costaría aproximadamente $0,01 en entrada y $0,05 en salida, sumando un total de $0,06. Este bajo costo te permite experimentar libremente con diferentes estructuras y estilos de prompt sin preocuparte por facturas altas.

Puedes recargar tu cuenta con tan solo $10, con bonificaciones para depósitos más grandes: +5 % de crédito adicional por $50 y +10 % por $100. El crédito pagado no caduca, por lo que puedes acumular un saldo y usarlo con el tiempo. Las cuentas nuevas reciben $0,50 en crédito de prueba válido por 7 días, sin necesidad de tarjeta de crédito, lo que te permite probar la API antes de comprometerte.

Primeros pasos con tu primera petición

Comenzar con la API de Seedream es sencillo. Primero, regístrate para crear una cuenta en la página "Obtener clave de API" usando solo un correo electrónico y una contraseña. No se requiere número de teléfono ni tarjeta de crédito para la prueba. Una vez registrado, tu clave de API se muestra inmediatamente.

A continuación, configura tu cliente compatible con OpenAI con la URL base https://api.sdxlapi.com/v1 y tu clave de API. Luego puedes enviar una petición al endpoint /v1/chat/completions con el ID de modelo "uncensored". Aquí tienes un ejemplo simple usando el SDK de Python:

La API admite streaming, llamadas a funciones y completados de chat estándar, lo que facilita su integración en cualquier flujo de trabajo. Puedes regenerar tu clave de API en cualquier momento, lo que invalida la clave anterior, asegurando la seguridad. Los prompts no se utilizan para entrenamiento y la privacidad de tu cuenta está protegida con solo un correo electrónico y una contraseña.

Preguntas y respuestas

¿Qué significa "sin censura" para la API de Seedream?

Significa que el modelo está ajustado para responder sin rechazos de contenido por temas adultos lícitos, ficticios o controvertidos. No aplica los filtros de seguridad corporativos estándar que podrían bloquear temas creativos o maduros. La única limitación estricta es que el contenido sexual que involucra a menores siempre está bloqueado.

¿Genera la API de Seedream imágenes o video?

No. La API de Seedream es un modelo solo de texto. Genera prompts de texto, subtítulos, guiones y metadatos. Está diseñado para impulsar las etapas de texto de canalizaciones que utilizan otros modelos para la generación de imágenes o video.

¿Cuánto cuesta usar la API?

La API cuesta $0.25 por cada 1 millón de tokens de entrada y $1.00 por cada 1 millón de tokens de salida. No hay tarifas ni suscripciones mensuales. Solo pagas por los tokens que usas y el crédito pagado nunca caduca.

¿Puedo usar la API con los SDK estándar de OpenAI?

Sí. La API es totalmente compatible con OpenAI. Puedes usarla con los SDK oficiales de Python, JavaScript y otros SDK de OpenAI simplemente actualizando la URL base a https://api.sdxlapi.com/v1 y estableciendo el ID de modelo en "uncensored".

Tu clave está a un formulario de distancia

Crea una cuenta, copia la clave, cambia la URL base. Eso es toda la configuración.

Obtener clave de API