Últimos recursos sobre IA

共 3185 篇文章
Uthana - AI 3D 角色动画生成平台,文字描述或参考视频生成逼真动画

Uthana - AI 3D plataforma de generación de animación de personajes, descripción de texto o vídeo de referencia para generar animación realista

Uthana es una potente plataforma AI de generación de animaciones de personajes en 3D. Los usuarios introducen descripciones de texto, cargan vídeos de referencia o buscan en bibliotecas de movimiento, y la IA puede generar rápidamente animaciones realistas que pueden adaptarse a modelos con cualquier estructura ósea. La plataforma está equipada con una gran variedad de funciones, como migración de estilos, integración de API, personalización...
hace 1 año
077.4K
Doppl - 谷歌推出的AI虚拟试衣应用

Doppl: aplicación de Google para pruebas virtuales con inteligencia artificial

Doppl es una aplicación de pruebas virtuales de inteligencia artificial de Google. Después de que el usuario sube una foto de cuerpo entero, la aplicación admite la imagen de la ropa o la captura de pantalla "desgaste" en la versión digital de su propio cuerpo, y se puede convertir de imágenes estáticas a vídeo generado por IA, por lo que los usuarios pueden sentir más verdaderamente el efecto de la ropa en el cuerpo.
hace 1 año
077.4K
商汤如影 - 商汤科技推出的AI数字人视频制作平台

Shangtang Ruyi: Shangtang Technology lanza una plataforma de producción de vídeo humano digital con IA

Shangtang Ruying es una plataforma de producción de vídeo humano digital con IA lanzada por Shangtang Technology. Basada en la tecnología de grandes modelos, la plataforma permite crear imágenes humanas digitales de gran realismo y personalizarlas, incluidos los rasgos faciales, la ropa, los peinados, etc. La plataforma está equipada con clonación de sonido, generación de vídeo, anotación automática de datos, interacción en tiempo real y otras funciones...
hace 1 año
077.3K
LongCat-Video - 美团LongCat开源的视频生成模型

LongCat-Video - Modelo de generación de vídeo de código abierto LongCat de la Misión

LongCat-Video es un modelo de generación de vídeo de 1.360 millones de parámetros de código abierto del equipo LongCat, que utiliza el protocolo de código abierto del MIT y soporta tres tareas principales: vídeo generado por texto, vídeo generado por gráficos y continuación de vídeo. El modelo, a través de la estrategia de generación "de grueso a fino" y el mecanismo de atención dispersa por bloques, puede ...
hace 11 meses
077.3K
VoxCPM 1.5 - 面壁智能开源的端到端文本到语音模型

VoxCPM 1.5 - Modelado de texto a voz de código abierto de extremo a extremo de Faceted Intelligence

VoxCPM 1.5 es un modelo de generación de voz de código abierto publicado por Facade Intelligence, basado en la tecnología de conversión de texto a voz (TTS) sin necesidad de divisor, con varias innovaciones y mejoras. Adoptando una arquitectura autorregresiva de difusión de extremo a extremo, genera formas de onda de habla continua directamente a partir del texto, evitando las limitaciones de los métodos tradicionales de segmentación...
hace 9 meses
077.2K
ChatGPT Agent – OpenAI推出的通用智能AI Agent

Agente ChatGPT - Agente IA de inteligencia general de OpenAI

ChatGPT Agent es un agente de IA de propósito general de OpenAI que combina múltiples capacidades para completar tareas complejas de forma autónoma. Los usuarios solo tienen que describir sus necesidades en lenguaje natural, y el Agente puede seleccionar automáticamente las herramientas adecuadas, como navegar por la web, extraer información, ejecutar código...
hace 1 año
077.2K
SkyReels-A3 - 昆仑万维推出的音频驱动数字人创作工具

SkyReels-A3 - Herramienta de creación humana digital basada en audio de KunlunWangwei

SkyReels-A3 es una herramienta de creación humana digital basada en audio de Kunlun World Wide Group. SkyReels-A3 es una herramienta de creación humana digital basada en audio que puede generar contenidos de vídeo dinámicos de alta calidad a partir de entradas sencillas (por ejemplo, imágenes de retratos y voz), hacer que fotos estáticas "cobren vida" y sustituir líneas de vídeos existentes por nuevas sincronizaciones labiales que los personajes...
hace 1 año
077.1K
Shortbread - AI漫画生成工具,自然语言描述完成漫画创作

Shortbread - Herramienta de generación de cómics AI, descripción en lenguaje natural para completar la creación de cómics

Shortbread es una herramienta de generación de cómics mediante inteligencia artificial que permite a los usuarios crear rápidamente cómics completos a partir de descripciones sencillas en lenguaje natural.Shortbread no requiere conocimientos de dibujo, basta con escribir el texto y la IA genera rápidamente cómics personalizados con personajes, escenas y emociones únicas.Sho...
hace 1 año
076.8K
Intern-S1-mini - 上海AI Lab开源的轻量化科学多模态模型

Intern-S1-mini - Modelo científico multimodal ligero de código abierto de Shanghai AI Lab

Intern-S1-mini es un macromodelo científico multimodal ligero con una escala de parámetros de 8B lanzado por el Laboratorio de Inteligencia Artificial de Shanghai (SAL).Hereda las potentes capacidades de Intern-S1, combinando tanto capacidades de propósito general como científicas especializadas, y es adecuado para un despliegue rápido y un desarrollo secundario. En términos de rendimiento, I...
hace 1 año
076.8K
Kaleido - 智谱AI联合清华大学等开源的多主体参考视频生成模型

Kaleido - Un modelo de generación de vídeo de referencia multisujeto de código abierto creado por Smart Spectrum AI en colaboración con la Universidad de Tsinghua y otras instituciones.

Kaleido es un modelo de generación de vídeo de referencia multisujeto de código abierto desarrollado conjuntamente por la Universidad Tecnológica de Hefei, la Universidad de Tsinghua y Smart Spectrum AI. Genera vídeos coherentes con el sujeto a través de múltiples imágenes de referencia, resolviendo las deficiencias de los modelos existentes en cuanto a coherencia multisujeto y desacoplamiento del fondo.Kaleido genera vídeos a través de un...
hace 9 meses
076.7K
Genie 3 - 谷歌推出的通用世界模型

Genie 3 - El modelo universal del mundo de Google

Genie 3 es una nueva generación de modelos de mundo universales de Google DeepMind que permiten generar mundos virtuales muy dinámicos y coherentes en tiempo real.Genie 3 simula fenómenos físicos, ecosistemas naturales y admite la creación de escenarios fantásticos e históricos. Con indicaciones de texto, los usuarios pueden...
hace 1 año
076.7K
职达AI简历 - AI简历生成与优化平台,精准分析问题、提供优化建议

JobTech AI CV - Plataforma de generación y optimización de CV mediante IA, que analiza con precisión los problemas y ofrece sugerencias de optimización.

Job AI resume es una plataforma inteligente de generación y optimización de currículos eficiente y cómoda. Basada en la tecnología de IA, la plataforma ayuda a los usuarios a generar rápidamente currículos profesionales y personalizados. Los usuarios sólo tienen que introducir la información básica y la experiencia, la plataforma puede generar curriculum vitae de alta calidad en poco tiempo, proporcionando más de 2800 plantillas hermosas, que cubren una variedad de posiciones.
hace 1 año
076.7K
NitroGen - 英伟达联合斯坦福大学、加州理工等开源的游戏AI模型

NitroGen: el modelo de IA para juegos de código abierto de NVIDIA en colaboración con Stanford, Caltech y otros.

NitroGen es un modelo de IA para juegos de código abierto desarrollado por NVIDIA en colaboración con la Universidad de Stanford, Caltech y otras instituciones, capaz de ejecutar más de 1.000 tipos de juegos diferentes. El modelo se basa en la arquitectura GROOT N1.5 y se obtiene mediante el análisis de 40.000 horas de datos de vídeo de juegos (incluida la anotación del funcionamiento del joystick)....
hace 9 meses
076.7K
InternVLA-A1 - 上海AI Lab开源一体化操作能力的具身大模型

InternVLA-A1 - Laboratorio de IA de Shanghai Integración de código abierto de capacidades operativas para grandes modelos incorporados

InternVLA-A1 es un gran modelo de operación encarnada de código abierto del Laboratorio de Inteligencia Artificial de Shanghai. Tiene la capacidad de comprender, imaginar y ejecutar la integración, y puede completar la tarea con precisión. El modelo fusiona datos de operación reales y simulados, y automatiza la construcción de activos de escena híbridos multimodales masivos a través de...
hace 1 año
076.5K
Qwen3-Coder-Flash - 阿里通义推出的开源高性能编程模型

Qwen3-Coder-Flash - un modelo de programación de alto rendimiento y código abierto de Ali Tongyi

Qwen3-Coder-Flash es un modelo de programación de alto rendimiento introducido por el equipo de Ali Tongyi Thousand Questions, que tiene excelentes capacidades de programación basada en agentes y de invocación de herramientas, y es bueno en el manejo de tareas de programación complejas. El modelo soporta 256K tokens de comprensión de contexto largo, y puede escalar a 1M ...
hace 1 año
076.3K
GLM-Experimental - 智谱AI推出的实验性模型

GLM-Experimental - un modelo experimental lanzado por Smart Spectrum AI

GLM-Experimental es un modelo lingüístico experimental de gran tamaño lanzado por Wisdom Spectrum AI, que ya está disponible en la plataforma Z.ai. El modelo tiene la capacidad de generar automáticamente PPT. Después de que los usuarios introduzcan temas o puntos clave, el modelo puede generar rápidamente presentaciones claramente estructuradas y formateadas, que...
hace 1 año
076.3K
无问芯穹:企业级AI开发,云端资源服务平台

Sin preguntas Core Dome: desarrollo de IA empresarial, plataforma de servicios de recursos en la nube

Introducción integral No Ask Core Dome es una plataforma de servicios integral para desarrolladores de IA, que proporciona herramientas de desarrollo de IA capaces y grandes servicios de modelos. La plataforma cuenta con diversas herramientas de desarrollo de aprendizaje automático, como AIStudio, GenStudio, etc. También admite el despliegue de modelos, el almacenamiento de datos y...
hace 2 años
076.1K
靠岸妙写 - AI论文写作工具,构思到成稿一站式解决

Cushion Wonderful Writer - AI essay writing tool, one-stop solution from idea to finished paper

Leaning Wonderful Writer es una herramienta de escritura de tesis AI que proporciona una solución eficiente y conveniente para la escritura académica. La herramienta es compatible con la generación de un solo clic de esquema, resumen y primer borrador de la tesis, que es aplicable a diferentes niveles de las necesidades académicas, tales como licenciatura y maestría, que abarca campos multidisciplinares como la ciencia y la tecnología, las artes liberales y las ciencias sociales.
hace 1 año
076.1K
企鹅读伴 - 腾讯推出的中小学生AI阅读助手

Penguin Reading Companion: el asistente de lectura inteligente de Tencent para estudiantes de primaria y secundaria

Penguin Reading Companion es un asistente de lectura con inteligencia artificial diseñado por Tencent para estudiantes de primaria y secundaria. Penguin Reading Companion se basa en el gran modelo híbrido y la plataforma de metamáquinas de Tencent, combinados con el Programa Curricular de Lenguas de Educación Obligatoria y los Estándares Curriculares (Edición 2022), para ofrecer a los estudiantes recomendaciones de lectura personalizadas, múltiples modos de lectura (concentración, lectura en voz alta, escucha...
hace 1 año
076K
Klic Studio - AI音视频翻译配音工具,一键部署全流程

Klic Studio - Herramienta de traducción y doblaje de audio/vídeo con IA, despliegue de todo el proceso con un solo clic

Klic Studio (antes Krillin AI) es una herramienta de traducción de vídeo, doblaje y clonación de voz basada en IA diseñada para creadores de vídeo y exportadores de contenidos. Es compatible con la implementación de un solo clic de todo el proceso, que puede completar el vídeo desde la descarga hasta la salida terminada en un solo clic, y se adapta a Jittery, Xiaohongshu, B...
hace 1 año
076K
MiniMax Music 1.5 - MiniMax最新推出的AI音乐生成模型

MiniMax Music 1.5 - ¡El último modelo de generación de música por IA de MiniMax!

MiniMax Music 1.5 es una herramienta avanzada de generación de música por IA que permite generar hasta 4 minutos de música a partir de la descripción en lenguaje natural del usuario. El modelo es compatible con una amplia gama de estilos musicales y personalización del estado de ánimo, y genera tonos vocales naturales y completos, transiciones suaves y arreglos ricamente estratificados....
hace 1 año
075.7K
Squibler - AI小说辅助写作平台,助力构思到创作全过程

Squibler: plataforma de escritura asistida por inteligencia artificial que impulsa todo el proceso, desde la idea hasta la creación.

Squibler es una potente plataforma de escritura asistida por IA diseñada para escritores que ayuda a los usuarios en todo el proceso, desde la concepción a la creación y la publicación. La plataforma ofrece diversas plantillas de historias que abarcan novelas, guiones, relatos cortos, etc. Los usuarios solo tienen que introducir el concepto inicial, y la IA puede generar esquemas, personajes, escenas...
hace 1 año
075.5K
Goedel-Prover-V2 - 普林斯顿联合清华和英伟达等开源的定理证明模型

Goedel-Prover-V2 - Modelo de demostración de teoremas de código abierto de Princeton en colaboración con Tsinghua y NVIDIA, entre otros.

Goedel-Prover-V2 es un modelo de demostración de teoremas de código abierto creado por instituciones tan importantes como la Universidad de Princeton, la Universidad de Tsinghua y NVIDIA. El modelo se basa en técnicas innovadoras como la síntesis jerárquica de datos, la autocorrección guiada por el verificador y el promediado de modelos para mejorar significativamente el rendimiento de las pruebas formales automatizadas....
hace 1 año
075.4K
MoE-TTS - 昆仑万维推出的最新语音生成框架

MoE-TTS: el último marco de generación de voz de KunlunWei

MoE-TTS es un marco de síntesis del habla introducido por KunlunWanwei, basado en la arquitectura Mixed Expert (MoE), que combina Large Language Models (LLMs) preentrenados con módulos expertos del habla.MoE-TTS conserva el potente razonamiento textual congelando los parámetros del módulo textual y actualizando sólo los parámetros del módulo del habla....
hace 1 año
075.3K
Skywork-SWE-32B - 昆仑万维开源的自主代码智能体基座模型

Skywork-SWE-32B - Modelo base de cuerpo inteligente de código abierto autónomo KunlunWanwei

Skywork-SWE-32B es un modelo de base de inteligencias de código autónomas de ingeniería de software (SWE) a escala 32B de código abierto introducido por Kunlun World Wide Web. El modelo se centra en tareas de ingeniería de software, tiene potentes capacidades de reparación de código a nivel de repositorio y puede funcionar en escenarios complejos con interacciones de varias rondas y procesamiento de texto largo....
hace 1 año
075.3K
Seed GR-3 - 字节跳动Seed团队推出的通用机器人模型

Seed GR-3 - Modelo de robótica de uso general del equipo Wordpress Seed

Seed GR-3 es un modelo robótico de uso general introducido por ByteDance con una gran capacidad de generalización para adaptarse a nuevos entornos y órdenes complejas. El modelo fusiona información visual, verbal y de movimiento, y se basa en un método de entrenamiento tres en uno de datos del robot, datos de trayectoria humana de RV y datos gráficos públicos para mejorar la capacidad de respuesta a nuevos objetos....
hace 1 año
075.2K
Lumina-DiMOO - 上海AI Lab联合华为昇腾开源的多模态大模型

Lumina-DiMOO - Un gran modelo multimodal de código abierto del Laboratorio de Inteligencia Artificial de Shanghai y Huawei Rise

Lumina-DiMOO es un modelo unificado de nueva generación para la generación y comprensión multimodal lanzado por el Laboratorio de Inteligencia Artificial de Shanghái (SAL) junto con Huawei Rise en la Conferencia Mundial sobre Inteligencia Artificial 2025. Basado en la plataforma básica de hardware y software Rise AI y en el conjunto de grandes modelos multimodales MindSpeed MM, completa la...
hace 1 año
075.2K
HunyuanImage 3.0 - 腾讯开源的免费多模态图像生成模型

HunyuanImage 3.0 - Modelo gratuito de generación de imágenes multimodales de código abierto de Tencent

HunyuanImage 3.0 (Hunyuan Image 3.0) es un modelo nativo de generación de imágenes multimodales publicado y de código abierto por Tencent. El tamaño de los parámetros del modelo de 80B, es actualmente los mejores resultados de evaluación, el mayor número de parámetros del modelo de generación de imágenes de código abierto. Hybrid Image 3.0 soporta la generación de imágenes en tiempo real, los usuarios pueden...
hace 12 meses
075.2K
Ovis-U1 - 阿里推出的多模态统一AI模型

Ovis-U1: un modelo multimodal de IA unificada lanzado por Ali

Ovis-U1 es un modelo unificado multimodal introducido por el equipo Ovis de Alibaba Group con una escala de parámetros de 3.000 millones. El modelo cuenta con tres capacidades básicas de comprensión multimodal, generación de texto a imagen y edición de imágenes, y con un diseño arquitectónico avanzado y métodos de formación colaborativos y unificados, apoya la realización de...
hace 1 año
075.1K
EXAONE 4.0 - LG推出的混合推理模型

EXAONE 4.0 - Modelo de razonamiento híbrido de LG

EXAONE 4.0 es un gran modelo híbrido de razonamiento de LG AI Research (Corea) que combina el procesamiento del lenguaje natural de uso general con funciones avanzadas de razonamiento. El modelo es compatible con coreano, inglés y español y se divide en una versión profesional de 32B y una versión final de 1,2B. La versión profesional es adecuada para los sectores jurídico, contable...
hace 1 año
075K
DeckSpeed - AI PPT制作工具,自然语言生成演示文稿

DeckSpeed - AI PPT Maker, Presentación Generada con Lenguaje Natural

DeckSpeed es una herramienta de creación de presentaciones por IA basada en la interacción conversacional, en la que los usuarios expresan sus necesidades basándose en el lenguaje natural para generar rápidamente diapositivas personalizadas sin depender de las plantillas tradicionales. La herramienta admite ajustes de retroalimentación en tiempo real, los usuarios pueden modificar el color, el estilo y el contenido de las diapositivas en cualquier momento, para garantizar que la presentación esté completa....
hace 1 año
074.9K
Confucius3-Math - 网易有道推出专注于数学教育的开源推理模型

Confucius3-Math - NetEase.com lanza un modelo de razonamiento de código abierto centrado en la enseñanza de las matemáticas

Confucius3-Math es el primer modelo de razonamiento de código abierto nacional centrado en la educación matemática de código abierto por NetEaseYouDao. Con 14.000 millones de parámetros, optimizado para escenarios de educación matemática K-12, puede ejecutarse eficientemente en una sola GPU de consumo (por ejemplo, RTX 4090D), con un rendimiento de inferencia de...
hace 1 año
074.4K
稿定AI社区 - AI创意内容设计平台,多种设计资源满足不同创作需求

Drafting AI Community - Plataforma de diseño de contenidos creativos con IA, una variedad de recursos de diseño para satisfacer diferentes necesidades creativas.

Drafting AI Community es una plataforma en línea de inspiración creativa en IA que proporciona a los usuarios una gran cantidad de recursos y herramientas de diseño creativo. La plataforma abarca diversos campos del diseño, como fotos de imágenes, diseño de comercio electrónico, temas de vacaciones, ilustraciones en 3D, diseño de avatares, materiales Xiaohongshu, diseño de retratos, etc., para satisfacer las necesidades de los distintos usuarios.
hace 1 año
074.1K
CRIC深度智联 - 克而瑞推出的中国房地产首个AI Agent

CRIC - CRIC lanza el primer agente de IA para el sector inmobiliario chino

CRIC Depth Intelligence es el primer organismo inteligente de IA del sector inmobiliario chino desarrollado de forma independiente por CRIC, basado en los 20 años de experiencia y acumulación de datos de CRIC en el sector inmobiliario y en la tecnología de grandes modelos multimodales, que abre toda la cadena desde la integración de datos, el análisis inteligente hasta la generación de contenidos.
hace 1 año
074K
ThinkSound - 阿里通义推出的音频生成模型

ThinkSound - Modelado de generación de audio de Ali Tongyi

ThinkSound es el primer modelo de generación de audio CoT (Chain Thinking) introducido por el equipo de discurso de Ali Tongyi. El modelo puede generar efectos de sonido adaptados con precisión a imágenes de vídeo, basándose en la introducción del razonamiento CoT, para resolver el problema de que la tecnología tradicional es difícil de captar los detalles dinámicos de la pantalla y las relaciones espaciales.
hace 1 año
074K
AutoMV - M-A-P联合北邮、南大等开源的免费音乐视频生成系统

AutoMV - Sistema libre de generación de vídeos musicales de código abierto M-A-P en colaboración con Beipiao, NU y otros.

AutoMV es un sistema de generación de vídeos musicales de código abierto desarrollado por el equipo de M-A-P en colaboración con varias universidades, que puede generar automáticamente vídeos musicales coherentes a partir de canciones completas sin necesidad de formación.Adopta un modelo de colaboración multiinteligencia, que incluye módulos de análisis musical, escritura de guiones, dirección y control de calidad, y puede analizar con precisión letras, ritmos...
hace 9 meses
074K
Genie Envisioner - 智元联合北航等开源的通用机器人操作平台

Genie Envisioner: la plataforma robótica de código abierto de uso general de Jiyuan con Beihang y otras entidades

Genie Envisioner (GE) es una plataforma unificada para operaciones robóticas desarrollada por el equipo de Genie Robotics en colaboración con la Universidad Nacional de Singapur, la Universidad de Aeronáutica y Astronáutica de Pekín y otras instituciones. Permite a los robots comprender y realizar mejor las tareas "imaginando primero y actuando después".
hace 1 año
073.9K
CWM - Meta FAIR开源的代码世界语言模型

CWM - Modelo Meta FAIR de lenguaje mundial de código abierto

CWM (Code World Model) es un modelo de lenguaje mundial de código abierto con 32.000 millones de parámetros publicado por el equipo Meta FAIR, diseñado para la generación y el razonamiento de código. Introduce el concepto de "modelo del mundo", que puede simular el proceso de ejecución del código, predecir los cambios de estado de las variables y avanzar...
hace 12 meses
073.9K
全球首个量子 AI 模型问世!SECQAI 发布 QLLM 即将进入 Beta 测试

SECQAI lanza QLLM para pruebas beta: ¡el primer modelo de inteligencia artificial cuántica del mundo!

SECQAI, una empresa británica de hardware y software ultraseguros, ha anunciado el lanzamiento del primer Modelo Cuántico de Lenguaje Grande (QLLM) del mundo, que integra la tecnología de computación cuántica en los modelos tradicionales de IA para mejorar la eficiencia computacional y la capacidad de resolución de problemas. Mecánica cuántica + IA = ¿una IA más potente? ...
hace 2 años
073.6K
MinerU2.5 - 上海AI Lab联合北大开源的文档解析模型

MinerU2.5 - Modelo de análisis sintáctico de documentos de código abierto del Laboratorio de Inteligencia Artificial de Shanghai y la Universidad de Pekín

MinerU2.5 es un modelo de lenguaje visual desacoplado desarrollado conjuntamente por el Laboratorio de Inteligencia Artificial de Shanghai y el equipo de la Universidad de Pekín, centrado en el procesamiento eficiente del análisis sintáctico de imágenes de documentos de alta resolución. La principal innovación radica en el diseño en dos fases de la "detección de la disposición global seguida del reconocimiento del contenido local": la primera fase...
hace 11 meses
073.5K
MedASR - 谷歌开源的医疗语音识别模型

MedASR - Modelo de reconocimiento médico del habla de código abierto de Google

MedASR es un modelo de reconocimiento del habla médica con 105 millones de parámetros, de código abierto de Google, perfeccionado con un corpus clínico desensibilizado de 5.000 horas, optimizado para la terminología de fármacos, dosis y anatomía, con un modelo de lenguaje médico integrado de 6 gramos y una tasa de error de palabra de sólo el 4,6 en el conjunto de datos privados de radiología RAD-DICT...
hace 9 meses
073.4K
悟能 - 商汤科技最新推出的具身智能平台

Wuneng, la última plataforma de inteligencia corporal de ShangTech

Wuneng es una plataforma de inteligencia incorporada diseñada para robots y dispositivos inteligentes. Basada en el modelo del mundo "Iluminado" y en la tecnología de grandes modelos multimodales, Wuneng integra entradas multisensoriales como la visión, la voz, el tacto, etc., y posee potentes capacidades de percepción, toma de decisiones y acción.
hace 1 año
073.3K
AntSK FileChunk - 免费的AI语义文档切片工具,动态切片调整

AntSK FileChunk - Herramienta gratuita de rebanado semántico de documentos AI, ajuste dinámico de rebanado

AntSK FileChunk es una herramienta gratuita de rebanado inteligente de documentos diseñada para aplicaciones RAG (Retrieval Augmented Generation). Semántica como núcleo, el documento será inteligentemente rebanado en segmentos semánticamente completos, coherentes, soporte para multi-idioma, ajustar dinámicamente el tamaño de la rebanada para asegurar la coherencia contextual.
hace 1 año
073.3K
Qwen-Image-Layered - 阿里团队开源的AI图像编辑模型

Qwen-Image-Layered - Modelo de edición de imágenes por IA de código abierto por el equipo de Ali

Qwen-Image-Layered es un modelo de edición de imágenes de AI de código abierto del equipo Ali que descompone de forma inteligente imágenes ordinarias en capas transparentes independientes para lograr una edición de precisión similar a la de Photoshop. El modelo es de código abierto mediante el protocolo Apache 2.0 y admite un control flexible de las capas...
hace 9 meses
073.1K
Lucy Edit - 开源的AI视频编辑工具,自然语言描述编辑

Lucy Edit - Herramienta de edición de vídeo con inteligencia artificial de código abierto, edición de descripciones en lenguaje natural

Lucy Edit es una herramienta de edición de vídeo de IA de código abierto desarrollada por Decart AI. Permite a los usuarios editar vídeo mediante sencillas descripciones en lenguaje natural, como "cambiar el personaje en un oso polar" o "convertir la escena en un estilo de dibujos animados 2D", sin necesidad de complejos ajustes finos ni del uso de máscaras...
hace 1 año
073K
Step-Audio 2 mini - 阶跃星辰开源的语音大模型

Step-Audio 2 mini - Macromodelado del habla de código abierto Step-Star

Step-Audio 2 mini es un macromodelo del habla integral de código abierto de Step-Audio. Rompe con la estructura tradicional del modelo del habla y adopta una verdadera arquitectura multimodal de extremo a extremo, que transforma directamente la entrada de audio sin procesar en salida de respuesta del habla, con menor latencia, y comprende la información paralingüística y las señales no vocales.
hace 1 año
072.6K