Círculo de intercambio de inteligencia artificial

Puesta en común diaria de los últimos productos, proyectos, marcos, interpretaciones de documentos, etc.~ sobre IA.
gpt-oss - OpenAI推出的开源推理模型系列

gpt-oss - una familia de modelos de inferencia de código abierto de OpenAI

gpt-oss es la familia de modelos de inferencia de código abierto de OpenAI que permite soluciones de IA eficientes, flexibles y fáciles de implementar para desarrolladores. gpt-oss se presenta en dos versiones, gpt-oss-120B con 117.000 millones de parámetros y soporte para 8...
hace 12 meses
062.4K
MiDashengLM - 小米开源的声音理解模型

MiDashengLM: el modelo de comprensión de sonido de código abierto de Xiaomi

MiDashengLM es el gran modelo de código abierto de Xiaomi para la comprensión eficaz del sonido, con la versión de parámetros específicos MiDashengLM-7B , centrada en el procesamiento y la comprensión del audio. El modelo se basa en Xiaomi Dasheng codificador de audio y Qwen2.5-Omn...
hace 12 meses
067.8K
MOSS-TTSD - 清华实验室开源的双语对话语音生成模型

MOSS-TTSD - Modelo de código abierto para la generación de diálogos bilingües del laboratorio Tsinghua

MOSS-TTSD es un modelo de diálogo hablado de código abierto desarrollado por el Laboratorio de Habla y Lenguaje de la Universidad de Tsinghua. MOSS-TTSD puede convertir guiones de diálogo de texto en habla de diálogo natural, fluida y expresiva, y admite la generación bilingüe.
hace 12 meses
068.7K
AudioGen-Omni - 快手推出的多模态音频生成模型

AudioGen-Omni - Un modelo de generación de audio multimodal de Racer

AudioGen-Omni es un modelo de generación de audio multimodal de Racer que genera audio, voz y canciones de alta calidad a partir de entradas como vídeo, texto, etc.AudioGen-Omni se basa en técnicas avanzadas como el transformador de difusión multimodal y...
hace 12 meses
067K
RedOne - 小红书最新推出的社交大模型

RedOne: el último megamodelo social de Little Red Book

RedOne es un gran modelo lingüístico adaptado a las redes sociales presentado por Little Red Book. El modelo se entrena mediante una estrategia de formación en tres fases que incorpora conocimientos sociales y culturales, refuerza las capacidades multitarea y alinea las preferencias humanas.RedOne supera significativamente al modelo base en rendimiento de tareas sociales, en detección de contenidos nocivos y navegación...
hace 12 meses
060.6K
FastDeploy - 百度推出的高性能大模型推理与部署工具

FastDeploy - Herramienta de Baidu de alto rendimiento para el razonamiento y despliegue de grandes modelos

FastDeploy es una herramienta de razonamiento y despliegue de alto rendimiento de Baidu, diseñada para grandes modelos lingüísticos (LLM) y modelos lingüísticos visuales (VLM). FastDeploy se ha desarrollado a partir del marco Flying Paddle (PaddlePaddle) y es compatible con diversas plataformas de hardware....
hace 12 meses
065.6K
InteriorGS - 群核科技推出的3D高斯语义数据集

InteriorGS - Conjunto de datos semánticos gaussianos en 3D de Qunar Technology

InteriorGS es un conjunto de datos semánticos gaussianos 3D de alta calidad presentado por Qunar Technology. El conjunto de datos contiene 1.000 escenas 3D que abarcan más de 80 entornos interiores, como viviendas, tiendas, salones de bodas y museos. El conjunto de datos contiene más de 554.000 instancias de objetos en 755 categorías...
hace 12 meses
066.1K
DragonV2.1 - 微软推出的零样本语音合成模型

DragonV2.1 - Modelos de síntesis de voz sin muestras de Microsoft

DragonV2.1 es un avanzado modelo de conversión de texto a voz (TTS) de muestra cero de Microsoft. Basado en la arquitectura Transformer, el modelo admite la clonación de voz en varios idiomas y sin muestras, y genera un habla natural y expresiva con solo 5-90 segundos de indicaciones de voz.
hace 12 meses
060.9K
ScreenCoder – 开源的UI截图生成前端代码工具

ScreenCoder - Herramienta de código abierto para la generación de capturas de pantalla de interfaz de usuario

ScreenCoder es una herramienta inteligente de código abierto para convertir rápidamente capturas de pantalla de diseño de interfaz de usuario en código HTML / CSS de alta calidad. Herramientas basadas en la arquitectura modular multi-inteligencia , combinado con la comprensión visual , la planificación de diseño y técnicas de síntesis de código para apoyar la generación de alta precisión y semántica front-end ...
hace 12 meses
075.7K
Kimi K2 高速版 - 月之暗面Kimi推出的高速版语言模型

Kimi K2 High-Speed Edition - Edición de alta velocidad del modelo de lenguaje lanzado por Dark Side of the Moon Kimi

Kimi K2 versión de alta velocidad (kimi-k2-turbo-preview) es un modelo de lenguaje de alto rendimiento introducido por Kimi, el Lado Oscuro de la Luna. El modelo está optimizado sobre la base de Kimi K2, y la velocidad de salida se incrementa en gran medida, que puede generar 40 Token por segundo....
hace 1 año
078.2K