Círculo de intercambio de inteligencia artificial

Puesta en común diaria de los últimos productos, proyectos, marcos, interpretaciones de documentos, etc.~ sobre IA.
MiMo-VL - 小米开源的多模态模型

MiMo-VL: el modelo multimodal de código abierto de Xiaomi

MiMo-VL es el gran modelo multimodal de código abierto de Xiaomi, que consta de un codificador visual, una capa de proyección multimodal y un modelo de lenguaje. El codificador visual se basa en Qwen2.5-ViT, que admite entradas de resolución nativa y conserva más detalles; el modelo de lenguaje es el MiMo-7B de desarrollo propio de Xiaomi, diseñado para proyecciones complejas....
hace 1 año
083.7K
Olovka AI - AI学术写作辅助平台,提供精准的写作建议和辅助

Olovka AI - Plataforma de ayuda a la escritura académica con IA para un asesoramiento y asistencia precisos en la escritura

Olovka AI es una plataforma de ayuda a la redacción académica para estudiantes, que proporciona asesoramiento y asistencia precisos en función del nivel académico, el campo de especialización y el tipo de trabajo. Basándose en algoritmos inteligentes, Olovka AI ayuda a los estudiantes a escribir rápidamente trabajos académicos de alta calidad que serán...
hace 1 año
081.3K
Fish Audio - AI 语音合成与声音克隆工具

Fish Audio - Herramienta AI de síntesis de voz y clonación de sonidos

Fish Audio es una potente herramienta de síntesis de voz generativa AI que soporta texto a voz (TTS) y la clonación de voz. Los usuarios sólo tienen que introducir texto, la herramienta es compatible con la conversión de voz natural y suave, la plataforma ofrece una variedad de idiomas y estilos de voz para elegir, para satisfacer diferentes escenarios y...
hace 1 año
0133.9K
SignGemma - 谷歌 DeepMind 推出的手语翻译模型

SignGemma - Modelo de traducción del lenguaje de signos de Google DeepMind

SignGemma es el modelo de IA de interpretación del lenguaje de signos más potente del mundo, creado por Google DeepMind, que permite traducir con precisión el lenguaje de signos estadounidense (ASL) a texto en inglés. El modelo se basa en el entrenamiento multimodal, combinando datos visuales y textuales para captar las acciones del lenguaje de signos en tiempo real y traducirlas rápidamente a texto....
hace 1 año
087.2K
FLUX.1 Kontext - 黑森林推出的图像生成与编辑模型

FLUX.1 Kontext - Modelo de generación y edición de imágenes de la Selva Negra

FLUX.1 Kontext es un modelo de generación y edición de imágenes de Black Forest Labs que proporciona técnicas de procesamiento de imágenes conscientes del contexto. El modelo entiende las respuestas a las señales de texto e imagen, realiza tareas como la modificación de objetos, la conversión de estilos y la sustitución del fondo, manteniendo la esquina...
hace 1 año
071.7K
WebAgent - 阿里通义开源的自主搜索AI Agent

WebAgent - Agente AI de búsqueda autónoma de código abierto Ali Tongyi

WebAgent es un agente de búsqueda autónoma de Alibaba Tongyi Labs con una potente capacidad de recuperación de información autónoma de extremo a extremo y de razonamiento en varios pasos. WebAgent puede percibir, decidir y actuar activamente en el entorno de red como los humanos, y se utiliza ampliamente en la investigación académica, la toma de decisiones empresariales...
hace 1 año
085.5K
灵码 IDE - 通义灵码推出 AI 原生开发环境工具

Lingcode IDE - Tongyi Lingcode lanza herramientas de entorno de desarrollo nativo de IA

Spirit Code IDE es el entorno de desarrollo integrado (IDE) nativo de IA lanzado por Tongyi Spirit Code, que está profundamente adaptado a los 3 modelos principales de Thousand Questions, y tiene un potente modo de cuerpo inteligente de programación para apoyar la realización autónoma de tareas como la percepción del proyecto, la recuperación de código y la ejecución de operaciones terminales. Es compatible con las herramientas de MCP e integra Magic Hitch MCP Square's 3...
hace 1 año
081.1K
BAGEL - 字节跳动推出的开源多模态基础模型

BAGEL - Modelo de base multimodal de código abierto lanzado por Wordpress

BAGEL es un modelo base multimodal de código abierto de ByteDance con 14.000 millones de parámetros, de los cuales 7.000 millones están activos. La base del modelo y la Arquitectura Experta de Transformación Mixta (MoT), que captura las características a nivel de píxel y a nivel semántico de una imagen con dos codificadores independientes respectivamente, admite un procesamiento eficiente de imagen, texto, vídeo...
hace 1 año
079.4K
DeepSeek-R1 - DeepSeek推出的AI推理模型,性能对齐 OpenAI o1 正式版

DeepSeek-R1 - Modelo de inferencia de IA de DeepSeek, rendimiento alineado con la versión OpenAI o1

DeepSeek-R1 es un modelo de inferencia de IA de alto rendimiento lanzado por DeepSeek, con sede en Hangzhou, que se compara con la versión oficial o1 de OpenAI. El modelo está post-entrenado sobre la base de técnicas de aprendizaje por refuerzo a gran escala y solo requiere una cantidad muy pequeña de datos etiquetados para razonar en matemáticas, código y lenguaje natural....
hace 1 año
086.1K
幻舟AI - 一站式AI短片创作平台,批量生成各类型视频内容

Phantom Boat AI - Plataforma única de creación de cortometrajes con IA, generación por lotes de varios tipos de contenidos de vídeo.

Phantom Boat AI es una potente plataforma integral de creación de cortometrajes con IA que permite la generación eficiente por lotes de varios tipos de contenidos de vídeo, incluidos anuncios, promos, animaciones y mucho más. La plataforma se basa en Midjourney, Runway y otros modelos de IA líderes en el mundo, y ofrece a los creadores una amplia gama de servicios, desde la escritura de guiones hasta...
hace 1 año
086.5K