Proyecto AI de código abierto

Total 1020 artículos
简单易用的开源AI写作助手

Asistente de escritura con inteligencia artificial de código abierto y fácil de usar

Introducción general AI Writing Assistant es un asistente de escritura AI de código abierto basado en Next.js, alojado en GitHub, diseñado para ayudar a escritores, creadores de contenido y profesionales de la redacción a mejorar la eficiencia y la calidad de su escritura a través de la tecnología de inteligencia artificial. La herramienta permite a los usuarios detallar...
hace 2 años
090.9K
Gemini Next Chat:一键免费部署您的私人多模态Gemini应用

Gemini Next Chat: ¡Despliegue gratis su aplicación privada multimodal Gemini con un solo clic!

Introducción general Gemini Next Chat es un proyecto de código abierto diseñado para ayudar a los usuarios a desplegar fácilmente aplicaciones Gemini privadas. El proyecto soporta los modelos multimodales Gemini 1.5 y Gemini 2.0 , los usuarios pueden desplegar con un click en Vercel...
hace 2 años
090.9K
StickerBaker:用AI制作个性贴纸图片

StickerBaker: Crea pegatinas personalizadas con IA

Descripción general stickerbaker es un creador de pegatinas de código abierto que utiliza tecnología de inteligencia artificial para crear una gran variedad de pegatinas interesantes. Tanto si quieres una simple pegatina de un gato como si quieres hacer una serie de pegatinas diversas, stickerbaker puede satisfacer tus necesidades....
hace 2 años
090.8K
Together Open Deep Research:生成带索引的深度研究报告

Together Open Deep Research: generación de informes indexados de investigación profunda

Introducción general Open Deep Research es una herramienta de investigación en profundidad desarrollada y de código abierto por el equipo Together AI y alojada en GitHub. Simula el proceso de investigación humana mediante un flujo de trabajo de IA multiagente, generando informes de investigación detallados...
hace 1 año
090.8K
Deep Research Web UI:支持多语言深度研究的AI助手

Deep Research Web UI: un asistente de inteligencia artificial para la investigación profunda multilingüe

Introducción exhaustiva Deep Research Web UI es una herramienta asistente de investigación de código abierto basada en tecnología de IA, diseñada para ayudar a los usuarios a realizar investigaciones iterativas profundas sobre cualquier tema. Combina la potencia de los motores de búsqueda, el rastreo web y el modelado lingüístico a gran escala a través de una interfaz web intuitiva....
hace 1 año
090.7K
LaWGPT:中文法律知识模型,支持法律问答和司法考试训练

LaWGPT: modelización de los conocimientos jurídicos chinos, apoyo a los cuestionarios jurídicos y formación para los exámenes judiciales.

Introducción general LaWGPT es un proyecto de código abierto apoyado por el Grupo de Investigación de Aprendizaje Automático y Minería de Datos de la Universidad de Nanjing, que se dedica a construir un gran modelo lingüístico basado en el conocimiento jurídico chino. Se basa en modelos chinos genéricos (como Chinese-LLaMA y ChatGLM)...
hace 2 años
090.6K
LiberSonora:有声书字幕提取与多语言翻译,有声小说转录为多语言

LiberSonora: Extracción de subtítulos de audiolibros y traducción multilingüe, transcripción de audiolibros a varios idiomas

Introducción LiberSonora, que significa "sonido libre", es un potente conjunto de herramientas de código abierto para audiolibros. Es compatible con la extracción inteligente de subtítulos, la generación de títulos AI, traducción multi-idioma, etc., y es capaz de procesamiento por lotes fuera de línea bajo GPU acceleration.LiberSo...
hace 2 años
090.6K
Llama 3.2 Reasoning WebGPU:在浏览器中运行LLama-3.2

WebGPU de razonamiento de Llama 3.2: ejecución de Llama-3.2 en un navegador

Introducción general Transformers.js es una biblioteca JavaScript proporcionada por Hugging Face diseñada para ejecutar modelos de aprendizaje automático de última generación directamente en el navegador, sin soporte de servidor. La librería funciona conjuntamente con la plataforma Hugging Fa...
hace 2 años
090.4K
CoT-Lab:探索人机协作迭代思考的实验性对话工具

CoT-Lab: una herramienta de diálogo experimental para explorar el pensamiento iterativo sobre la colaboración persona-ordenador.

CoT-Lab es una interfaz experimental para explorar nuevos paradigmas en la colaboración entre humanos y ordenadores. Basado en la Teoría de la Carga Cognitiva y los Principios del Aprendizaje Activo, CoT-Lab facilita una profunda alineación cognitiva entre humanos e Inteligencia Artificial (IA) mediante la creación de relaciones de "compañero pensante". El proyecto pretende...
hace 2 años
090.4K
MOFA Video:运动场适配技术将静态图像转换为视频

Vídeo MOFA: la tecnología de adaptación del campo de movimiento convierte imágenes fijas en vídeo

Introducción general MOFA-Video es una herramienta de generación de animación de imágenes de última generación que utiliza técnicas generativas de adaptación de campos de movimiento para convertir imágenes estáticas en vídeos dinámicos. Se ha desarrollado en colaboración con la Universidad de Tokio y Tencent AI Lab, y se presentará en la Conferencia Europea de Visión por Computador de 2024 (E...
hace 2 años
090.4K
MM-EUREKA:探索视觉推理的多模态强化学习工具

MM-EUREKA: una herramienta multimodal de aprendizaje por refuerzo para explorar el razonamiento visual

Introducción general MM-EUREKA es un proyecto de código abierto desarrollado por el Laboratorio de Inteligencia Artificial de Shanghai, la Universidad Jiao Tong de Shanghai y otras partes. Amplía las capacidades de razonamiento textual a escenarios multimodales mediante técnicas de aprendizaje por refuerzo basadas en reglas para ayudar a los modelos a procesar información de imágenes y texto. El núcleo de esta herramienta...
hace 2 años
090.3K
Vision Parse: conversión inteligente de documentos PDF al formato Markdown mediante modelos de lenguaje visual

Vision Parse: conversión inteligente de documentos PDF al formato Markdown mediante modelos de lenguaje visual

Introducción completa Vision Parse es una revolucionaria herramienta de procesamiento de documentos, que combina inteligentemente la tecnología más avanzada de modelos de lenguaje visual (Vision Language Models), la capacidad de convertir inteligentemente documentos PDF a formato Markdown de alta calidad...
hace 2 años
090.3K
X-R1:在普通设备中低成本训练0.5B模型

X-R1: Formación de modelos 0,5B en dispositivos comunes a bajo coste

Introducción general X-R1 es un marco de aprendizaje por refuerzo de código abierto en GitHub por el equipo dhcode-cpp, con el objetivo de proporcionar a los desarrolladores una herramienta eficiente y de bajo coste para el entrenamiento de modelos basados en el aprendizaje por refuerzo de extremo a extremo. El proyecto cuenta con el apoyo de DeepSeek...
hace 2 años
090.3K
zChunk:基于Llama-70B的通用语义分块策略

zChunk: una estrategia genérica de fragmentación semántica basada en Llama-70B

Introducción general zChunk es una novedosa estrategia de chunking desarrollada por ZeroEntropy que pretende ofrecer una solución para el chunking semántico genérico. La estrategia se basa en el modelo Llama-70B, que optimiza el proceso de chunking de los documentos solicitando la generación de trozos, lo que garantiza que la recuperación de información se mantenga en un alto...
hace 2 años
090.2K
OneLine:生成热点事件时间轴的AI工具

OneLine: una herramienta de IA para generar cronologías de acontecimientos candentes

Introducción general OneLine es una herramienta de código abierto para generar cronologías de eventos alojada en GitHub y desarrollada por el usuario chengtx809. Genera rápidamente una línea de tiempo de eventos por palabras clave introducidas por el usuario, mostrando la hora, título, descripción y personas relacionadas del evento....
hace 1 año
090.1K
LivePortrait:静态图像、视频生成动态肖像动画工具

LivePortrait: herramienta de animación para generar retratos dinámicos a partir de imágenes fijas y vídeos

Introducción general LivePortrait es una herramienta avanzada de animación dinámica de retratos AI desarrollada por Racer Technology. Utiliza una innovadora tecnología de IA para transformar imágenes fijas en vívidas animaciones de vídeo. Tanto si utiliza fotos reales, estilos de animación o retratos artísticos, LivePo...
hace 2 años
090.1K
Xata Agent:监控和优化PostgreSQL数据库的AI助手

Xata Agent: un asistente de IA para monitorizar y optimizar bases de datos PostgreSQL

Descripción general Xata Agent es una herramienta de IA de código abierto diseñada específicamente para bases de datos PostgreSQL. Supervisa automáticamente el estado operativo de la base de datos, encuentra la causa raíz de los problemas de rendimiento o fallos y ofrece recomendaciones para solucionarlos. El equipo de desarrollo xAI lo posiciona como un...
hace 2 años
090K
DualPipe:双向流水线并行算法,提升大规模AI模型训练效率(DeepSeek 开源周第四天)

DualPipe: a bi-directional pipelined parallel algorithm to improve the efficiency of large-scale AI model training (DeepSeek Open Source Week Day 4)

Introducción general DualPipe es una tecnología de código abierto desarrollada por el equipo de DeepSeek-AI centrada en mejorar la eficiencia del entrenamiento de modelos de IA a gran escala. Se trata de un innovador algoritmo paralelo bidireccional canalizado que se utiliza principalmente en DeepSeek-V3 y R1....
hace 2 años
089.9K
Marco-o1:基于Qwen2-7B-Instruct微调的开源版OpenAI o1模型,探索开放式推理模型,解决复杂问题

Marco-o1: una versión de código abierto del modelo OpenAI o1 basado en Qwen2-7B-Instruye el ajuste fino para explorar modelos de inferencia abiertos para resolver problemas complejos.

Introducción Marco-o1 es un modelo de razonamiento abierto desarrollado por Alibaba International Digital Commerce Group (AIDC-AI) para resolver problemas complejos del mundo real. El modelo combina el ajuste fino de Chain of Thought (CoT), Monte Carlo Tree Search (MCTS) y estrategias de razonamiento innovadoras....
hace 2 años
089.9K
Quantum Swarm:多智能体集群协作框架

Quantum Swarm: un marco para la colaboración multiinteligente en clústeres

Quantum Swarm es un marco de inteligencia artificial de código abierto centrado en el desarrollo y la investigación de inteligencia poblacional AI. El proyecto es mantenido por el equipo de Quarm AI en GitHub y tiene como objetivo proporcionar una plataforma flexible y eficiente para construir y probar sistemas multiinteligencia.Quan...
hace 2 años
089.8K
GraphCast:基于扩散模型的学习并预测中期全球天气预报的高效工具

GraphCast: una herramienta eficaz de aprendizaje y previsión de predicciones meteorológicas mundiales a medio plazo basada en modelos de difusión

Introducción general GraphCast es una herramienta avanzada de previsión meteorológica desarrollada por Google DeepMind que pretende mejorar la precisión de las previsiones meteorológicas globales a medio plazo mediante técnicas de aprendizaje profundo. El proyecto proporciona una variedad de modelos preentrenados y código de muestra, que los usuarios pueden...
hace 2 años
089.8K
DisPose:生成人体姿态精准控制的视频,创作跳舞的小姐姐

DisPose: generación de vídeos con control preciso de la postura humana, creación de bailarinas

Introducción general DisPose es un innovador proyecto de inteligencia artificial de código abierto centrado en la generación controlada de animación de imágenes de personajes. Desarrollado por un equipo de investigadores y de código abierto en GitHub, el proyecto utiliza técnicas avanzadas de aprendizaje profundo para lograr un control preciso de la animación de personajes mediante la descomposición de la información de pose esquelética.D...
hace 2 años
089.7K
GitPodcast:将GitHub仓库转化为播客,随时随地收听代码更新

GitPodcast: Convierte tus repositorios de GitHub en podcasts y escucha las actualizaciones de código en cualquier momento y lugar.

Introducción general GitPodcast es una herramienta innovadora diseñada para convertir los repositorios de GitHub en podcasts, permitiendo a los desarrolladores escuchar las actualizaciones de código en cualquier momento y lugar. Utilizando OpenAI y Azure Speech SDK, GitPodca...
hace 2 años
089.7K
Auto-Coder.Chat:基于终端命令行的AI辅助编程助手,提供VSCode插件

Auto-Coder.Chat: asistente de programación asistido por IA basado en la línea de comandos del terminal con el complemento VSCode.

Introducción general Auto-Coder.Chat es una herramienta de programación asistida por IA basada en terminal diseñada para mejorar la eficiencia de programación de los desarrolladores a través de medios inteligentes. La herramienta se puede utilizar con cualquier IDE para permitir la programación asistida por IA en herramientas de desarrollo.Auto...
hace 1 año
089.6K
Reflex LLM Examples:展示大语言模型实际应用的AI应用集合

Ejemplos de Reflex LLM: una colección de aplicaciones de IA que demuestran la aplicación práctica de grandes modelos lingüísticos

Introducción general Reflex LLM Examples es un proyecto de código abierto creado por el equipo de desarrollo de Reflex para demostrar aplicaciones prácticas del Large Language Model (LLM). El proyecto reúne varias aplicaciones de IA construidas sobre Reflex, mostrando aplicaciones de Googl...
hace 2 años
089.5K
LettuceDetect:检测RAG系统幻觉的高效工具

LettuceDetect: una herramienta eficaz para detectar alucinaciones en el sistema RAG

Introducción completa LettuceDetect es una herramienta ligera de código abierto desarrollada por KRLabsOrg específicamente para detectar contenido alucinatorio generado en sistemas de Generación Aumentada de Recuperación (RAG). Identifica respuestas que no están respaldadas por el contexto comparando el contexto, la pregunta y la respuesta...
hace 2 años
089.4K
NoneBot DeepSeek 插件:基于 NoneBot&DeepSeek 实现客服智能对话

Plugin NoneBot DeepSeek: Diálogo inteligente para el servicio de atención al cliente basado en NoneBot y DeepSeek.

Introducción General El plugin DeepSeek de NoneBot es un plugin de NoneBot que integra el modelo DeepSeek y está diseñado para proporcionar diálogo inteligente y funcionalidad de preguntas y respuestas. Al acceder al modelo DeepSeek, los usuarios pueden utilizar el plugin NoneBot...
hace 2 años
089.4K
Pyramid Flow:快手推出的开源版

Pyramid Flow: una versión de código abierto de "Kringle" lanzada por Racer, basada en SD3 y que funciona en GPU de menos de 8 GB (versión de despliegue con un solo clic).

Introducción exhaustiva Pyramid Flow es un eficaz método autorregresivo de generación de vídeo basado en la técnica Flow Matching. El método consigue una mayor eficiencia computacional en la generación y descompresión de contenidos de vídeo interpolando entre diferentes resoluciones y niveles de ruido....
hace 2 años
089.3K
ControlFlow:构建可控透明AI智能体工作流的Python框架

ControlFlow: un marco de trabajo en Python para crear flujos de trabajo controlados y transparentes del Cuerpo de Inteligencia Artificial

Introducción general ControlFlow es un framework Python desarrollado por PrefectHQ centrado en la construcción y gestión de flujos de trabajo de IA. Proporciona un marco estructurado y orientado al desarrollador para definir flujos de trabajo y delegar tareas a la generación de Large Language Model (LLM)....
hace 2 años
089.2K
VACE:视频创作和编辑的开源模型(未开放)

VACE: modelo de código abierto para la creación y edición de vídeo (no abierto)

Introducción VACE es un proyecto de código abierto desarrollado por Alitongyi Visual Intelligence Lab (ali-vilab), centrado en la creación y edición de vídeo. Se trata de una herramienta todo en uno que integra diversas funciones, como la generación de vídeos basados en referencias, la edición de contenidos de vídeo existentes, las modificaciones de localización y otras...
hace 2 años
089.2K
OpenPromptStudio:可视化编辑、管理图像提示词,同步自己的Notion提示词表

OpenPromptStudio: edita y gestiona visualmente avisos de imagen, sincroniza tus propias listas de avisos de Notion.

Introducción general OpenPromptStudio (OPS) es un editor visual de código abierto para palabras clave AIGC, desarrollado por el equipo Moonvy. Está diseñado para simplificar el proceso de creación y gestión de palabras de aviso, apoyando modelos de IA como Midjourney.OPS soporta modelos de IA a través de No...
hace 2 años
089K
Quanta Quest:端侧大模型与面向个人数据的本地化AI搜索平台(预览版)

Quanta Quest: plataforma de búsqueda de grandes modelos y AI localizada para datos personales (avance)

Introducción Quanta Quest es el primer producto del mundo con "end-side big model + C-side data localisation" como dirección de evolución central. Ayuda a los usuarios a almacenar todos los datos de Gmail, Notion, Dropbox, etc. localmente, y procesarlos a través de la base de datos vectorial para garantizar...
hace 2 años
088.9K
GLIGEN GUI:精确控制图像元素位置,基于ComfyUI的直观图形界面

GLIGEN GUI: control preciso de la posición de los elementos de la imagen, interfaz gráfica intuitiva basada en ComfyUI

Introducción general GLIGEN GUI es una interfaz gráfica intuitiva basada en ComfyUI, diseñada para simplificar el uso del modelo GLIGEN, un novedoso modelo texto-imagen que permite especificar con precisión la posición de los objetos en una imagen. Con GLIGE...
hace 2 años
088.6K
Qwen4Mac:在Mac菜单栏中使用千问(Qwen)大模型随时对话

Qwen4Mac: ¡utiliza los grandes modelos de Qwen en la barra de menús de Mac para conversar en cualquier momento!

Introducción general Qwen4Mac es un proyecto de código abierto diseñado para integrar el Qwen Large Language Model (LLM) en la barra de menú del Mac, facilitando a los usuarios su llamada y uso en cualquier momento. El proyecto está desarrollado y mantenido por andreaturchet y proporciona una manera fácil para que los usuarios...
hace 2 años
088.5K
InsightExpress:生成AI驱动的研究报告并通过电子邮件发送

InsightExpress: generar informes de investigación basados en IA y enviarlos por correo electrónico

Descripción general InsightExpress es una aplicación basada en Next.js que genera informes de investigación impulsados por IA basados en temas suministrados por el usuario y los envía por correo electrónico a los usuarios. La aplicación aprovecha la IA de Langflow ...
hace 1 año
088.5K
Go-with-the-Flow:控制视频中物体的运动轨迹,视频中增减任何运动物体

Go-with-the-Flow: Controla el movimiento de los objetos en el vídeo, añadiendo o restando cualquier objeto en movimiento en el vídeo.

Introducción general Go-with-the-Flow es un proyecto de código abierto desarrollado por el equipo de investigación de Netflix Eyeline Studios para controlar los patrones de movimiento de los modelos de difusión de vídeo mediante la distorsión del ruido. El proyecto permite al usuario determinar cómo la cámara de la escena y...
hace 2 años
088.5K
muAgent:由 LLM 和 EKG(行业知识)驱动的全新Agent编排框架

muAgent: un nuevo marco de orquestación de agentes impulsado por LLM y EKG (conocimiento del sector)

Introducción general muAgent es un innovador marco multiinteligentsia desarrollado por Ant Group. El marco ayuda a los usuarios a ejecutar diversos procedimientos operativos estándar (SOP) complejos bajo orientación humana mediante arrastrar y soltar en lienzo y escritura de texto simple, en colaboración con multiintelligentsia, llamadas a funciones, intérpretes de código y otras tecnologías....
hace 2 años
088.4K
VideoReTalking:音频驱动的嘴唇同步和视频编辑系统

VideoReTalking: sistema de sincronización labial y edición de vídeo basado en audio

Introducción general VideoReTalking es un sistema innovador que permite al usuario generar vídeos faciales sincronizados con los labios a partir del audio de entrada, produciendo vídeos de salida de alta calidad y sincronizados con los labios incluso con diferentes emociones. El sistema divide este objetivo en tres tareas consecutivas: con expresiones típicas...
hace 2 años
088.4K
Laminar:开源AI产品工程化平台,轻松实现数据可视化追踪与评估

Laminar: plataforma de código abierto de ingeniería de productos de IA para facilitar el seguimiento y la evaluación de la visualización de datos

Introducción exhaustiva Laminar es una plataforma de optimización de ingeniería de IA de código abierto centrada en la ingeniería de IA desde los primeros principios. Ayuda a los usuarios a recopilar, comprender y utilizar datos para mejorar la calidad de las aplicaciones LLM (Large Language Modelling).
hace 2 años
088.3K
Doc2XAPITranslate:文档全文翻译:快速将英文PDF/MD论文翻译为中文文档

Doc2XAPITranslate: traducción de documentos a texto completo: traduce rápidamente documentos PDF/MD ingleses a documentos chinos.

Introducción completa Doc2XAPITranslate es una potente herramienta de traducción de documentos de texto completo diseñada para traducir rápidamente documentos PDF o Markdown en inglés a documentos chinos. La herramienta es compatible con una variedad de traductores, incluyendo DeepSeek, OpenAI, O...
hace 2 años
088.3K
Omnitool:AI爱好者工具箱,在一个桌面中管理、连接并使用所有AI模型

Omnitool: la caja de herramientas de los entusiastas de la IA para gestionar, conectar y utilizar todos sus modelos de IA en un solo escritorio.

General Omnitool.ai es un "laboratorio de IA" de código abierto diseñado para proporcionar un entorno de escritorio extensible basado en navegador para estudiantes, aficionados y cualquier persona interesada en las innovaciones actuales de IA. Permite a los usuarios colaborar a través de una interfaz unificada con una amplia gama de expertos en IA de OpenAI, repl...
hace 2 años
088.2K
Porkybank:AI驱动的日常预算管理,轻松追踪每日预算

Porkybank: gestión del presupuesto diario basada en inteligencia artificial para facilitar el seguimiento de los presupuestos diarios

Descripción general Porkybank es una aplicación de gestión de finanzas personales de código abierto diseñada para ayudar a los usuarios a controlar fácilmente su presupuesto diario. Con una sencilla fórmula (Ingresos - Gastos) / Días = Efectivo, los usuarios pueden visualizar su situación financiera. El proyecto está alojado en GitHu...
hace 2 años
088.1K
Kheish:多角色智能体,审查、验证和格式化输出以生成高质量结果

Kheish: inteligencias polivalentes que revisan, validan y formatean los resultados para obtener resultados de alta calidad.

Introducción exhaustiva Kheish es un agente multirol de código abierto diseñado para tareas de modelado de grandes lenguajes (LLM) que requieren una colaboración estructurada paso a paso.Kheish es más que un simple coordinador, es un agente inteligente por derecho propio, que solicita módulos bajo demanda, integra...
hace 2 años
088.1K
mac assistant:macOS设备自动执行桌面操作的AI智能体

mac assistant: la inteligencia artificial que automatiza las acciones del escritorio en dispositivos macOS

Introducción general mac assistant es un proyecto de cuerpo de inteligencia AI diseñado para macOS, con el objetivo de simplificar las operaciones del usuario mediante la combinación de software nativo y funciones web. Actualmente, el proyecto es compatible con las API OpenAI y GEMINI, y tiene previsto ...
hace 2 años
088.1K
中文基于满血 DeepSeek-R1 蒸馏数据集,支持中文R1蒸馏SFT数据集

Conjunto de datos de destilación DeepSeek-R1 basado en China, compatible con el conjunto de datos SFT de destilación R1 chino

Introducción exhaustiva El conjunto de datos chinos de destilación DeepSeek-R1 es un conjunto de datos chinos de código abierto que contiene 110.000 datos diseñados para apoyar el aprendizaje automático y la investigación del procesamiento del lenguaje natural. El conjunto de datos ha sido publicado por el equipo de PNL de Cong Liu. El conjunto de datos no sólo contiene datos matemáticos, sino también un gran número de...
hace 2 años
088K
SciToolAgent:整合500+科研工具,自动化研究科研任务的智能体

SciToolAgent: una inteligencia que integra más de 500 herramientas de investigación para automatizar las tareas científicas y de investigación.

Introducción completa SciToolAgent es una plataforma de herramientas de código abierto desarrollada por el Centro de Innovación de la Universidad de Zhejiang en Hangzhou (HICAI-ZJU). Integra más de 500 herramientas científicas a través de tecnologías de grafos de conocimiento (SciToolKG) y modelado de grandes lenguajes para ayudar a los investigadores a enfrentarse a...
hace 2 años
088K
VirtualWife:支持B站直播和语音互动的二次元数字人

VirtualWife: una persona digital secundaria que permite la retransmisión en directo de la estación B y la interacción por voz.

VirtualWife es un proyecto de persona digital virtual de código abierto creado por el desarrollador yakami129. Actualmente se encuentra en fase de incubación. El objetivo es crear un personaje virtual con "alma", con el que el usuario pueda interactuar como con un amigo. El proyecto cuenta con el apoyo de B Station Live...
hace 1 año
087.9K
Autiobooks:将epub电子书转换为m4b有声书

Autiobooks: convertir ebooks epub en audiolibros m4b

Introducción general Autiobooks es una herramienta de código abierto diseñada para ayudar a los usuarios a convertir rápidamente libros electrónicos en formato .epub a audiolibros en formato .m4b. Utiliza tecnología de síntesis de voz de alta calidad proporcionada por Kokoro para generar un audio natural y fluido. Esta herramienta fue desarrollada por...
hace 2 años
087.9K
OpenAI Realtime Agents:多智能体语音交互应用(OpenAI示例)

Agentes en tiempo real de OpenAI: una aplicación multiinteligente de interacción cuerpo-voz (ejemplo de OpenAI)

Introducción General OpenAI Realtime Agents es un proyecto de código abierto que tiene como objetivo mostrar cómo la API en tiempo real de OpenAI se puede utilizar para construir aplicaciones de voz corporal multi-inteligente. Proporciona un modelo de cuerpo inteligente de alto nivel (tomado de OpenAI Swarm) que permite...
hace 2 años
087.8K
SQLite-Utils-Ask:让用户对SQLite数据库和CSV/JSON文件进行问答式数据查询

SQLite-Utils-Ask: Permite a los usuarios consultar bases de datos SQLite y archivos CSV/JSON para obtener datos de consulta.

Introducción general SQLite-Utils-Ask es una potente herramienta diseñada para ayudar a los usuarios a realizar consultas de datos de preguntas y respuestas en bases de datos SQLite y archivos CSV/JSON con la ayuda de LLM (Large Language Model). La herramienta es capaz de generar automáticamente preguntas de usuario basadas en...
hace 2 años
087.8K
Vector Vein(向量脉络):无代码AI工作流构建平台

Vector Vein: plataforma de creación de flujos de trabajo de IA sin código

Introducción completa Vector Vein es una plataforma de creación de flujos de trabajo de IA sin código diseñada para ayudar a los usuarios a crear fácilmente flujos de trabajo inteligentes y automatizados. Sin necesidad de conocimientos de programación, los usuarios pueden simplemente conectar varios módulos funcionales a través de operaciones de arrastrar y soltar para construir...
hace 2 años
087.7K
MultiPost-Extension:将AI生成内容一键同步到自媒体平台的浏览器扩展

MultiPost-Extension: Extensión del navegador para sincronizar contenidos generados por IA con plataformas de autopublicación en un clic

Introducción General MultiPost-Extension es una extensión del navegador de gran alcance diseñado para ayudar a los usuarios publicar contenido en múltiples plataformas de medios sociales en un solo clic. La extensión soporta la publicación simultánea en más de 10 plataformas principales, incluyendo Zhihu, Weibo, Xiaohongshu, TikTok ...
hace 2 años
087.6K
DragAnything:对图像中实体对象控制运动硅基生成视频

DragAnything: generación de vídeo basada en silicio para controlar el movimiento de objetos sólidos en imágenes

Introducción General DragAnything es un proyecto de código abierto que tiene como objetivo lograr el control de movimiento de objetos arbitrarios a través de la representación de entidades. El proyecto está desarrollado por el equipo Showlab y ha sido aceptado por ECCV 2024.DragAnything proporciona una forma de utilizar...
hace 2 años
087.3K
HN中文播客:自动抓取热门科技文章,AI生成中文总结并转换为播客

Podcast en chino de HN: captura automáticamente artículos tecnológicos populares, la IA genera resúmenes en chino y los convierte en podcasts.

Introducción general El proyecto Hacker News Chinese Podcast es una plataforma innovadora basada en tecnología de IA, cuyo objetivo es recopilar automáticamente los artículos más populares de Hacker News cada día y generar resúmenes en chino y contenidos de podcast mediante IA. El proyecto está dirigido por ccbikai ...
hace 2 años
087K
PilottAI:构建企业级多智能体应用的开源项目

PilottAI: un proyecto de código abierto para crear aplicaciones empresariales de inteligencia múltiple

Introducción general PilottAI es un framework Python de código abierto alojado en GitHub y creado por el desarrollador anuj0456. Se centra en ayudar a los usuarios a construir sistemas corporales multi-inteligentes de clase empresarial, soporta la integración de Large Language Model (LLM), proporciona cualquier...
hace 2 años
086.9K
Executive AI Assistant:AI行政助理,提醒阅读邮件并规划工作日程

Asistente ejecutivo AI: AI asistente ejecutivo, recordatorios para leer correos electrónicos y planificar horarios de trabajo.

Introducción general Executive AI Assistant (EAIA) es una herramienta de asistencia basada en IA diseñada para ayudar a los usuarios a automatizar y gestionar sus tareas diarias. Desarrollada por LangChain, la herramienta es capaz de gestionar correos electrónicos, programar, gestionar tareas y otras...
hace 2 años
086.9K
Agentic Radar:对 Agentic 工作流安全检测的可视化工具

Agentic Radar: herramienta de visualización para la inspección de la seguridad del flujo de trabajo de Agentic

Introducción general Agentic Radar es una herramienta de código abierto de SplxAI diseñada para escanear y asegurar grandes flujos de trabajo de IA basados en modelos (LLM). Genera diagramas de flujo de trabajo claros e informes de seguridad mediante el análisis de código, ayudando a los desarrolladores, expertos en seguridad...
hace 2 años
086.9K
Zev:用自然语言快速查询终端命令的CLI工具

Zev: una herramienta CLI para consultar rápidamente comandos de terminal en lenguaje natural

Introducción general Zev es una herramienta de interfaz de línea de comandos (CLI) fácil de usar que ayuda a los usuarios a consultar y generar rápidamente comandos de terminal en lenguaje natural. En lugar de tener que recordar complejas sintaxis de comandos, Zev genera comandos de terminal describiendo tus necesidades en lenguaje cotidiano. Basado en Ope...
hace 1 año
086.8K
AgentClientDemo:演示智能体运行过程的Python客户端,提供直观的图形用户界面

AgentClientDemo: un cliente Python que demuestra el proceso de ejecución de un organismo inteligente, proporcionando una interfaz gráfica de usuario intuitiva.

Introducción completa AgentClientDemo es un proyecto completo de Python que integra funcionalidad inteligente (Agente) y cliente (Cliente). El proyecto está basado en el framework PyQt y proporciona una interfaz gráfica de usuario (G...
hace 2 años
086.8K
FoloUp:开源AI语音面试平台,生成定制面试题并进行智能分析

FoloUp: Plataforma de código abierto para entrevistas de voz con inteligencia artificial que genera preguntas de entrevista personalizadas y realiza análisis inteligentes

Introducción general FoloUp es una plataforma de código abierto diseñada para ofrecer a las empresas soluciones de entrevistas de voz basadas en IA. Con FoloUp, las empresas pueden generar rápidamente preguntas de entrevista personalizadas para descripciones de puestos de trabajo y realizar entrevistas conversacionales naturales con IA. La plataforma también proporciona un análisis detallado de las entrevistas...
hace 2 años
086.7K
Vision is All You Need:使用视觉语言模型构建智能文档检索系统(Vision RAG)

Vision is All You Need: Building an Intelligent Document Retrieval System Using Visual Language Models (Visión RAG)

Introducción Vision-is-all-you-need es un innovador proyecto de demostración del sistema visual RAG (Retrieval Augmented Generation) que abre nuevos caminos en la aplicación del Modelado del Lenguaje Visual (VLM) al ámbito del procesamiento de documentos. A diferencia de los métodos tradicionales de fragmentación de textos, el sistema...
hace 2 años
086.7K
混元Turbo S:腾讯推出的快思考大模型(开放申请)

Hybrid Turbo S: el gran modelo de Tencent para pensar rápido (abierto a candidaturas)

Introducción general Tencent Turbo S es una nueva generación del modelo de pensamiento rápido desarrollado por Tencent, que se lanzó en el sitio web oficial de Tencent Cloud el 27 de febrero de 2025. Se diferencia de los modelos tradicionales de pensamiento lento (por ejemplo, Deepseek R1, Hybrid T1) en que puede realizar "segundas respuestas", escupir...
hace 2 años
086.7K
FramePainter:AI驱动的涂鸦式图像编辑工具

FramePainter: herramienta de edición de imágenes estilo garabato con IA

Introducción general FramePainter es una revolucionaria herramienta de edición de imágenes basada en IA que utiliza una avanzada tecnología de difusión de vídeo y controles intuitivos Sketch para ayudar a los usuarios a lograr fácilmente una compleja edición de imágenes. Tanto si se trata de un simple ajuste como de una compleja transformación creativa, Fr...
hace 2 años
086.5K
VOP:提取复杂图表与数学公式的OCR工具

VOP: herramienta de OCR para extraer diagramas complejos y fórmulas matemáticas

Introducción completa Versatile OCR Program es una herramienta de reconocimiento óptico de caracteres (OCR) de código abierto diseñada para trabajar con documentos académicos y educativos complejos. Puede extraer texto, tablas, fórmulas matemáticas, diagramas y esquemas de PDF, imágenes y otros documentos y generar...
hace 1 año
086.5K
DataLine:AI数据分析与可视化客户端,快速生成图表和报告

DataLine: cliente AI de análisis y visualización de datos para la generación rápida de gráficos e informes

Introducción general DataLine es una potente herramienta de análisis y visualización de datos de IA diseñada para ayudar a los usuarios a interactuar con diversas fuentes de datos mediante operaciones sencillas. Ya sea un archivo CSV o una base de datos convencional como Postgres, MySQL, Snowflake, SQL...
hace 2 años
086.4K
Promptimizer:优化大模型提示词的实验性库,自动优化 Prompt

Promptimizer: una biblioteca experimental para la optimización de grandes modelos de palabras clave, que optimiza automáticamente Prompt

Introducción general Promptimizer es una biblioteca experimental de optimización de palabras clave diseñada para ayudar a los usuarios a mejorar sistemáticamente las palabras clave de sus sistemas de IA. Al automatizar el proceso de optimización, Promptimizer puede mejorar el rendimiento de las palabras clave en tareas específicas. Los usuarios sólo tienen que...
hace 2 años
086.4K
OmniParse:从文档/多媒体中提取任何非结构化数据解析为结构化数据

OmniParse: extrae cualquier dato no estructurado de documentos/multimedia y lo analiza para convertirlo en datos estructurados.

Introducción general OmniParse es una potente plataforma de análisis y optimización de datos diseñada para transformar cualquier dato no estructurado en datos estructurados y procesables, optimizada para el marco GenAI (Generative Artificial Intelligence). Tanto si trabaja con documentos, tablas, imágenes, vídeos, archivos de audio o...
hace 2 años
086.3K
DeepResearcher:基于强化学习驱动AI研究复杂问题

DeepResearcher: IA motriz basada en el aprendizaje por refuerzo para estudiar problemas complejos

Introducción general DeepResearcher es un proyecto de código abierto desarrollado por el equipo GAIR-NLP de la Universidad Jiao Tong de Shanghai. Se trata de una herramienta de investigación inteligente basada en grandes modelos lingüísticos (LLM), entrenados de principio a fin en entornos web reales mediante aprendizaje por refuerzo (RL). El proyecto ...
hace 1 año
086.3K
Agent Service Toolkit:基于LangGraph构建AI智能体的完整工具集

Agent Service Toolkit: un completo conjunto de herramientas para construir inteligencias IA basadas en LangGraph

Introducción El AI Agent Service Toolkit es un conjunto de herramientas completo basado en LangGraph, FastAPI y Streamlit, diseñado para ayudar a los desarrolladores a crear y ejecutar rápidamente servicios de agentes de IA. El conjunto de herramientas proporciona...
hace 2 años
086.2K
Swarm:学习轻量级多智能体系统的实验性教学项目(OpenAI示例)

Swarm: un proyecto pedagógico experimental para el aprendizaje de sistemas corporales ligeros multiinteligentes (ejemplo de OpenAI)

Introducción general Swarm es un marco educativo experimental desarrollado por OpenAI para explorar interfaces ligeras, controladas y fáciles de probar para sistemas multiagente. El marco se utiliza principalmente para demostrar traspasos y patrones rutinarios entre agentes, ayudando a los desarrolladores a comprender e implementar la coordinación y ejecución de sistemas multiagente....
hace 2 años
086.1K
wdoc:从海量、多源文档中检索内容并总结知识

wdoc: recuperar contenidos y resumir conocimientos a partir de documentos masivos de múltiples fuentes

Introducción wdoc es un potente sistema RAG (Retrieval Augmentation Generation) diseñado para procesar y analizar grandes cantidades de documentos diversos. Es capaz de recuperar a partir de una amplia gama de tipos de documentos, incluidos PDF, páginas web, vídeos de YouTube, archivos de audio, etc. wdoc es especialmente adecuado para procesar...
hace 2 años
086K
Claude生成深度研究报告的MCP服务

Servicio MCP de Claude para generar informes de investigación en profundidad

Introducción general MCP Server Deep Research es una herramienta de código abierto que genera automáticamente informes de investigación estructurados para problemas complejos mediante inteligencia artificial y búsqueda en la web. Los usuarios introducen una pregunta de investigación y la herramienta la desglosa, busca información autorizada, evalúa la credibilidad de las fuentes...
hace 1 año
086K
OPR:智能修复泛黄、破损老旧照片的AI工具

OPR: la herramienta de inteligencia artificial que restaura de forma inteligente las fotos antiguas amarillentas y desgastadas

Bringing Old Photos Back to Life es un proyecto de código abierto desarrollado por un equipo de investigadores de Microsoft que se centra en la restauración de fotos antiguas utilizando tecnología de IA. Se basa en un enfoque de aprendizaje profundo que puede tratar problemas graves de degradación en las fotos, como arañazos....
hace 2 años
085.8K
Inbox Zero:轻松实现收件箱零邮件,借助 AI 帮助你对邮件进行归类、过滤、处理。

Inbox Zero: Consigue fácilmente cero correos electrónicos en tu bandeja de entrada, con la ayuda de la IA para ayudarte a categorizar, filtrar y procesar tus correos electrónicos.

Descripción general Inbox Zero es una aplicación de gestión de correo electrónico de código abierto diseñada para ayudar a los usuarios a alcanzar rápidamente la bandeja de entrada cero con un asistente de inteligencia artificial. La aplicación ofrece una gran variedad de funciones, como responder automáticamente, archivar, etiquetar y reenviar correos electrónicos, gestionar y darse de baja de boletines, bloquear correos...
hace 2 años
085.6K
Deep Searcher:企业私有文档高效检索与智能问答

Deep Searcher: recuperación eficiente de documentos privados de empresas y preguntas y respuestas inteligentes

Descripción general Deep Searcher es una herramienta que combina potentes modelos de big language (como DeepSeek y OpenAI) y bases de datos vectoriales (como Milvus) diseñados para buscar, evaluar y razonar basándose en datos privados, proporcionando respuestas altamente precisas...
hace 2 años
085.4K
OpenDeepResearcher:自动化深度研究工具,撰写完整的研究报告

OpenDeepResearcher: herramienta automatizada de investigación en profundidad para redactar informes de investigación completos.

Introducción general OpenDeepResearcher es una herramienta de investigación profunda automatizada de código abierto diseñada para mejorar la eficiencia de la investigación mediante técnicas de inteligencia artificial. El proyecto está desarrollado por mshumer y alojado en GitHub.OpenDeepResear...
hace 1 año
085.4K
文颜:一键美化Markdown文章,适配多个自媒体平台格式(开源本地客户端)

Wenyan: embellece artículos Markdown con un solo clic, se adapta al formato de múltiples plataformas multimedia propias (cliente local de código abierto)

Introducción general WenYan es una herramienta diseñada para la composición tipográfica y el embellecimiento de artículos Markdown, que permite convertir artículos Markdown editados en un formato adecuado para WeChat, Zhihu, Today's headlines y otras plataformas. Los usuarios pueden copiar el artículo directamente con un clic...
hace 2 años
085.4K