Проект с открытым исходным кодом AI

Всего 1020 статей
расставлять по порядку
RuoYi AI:基于SpringBoot实现AI聊天和绘画的后端框架

RuoYi AI: основанный на SpringBoot бэкэнд-фреймворк для чата и рисования ИИ

Всеобъемлющее введение RuoYi AI является бэкэнд проект, основанный на ruoyi-плюс рамки , сосредоточив внимание на интеграции AI чат и живопись функции. Он является полностью открытым исходным кодом и бесплатно, используя Java17 и SpringBoot 3.X стека технологий, бэкэнд управления ...
1 год назад
0111.7K
MiniMind:2小时从零训练26M参数GPT的开源工具

MiniMind: 2 часа обучения с нуля 26M параметрам GPT с открытым исходным кодом

Общее введение MiniMind - это проект с открытым исходным кодом, созданный разработчиком jingyaogong. Его основная цель - позволить обычным людям также быстро обучать свои собственные модели искусственного интеллекта. Основной особенностью MiniMind является использование 2 часов в одном NVIDIA ...
1 год назад
0111.5K
PPTAgent:自动生成和评估PPT演示文稿,文档转PPT

PPTAgent: автоматическое создание и оценка PPT-презентаций, документов в PPT

Общее представление PPTAgent - это инновационная система, предназначенная для автоматического создания презентаций на основе документов. Система опирается на человеческий подход к созданию презентаций, используя двухэтапный процесс для обеспечения качества содержания и визуального воздействия. Кроме того, PPTAgent представляет PPTEval, комплексный...
2 года назад
0111.4K
ImBD:AI生成内容检测,检测内容是否由人工智能生成

ImBD: обнаружение контента, созданного ИИ, определение того, создан ли контент ИИ или нет

Всеобъемлющее введение ImBD (Imitate Before Detect) - это новаторский проект по обнаружению текста, созданного машиной, который был представлен на конференции AAAI 2025. С широким распространением больших языковых моделей (LLM), таких как ChatGPT, определение A...
2 года назад
0111.4K
Fish Speech:快速且高精度使用少样本克隆中英文语音

Fish Speech: быстрое и высокоточное клонирование английской и китайской речи по небольшому количеству образцов

Общее представление Fish Speech - это инструмент синтеза текста в речь (TTS) с открытым исходным кодом, разработанный компанией Fish Audio. Инструмент основан на передовых технологиях искусственного интеллекта, таких как VQ-GAN, Llama и VITS, и способен преобразовывать текст в реалистичную речь.Fish S...
1 год назад
0111.3K
Browser Use Web UI:运行AI智能体浏览网页,让AI能够自动操作网页的开源框架

Browser Use Web UI: фреймворк с открытым исходным кодом для запуска искусственного интеллекта для просмотра веб-страниц, позволяющий искусственному интеллекту автоматически управлять веб-страницами.

Общие сведения Введение Browser Use Web UI - это инновационный проект с открытым исходным кодом, нацеленный на предоставление агентам искусственного интеллекта возможностей взаимодействия с браузером в качестве инструмента графического интерфейса. Проект построен на основе базового фреймворка browser-use, созданного с помощью Gradio ...
1 год назад
0111.3K
PaddleOCR:基于飞桨的多语言OCR工具库,支持80多种语言识别

PaddleOCR: Многоязычная библиотека инструментов OCR на основе Flying Paddle, поддерживающая распознавание более 80 языков.

Всеобъемлющее введение PaddleOCR - это многоязычный инструментарий OCR, основанный на PaddlePaddle и предназначенный для создания практичной и сверхлегкой системы OCR. Он поддерживает распознавание более 80 языков и предоставляет инструменты аннотирования и синтеза данных для поддержки...
2 года назад
0111.2K
Kokoro WebGPU:浏览器中离线运行的文本转语音服务

Kokoro WebGPU: служба преобразования текста в речь для автономной работы в браузерах

Общее представление Kokoro WebGPU - это WebGPU-версия модели преобразования текста в речь (TTS) Kokoro, предоставляемая WebML Community на платформе Hugging Face. Проект использует технологию WebGPU, чтобы позволить пользователям...
1 год назад
0111.1K
ComfyUI disty Flow:为 ComfyUI 提供友好的用户界面,简化工作流程

ComfyUI disty Flow: удобный интерфейс для ComfyUI для оптимизации рабочего процесса

Общее представление ComfyUI-disty-Flow - это пользовательский узел, который предоставляет удобный интерфейс для ComfyUI. Он предназначен для упрощения работы с рабочими процессами, предоставляя альтернативный пользовательский интерфейс для создания рабочих процессов.ComfyUI-disty...
2 года назад
0111.1K
FlowiseAI:构建自定义LLM应用的节点拖放界面

FlowiseAI: создание интерфейса перетаскивания узлов для пользовательских LLM-приложений

Общее представление FlowiseAI - это инструмент с открытым исходным кодом, предназначенный для помощи разработчикам в создании пользовательских приложений LLM (Large Language Model) и агентов искусственного интеллекта. С помощью простого интерфейса drag-and-drop пользователи могут быстро создавать и итерировать LLM-приложения, делая процесс от тестирования до производства более эффективным...
2 года назад
0111.1K
Open Codex:将自然语言转换为Shell命令的开源AI工具

Open Codex: инструмент ИИ с открытым исходным кодом для преобразования естественного языка в команды оболочки

Общее представление Open Codex - это инструмент ИИ командной строки с открытым исходным кодом, предназначенный для разработчиков, чтобы преобразовывать инструкции естественного языка в точные команды оболочки. Он использует родную языковую модель (например, phi-4-mini), не требует подключения к сети или ключей API, а все операции в...
1 год назад
0111K
Aider:开源编程助手工具,使用AI助手进行代码编写和文件编辑

Aider: инструмент-помощник программиста с открытым исходным кодом, используйте AI-помощника для написания кода и редактирования файлов

Общее представление Aider - это мощный помощник программирования с открытым исходным кодом, который помогает разработчикам писать, редактировать и рефакторить код с помощью диалога на естественном языке. Будучи интерактивным инструментом для парного программирования с искусственным интеллектом, Aider поддерживает многие основные языки программирования и может быть легко интегрирован в Git...
1 год назад
0110.5K
阿布量化交易系统:基于Python的开源量化交易平台

Количественная торговая система Abu: платформа для количественной торговли с открытым исходным кодом на основе Python

Общее введение Abu Quantitative Trading System - это платформа с открытым исходным кодом, основанная на Python. Она была создана пользователем "bbfamily", чтобы помочь инвесторам реализовать количественные торговые стратегии с помощью кода. Система поддерживает бэктестирование и торговлю различными финансовыми продуктами, такими как акции, опционы, фьючерсы и биткоин. Она...
1 год назад
0110.4K
Page Assist:本地AI模型对话与检索文档的网页助手插件

Page Assist: плагин веб-помощника для диалога с использованием нативной ИИ-модели и поиска документов

Общее представление Page Assist - это расширение для браузера с открытым исходным кодом, предназначенное для предоставления пользователям простого способа взаимодействия с локальными моделями искусственного интеллекта. С помощью этого расширения пользователи могут открыть боковую панель на любой веб-странице, чтобы взаимодействовать с локально запущенными моделями искусственного интеллекта.Page Assi...
1 год назад
0110.3K
One API:多模型API管理与负载均衡,分发系统

Единый API: многомодельное управление API и балансировка нагрузки, система распределения

Всеобъемлющее введение One API - это система управления и распространения интерфейсов с открытым исходным кодом, которая поддерживает различные большие модели, такие как OpenAI ChatGPT, Anthropic Claude, Google PaLM 2 & Gemini. ...
2 года назад
0110.3K
AgenticSeek:完全本地运行的任务自动化AI助手

AgenticSeek: ИИ-помощник для автоматизации задач, работающий полностью локально

Общее представление AgenticSeek - это ИИ-ассистент с открытым исходным кодом, который работает полностью локально и основан на модели Deepseek R1. Он не требует облачного API и не влечет за собой ежемесячной платы в сотни долларов. Его цель - стать интеллектуальным помощником, подобным "Джарвису" из фильма...
1 год назад
0110.1K
VoltAgent:快速构建AI智能体的TypeScript开源框架

VoltAgent: фреймворк с открытым исходным кодом на TypeScript для быстрого создания искусственного интеллекта

Общее представление VoltAgent - это фреймворк TypeScript с открытым исходным кодом, предназначенный для разработчиков, чтобы помочь быстро создать и оркестровать интеллектуальные системы искусственного интеллекта. Он предоставляет модульные инструменты и стандартизированную модель разработки, которая упрощает взаимодействие с большими языковыми моделями (LLM), состоянием...
1 год назад
0110K
ChatGPT-on-WeChat:基于大模型构建的智能对话机器人,支持微信等多对话平台接入

ChatGPT-on-WeChat: интеллектуальный диалоговый робот, построенный на основе большой модели, поддерживающий доступ к WeChat и другим мультидиалоговым платформам.

Всеобъемлющее введение Проект ChatGPT-on-WeChat - это интеллектуальный диалоговый робот на основе большой модели, поддерживающий многоплатформенный доступ к личному WeChat, публичному номеру WeChat, корпоративному приложению WeChat, Flybook, Nail и так далее. Пользователи могут выбрать GPT3.5, GPT-4, Claude, Man...
2 года назад
0109.9K
tldraw:开源无限画布白板SDK,AI生成简约线框图和UML图

tldraw: SDK с открытым исходным кодом для создания неограниченных досок на холсте, искусственный интеллект для создания минималистичных электронных схем и UML-диаграмм

Общее описание tldraw - это бесплатный инструмент для совместного рисования, который предоставляет неограниченный холст, на котором пользователи могут быстро рисовать графику, писать текст и мгновенно работать. Обладая интуитивно понятным интерфейсом и отличной производительностью, он подходит для совместной и удаленной работы. Поддерживаемый сообществом разработчиков с открытым исходным кодом, tldr...
2 года назад
0109.9K
IC-Light(V2):图像照明控制神器,控制图像光影和背景

IC-Light (V2): магия управления освещением изображения, управление светом, тенью и фоном изображения

Всеобъемлющее введение IC-Light - это проект по управлению освещением изображений, целью которого является манипулирование эффектами освещения изображений с помощью продвинутых моделей искусственного интеллекта. Разработанный Лвмином Чжаном и другими, проект предоставляет две основные модели: модель пересвета с учетом текста и модель с учетом фона. Пользователи могут передавать...
2 года назад
0109.6K
InstantCharacter:从单张图片生成一致性角色的开源工具

InstantCharacter: инструмент с открытым исходным кодом для генерации последовательных персонажей из одного изображения

Общее представление InstantCharacter - это проект с открытым исходным кодом, разработанный Tencent Hunyuan и командой InstantX и размещенный на GitHub. Он генерирует последовательные карты символов с эталонным изображением и текстовым описанием...
1 год назад
0109.6K
DDG-Chat:一键部署Chat2API后端,DuckDuckGo转API

DDG-Chat: развертывание бэкенда Chat2API одним щелчком мыши, DuckDuckGo для API

Общее введение DDG-Chat - это проект с открытым исходным кодом, целью которого является предоставление бэкенда ChatGPT API, который может быть развернут на нескольких платформах одним щелчком мыши. Проект поддерживает множество моделей, включая GPT-4o mini, Claude 3 Haiku, Llam...
2 года назад
0109.4K
OpenPilot:开源自动驾驶系统,为爱车DIY一套自己的智能驾驶系统

OpenPilot: система автономного вождения с открытым исходным кодом, сделайте свой собственный набор интеллектуальной системы вождения для вашего автомобиля

Общее представление OpenPilot - это система автономного вождения с открытым исходным кодом, разработанная comma.ai для повышения удобства и безопасности вождения существующих автомобилей с помощью передовых функций помощи водителю. С момента своего первого релиза в 2016 году OpenPilot поддерживает более 2...
1 год назад
0109.3K
Deep Chat:快速集成到网站的AI聊天组件

Deep Chat: компонент чата с искусственным интеллектом для быстрой интеграции с веб-сайтом

Общее описание Deep Chat - это компонент чата с открытым исходным кодом AI, предназначенный для веб-разработчиков. Он был разработан Овидиусом Парсюнасом, размещен на GitHub и в настоящее время имеет более 2 тысяч звезд. Пользователи могут просто настроить...
1 год назад
0109.2K
GraphRAG-Dify:让Dify具备GraphRAG能力

GraphRAG-Dify: оснащение Dify возможностями GraphRAG

Всеобъемлющее введение GraphRAG-Dify - это проект с открытым исходным кодом, предназначенный для объединения технологий GraphRAG и Dify для быстрого создания и развертывания агентов искусственного интеллекта. Проект использует FastAPI и Uvicorn для создания сервисов, а также поддерживает импорт DSL, что удобно для...
2 года назад
0109.1K
Gemini Balance:Gemini模型API兼容OpenAI格式,解锁区域限制并支持多API Key轮询

Gemini Balance: Gemini model API совместим с форматом OpenAI, снимает ограничения по регионам и поддерживает опрос ключей через несколько API.

Всеобъемлющее введение Gemini Balance - это прокси-сервис OpenAI API, разработанный на основе фреймворка FastAPI, целью которого является обеспечение эффективного управления и оптимизации мультиAPI-ключей. Проект поддерживает вызовы модели Gemini, а его основные возможности включают в себя мультиAPI...
1 год назад
0109.1K
BEN2:从图像、视频中快速移除背景的深度学习模型

BEN2: модель глубокого обучения для быстрого удаления фона с изображений и видео

Всеобъемлющее введение BEN2 (Background Erase Network 2) - это модель глубокого обучения, разработанная компанией Prama LLC специально для автоматического удаления фона с изображения и создания изображения переднего плана. Модель использует инновационную систему Confiden...
1 год назад
0108.8K
GitIngest:快速将Github代码仓库转为适合LLM理解的文本

GitIngest: быстрое преобразование репозиториев кода Github в текст, пригодный для понимания LLM

Общие сведения Введение GitIngest - это инструмент с открытым исходным кодом, предназначенный для преобразования репозиториев кода GitHub в текст, подходящий для подсказок Large Language Model (LLM). С помощью простой операции пользователи могут извлечь и отформатировать содержимое любого репозитория GitHub, чтобы оно соответствовало LLM ...
2 года назад
0108.8K
NGCBot:新闻推送、AI对话与群聊管理的微信机器人

NGCBot: бот для WeChat для отправки новостей, диалога с искусственным интеллектом и управления групповым чатом

Всеобъемлющее введение NGCBot является HOOK механизм на основе развития WeChat робот открытый исходный проект , созданный разработчиком ngc660sec (Yunshan/eXM) и размещен на GitHub После двух лет итерации, текущая версия V2.3, функции от первоначального простого ...
1 год назад
0108.6K
BetterWhisperX:自动语音识别与说话人分离,提供高精度单词级时间戳

BetterWhisperX: автоматическое распознавание речи отдельно от диктора, обеспечивающее высокую точность временных меток на уровне слов

Общее введение BetterWhisperX - это оптимизированная версия проекта WhisperX, ориентированная на предоставление эффективных и точных услуг автоматического распознавания речи (ASR). Как улучшенное ответвление WhisperX, проект был разработан Федерико ...
2 года назад
0108.6K
文多多 AiPPT:AI生成PPT,演讲稿生成

Wenduoduo AiPPT: AI Generated PPT, генерация презентаций

Всеобъемлющее введение AiPPT - это инструмент для создания PPT на основе технологии искусственного интеллекта, призванный помочь пользователям быстро создавать профессиональные презентации. Он автоматически генерирует насыщенные контентом и красиво оформленные слайды при вводе тем, загрузке файлов или предоставлении URL-адресов и т.д. Он поддерживает встроенные диаграммы, анимацию и 3D-спец...
1 год назад
0108.5K
GPT SoVITS:革命性的语音生成与语音克隆工具

GPT SoVITS: революционные инструменты для генерации и клонирования речи

Всеобъемлющее введение GPT-SoVITS - это инструмент для преобразования и синтеза речи с открытым исходным кодом, который сочетает в себе модель GPT и технологию изменения голоса SoVITS. Инструмент поддерживает преобразование текста в речь "на лету" с нулевым и малым количеством образцов, а также перенос стиля голоса всего с 5 секундами аудиообразцов. Среди его возможностей - кросс-языковая ...
2 года назад
0108.5K
Magic MCP:生成现代化UI组件的MCP服务

Magic MCP: MCP-сервис для генерации современных компонентов пользовательского интерфейса

Общее введение Magic MCP - это инструмент, управляемый искусственным интеллектом, разработанный командой 21st.dev и предназначенный для front-end разработчиков. Он генерирует современные компоненты пользовательского интерфейса "на лету" из описаний на естественном языке и интегрируется с Cursor, WindSurf и ...
1 год назад
0108.2K
Qwen2.5-VL:支持图像视频文档解析的开源多模态大模型

Qwen2.5-VL: мультимодальная большая модель с открытым исходным кодом для разбора изображений и видеодокументов

Всеобъемлющее введение Qwen2.5-VL - это мультимодальная большая модель с открытым исходным кодом, разработанная командой Qwen из Alibaba Cloud (Alibaba Cloud). Она может обрабатывать текст, изображения, видео и документы одновременно, является обновленной версией Qwen2-VL, основанной на Qwen2.5...
1 год назад
0108.1K
MCP Playwright:提供浏览器自动化操作的MCP服务

MCP Playwright: служба MCP, обеспечивающая автоматизацию работы браузера

Общее представление MCP-Playwright - это инструмент с открытым исходным кодом, разработанный компанией ExecuteAutomation и размещенный на GitHub. Он основан на Playwright и Model Context Proto...
1 год назад
0108.1K
Outlines:通过正则表达式、JSON或Pydantic模型生成结构化文本输出

Outlines: генерирует структурированный текст с помощью регулярных выражений, JSON или моделей Pydantic.

Общее представление Outlines - это библиотека с открытым исходным кодом, разработанная dottxt-ai для расширения возможностей применения больших языковых моделей (LLM) путем создания структурированного текста. Библиотека поддерживает различные интеграции моделей, включая OpenAI, трансформаторы...
1 год назад
0108.1K
GFPGAN:腾讯开源的人脸修复算法

GFPGAN: алгоритм восстановления лица с открытым исходным кодом от Tencent

Всеобъемлющее введение GFPGAN (Generative Facial Prior GAN) - это алгоритм восстановления лица с открытым исходным кодом, разработанный Tencent ARC (Applied Research Center). Алгоритм использует предварительно обученный лицевой GAN...
2 года назад
0108K
cognee:基于知识图谱构建的RAG开源框架,核心prompts学习

cognee: фреймворк с открытым исходным кодом для построения RAG на основе графа знаний, обучение по основным подсказкам

Общее представление Cognee - это надежное решение уровня данных, предназначенное для приложений ИИ и агентов ИИ. Предназначен для загрузки и построения контекстов LLM (Large Language Models) для создания точных и интерпретируемых решений ИИ с помощью графов знаний и векторных хранилищ. Фреймворк способствует экономии средств, интерпретируемости...
2 года назад
0107.5K
Abogen:将多种文本格式转换为有声读物的工具

Abogen: инструмент для преобразования различных текстовых форматов в аудиокниги

Общее представление Abogen - это инструмент с открытым исходным кодом, предназначенный для быстрого преобразования файлов ePub, PDF или обычного текста в высококачественный звук. Он использует модель Kokoro-82M для генерации естественной и плавной речи и поддерживает одновременную генерацию субтитров, что подходит для создания аудиокниг...
1 год назад
0107.4K
AutoGen Studio:多代理系统AutoGen的简易用户界面版

AutoGen Studio: простая в использовании интерфейсная версия мультиагентной системы AutoGen

Общее описание AutoGen Studio 2.0 - это пользовательский интерфейс на базе AutoGen, предназначенный для упрощения процесса создания и управления мультиагентными решениями. Платформа позволяет пользователям декларативно определять и изменять агентов и их рабочие процессы с помощью интуитивно понятного интерфейса...
2 года назад
0107.3K
A2A:谷歌发布AI智能间通信的开放协议

A2A: Google выпускает открытый протокол для общения между ИИ-интеллектами

Общее введение A2A (Agent2Agent) - это протокол с открытым исходным кодом, разработанный компанией Google для того, чтобы позволить ИИ-интеллектам, разработанным различными структурами или поставщиками, общаться и сотрудничать друг с другом. Он предоставляет стандартизированный набор методов, позволяющих интеллектам узнавать о возможностях друг друга, делиться задачами и завершать работу...
1 год назад
0107.1K
ElizaOS:构建自主执行的多智能体,功能完备的开源AI智能体开发框架

ElizaOS: создание автономно исполняющих мультиинтеллектов, полнофункциональный фреймворк для разработки интеллектуальных тел ИИ с открытым исходным кодом

Всеобъемлющее введение Eliza является передовым мульти-интеллектуального тела (Multi-Agent) развития рамки, стремится упростить строительство и развертывание автономных интеллектуальных тел (автономный агент) процесс. Она поддерживает развертывание нескольких интеллектуальных тел с различными настройками роли, может достичь интеллектуального ...
2 года назад
0107.1K
MetaGPT:多智能体协作框架,构建 AI 软件开发团队实现自然语言编程

MetaGPT: механизм взаимодействия с несколькими интеллектуальными органами для создания команд разработчиков программного обеспечения ИИ для программирования на естественном языке

Всеобъемлющее введение MetaGPT - это инновационный фреймворк с несколькими интеллектуальными телами, предназначенный для моделирования работы полноценной компании по разработке программного обеспечения с искусственным интеллектом. Цель проекта, созданного geekan (Александр Ву), - объединить модели GPT с различными ролями в совместную структуру...
1 год назад
0107K
Steel Browser:自动化网页浏览器API,构建控制浏览器操作的智能体与应用

Steel Browser: автоматизированный API веб-браузера для создания интеллектов и приложений, контролирующих работу браузера

Общее представление Steel Browser - это API браузера с открытым исходным кодом, разработанный для агентов и приложений искусственного интеллекта. Он предоставляет полный экземпляр браузера, который позволяет пользователям автоматизировать веб-операции, не заботясь об инфраструктуре.Steel Browser поддерживает...
2 года назад
0107K
TubeTube:自部署YouTube视频下载工具

TubeTube: саморазвертывающийся инструмент для загрузки видео с YouTube

Общее представление TubeTube - это инструмент для загрузки видео с YouTube с открытым исходным кодом, разработанный MattBlackOnly. Инструмент использует yt-dlp в качестве основного движка загрузки, поддерживает многопоточную загрузку и способен быстро загружать несколько видео одновременно. Пользователи могут скачивать...
1 год назад
0107K
FinGPT:开源金融大语言模型平台,助力金融分析与预测

FinGPT: платформа с открытым исходным кодом для финансового моделирования на большом языке для финансовой аналитики и прогнозирования

Общее представление FinGPT - это платформа для моделирования на большом финансовом языке с открытым исходным кодом, разработанная фондом AI4Finance Foundation и предназначенная для финансового сектора с целью решения сложных финансовых задач и стимулирования инноваций в области финтеха. FinGPT использует методы облегченной адаптации и подходы к обучению с усилением...
2 года назад
0106.9K
PPTX2MD:将PPTX文件转换为Markdown的专用工具

PPTX2MD: Специальный инструмент для преобразования файлов PPTX в Markdown

Общее представление PPTX2MD - это инструмент с открытым исходным кодом, предназначенный для преобразования файлов PowerPoint PPTX в формат Markdown. Разработанный пользователем GitHub ssine, инструмент поддерживает сохранение заголовков, списков, форматирования текста (например, жирный шрифт, курсив, цвета и супер...
1 год назад
0106.8K
Klee:桌面本地运行AI大模型并管理私人知识库

Klee: запуск макромоделей ИИ локально на рабочем столе и управление частной базой знаний

Общее представление Klee - это настольное приложение с открытым исходным кодом, разработанное для того, чтобы помочь пользователям запускать открытые Большие языковые модели (LLM) локально с безопасным управлением частными базами знаний и возможностями ведения заметок в формате Markdown. Оно основано на технологиях Ollama и LlamaIndex...
1 год назад
0106.8K
MNN-LLM-Android:MNN 多模态语言模型的安卓应用

MNN-LLM-Android: Мультимодальное моделирование языка с помощью MNN для Android

Всеобъемлющее введение MNN (Mobile Neural Network) - это эффективный, легкий фреймворк глубокого обучения, разработанный компанией Alibaba и оптимизированный для мобильных устройств. MNN не только способен быстро делать выводы на мобильных устройствах, но и поддерживает мультимодальные задачи, включая генерацию текста...
2 года назад
0106.8K
InstantID:上传一张图片,迁移人像特征来生成不同风格图片

InstantID: загрузите изображение и переместите функции портрета для создания различных стилей изображений

Всеобъемлющее введение InstantID - это передовая технология, направленная на создание изображений с индивидуальными стилями или позами за считанные секунды, обеспечивая при этом высокий уровень достоверности с использованием одной эталонной идентификационной фотографии. Технология использует решение на основе диффузионной модели, объединяющее изображения лиц, карты ориентиров...
2 года назад
0106.6K
Stagehand:自然语言实现浏览器自动化操作框架

Stagehand: фреймворк для реализации операций автоматизации браузеров на естественном языке

Общее представление Stagehand - это фреймворк для веб-браузинга с искусственным интеллектом, ориентированный на простоту и расширяемость. Он полностью совместим с Playwright и предоставляет три простых AI API (act, extract и observe), которые построены на базе...
2 года назад
0106.6K
Cursor Auto Register:自动创建并管理Cursor账号的开源工具

Cursor Auto Register: автоматическое создание и управление учетными записями Cursor с помощью инструментов с открытым исходным кодом

Общее введение Cursor Auto Register - это проект с открытым исходным кодом, размещенный на GitHub. Он был создан разработчиком ddCat-main, чтобы помочь пользователям автоматически регистрировать и управлять учетными записями для редактора кода Cursor AI...
1 год назад
0106.4K
Mad Professor:辅助阅读和分析学术论文的AI工具

Mad Professor: инструмент искусственного интеллекта, помогающий читать и анализировать научные статьи

Общее представление Mad Professor (Grumpy Professor Reads Papers) - это академический инструмент с открытым исходным кодом на основе ИИ, разработанный для исследователей и студентов, чтобы упростить чтение и анализ научных работ. Он объединяет в себе обработку PDF, перевод ИИ, поиск RAG, вопросы ИИ...
1 год назад
0106.4K
Step1X-Edit:自然语言指令编辑图像的开源工具

Step1X-Edit: инструмент с открытым исходным кодом для редактирования изображений с помощью инструкций на естественном языке

Общее представление Step1X-Edit - это фреймворк для редактирования изображений с открытым исходным кодом, разработанный командой Stepfun AI и размещенный на GitHub. Он сочетает в себе мультимодальную модель большого языка (Qwen-VL) и диффузионный трансформатор (DiT), чтобы позволить пользователям создавать изображения с помощью простой и естественной...
1 год назад
0106.2K
Orama:高性能全文本和向量搜索引擎

Orama: высокопроизводительная система полнотекстового поиска книг и векторов

Общее представление Orama - это высокопроизводительная поисковая система с открытым исходным кодом, написанная полностью на TypeScript, поддерживающая полнотекстовый поиск, векторный поиск и гибридный поиск.Orama разработана для работы в любой среде выполнения JavaScript, обеспечивая быстрый, надежный ...
2 года назад
0106.2K
CrewAI:多角色扮演协作智能框架,简化复杂任务

CrewAI: многоролевая система совместного интеллекта для упрощения сложных задач

Всеобъемлющее введение CrewAI - это продвинутый фреймворк, предназначенный для организации взаимодействия между ролевыми играми и автономными агентами ИИ. Благодаря совместной интеллектуальной деятельности CrewAI позволяет агентам беспрепятственно работать вместе для решения сложных задач. Независимо от того, создаете ли вы платформу интеллектуального помощника, автоматизируете команды обслуживания клиентов или мультиагентную...
2 года назад
0105.8K
FreeAI:基于Pollinations封装的的免费AI工具

FreeAI: бесплатный инструмент искусственного интеллекта, основанный на пакете Pollinations.

Общее введение FreeAI - это платформа приложений ИИ с открытым исходным кодом, основанная на Pollinations.AI API, предоставляющая бесплатные и неограниченные услуги чат-ассистентов ИИ, генерации изображений и синтеза речи. Проект был начат разработчиком Azad-sl в Г...
1 год назад
0105.6K
Anon-Kode:命令行AI代码助手(Claude Code代码反编译)

Anon-Kode: помощник ИИ-кода из командной строки (декомпиляция кода Claude Code)

Общее представление Anon-Kode - это кодовый помощник ИИ с открытым исходным кодом для терминальных операций, запущенный на GitHub разработчиком Даниилом Наковым. Он предназначен для программистов, чтобы поддерживать API в стиле OpenAI, интегрируя языковые модели, поддерживающие...
1 год назад
0105.6K
MoneyPrinterTurbo:输入视频主题一键生成视频文案和高清短视频

MoneyPrinterTurbo: создание видеокопий и коротких HD-видеороликов в один клик, введя тему для видео

Всеобъемлющее введение MoneyPrinterTurbo - это проект с открытым исходным кодом, который использует передовую технологию больших моделей AI для достижения функции генерации коротких HD видео одним щелчком мыши. Пользователям нужно только предоставить тему видео или ключевые слова, система будет автоматически генерировать видео копии, видео клипы, видео субтитры и...
1 год назад
0105.6K
Search-R1:强化学习训练大模型搜索与推理的工具

Search-R1: обучение с подкреплением для обучения больших моделей для поиска и рассуждений

Общее представление Search-R1 - это проект с открытым исходным кодом, разработанный PeterGriffinJin на GitHub и построенный на фреймворке veRL. Он обучает большие языковые модели (LLM) с помощью методов обучения с подкреплением (RL), позволяя моделям автономно обучаться...
1 год назад
0105.4K
Moffee:将Markdown转为PPT幻灯片

Moffee: Преобразование Markdown в PPT слайд-шоу

Общее представление Moffee - это инструмент с открытым исходным кодом, который быстро, просто и эффективно превращает файлы Markdown в профессиональные слайд-шоу. Пользователям нужно только написать содержимое в формате Markdown, а Moffee автоматически обработает макет, пагинацию и стиль, избавляя от необходимости вручную набирать...
1 год назад
0105.2K
DeepSeek-VL2:高级多模态理解的专家级视觉语言模型

DeepSeek-VL2: экспертная модель визуального языка для расширенного мультимодального понимания

Всеобъемлющее введение DeepSeek-VL2 - это серия усовершенствованных визуальных языковых моделей Mixture-of-Experts (MoE), которые значительно улучшают производительность своего предшественника DeepSeek-VL. Модели полезны для визуальных вопросов и ответов, оптического распознавания символов,...
1 год назад
0105.2K
Refly:基于自由画布上流程编排的AI写作平台,自动化生成文章

Refly: платформа для написания статей с искусственным интеллектом, основанная на оркестровке процессов на свободном холсте для автоматического создания статей

Всеобъемлющее введение Refly - это бесплатный авторский движок на основе холста с искусственным интеллектом, призванный помочь пользователям превратить идеи в высококачественный контент благодаря многопоточному диалогу, интеграции базы знаний, контекстной памяти и технологии интеллектуального поиска. Платформа охватывает более 20 профессиональных шаблонов сценариев, включая учебные...
1 год назад
0104.9K
Gemini-OpenAI:反代Gemini地址绕过区域限制并转换为OpenAI兼容API

Gemini-OpenAI: обратная генерация адресов Gemini в обход региональных ограничений и преобразование в API, совместимые с OpenAI

Общее введение Gemini OpenAI API Agent - это бесплатная и не требующая обслуживания сервера конечная точка, совместимая с OpenAI. Пользователи могут легко развернуть его на таких платформах, как Vercel, Netlify и Cloudflare для личного использования. Проект ...
2 года назад
0104.7K
TreeGPT:可视化树状对话的AI聊天界面

TreeGPT: интерфейс чата с искусственным интеллектом для визуализации разговоров на основе деревьев

Общее представление TreeGPT - это чат-приложение с открытым исходным кодом на базе Next.js, ориентированное на визуализацию разговоров с большими языковыми моделями (LLM, например, GPT) через древовидные графовые структуры (directed acyclic graphs, DAGs), заменяя традиционные линейные методы чата для повышения скорости и...
1 год назад
0104.6K
Unstructured:开源预处理非结构化文档,无结构数据处理的利器

Неструктурированные: препроцессинг неструктурированных документов с открытым исходным кодом, инструменты обработки неструктурированных данных

Всеобъемлющее введение Unstructured-IO представляет собой набор компонентов с открытым исходным кодом для обработки и предварительной обработки изображений и текстовых документов, таких как PDF, HTML, документы Word и т. д. Его основная цель - упростить и оптимизировать рабочие процессы обработки данных, особенно для больших языковых моделей (LL...
2 года назад
0104.6K
无服务器快速部署Grok3国内镜像站

Бессерверное быстрое развертывание внутреннего зеркального сайта Grok3

Общее введение Grok Playground - это проект с открытым исходным кодом, разработанный командой "Technical Crawling Shrimp". Основная функция этого инструмента заключается в том, чтобы позволить пользователям развернуть внутренний зеркальный сайт Grok3 за 10 секунд. Grok3 - это модель искусственного интеллекта, представленная компанией xAI, и ...
1 год назад
0104.5K
MobileAgent:多代理协作的移动设备操作助手

MobileAgent: мультиагентное взаимодействие для помощника по эксплуатации мобильных устройств

Общее представление MobileAgent - это мощный помощник по управлению мобильными устройствами, предназначенный для повышения эффективности и автоматизации работы с мобильными устройствами за счет мультиагентного взаимодействия и улучшенных модулей визуального восприятия. Он разработан командой X-PLUG и поддерживает Android и ...
2 года назад
0104.4K
Kokoro:高效语音合成模型,生成自然流畅的语音

Kokoro: эффективные модели синтеза речи для создания естественной и плавной речи

Общее представление Kokoro 82M - это эффективная модель синтеза речи, предоставленная компанией Hugging Face, предназначенная для создания высококачественной речи с меньшим количеством параметров и данных. Модель имеет 82 миллиона параметров и лицензирована под Apache 2.0...
2 года назад
0104K
Firecrawl MCP Server:基于 Firecrawl 的网页爬虫 MCP 服务

Firecrawl MCP Server: MCP-служба веб-краулера на основе Firecrawl

Общее представление Firecrawl MCP Server - это инструмент с открытым исходным кодом, разработанный MendableAI, основанный на реализации протокола Model Context Protocol (MCP), с Firecrawl A...
1 год назад
0103.7K
BlenderMCP:依赖Blender生成3D模型的MCP服务

BlenderMCP: служба MCP, использующая Blender для создания 3D-моделей.

Общее введение BlenderMCP - это инструмент с открытым исходным кодом, который соединяет Blender с Claude AI через протокол Model Context Protocol (MCP). Пользователи могут использовать текстовые команды для прямого управления ...
1 год назад
0103.7K
PocketFlow:100行代码实现AI应用开发的极简框架

PocketFlow: минималистичный фреймворк для разработки приложений искусственного интеллекта за 100 строк кода

Всеобъемлющее введение PocketFlow - это легкий фреймворк для разработки приложений искусственного интеллекта, состоящий всего из 100 строк кода, разработанный командой The-Pocket и открытый на GitHub. Он преследует минималистский дизайн, ядро управления кодом в 100 строк, никаких внешних зависимостей ...
1 год назад
0103.7K
AI Auto Free:使用自动化工具无限制使用AI IDE(如Cursor和Windsurf)

AI Auto Free: неограниченное использование AI IDE с помощью инструментов автоматизации (например, Cursor и Windsurf).

Общее описание AI Auto Free - это мощный инструмент автоматизации, призванный помочь пользователям неограниченно использовать интегрированные среды разработки (IDE), основанные на искусственном интеллекте, такие как Cursor и Windsurf. Проект предлагает кросс-платформенную поддержку и включает в себя множество языковых возможностей...
2 года назад
0103.7K
MediaCrawler:多社交媒体平台内容、视频评论爬虫工具

MediaCrawler: инструмент для поиска контента и комментариев к видео на платформах мультисоциальных медиа

Общее представление MediaCrawler - это инструмент для сбора контента социальных сетей, предназначенный для разработчиков. Благодаря мощному краулеру он может быстро захватывать видео, изображения, комментарии, лайки, ретвиты и другие данные с таких социальных платформ, как Xiaohongshu, Shake, Shutter, B, Weibo и других...
2 года назад
0103.5K
Browser-Use:构建智能网页自动化工具,让AI智能体轻松操作浏览器

Browser-Use: создание интеллектуальных инструментов веб-автоматизации для ИИ-интеллектуалов, позволяющих легко управлять браузерами

Всеобъемлющее введение Browser-Use - это инновационный инструмент автоматизации веб-сайтов с открытым исходным кодом, специально разработанный для того, чтобы языковые модели (LLM) могли естественным образом взаимодействовать с веб-сайтами. Он предоставляет мощный и гибкий фреймворк, поддерживающий широкий спектр основных языковых моделей, включая GPT-4, Claud...
2 года назад
0103.4K
AIGCPanel:开源克隆数字人整合系统,一键部署免费数字人客户端

AIGCPanel: клон интеграционной системы digital man с открытым исходным кодом, развертывание бесплатного клиента digital man одним щелчком мыши

Всеобъемлющее введение AigcPanel - это универсальная система производства цифровых людей AI для всех пользователей, разработанная с использованием стека технологий electron+vue3+typescript, поддерживающая развертывание в один клик на Windows. Система спроектирована так, чтобы быть удобной для пользователя, даже...
2 года назад
0103.4K
AsrTools:语音转字幕工具,内置剪映、快手、必剪接口的轻量客户端

AsrTools: инструмент преобразования речи в субтитры, легкий клиент со встроенными интерфейсами для Cutscene, Racer и Must-Cut

Всеобъемлющее введение AsrTools - это интеллектуальный инструмент преобразования речи в текст со встроенными интерфейсами от таких крупных игроков, как Cutscene, QuickScope, MustCut и т.д. Он не требует GPU или громоздкой конфигурации, а также поддерживает эффективную многопоточную пакетную обработку. Он основан на разработке PyQt5, имеет красивый и удобный интерфейс, способен выводить слова в форматах SRT и TXT...
2 года назад
0103.3K
n8n-mcp-server:与n8n工作流交互的MCP服务工具

n8n-mcp-server: Сервисный инструмент MCP для взаимодействия с рабочими процессами n8n

Общее представление n8n-mcp-server - это проект с открытым исходным кодом, размещенный на GitHub и разработанный Леонардом Селлемом. Это сервисный инструмент MCP (Model Context Protocol), специализирующийся...
1 год назад
0103.2K
Unsloth:高效微调和训练大语言模型的开源工具

Unsloth: инструмент с открытым исходным кодом для эффективной тонкой настройки и обучения больших языковых моделей

Всеобъемлющее введение Unsloth - это проект с открытым исходным кодом, предназначенный для предоставления эффективных инструментов для тонкой настройки и обучения больших языковых моделей (LLM). Проект поддерживает множество известных моделей, включая Llama, Mistral, Phi и Gemma.Unsloth...
1 год назад
0103.1K
Whisper Input:利用Groq免费且高速的语音转录文本服务

Whisper Input: бесплатный и высокоскоростной сервис транскрипции голоса в текст с помощью Groq.

Общее описание Whisper Input - это инструмент транскрипции голоса с открытым исходным кодом, который позволяет пользователям начинать запись голоса нажатием кнопки Option и заканчивать запись поднятием кнопки. Инструмент вызывает Groq Whisper Large V3 Turbo ...
1 год назад
0102.7K
AIstudioProxyAPI:无限使用 Gemini 2.5 Pro 模型 API

AIstudioProxyAPI: неограниченное использование API моделей Gemini 2.5 Pro

Всеобъемлющее введение AIstudioProxyAPI - это проект с открытым исходным кодом, который использует Node.js и технологию Playwright для эмуляции API OpenAI, подражая веб-версии Google AI Studio...
1 год назад
0102.6K
Dia:生成超现实多人对话的文本转语音模型

Dia: модель преобразования текста в речь для создания гиперреалистичных многопользовательских диалогов

Общее представление Dia - это модель преобразования текста в речь (TTS) с открытым исходным кодом, разработанная компанией Nari Labs и предназначенная для создания гиперреалистичных диалоговых аудио. Она преобразует текстовые сценарии в реалистичные многосимвольные диалоги за один процесс, поддерживает управление эмоциями и интонациями и даже генерирует невербальные представления...
1 год назад
0102.6K
Tifa-DeepsexV2-7b-MGRPO:支持角色扮演和复杂对话的模型,性能超越32b(附一键安装包)

Tifa-DeepsexV2-7b-MGRPO: модель, поддерживающая ролевые игры и сложные диалоги, с производительностью выше 32b (с пакетом установки в один клик)

Всеобъемлющее введение Tifa-DeepsexV2-7b-MGRPO-GGUF-Q4 - это эффективная языковая модель, разработанная для поддержки сложных ролевых игр и многораундовых диалогов. Глубоко оптимизированная на основе Qwen 2.5-7B, она обладает отличной генерацией текста и диалогов...
1 год назад
0102.5K
Fabric:集成众多提示词的AI开源工作流框架,高效处理各种事务

Fabric: фреймворк рабочего процесса с открытым исходным кодом для ИИ, объединяющий множество слов-ключей для эффективной обработки различных операций.

Общее представление Fabric - это фреймворк искусственного интеллекта с открытым исходным кодом, разработанный Даниэлем Мисслером для упрощения и автоматизации повседневных компьютерных задач и облегчения использования искусственного интеллекта. Он эффективно помогает пользователям благодаря модульной конструкции и заранее заданным словам-подсказкам (Patterns)...
2 года назад
0102.4K
Kolors Virtual Try On:高效的虚拟试穿/模特换装,文本到图像生成模型

Виртуальная примерка Kolors: эффективная виртуальная примерка/одевание моделей, генерация моделей из текста в изображение

Общее представление Kolors Virtual Try-On - это приложение для виртуальной примерки от команды Kwai-Kolors на платформе Hugging Face. Приложение использует передовую технологию искусственного интеллекта, чтобы помочь пользователям примерить виртуальные...
2 года назад
0102.4K
优化代码生成和展示的Open WebUI

Открытый WebUI для оптимизированной генерации и представления кода

Общее представление Open WebUI Artifacts Overhaul - форк проекта на основе Open WebUI, разработанный разработчиком Ником Тоньюмом. Это инструмент с открытым исходным кодом, ориентированный на улучшение кода, генерируемого искусственным интеллектом...
1 год назад
0102.1K
TimesFM 2.0:谷歌开源进行时间序列预测的预训练模型

TimesFM 2.0: Google выкладывает в открытый доступ предварительно обученную модель для прогнозирования временных рядов

Общее представление TimesFM 2.0 - 500M PyTorch - это предварительно обученная базовая модель временных рядов, разработанная Google Research и предназначенная для прогнозирования временных рядов. Модель способна обрабатывать до 2048 временных точек вверх и вниз...
2 года назад
0102.1K
RD-Agent:自动化数据驱动研发工具,通过AI技术推动以数据为导向的研发过程

RD-Agent: автоматизированный инструмент для проведения НИОКР на основе данных, который облегчает процессы НИОКР на основе данных с помощью технологии искусственного интеллекта.

Общее представление RD-Agent - это инструмент с открытым исходным кодом от Microsoft, предназначенный для автоматизации и оптимизации процесса исследований и разработок (R&D). Инструмент ориентирован на сценарии, основанные на данных, для повышения эффективности разработки моделей и данных с помощью методов искусственного интеллекта.RD-Agent объединяет исследовательские...
1 год назад
0102K
DUIX:实时互动的智能数字人,支持多平台一键部署

DUIX: интеллектуальные цифровые люди для взаимодействия в реальном времени, поддерживающие многоплатформенное развертывание в один клик

Общее представление DUIX (Dialogue User Interface System) - это платформа цифрового взаимодействия с человеком на базе искусственного интеллекта, созданная компанией Silicon Intelligence. Благодаря возможностям цифрового взаимодействия с человеком с открытым исходным кодом разработчики могут легко интегрировать крупномасштабные модели, автоматическое распознавание речи (ASR...
2 года назад
0102K
Sonic:音频驱动肖像图片生成面部表情生动的数字人口播视频

Sonic: портретные изображения с аудиоуправлением создают цифровые демонстрационные видеоролики с яркой мимикой

Общее представление Sonic - это инновационная платформа, ориентированная на глобальное восприятие звука и предназначенная для создания ярких портретных анимаций, управляемых звуком. Разработанная группой исследователей из Tencent и Чжэцзянского университета, платформа использует аудиоинформацию для управления мимикой и движениями головы, чтобы генерировать естественные и плавные анимационные видеоролики.S...
1 год назад
0102K
Llasa 1~8B:高品质语音生成和克隆的开源文本转语音模型

Llasa 1~8B: модель преобразования текста в речь с открытым исходным кодом для генерации и клонирования речи высокого качества

Общие сведения Введение Llasa-3B - это модель преобразования текста в речь (TTS) с открытым исходным кодом, разработанная аудиолабораторией Гонконгского университета науки и технологий (HKUST Audio). Модель основана на архитектуре Llama 3.2B, которая была тщательно настроена для обеспечения высококачественной генерации речи, которая не только поддерживает множество...
1 год назад
0101.9K
CFG-Zero-star:提升图像和视频生成质量的开源工具

CFG-Zero-star: инструмент с открытым исходным кодом для улучшения качества генерации изображений и видео

Всеобъемлющее введение CFG-Zero-star - это проект с открытым исходным кодом, разработанный Вейчен Фаном и командой S-Lab в Наньянгском технологическом университете. Он направлен на улучшение техники Classifier Free Guidance (CFG) в моделях потокового сопоставления путем оптимизации стратегии наведения и нулевого инициального ...
1 год назад
0101.9K
Qwen-Agent:基于Qwen的智能代理应用框架,包括工具调用、代码解释器、RAG和Chrome扩展。

Qwen-Agent: основанный на Qwen фреймворк для приложений интеллектуальных агентов, включающий вызовы инструментов, интерпретаторы кода, RAG и расширения для Chrome.

Всеобъемлющее введение Qwen-Agent - это фреймворк интеллектуальных агентских приложений, разработанный на основе Qwen 2.0 и выше, с такими возможностями, как выполнение команд, использование инструментов, планирование и память. Фреймворк предоставляет множество примеров приложений, таких как браузерные помощники, интерпретаторы кода и пользовательские помощники...
2 года назад
0101.8K
MTEB:评估文本嵌入模型性能的基准测试

MTEB: бенчмаркинг для оценки эффективности моделей встраивания текста

Общие сведения Введение MTEB (Massive Text Embedding Benchmark) - это проект с открытым исходным кодом, разработанный командой embeddings-benchmark и размещенный на GitHub, цель которого - предоставить модели встраивания текста...
1 год назад
0101.7K
LHM:从单张图片生成支持动作的3D人体模型

LHM: генерация 3D-моделей человека с учетом движения на основе одного изображения

Всеобъемлющее введение LHM (Large Animatable Human Reconstruction Model) - это проект с открытым исходным кодом, разработанный командой aigc3d для быстрой генерации поддерживающей действия 3D-модели человека из одного изображения. Основные характеристики ...
1 год назад
0101.7K
MangaNinjia:自动化线稿上色工具,为动漫黑白线稿快速填色

MangaNinjia: автоматизированный инструмент для быстрого раскрашивания черно-белых линейных рисунков аниме.

Введение MangaNinjia - это проект с открытым исходным кодом, разработанный Alibaba Tongyi Visual Intelligence Lab (Ali-Vilab) и направленный на автоматизированную обработку раскраски линейных рисунков. Этот инструмент обеспечивает точное цветовое соответствие эталонных изображений с помощью методов глубокого обучения, значительно улучшая...
2 года назад
0101.6K
DiffRhythm(谛韵):10秒内生成最长4分45秒的歌曲

DiffRhythm: генерируйте песни длительностью до 4 минут 45 секунд за 10 секунд.

Общее представление DiffRhythm - это проект с открытым исходным кодом, разработанный ASLP-lab (Группа обработки аудио, речи и языка, Северо-Западный политехнический университет) и направленный на сквозное создание музыки с помощью методов искусственного интеллекта. Он основан на латентной диффу...
1 год назад
0101.6K
Gemini Teacher:英语口语发音纠正助手

Gemini Teacher: Помощник по коррекции произношения в английском языке

Общее представление Gemini Teacher - это помощник для практики английского языка, основанный на искусственном интеллекте Google Gemini. Он распознает английское произношение пользователя в режиме реального времени и предоставляет мгновенную обратную связь и предложения по исправлению. Инструмент разработан, чтобы помочь пользователям улучшить свои навыки разговорного английского языка через...
1 год назад
0101.5K