Проект с открытым исходным кодом AI

Всего 1020 статей
расставлять по порядку
Motia:用代码快速构建智能体的开发框架

Motia: система разработки для быстрого создания интеллекта в коде

Общее представление Motia - это фреймворк ИИ-агентов с открытым исходным кодом для инженеров-программистов, размещенный на GitHub и разработанный командой MotiaDev. Он позволяет разработчикам использовать знакомые языки программирования (например, Python, TypeScript, Rub...
1 год назад
0101.5K
混元文生视频:生成写实镜头感的高质量视频,腾讯开源视频生成大模型

Гибридное видео Vincennes: генерация реалистичных кадров высококачественного видео, Tencent с открытым исходным кодом для генерации видео больших моделей

Всеобъемлющее введение Tencent Mixed Yuan Text Generation Video (доступно в Yuanbao APP) - это платформа для создания видео на основе технологии искусственного интеллекта, запущенная компанией Tencent. Платформа использует гибридную большую модель Tencent с мощными междоменными знаниями и пониманием естественного языка и способна генерировать высококачественные видео на основе текстовых описаний пользователей...
2 года назад
0101.4K
Spark-TTS:生成自然语音的文本转语音工具

Spark-TTS: инструмент преобразования текста в речь для генерации естественной речи

Общее представление Spark-TTS - это инструмент преобразования текста в речь (TTS) с открытым исходным кодом, разработанный командой SparkAudio и размещенный на GitHub, призванный помочь пользователям эффективно преобразовывать текст в естественную и плавную речь...
1 год назад
0101.4K
AI投资系统:自动化A股投资决策系统,利用多智能体系统分析市场数据

Инвестиционная система AI: автоматизированная система принятия инвестиционных решений по акциям A, использующая мультиинтеллектуальную систему для анализа рыночных данных

Всеобъемлющее введение A_Share_investment_Agent - это помощник в принятии инвестиционных решений на основе мультиинтеллектуальной системы. Система предназначена для анализа рыночных данных, расчета внутренней стоимости акций, анализа настроений на рынке и фундаментальных данных с помощью нескольких совместных интеллектов, чтобы...
2 года назад
0101.3K
OuteTTS:实验性文本转语音模型,使用纯语言建模方法实现的TTS

OuteTTS: экспериментальная модель преобразования текста в речь, TTS, реализованная с использованием подхода чистого языкового моделирования

Всеобъемлющее введение OuteTTS - это экспериментальная модель преобразования текста в речь (TTS), которая использует подход чистого языкового моделирования для генерации высококачественной речи. В отличие от традиционных систем TTS, OuteTTS не требует внешних адаптеров или сложных архитектур. Модель основана на архитектуре LLaMa...
1 год назад
0101.3K
VLM-R1:通过自然语言定位图像目标的视觉语言模型

VLM-R1: модель визуального языка для определения местоположения целей изображения с помощью естественного языка

Всеобъемлющее введение VLM-R1 - это проект визуального моделирования языка с открытым исходным кодом, разработанный Om AI Lab и размещенный на GitHub. Проект основан на подходе R1 компании DeepSeek, объединенном с моделью Qwen2.5-VL, с помощью обучения с подкреплением...
1 год назад
0101.2K
Agent TARS:使用视觉和命令操作电脑的开源智能体

Агент TARS: интеллектуальная система с открытым исходным кодом, использующая зрение и команды для управления компьютерами

Всеобъемлющее введение Агент TARS - это мультимодальный искусственный интеллект с открытым исходным кодом от ByteDance, основные функции которого помогают пользователям выполнять сложные компьютерные задачи путем визуального понимания веб-контента и комбинирования операций командной строки и файловой системы. Вместо того чтобы требовать ручных операций, как это делают традиционные инструменты, он может самостоятельно...
1 год назад
0101.2K
Clone Voice:支持多语言的少样本声音克隆工具,基于xtts_v2提供Windows一键安装包

Clone Voice: Многоязычный инструмент для клонирования голоса без сэмплов на основе xtts_v2 для Windows.

Общее описание Clone Voice - это инструмент клонирования звука с открытым исходным кодом, который предоставляет веб-интерфейс, позволяющий пользователям клонировать голоса, используя любой звук или личную запись голоса. Инструмент прост в использовании, даже без NVIDIA GPU, и может быть использован с предварительно скомпилированным приложением...
2 года назад
0101.1K
InvSR:开源图像超分辨率项目,提升图像分辨率质量

InvSR: проект суперразрешения изображений с открытым исходным кодом для улучшения качества разрешения изображений

Общее представление InvSR - это инновационный проект с открытым исходным кодом по сверхразрешению изображений, основанный на методах диффузионной инверсии, способных преобразовывать изображения низкого разрешения в высококачественные изображения высокого разрешения. Проект использует богатые предварительные знания об изображениях, заложенные в предварительно обученных крупномасштабных диффузионных моделях, и, благодаря гибкому механизму выборки, поддерживает...
2 года назад
0101K
Scira(MiniPerplx):模仿Perplexity的开源项目,集成AI对话、网页搜索、天气查询等功能

Scira (MiniPerplx): проект с открытым исходным кодом, который имитирует Perplexity, интегрируя диалог ИИ, веб-поиск, запрос погоды и т.д.

Общее представление MiniPerplx (переименованный в Scira) - это минималистичная поисковая система, управляемая искусственным интеллектом, которая объединяет в себе множество полезных функций, чтобы предоставить пользователям полный спектр услуг по поиску информации. Проект использует современный стек технологий, включающий Next.js, Tailwi...
2 года назад
0100.9K
OpenWebUI-Monitor:监控OpenWebUI用户活动,管理使用限额,支持一键部署。

OpenWebUI-Monitor: мониторинг действий пользователей OpenWebUI, управление лимитами использования, поддержка развертывания одним щелчком мыши.

Общее представление OpenWebUI-Monitor - это приборная панель для мониторинга деятельности пользователей OpenWebUI и управления квотами использования. Она позволяет эффективно устанавливать пользовательские квоты, просматривать пользовательские данные и визуальную информацию в режиме реального времени, поддерживает развертывание одним щелчком мыши, а также облегчает управление пользователями и мониторинг...
2 года назад
0100.8K
codemcp:Claude Desktop专用的编码助手MCP

codemcp: ассистент кодирования MCP для Claude Desktop

Общее представление codemcp - это инструмент с открытым исходным кодом для пользователей Claude Desktop, разработанный Эдвардом З. Янгом на GitHub. Он делает Claude Desktop полезным...
1 год назад
0100.7K
SadTalker:让照片说话|嘴型同步音频|合成口型同步视频|免费数字人

SadTalker: Заставьте фотографии говорить | Синхронизация рта аудио | Синтезированное видео синхронизации рта | Бесплатные цифровые люди

Общее представление SadTalker - это инструмент с открытым исходным кодом, который объединяет одну портретную фотографию с аудиофайлом для создания реалистичных говорящих видео аватаров для широкого спектра сценариев, таких как персонализированные сообщения, образовательный контент и многое другое. Революционное использование технологий 3D-моделирования, таких как ExpNet и PoseVA...
1 год назад
0100.6K
Voice-Pro:开源多功能视频翻译工具,语音转录并翻译为多语言,Windows一键安装

Voice-Pro: многофункциональный инструмент для перевода видео с открытым исходным кодом, транскрипция и перевод голоса на множество языков, установка Windows одним щелчком мыши

Общее представление Voice-Pro - это универсальный инструмент на базе Gradio WebUI, который поддерживает преобразование речи в текст, текст в речь, перевод в реальном времени, загрузку видео с YouTube и разделение человеческого голоса. В него интегрированы технологии Whisper, Faster-Wh...
2 года назад
0100.6K
Screenshot to Code:将截图转换为干净前端代码的AI工具

Screenshot to Code: AI-инструмент для преобразования скриншотов в чистый внешний код

Общее представление Screenshot-to-Code - это инструмент с открытым исходным кодом, который использует искусственный интеллект для преобразования скриншотов, черновиков дизайна и проектов Figma в чистый, функциональный код. Инструмент поддерживает множество стеков фронтенд-технологий, включая HTML, Tailwind CS...
2 года назад
0100.5K
Emigo:在Emacs中使用AI完成复杂编程任务的助手

Emigo: помощник для решения сложных задач программирования с использованием искусственного интеллекта в Emacs

Общее представление Emigo - это ассистент программирования с открытым исходным кодом, созданный для Emacs, разработанный MatthewZMD на GitHub. Он помогает программистам выполнять анализ кода в Emacs, интегрируя крупномасштабную языковую модель (LLM)...
1 год назад
0100.5K
multi-model-bolt.new:基于 Bolt.new 的开源修改版,AI驱动的全栈开发工具

multi-model-bolt.new: модификация с открытым исходным кодом, основанная на Bolt.new, управляемом искусственным интеллектом инструменте разработки полного стека

Общее описание multi-model-bolt.new - это модифицированная версия Bolt.new, которая позволяет использовать модели TogetherAI, поддерживая такие функции, как развертывание, мобильный ответ и голосовой ввод. Пользователи могут получать запросы непосредственно в браузере, запускать...
2 года назад
0100.4K
Fragments:类似于 Anthropic 的 Claude Artifacts、Vercel v0 或 GPT Engineer 等应用程序的开源版本

Фрагменты: версии с открытым исходным кодом таких приложений, как Claude Artifacts от Anthropic, Vercel v0 или GPT Engineer.

Общее представление Fragments by E2B - это проект с открытым исходным кодом, который предоставляет шаблон на основе Next.js для создания приложений, полностью созданных искусственным интеллектом. Разработанный E2B, проект направлен на упрощение и ускорение процесса разработки приложений для искусственного интеллекта. Он объединяет в себе множество современных...
2 года назад
0100.4K
MiMo:高效数学推理与代码生成的小型开源模型

MiMo: небольшая модель с открытым исходным кодом для эффективных математических рассуждений и генерации кода

Общее представление MiMo - это проект моделирования больших языков с открытым исходным кодом, разработанный компанией Xiaomi и сфокусированный на математических рассуждениях и генерации кода. Основным продуктом является семейство моделей MiMo-7B, которое содержит базовую модель (Base), модель тонкой настройки под наблюдением (SFT), сильную химическую модель, обученную на основе базовой модели...
1 год назад
0100.4K
Zerox:PDF、DOCX、图像转换为Markdown,视觉模型高精度OCR

Zerox: PDF, DOCX, преобразование изображений в Markdown, высокоточное распознавание визуальных моделей

Общее представление Zerox - это проект с открытым исходным кодом, предназначенный для преобразования PDF, DOCX, изображений и других документов в формат Markdown с помощью визуальных моделей. Проект разработан командой getomni-ai и представляет собой простое и эффективное решение OCR (Optical Character Recognition).Ze...
2 года назад
0100.3K
BlinkShot:输入提示词实时生成图像(免费接入Flux Schnell模型)

BlinkShot: создание изображений в режиме реального времени путем ввода слов подсказки (бесплатный доступ к модели Flux Schnell)

Общее описание BlinkShot - это генератор изображений с открытым исходным кодом, работающий в режиме реального времени и использующий технологию Together AI и Flux Schnell, чтобы позволить пользователям генерировать высококачественные изображения по мере ввода подсказок. Платформа полностью бесплатна, поддерживает пользовательскую настройку и вторичные открытые...
2 года назад
0100.3K
MathTranslate:科学论文LaTeX翻译工具

MathTranslate: инструмент для перевода научных статей в формате LaTeX

Общее введение MathTranslate - это онлайн-инструмент, предназначенный для перевода документов LaTeX, особенно научных работ. Инструмент способен сохранять выражения LaTeX (например, математические выражения) без изменений и в итоге компилирует документы LaTeX в...
2 года назад
0100.3K
SemHash:快速实现语义文本去重,提升数据清理效率

SemHash: быстрая реализация семантической дедупликации текста для повышения эффективности очистки данных

Всеобъемлющее введение SemHash - это легкий и гибкий инструмент для дедупликации наборов данных по семантическому сходству. Он сочетает в себе быструю генерацию вкраплений Model2Vec и эффективный поиск сходства ANN (приближенный ближайший сосед) Vicinity.SemHa...
2 года назад
0100.2K
InstantIR:受损图像修复与图像高清放大开源项目,最低16G显存

InstantIR: проект с открытым исходным кодом по восстановлению поврежденных изображений и их HD-зуму, минимум 16 Гб видеопамяти

Общее описание InstantIR - это инновационная модель восстановления одного изображения, разработанная командой InstantX, предназначенная для воскрешения ваших поврежденных изображений с чрезвычайно высоким качеством и реалистичными деталями, способная выполнять высококачественное восстановление поврежденных изображений. Инструмент не только восстанавливает детали изображения...
2 года назад
0100.2K
KTransformers:大模型推理性能引擎:极致加速,灵活赋能

KTransformers: механизм вывода больших моделей: экстремальное ускорение, гибкое расширение возможностей

KTransformers: высокопроизводительный фреймворк на языке Python для преодоления узких мест, связанных с выводом больших моделей. Это больше, чем просто инструмент для работы с моделями, это набор движков для оптимизации производительности и гибкая платформа для расширения возможностей интерфейса. KTransf...
1 год назад
0100.1K
Cua:让AI代理在macOS/Linux沙盒中安全执行应用

Cua: обеспечение безопасного выполнения приложений агентами искусственного интеллекта в "песочницах" macOS/Linux

Общее представление Cua - это проект с открытым исходным кодом под названием "Computer-Use Agent", произносится как "ку-а". Он предназначен для устройств Apple Silicon, может создавать и запускать высокопроизводительные macOS ...
1 год назад
0100.1K
TRELLIS:Microsoft开发的3D资产生成模型,支持多种格式和灵活编辑

TRELLIS: разработанная Microsoft модель создания 3D-активов с поддержкой различных форматов и возможностью гибкого редактирования

Общее представление TRELLIS - это крупномасштабная модель генерации 3D-активов, разработанная компанией Microsoft. Она способна получать текстовые или графические подсказки и генерировать высококачественные 3D-активы в различных форматах, таких как радиальные поля, 3D-гауссианы и сетки.В основе TRELLIS лежит унифицированная структурированная скрытая...
2 года назад
099.9K
微信Markdown编辑器:简洁高效的微信图文排版工具,一键粘贴文章到微信公众号

Редактор WeChat Markdown: простые и эффективные инструменты для графической верстки WeChat, ключ для вставки статьи в публичный номер WeChat

Всеобъемлющее введение WeChat Markdown Editor (редактор WeChat Markdown) - это очень лаконичный инструмент для графической верстки WeChat, призванный помочь пользователям легко создавать красивые посты в WeChat. Редактор поддерживает все основные ...
2 года назад
099.8K
NarratoAI:文本生成影视解说与自动化剪辑神器

NarratoAI: текстовый нарратив для кино и телевидения и инструмент для автоматизированного редактирования

Общее представление NarratoAI - это полностью автоматизированный инструмент, объединяющий в себе функции озвучивания фильмов и видео, автоматического редактирования, дубляжа и создания субтитров. Он опирается на технологию крупномасштабного моделирования языка (LLM) для автоматического создания копий и автоматического редактирования видео с соответствующими закадровым голосом и субтитрами, предоставляя пользователям универсальный...
2 года назад
099.7K
Second Me:本地训练拥有个人记忆和习惯的AI分身

Второе Я: локально обученные двойники ИИ с личными воспоминаниями и привычками

Second Me - это проект с открытым исходным кодом, разработанный командой Mindverse, который позволяет создать на вашем компьютере искусственный интеллект, действующий как "цифровой двойник", изучающий ваши речевые модели и привычки через ваши слова и воспоминания и превращающийся в умного человека, понимающего ваши...
1 год назад
099.6K
免服务器生成永久微信群二维码

Генерация постоянного QR-кода microsoft без использования сервера

Общее введение serverless-qrcode-hub - это инструмент с открытым исходным кодом, предназначенный для решения проблемы частого отказа QR-кодов в групповых чатах WeChat. Он основан на Cloudflare Workers и базах данных D1, без необходимости использования традиционных серверов для запуска ...
1 год назад
099.5K
AutoGen:微软开发的多智能体对话框架

AutoGen: многоинтеллектуальная платформа для диалога с телом, разработанная Microsoft

Общее представление AutoGen - это фреймворк с открытым исходным кодом, разработанный группой исследователей Microsoft и направленный на упрощение создания приложений с большой языковой моделью (LLM) посредством диалога между несколькими интеллектуальными организмами. Он позволяет разработчикам создавать агентов ИИ, которые могут вести диалог друг с другом и совместно решать поставленные задачи. Такой подход не только повышает производительность LLM...
2 года назад
099.4K
DCT-Net:照片和视频转绘为动漫风格化的开源工具

DCT-Net: инструмент с открытым исходным кодом для преобразования фотографий и видео в стилизованное аниме

Общее представление DCT-Net - это проект с открытым исходным кодом, разработанный Академией DAMO и Институтом компьютерных технологий Ван Сюань Пекинского университета и направленный на стилизованное под аниме преобразование изображений. В проекте используются методы глубокого обучения через Domain-Calibrated Translation (Domain-Calibrat...
2 года назад
099.4K
推荐Github优秀开源下载工具

Рекомендуемый Github - отличный инструмент для загрузки открытых источников

В условиях стремительного развития современного Интернета инструменты загрузки, как важное средство получения пользователями информации и ресурсов, играют незаменимую роль. В этой статье будет проведен систематический анализ пяти инструментов загрузки с открытым исходным кодом: AB Download Manager, XDM (Xtreme Download ...
2 года назад
099.4K
Fay数字人框架:集成语言模型与3D数字角色,支持多种应用场景

Fay Digital Human Framework: интеграция языковых моделей и трехмерных цифровых персонажей для поддержки различных сценариев применения

Введение Fay - это фреймворк с открытым исходным кодом для создания 3D-виртуальных цифровых людей, который объединяет языковые модели и цифровые персонажи для различных сценариев применения, таких как виртуальные гиды по магазинам, виртуальные ведущие, ассистенты, официанты, учителя, а также голосовые или текстовые мобильные помощники.Fay поддерживает полное автономное использование, обеспечивая м...
2 года назад
099.2K
NSFW Detector:检测文件是否包含不适(NSFW)内容,保护数据安全

Детектор NSFW: определяет, содержит ли файл содержимое NSFW, чтобы защитить данные.

Всеобъемлющее введение NSFW Detector - это инструмент обнаружения дискомфортного содержимого на основе искусственного интеллекта, в основном используемый для определения того, содержат ли изображения, видео, PDF-файлы и т.д. дискомфортное содержимое. Инструмент использует Falconsai/nsfwimagedetectio...
2 года назад
099.2K
Local Deep Research:本地运行的生成深度研究报告工具

Местные глубокие исследования: локальный инструмент для создания отчетов о глубоких исследованиях

Общее представление Local Deep Research - это исследовательский помощник ИИ с открытым исходным кодом, призванный помочь пользователям проводить глубокие исследования и создавать подробные отчеты по сложным проблемам. Он поддерживает локальный запуск, позволяя пользователям выполнять исследовательские задачи, не полагаясь на облачные сервисы. Инструмент ...
1 год назад
098.9K
YOLOE:实时视频检测和分割物体的开源工具

YOLOE: инструмент с открытым исходным кодом для обнаружения и сегментации объектов на видео в реальном времени

YOLOE - проект с открытым исходным кодом, разработанный Группой мультимедийного интеллекта (THU-MIG) Школы программного обеспечения Университета Цинхуа, полное название - "You Only Look Once Eye". Он основан на фреймворке PyTorch, который относится к серии расширений YOLO ...
1 год назад
098.8K
Vanna:利用RAG技术将文本生成精准SQL查询

Vanna: генерация точных SQL-запросов из текста с помощью техники RAG

Всеобъемлющее введение Vanna - это лицензированный MIT фреймворк Python с открытым исходным кодом, ориентированный на генерацию SQL-запросов с помощью методов RAG (Retrieval Augmented Generation). Пользователи могут обучать модели RAG, применять их к своим собственным данным, а затем задавать вопросы, и Vanna будет возвращать соответствующие...
2 года назад
098.8K
AnkiAIUtils: Anki Flashcard Learning AI Toolset, интеллектуальный помощник, который автоматически оптимизирует карты памяти

AnkiAIUtils: Anki Flashcard Learning AI Toolset, интеллектуальный помощник, который автоматически оптимизирует карты памяти

Общее описание AnkiAIUtils - это набор инструментов с поддержкой искусственного интеллекта, предназначенных для системы изучения флэш-карт Anki. Разработанный студентом-медиком, этот инструмент предназначен для автоматического улучшения карточек, с которыми пользователи испытывают трудности в процессе обучения, с помощью технологии искусственного интеллекта. Он интеллектуально предоставляет пользователям персонализированные...
2 года назад
098.7K
TinyZero:低成本复现 DeepSeeK-R1 Zero 的顿悟效果

TinyZero: недорогая репликация эффекта прозрения DeepSeeK-R1 Zero

Общее представление TinyZero - это модель обучения с подкреплением на основе veRL, разработанная для воспроизведения производительности DeepSeeK-R1 Zero в задачах обратного отсчета и умножения. Удивительно, но стоимость проекта составляет всего 30 долларов (при использовании 2xH2...
2 года назад
098.7K
MoneyPrinterPlus:一键生成短视频的AI工具,免费批量混剪

MoneyPrinterPlus: ИИ-инструмент для создания коротких видеороликов одним щелчком мыши, бесплатное пакетное смешивание

Всеобъемлющее введение MoneyPrinterPlus - это проект с открытым исходным кодом, направленный на создание и смешивание всех видов коротких видео одним щелчком мыши с помощью технологии искусственного интеллекта и автоматическую публикацию их на нескольких видеоплатформах, таких как Jieyin, Shutterbugs, Xiaohongshu и Video Number. Инструмент поддерживает локальные и облачные голосовые модели, включая чат...
2 года назад
098.6K
DeOldify:使用AI技术为黑白照片和视频上色的经典开源工具

DeOldify: классический инструмент с открытым исходным кодом для окрашивания черно-белых фотографий и видео с помощью методов искусственного интеллекта

Всеобъемлющее представление DeOldify - это проект с открытым исходным кодом, основанный на технологии глубокого обучения и предназначенный для интеллектуального окрашивания и восстановления черно-белых фотографий и видео. В проекте используется инновационный метод обучения NoGAN, позволяющий успешно устранить общие недостатки традиционных GAN-сетей в процессе окрашивания изображений...
2 года назад
098.6K
Yutu:YouTube 命令行管理工具,接入AI全自动运营 YouTube 频道

Yutu: инструмент управления командной строкой YouTube, доступ к искусственному интеллекту для полной автоматизации каналов YouTube

Общее представление Yutu - это мощный инструмент командной строки с открытым исходным кодом, предназначенный для пользователей YouTube, размещенный на GitHub и разработанный командой eat-pray-ai. Он работает через терминал для достижения YouTube видео, плейлисты, частота...
1 год назад
098.6K
AI RSS生成器:通过AI将网页内容转换为RSS订阅源的工具

AI RSS Generator: инструмент для преобразования веб-контента в RSS-каналы с помощью искусственного интеллекта.

Общее представление AI RSS - это инновационный инструмент, который преобразует веб-контент в RSS-каналы с помощью технологии искусственного интеллекта. Он состоит из двух основных частей: плагина для браузера и серверной части. Плагин для браузера позволяет пользователям выбирать списки с веб-страниц и генерировать файлы структурированного описания данных (SDD)...
2 года назад
098.5K
DiffSynth-Engine:低现存部署FLUX、Wan2.1的开源引擎

DiffSynth-Engine: движок с открытым исходным кодом для развертывания FLUX, Wan 2.1

Общее представление DiffSynth-Engine - это проект с открытым исходным кодом, запущенный компанией ModelScope и размещенный на GitHub. Он основан на технологии диффузионного моделирования, ориентирован на эффективную генерацию изображений и видео и подходит разработчикам для развертывания моделей ИИ в производственных средах...
1 год назад
098.5K
WeChatAI:Windows版微信群聊智能助手客户端

WeChatAI: клиент интеллектуального помощника группового чата WeChat для Windows

Всеобъемлющее введение WeChatAI - это основанный на Python групповой чат WeChat и персональный интеллектуальный помощник, поддерживающий различные большие языковые модели (такие как DeepSeek, Gemini, Tongyi Thousand Questions), которые могут достигать интеллектуального диалога, автоответа и других функций. Проект использует современные ...
1 год назад
098.5K
Anubis:通过工作量证明干扰AI爬虫抓取

Anubis: вмешательство в ползание ИИ-кроулеров с помощью доказательств рабочей нагрузки

Общее представление Anubis - это инструмент с открытым исходным кодом, разработанный командой TecharoHQ для защиты веб-сайтов от краулеров искусственного интеллекта. Он добавляет вызов SHA256 Proof-of-Work в HTTP-запросы...
1 год назад
098.4K
Zola:支持文档上传与多模型的开源AI聊天Web应用

Zola: веб-приложение для чата с искусственным интеллектом с открытым исходным кодом, загрузкой документов и поддержкой нескольких моделей

Общее представление Zola - это бесплатное приложение с открытым исходным кодом для чата с искусственным интеллектом, разработанное разработчиком Жюльеном Тибо (имя пользователя ibelick на GitHub) и размещенное на GitHub. Его лучшей особенностью является то, что он поддерживает несколько режимов ИИ...
1 год назад
098.3K
Step-Audio:多模态语音交互框架,识别语音并使用克隆语音交流等功能

Step-Audio: мультимодальный фреймворк для голосового взаимодействия, который распознает речь и общается с помощью клонированной речи, среди прочих возможностей

Всеобъемлющее введение Step-Audio - это фреймворк с открытым исходным кодом для интеллектуального речевого взаимодействия, предназначенный для обеспечения готовых возможностей понимания и генерации речи в производственных средах. Фреймворк поддерживает многоязычные разговоры (например, китайский, английский, японский), эмоциональную речь (например, счастливую, грустную), региональные диалекты (например, кантонский, чечуаньский ...
1 год назад
098.2K
olmOCR:PDF文档转换为文本,支持表格、公式和手写内容的识别

olmOCR: преобразование PDF-документов в текст, поддержка таблиц, формул и распознавание рукописного текста

Общее представление olmOCR - это инструмент с открытым исходным кодом, разработанный командой AllenNLP в Институте искусственного интеллекта Аллена (AI2), который предназначен для преобразования PDF-файлов...
1 год назад
098.1K
Muyan-TTS:个性化播客语音训练与合成

Muyan-TTS: персонализированное обучение и синтез речи в подкастах

Синтез Muyan-TTS - это модель преобразования текста в речь (TTS) с открытым исходным кодом, разработанная для сценариев подкастинга. Она предварительно обучена на более чем 100 000 часах аудиоданных подкастов и поддерживает синтез речи с нулевой выборкой для генерации высококачественной естественной речи. Модель основана на Llama-3.2-3...
1 год назад
098.1K
MCP Containers:基于 Docker 提供数百种 MCP 容器化部署

Контейнеры MCP: сотни контейнерных развертываний MCP на базе Docker

Общее введение MCP Containers - это проект с открытым исходным кодом, размещенный на GitHub, ориентированный на предоставление контейнерных решений для серверов Model Context Protocol (MCP). Он упрощает с помощью контейнеров Docker...
1 год назад
098.1K
语析(Yuxi-Know):基于知识图谱的智能问答平台

Yuxi-Know: интеллектуальная платформа вопросов и ответов на основе графа знаний

Yuxi-Know - это интеллектуальная платформа вопросов и ответов с открытым исходным кодом, которая сочетает в себе граф знаний и технологию RAG (Retrieval Augmented Generation), чтобы помочь пользователям быстро получать точные ответы. Она основана на Neo4j для хранения графа знаний, использует FastAPI и структуру VueJS ...
1 год назад
098K
promptfoo:提供安全可靠的LLM应用测试工具

Promptfoo: безопасный и надежный инструмент для тестирования приложений LLM

Всеобъемлющее введение promptfoo - это инструмент командной строки с открытым исходным кодом и библиотека, предназначенная для оценки и повторного тестирования приложений Large Language Model (LLM). Она предоставляет разработчикам полный набор инструментов для создания надежных подсказок, моделей и генерации на основе поиска (RAG) с само...
1 год назад
097.9K
Easy Dataset:创建大模型微调数据集的简易工具

Easy Dataset: простой инструмент для создания больших модельных наборов данных с точной настройкой

Общее введение Easy Dataset - это инструмент с открытым исходным кодом, разработанный специально для тонкой настройки больших моделей (LLM) и размещенный на GitHub. Он предоставляет простой в использовании интерфейс, который позволяет пользователям загружать файлы, автоматически сегментировать содержимое, генерировать вопросы и ответы и в конечном итоге выводить подходящие...
1 год назад
097.8K
Open R1:Hugging Face 复现 DeepSeek-R1 的训练过程

Open R1: обнимающееся лицо повторяет процесс обучения DeepSeek-R1

Общее введение Проект Hugging Face's Open R1 - это проект репликации DeepSeek-R1 с открытым исходным кодом, целью которого является создание недостающих частей конвейера R1, чтобы каждый мог воспроизвести их и построить на их основе. Проект задуман как простой и состоит в основном из обучения и оценки...
2 года назад
097.8K
Qwen2.5-Omni:多模态输入和实时语音交互的端测模型

Qwen2.5-Omni: модель конечных измерений для мультимодального ввода и речевого взаимодействия в реальном времени

Всеобъемлющее введение Qwen2.5-Omni - это мультимодальная модель ИИ с открытым исходным кодом, разработанная командой Alibaba Cloud Qwen. Она может обрабатывать множество входных данных, таких как текст, изображения, аудио и видео, и генерировать текстовые или естественные речевые ответы в режиме реального времени. Модель была выпущена в 2025 году 3 ...
1 год назад
097.8K
Comp AI:自动化SOC 2、ISO 27001和GDPR合规的开源平台

Comp AI: платформа с открытым исходным кодом для автоматизации соблюдения требований SOC 2, ISO 27001 и GDPR

Общее представление Comp AI - это платформа с открытым исходным кодом, разработанная компанией Comp AI, Inc. в Сан-Франциско, США. Она помогает организациям быстро выполнить требования к соответствию, такие как SOC 2, ISO 27001 и GDPR, с помощью автоматизированных инструментов, с целью...
1 год назад
097.8K
Chonkie:轻量级RAG文本切块库

Chonkie: легкая библиотека для разбивки текста на части в RAG

Всеобъемлющее введение Chonkie - это легкая и эффективная библиотека RAG (Retrieval-Augmented Generation) для разбивки текста на куски, призванная помочь разработчикам быстро и легко разбивать текст на куски. Библиотека поддерживает различные методы разбивки, включая ...
1 год назад
097.7K
OmniSQL:将自然语言转化为高质量SQL查询的模型

OmniSQL: модель для преобразования естественного языка в высококачественные SQL-запросы

Общее введение OmniSQL - это проект с открытым исходным кодом, разработанный командой RUCKBReasoning и размещенный на GitHub. Его основной функцией является преобразование вводимых пользователем вопросов на естественном языке в высококачественные SQL-запросы, чтобы помочь пользователям легко справляться с ...
1 год назад
097.6K
CoAI.Dev (Chat Nio):AI聚合应用 一站式 B/C 端解决方案,支持弹性计费和订阅计划模式

CoAI.Dev (Chat Nio): универсальное решение для агрегации приложений искусственного интеллекта с поддержкой гибкой модели биллинга и подписки

Общее введение CoAI.Dev (ранее Chat Nio) - это чат-платформа, объединяющая несколько моделей искусственного интеллекта и поддерживающая распределенный стриминг, генерацию изображений, синхронизацию и обмен разговорами между устройствами. В ней реализованы система подписки и биллинга с использованием токенов, сервис транзита ключей и множество...
2 года назад
097.6K
Neural4D:生成高分辨率3D建模数字资产的AI平台

Neural4D: платформа искусственного интеллекта для создания цифровых 3D-моделей высокого разрешения

Общее представление Neural4D - это инновационная платформа на основе искусственного интеллекта, помогающая пользователям быстро создавать высококачественные 3D-модели и анимации с помощью простого ввода текста или изображения. Разработанная компанией DreamTech, она опирается на ведущую в мире технологию сквозной генерации больших 3D-моделей...
1 год назад
097.6K
Activepieces:AI工作流程自动化,适合非技术用户的任务编排工具,开源Zapier替代品

Activepieces: автоматизация рабочих процессов с помощью искусственного интеллекта, инструмент планирования задач для нетехнических пользователей, замена Zapier с открытым исходным кодом

Общее представление Activepieces - это платформа автоматизации рабочих процессов с открытым исходным кодом, ориентированная на предоставление интуитивно понятных и мощных решений автоматизации для предприятий и индивидуальных пользователей. Разработанная на TypeScript, платформа чрезвычайно масштабируема и поддерживает более 200 интегрированных сервисов...
2 года назад
097.5K
k8m:简化Kubernetes集群管理的轻量级AI控制台工具

k8m: легкий консольный инструмент с искусственным интеллектом для упрощения управления кластером Kubernetes

Общее представление k8m - это легкая, кроссплатформенная Mini Kubernetes AI Dashboard, предназначенная для упрощения управления кластером. Он построен на базе AMIS и доступен через kom как гостевой Kubernetes API...
2 года назад
097.5K
AI reads books:AI逐页阅读PDF书籍,自动提取知识要点并生成总结

ИИ читает книги: ИИ читает PDF-книги страницу за страницей, автоматически извлекает основные моменты и создает резюме.

Комплексное введение AI-reads-books-page-by-page - это основанная на Python разработка интеллектуального инструмента анализа PDF-книг, который может автоматизировать постраничный анализ PDF-книг, извлекать ключевые точки знаний, а после указанного интервала страниц генерировать этап...
2 года назад
097.5K
Copilot后端代理服务:用其他模型接管GitHub Copilot插件服务端

Прокси-сервис бэкенда Copilot: передача сервера плагинов GitHub Copilot другим моделям

Общее введение Служба Copilot Backend Agent Service - это проект с открытым исходным кодом, предназначенный для управления сервером плагинов GitHub Copilot с использованием других моделей FIM, таких как DeepSeek, при поддержке нескольких людей, имеющих общие официальные аккаунты. Сервис поддерживает множество IDE, включая V...
2 года назад
097.5K
ChatFree(ChatAnywhere-2):使用GPT API创建的本地Copilot,支持任意窗口中补全对话

ChatFree (ChatAnywhere-2): нативный Copilot, созданный с помощью GPT API, с поддержкой дополнительных диалогов в любом окне.

Общее представление ChatFree - это проект с открытым исходным кодом, цель которого - освободить приложения искусственного интеллекта пользователей от ограничений браузеров и запустить их локально. Созданный с использованием GPT API, Copilot предназначен для поддержки широкого спектра офисных программ, таких как Office, Word, WPS и других. Проект был разработан ...
2 года назад
097.5K
99AI:集成多模态AI服务的商业化Web应用(免费开源)

99AI: коммерческое веб-приложение, интегрирующее мультимодальные сервисы искусственного интеллекта (бесплатный открытый исходный код)

Всеобъемлющее введение 99AI - это проект веб-приложения ИИ с открытым исходным кодом, целью которого является предоставление простой в развертывании, низкопороговой интегрированной платформы услуг ИИ. Проект поддерживает интеллектуальные диалоги, мультимодальные модели, площадки для приложений, сетевой поиск, а также интегрирует ИИ-живопись, музыку и видео...
2 года назад
097.3K
Midjourney Proxy:代理/逆向Midjourney Discord频道,实现AI绘图API调用(免费测试)

Midjourney Proxy: проксирование/реверсирование канала Midjourney Discord для вызовов API AI mapping (бесплатный тест)

Всеобъемлющее введение Midjourney Proxy - это проект с открытым исходным кодом, предназначенный для предоставления прокси-услуг для канала Midjourney's Discord, преобразующий функции рисования AI в форму API. Проект полностью бесплатный и с открытым исходным кодом, поддерживает подмену лица одним кликом, смешивание изображений, генерацию графики...
2 года назад
097.2K
YTSage:YouTube下载器,免费下载YouTube视频,提取音频,获取字幕

YTSage: YouTube Downloader, бесплатная загрузка видео с YouTube, извлечение аудио, получение субтитров

Общее представление YTSage - это современный инструмент для скачивания YouTube с чистым интерфейсом PyQt6. Пользователи могут использовать YTSage для загрузки видео любого качества, извлечения звука, получения субтитров (в том числе автогенерируемых) и просмотра метаданных видео...
2 года назад
097.2K
LangGraph CodeAct:生成代码帮助智能体解决复杂任务

LangGraph CodeAct: генерация кода для помощи интеллекту в решении сложных задач

Общие сведения Введение LangGraph CodeAct - это фреймворк, открытый на GitHub командой LangChain AI, основанный на архитектуре CodeAct (подробнее см. статью arXiv:2402.01030). Для этого он генерирует...
1 год назад
097K
ConsisID:一张人像参考图,生成人物一致的视频,多终端快速集成

ConsisID: портретная справочная карта для создания видео с учетом характера, быстрая многотерминальная интеграция

Всеобъемлющее введение ConsisID - это проект с открытым исходным кодом, разработанный группой Юань Ронга в Пекинском университете и направленный на достижение согласованной с личностью генерации текста в видео (IPT2V) с помощью методов частотного разложения. В основе проекта лежит DiT (Diffusion Transfor...
2 года назад
097K
NVIDIA Garak:检测LLM漏洞的开源工具,确保生成式AI的安全性

NVIDIA Garak: инструмент с открытым исходным кодом для обнаружения уязвимостей LLM и обеспечения безопасности генеративного ИИ

Всеобъемлющее введение NVIDIA Garak - это инструмент с открытым исходным кодом, специально разработанный для обнаружения уязвимостей в больших языковых моделях (LLM). Он проверяет модель на наличие множества слабых мест, таких как иллюзии, утечка данных, внедрение подсказок, генерация сообщений об ошибках, генерация вредоносного содержимого и т.д. с помощью статического, динамического и адаптивного зондирования...
2 года назад
097K
CrisperWhisper:精确的逐字语音转录工具

CrisperWhisper: инструмент для точной стенографической расшифровки речи

Общее описание CrisperWhisper - это продвинутый инструмент распознавания речи, основанный на OpenAI Whisper и ориентированный на быструю, точную и пословную транскрипцию речи. Он обеспечивает точные временные метки на уровне слов, даже в случае заполнения речи и пауз...
2 года назад
096.9K
Fast GraphRAG:高准确率且低成本的图形化检索增强生成工具

Быстрый GraphRAG: высокоточный и недорогой инструмент для создания расширений графического поиска

Всеобъемлющее введение Fast GraphRAG - это инструмент с открытым исходным кодом, разработанный Circlemind AI для обеспечения эффективного и точного расширения поиска (RAG) с помощью алгоритмов Knowledge Graph и PageRank. Инструмент интеллектуально адаптируется к использованию пользователем...
2 года назад
096.8K
Trackers:用于视频对象跟踪的开源工具库

Trackers: библиотека инструментов с открытым исходным кодом для отслеживания видеообъектов

Общее представление Trackers - это библиотека инструментов Python с открытым исходным кодом, ориентированная на отслеживание нескольких объектов в видео. Она объединяет несколько ведущих алгоритмов отслеживания, таких как SORT и DeepSORT, и позволяет пользователям комбинировать различные модели обнаружения объектов (например, YOLO...
1 год назад
096.8K
ChatTTS:模仿真人说话声音的语音生成模型(ChatTTS一键加速包)

ChatTTS: модель генерации речи, имитирующая голос реального собеседника (пакет ускорения ChatTTS в один клик)

Общее представление ChatTTS - это генеративная модель речи, разработанная для сценариев диалога. Она генерирует естественную и выразительную речь, поддерживает несколько языков и нескольких дикторов и подходит для интерактивных диалогов. Для этого модель предсказывает и контролирует такие тонкие ритмические особенности, как смех, паузы и междометия, а также...
1 год назад
096.7K
GraphRAG Visualizer:可视化和探索Microsoft GraphRAG工件的工具

GraphRAG Visualizer: инструмент для визуализации и изучения артефактов Microsoft GraphRAG

Общее введение GraphRAG Visualizer - это веб-инструмент, разработанный, чтобы помочь пользователям визуализировать и исследовать артефакты из Microsoft GraphRAG. Загрузив пар...
2 года назад
096.6K
LlamaEdge:本地运行和微调LLM的最快捷方式

LlamaEdge: самый быстрый способ запускать и настраивать LLM локально!

Общее представление LlamaEdge - это проект с открытым исходным кодом, разработанный для упрощения процесса запуска и тонкой настройки больших языковых моделей (LLM) на локальных или пограничных устройствах. Проект поддерживает семейство моделей Llama2 и предоставляет API-сервисы, совместимые с OpenAI, которые позволяют пользователям легко создавать и запускать...
2 года назад
096.6K
FlowDown(浮望):iOS/macOS下体验流畅的AI客户端

FlowDown: плавный AI-клиент для iOS/macOS

Общее представление FlowDown-App - это легкий и эффективный клиент AI-диалога, разработанный командой разработчиков с использованием Swift и UIKit, цель которого - предоставить пользователям быстрый и плавный опыт интеллектуального диалога. Приложение разделено на стандартную версию (FlowDown...
1 год назад
096.5K
Melty:体验AI驱动的代码编辑器 ,让每一次对话都成为Git提交

Melty: редактор кода на базе искусственного интеллекта, превращающий каждый разговор в Git-коммит!

Общее представление Melty - это революционный редактор кода с искусственным интеллектом, который сочетает в себе беседы в чате и контроль версий Git. Разработанный Чарли и Джексоном из Replicate, этот инструмент призван решить проблемы традиционных инструментов для кодирования ИИ. Его самая большая ...
2 года назад
096.5K
Amurex:开源AI会议记录助手,自动记录会议内容生成总结

Amurex: ассистент записи совещаний с открытым исходным кодом с искусственным интеллектом, автоматическая запись содержимого совещания для создания резюме

Общее представление Amurex - это помощник по организации встреч с открытым исходным кодом, разработанный компанией The Personal AI Company и предназначенный для повышения эффективности встреч с помощью интеллектуальных функций. Amurex способен давать советы в режиме реального времени, генерировать интеллектуальные резюме, записывать содержание встреч и автоматически отправлять последующие...
2 года назад
096.4K
CogAgent:智谱开源的智能视觉语言模型,实现图形界面自动化操作

CogAgent: интеллектуальная модель визуального языка Smart Spectrum с открытым исходным кодом для автоматизации графических интерфейсов

Всеобъемлющее введение CogAgent - это визуальная языковая модель с открытым исходным кодом, разработанная исследовательской группой Tsinghua University Data Mining Research Group (THUDM) и предназначенная для автоматизации работы графического интерфейса пользователя (GUI) на разных платформах. Модель основана на CogVLM (GLM-4V-9B) и поддерживает двуязычный китайский и английский...
2 года назад
096.4K
Sana:快速生成高分辨率图像,0.6B超小尺寸模型,低配笔记本GPU运行

Sana: быстрая генерация изображений высокого разрешения, ультрамалая модель размером 0,6 ББ, работа с GPU в низкопрофильном ноутбуке

Общее представление Sana - это эффективный фреймворк для создания изображений высокого разрешения, разработанный NVIDIA Labs, способный генерировать изображения с разрешением до 4096 × 4096 за считанные секунды. Sana использует линейное диффузионное преобразование и технологию самокодирования с глубоким сжатием, чтобы значительно...
2 года назад
096.3K
LogoCreator:开源Logo生成器,使用AI智能生成专业品牌Logo

LogoCreator: генератор логотипов с открытым исходным кодом, использующий искусственный интеллект для создания профессиональных логотипов брендов

Общее представление LogoCreator - это генератор логотипов с открытым исходным кодом, основанный на модели Together AI и Flux, ориентированный на предоставление быстрых и профессиональных услуг по разработке логотипов для предприятий и частных лиц. Проект разрабатывается и распространяется разработчиком Nutlope на Git...
2 года назад
096.3K
Open Canvas:代码编辑协作画布,开源版OpenAI Canvas/Claude Artifacts

Open Canvas: холст для совместного редактирования кода, версия OpenAI Canvas/Claude Artifacts с открытым исходным кодом

Общее представление LangChain представляет Open Canvas, веб-приложение с открытым исходным кодом, разработанное для улучшения редактирования документов и совместной работы, со встроенной функцией памяти двух агентов и интегрированным смитом для наблюдения за всеми деталями выполнения. Платформа работает на базе OpenA...
1 год назад
096.3K
Ultravox:实时端到端语音对话的音频多模态大模型,GPT-4o语音交互的开源实现

Ultravox: аудио мультимодальная макромодель для сквозного голосового диалога в реальном времени, реализация голосового взаимодействия GPT-4o с открытым исходным кодом

Всеобъемлющее введение Ultravox - это инновационная мультимодальная модель большого языка (LLM), предназначенная для обработки речи в реальном времени. В отличие от традиционных систем распознавания речи, Ultravox устраняет необходимость в отдельном этапе распознавания аудиоречи (ASR) и способен напрямую преобразовывать аудио в высокоразмерное пространство в...
2 года назад
096.2K
One Hub:管理和分发OpenAI接口,支持多种模型和统计功能

Единый хаб: управление и распространение интерфейсов OpenAI, поддержка множества моделей и статистических функций

Общее представление One Hub - это система управления и распространения интерфейсов OpenAI, основанная на вторичном развитии One API. Он был разработан компанией MartialBE для обеспечения более широкой поддержки моделей и улучшения статистических возможностей.One Hub имеет...
2 года назад
096.1K
腾讯混元3D(Hunyuan3D):生成高分辨率3D资产,多种3D素材生成工作流

Tencent Hybrid 3D (Hunyuan3D): создание 3D-активов высокого разрешения, несколько рабочих процессов создания 3D-материалов

Всеобъемлющее введение Tencent Hunyuan3D (Hunyuan3D 2.0) - это передовая крупномасштабная система 3D-композитинга от Tencent, предназначенная для создания текстурированных 3D-активов высокого разрешения. Система состоит из двух основных компонентов: Hunyuan3D-DiT, крупномасштабной модели генерации форм, и Hunyuan3D-DiT, крупномасштабной текстурной...
2 года назад
096K
AI ContentCraft:生成短故事、对话脚本、配音、配图的多功能AI内容创作工具

AI ContentCraft: универсальный инструмент для создания ИИ-контента, позволяющий генерировать короткие истории, сценарии диалогов, закадровый голос и графику.

Общее представление AI ContentCraft - это универсальный инструмент для создания контента, который объединяет в себе генерацию текста, синтез речи, создание изображений и многое другое. Он помогает авторам быстро создавать истории, сценарии подкастов, а также сопутствующий аудио- и видеоконтент. Инструмент поддерживает преобразование нескольких языков и может пакетно...
2 года назад
096K
AiPy:自动化运行Python代码完成数据分析任务

AiPy: автоматизация задачи выполнения кода на Python для анализа данных

Общее представление AiPy - это инструмент командной строки Python с открытым исходным кодом, разработанный командой Knownsec. Он сочетает в себе Большую языковую модель (LLM) и среду выполнения Python, позволяя пользователям автоматически генерировать и запускать Pytho...
1 год назад
095.7K
Baichuan-Audio:支持实时语音交互的端到端音频模型

Baichuan-Audio: сквозная аудиомодель, поддерживающая голосовое взаимодействие в реальном времени

Всеобъемлющее введение Baichuan-Audio - это проект с открытым исходным кодом, разработанный Baichuan Intelligence (baichuan-inc) и размещенный на GitHub, сфокусированный на сквозной технологии голосового взаимодействия. Проект предоставляет полный фреймворк для обработки звука, который обеспечивает речевое ...
1 год назад
095.5K
Datalab:专用OCR识别AI模型,PDF转Markdown(开源/API)

Datalab: специализированная модель ИИ для распознавания OCR, преобразование PDF в Markdown (открытый исходный код/API).

Всеобъемлющее представление Datalab предлагает ряд продвинутых моделей искусственного интеллекта, ориентированных на OCR, анализ макетов, преобразование PDF в Markdown и многое другое. Эти модели не только высокопроизводительны, но и просты в использовании и имеют открытый исходный код. Модели Marker на платформе могут быстро и точно...
2 года назад
095.5K
Austen:分析书籍角色关系并生成图表的AI工具

Austen: инструмент искусственного интеллекта для анализа отношений между персонажами книг и построения графиков

Общее представление Austen - это инструмент искусственного интеллекта с открытым исходным кодом, использующий фреймворк Angular и инициализацию Analogjs в сочетании с технологией Mermaidjs для создания диаграмм, которые помогают пользователям анализировать взаимоотношения персонажей в книгах. Пользователи могут вводить открытые...
1 год назад
095.5K
code2prompt:将代码库转换为大模型可理解的prompt文件

code2prompt: преобразование библиотек кода в понятные файлы подсказок с большой моделью

Общее представление code2prompt - это инструмент командной строки с открытым исходным кодом, созданный разработчиком Mufeed VH и размещенный на GitHub, призванный помочь пользователям быстро преобразовывать целые базы кода в подсказки, подходящие для Large Language Model (LLM) (подсказки...
1 год назад
095.4K
Zed:Rust开发的高性能多人协作代码编辑器

Zed: высокопроизводительный многопользовательский редактор кода для совместной работы, разработанный Rust

Общее представление Zed - это высокопроизводительный многопользовательский редактор совместного кода, разработанный создателями Atom и Tree-sitter. Написанный на языке Rust, Zed предназначен для быстрого и плавного написания кода. Среди его основных особенностей - поддержка многопользовательской...
2 года назад
095.3K
Moshi:实时语音对话框架,支持多种语言和口音的语音对话基础模型

Moshi: фреймворк речевого диалога в реальном времени с поддержкой нескольких языков и акцентов для базовых моделей речевого диалога

Общее представление Moshi Chat - это сквозной голосовой помощник с искусственным интеллектом в реальном времени от Kyutai, французской некоммерческой лаборатории искусственного интеллекта. Он не только слушает в режиме реального времени, но и участвует в естественных разговорах и поддерживает мультимодальное взаимодействие, включая возможность видеть, слышать и говорить.Moshi Ch...
2 года назад
095.3K
Dify-Plus:为Dify开发的企业内部管理后台

Dify-Plus: бэкэнд для управления Dify на местах

Всеобъемлющее представление Dify-Plus - это платформа для разработки приложений искусственного интеллекта, основанная на вторичном развитии проекта Dify с открытым исходным кодом. Она добавляет новый центр управления на основе Dify и оптимизирует функциональность для корпоративных сценариев. Изначально проект предназначался для внутреннего использования предприятиями, а затем, обнаружив, что у сообщества есть схожие потребности, он...
1 год назад
095.2K