Проект с открытым исходным кодом AI

Всего 1020 статей
расставлять по порядку
使用Cursor读取并修改Figma设计稿的MCP服务

MCP-сервис для чтения и модификации проектов Figma с помощью Cursor.

Общее введение Cursor Talk to Figma MCP - это проект с открытым исходным кодом, который соединяет инструмент программирования искусственного интеллекта Cursor с программным обеспечением для проектирования Figm...
1 год назад
095.1K
Markdownify MCP Server:基于MCP协议将各种内容转换为Markdown格式

Markdownify MCP Server: конвертирует различный контент в формат Markdown на основе протокола MCP.

Общие сведения Введение Markdownify MCP Server - это инструмент с открытым исходным кодом, основанный на протоколе Model Context Protocol, размещенный на GitHub разработчиком Заком Касересом ...
1 год назад
095.1K
FinRobot:提升金融数据分析效率和投资研究的的智能体

FinRobot: интеллектуальный организм для повышения эффективности анализа финансовых данных и инвестиционных исследований

Всеобъемлющее введение FinRobot - это интеллектуальная платформа ИИ с открытым исходным кодом, разработанная фондом AI4Finance и предназначенная для финансовой аналитики. Она не только охватывает традиционные языковые модели, но и включает в себя различные технологии ИИ, стремясь предоставить комплексное решение для финансовой индустрии.F...
1 год назад
095K
RoomGPT:上传房间照片,使用AI重新设计

RoomGPT: загружайте фотографии комнат и переделывайте их с помощью искусственного интеллекта!

Общее представление RoomGPT - это проект с открытым исходным кодом, разработанный пользователем GitHub - Nutlope, который позволяет пользователям загружать фотографии комнат и генерировать их переработанные версии с помощью технологии искусственного интеллекта. Цель проекта - предоставить пользователям доступ к профессиональному дизайну интерьера без дорогостоящих услуг дизайнера...
2 года назад
095K
LangBot:开源大模型即时通信机器人,支持多微信、QQ、飞书等多平台部署AI机器人

LangBot: открытый исходный код большой модели робота мгновенного обмена сообщениями, поддержка нескольких WeChat, QQ, Flybook и других многоплатформенных развертывания роботов ИИ

LangBot - это бот-платформа для обмена мгновенными сообщениями на основе больших моделей, которая поддерживает несколько платформ обмена сообщениями и большие модели. Платформа адаптируется к QQ, WeChat (корпоративный WeChat, персональный WeChat), Flybook, Discord, OneBot и другим платформам обмена сообщениями, а также поддерживает Open...
1 год назад
095K
Kotaemon:简单部署的开源多模态文档问答工具

Kotaemon: простой в развертывании мультимодальный инструмент для проверки документов с открытым исходным кодом

Общее представление Kotaemon - это инструмент вопросов и ответов на документы с открытым исходным кодом, предназначенный для предоставления конечным пользователям и разработчикам функциональности вопросов и ответов, основанной на Retrieval Augmented Generation (RAG). Проект был разработан компанией Cinnamon и поддерживает различные LLM API провайдеры (например, OpenA...
2 года назад
094.7K
Aide:强化VSCode开发体验的AI助手扩展,一键注释、转换、UI生成代码

Aide: расширение-помощник AI, которое расширяет возможности разработки VSCode с помощью аннотации, преобразования и генерируемого UI кода одним щелчком мыши.

Общее введение AIDE (AI-assisted Development Extension) - это мощное расширение для разработки с помощью искусственного интеллекта для VSCode, ориентированное на предоставление уникальной и полезной помощи в программировании с помощью искусственного интеллекта. Оно отличается от GitHu...
2 года назад
094.6K
AnyText:生成和编辑多语言图像文本,高可控在图像中生成多行中文

AnyText: создание и редактирование многоязычного текста на изображении, с возможностью управления для создания нескольких строк китайского языка на изображении

Всеобъемлющее введение AnyText - это революционный многоязычный инструмент для создания и редактирования визуального текста, разработанный на основе диффузионной модели. Он генерирует естественный, высококачественный многоязычный текст на изображениях и поддерживает гибкие возможности редактирования текста. Он был разработан группой исследователей и представлен на конференции ICLR 2024...
2 года назад
094.6K
TxAgent:帮医生分析药物作用和治疗方案的AI工具

TxAgent: инструмент искусственного интеллекта, помогающий врачам анализировать действие лекарств и варианты лечения

Всеобъемлющее введение TxAgent - это инструмент искусственного интеллекта с открытым исходным кодом, разработанный группой медицинского и научного искусственного интеллекта Гарвардского университета (MIMS) для помощи врачам в анализе лекарственных взаимодействий и разработке персонализированных планов лечения. Он объединяет ситуации, связанные с конкретным пациентом, с помощью многоступенчатых рассуждений и поиска биомедицинских знаний в режиме реального времени...
1 год назад
094.6K
飞桨 PP-TableMagic:复杂表格结构化信息提取神器

Flying Paddle PP-TableMagic: структурированное извлечение информации для сложных таблиц

Целью распознавания таблиц является разбор таблиц на изображениях, точная идентификация структуры таблиц и расположения ячеек, а также приведение их к структурированным табличным форматам (например, HTML). В современный информационный век большое количество важных табличных данных по-прежнему существует в неструктурированном виде (например, отсканированные документы с изображениями статистических таблиц...).
1 год назад
094.6K
PandasAI:数据分析对话平台,用自然语言完成数据查询与图表生成

PandasAI: диалоговая платформа анализа данных для запросов данных и построения диаграмм на естественном языке

Общее введение PandasAI - это платформа с открытым исходным кодом на базе Python, предназначенная для упрощения процесса анализа данных с помощью методов обработки естественного языка. Позволяет пользователям работать в диалоге с базами данных (например, SQL, CSV, pandas, polars, mongodb, n...
2 года назад
094.5K
Fish Agent:端到端AI语音克隆助手,实时语音对话助理,Fish Speech衍生项目

Fish Agent: сквозной голосовой помощник с искусственным интеллектом, голосовой помощник для ведения диалога в реальном времени, спин-офф проект Fish Speech

Всеобъемлющее введение Проект Fish Speech Derivative Project Fish Agent - это революционная сквозная система клонирования речи AI, разработанная на основе архитектуры модели V0.1 3B. Как полностью сквозная система обработки речевых клонов, ее важнейшей особенностью является использование инновационных безречевых...
2 года назад
094.4K
Eko:自然语言构建智能体工作流,实现桌面与浏览器自动化

Eko: построение интеллектуальных рабочих процессов на естественном языке для автоматизации рабочего стола и браузера

Общее представление Eko - это JavaScript-фреймворк производственного уровня, предназначенный для создания эффективных рабочих процессов интеллектуальных агентов с помощью описаний на естественном языке. Он предназначен для того, чтобы разработчики могли автоматизировать повседневные задачи с помощью технологий искусственного интеллекта без глубокого программирования.Eko предоставляет уни...
1 год назад
094.2K
R1-V:低成本强化学习实现视觉语言模型泛化能力

R1-V: Недорогое обучение с подкреплением для обобщения возможностей визуальных языковых моделей

Всеобъемлющее введение R1-V - это проект с открытым исходным кодом, целью которого является достижение прорыва в визуальном моделировании языка (VLM) с помощью недорогого обучения с подкреплением (RL). Проект использует проверяемые механизмы вознаграждения для мотивации ВЛМ к обучению общим способностям счета. Удивительно, но R1-V's 2B ...
1 год назад
094.2K
HyperChat:利用 MCP 智能执行复杂任务的AI对话客户端

HyperChat: диалоговый клиент с искусственным интеллектом, использующий интеллект MCP для выполнения сложных задач

Общее представление HyperChat - это чат-клиент с открытым исходным кодом, разработанный BigSweetPotatoStudio и размещенный на GitHub, предназначенный для обеспечения всестороннего обзора языковой модели BigSweetPotatoStudio путем интеграции API из нескольких больших языковых моделей (LLM), таких как OpenAI, Cla...
1 год назад
094.1K
AutoAgent:通过自然语言快速创建并部署AI智能体的框架

AutoAgent: основа для быстрого создания и развертывания интеллекта ИИ с помощью естественного языка

Общее представление AutoAgent - это фреймворк ИИ-интеллекта с открытым исходным кодом, разработанный Лабораторией интеллекта данных Гонконгского университета (HKUDS) и размещенный на GitHub. Он позволяет пользователям быстро создавать и внедрять индивидуальные ИИ-интеллекты, описывая свои требования на чисто естественном языке, без какой-либо базы программирования...
1 год назад
094.1K
uni-api:轻量大模型API转换为OpenAI接口,YAML文件配置API渠道

uni-api: облегченный API большой модели, преобразованный в интерфейс OpenAI, YAML-файл для настройки канала API

Всестороннее введение Нет фронт-энд, чистый файл конфигурации конфигурации API-канала. Просто напишите файл может запустить API станции их собственных, документ имеет подробное руководство по настройке, белый дружественный. uni-api является единым управлением большой модели API проекта, что позволяет унифицировать ...
2 года назад
094.1K
openapi-mcp-server:让AI直接调用开放API的MCP服务

openapi-mcp-server: позволяет ИИ напрямую вызывать службы MCP с помощью открытых API.

Общее представление openapi-mcp-server - это инструмент с открытым исходным кодом, предназначенный для преобразования API, совместимых с OpenAPI v3.1, в ресурсы, пригодные для использования в AI. Он поддерживается janwilmake и основан на модели Contex...
1 год назад
094K
VideoRAG:理解超长视频的RAG框架,支持多模态检索和知识图谱构建

VideoRAG: RAG-фреймворк для понимания сверхдлинных видео с поддержкой мультимодального поиска и построения графов знаний

Всеобъемлющее введение VideoRAG - это генеративный фреймворк с улучшенным поиском, предназначенный для обработки и понимания очень длинных контекстных видео. Инструмент сочетает в себе графовую текстовую базу знаний с иерархическим мультимодальным контекстным кодированием для эффективной обработки на одном графическом процессоре NVIDIA RTX 3090...
1 год назад
094K
Perplexica:1比1复刻 Perplexity AI 功能和界面的开源AI搜索引擎

Perplexica: поисковая система ИИ с открытым исходным кодом, которая повторяет функции и интерфейс Perplexity AI 1 к 1

Общее представление Perplexica - это поисковая система с открытым исходным кодом, управляемая искусственным интеллектом и предназначенная для поиска ответов в глубинах Интернета. Она использует передовые алгоритмы машинного обучения, такие как поиск по сходству и методы встраивания, для оптимизации результатов поиска и предоставления четких ответов со ссылками на источники.Perple...
2 года назад
093.9K
Genesis:开源生成式物理引擎,实现基于真实物理的4D动态世界模拟

Genesis: генеративный физический движок с открытым исходным кодом для моделирования 4D динамического мира на основе реальной физики

Общее представление Genesis - это генеративный физический мир, предназначенный для робототехники общего назначения и обучения воплощенного ИИ. Он предоставляет единую платформу моделирования, которая поддерживает моделирование широкого спектра материалов и физических явлений.Genesis нацелен на раскрытие генеративного ИИ и физического моделирования путем объединения...
2 года назад
093.8K
InfiniteYou:保留人脸特征的照片生成与编辑工具

InfiniteYou: инструмент для создания и редактирования фотографий, сохраняющий черты лица

Общее представление InfiniteYou - это проект с открытым исходным кодом, разработанный командой ByteDance Intelligent Creation. Он основан на технологии диффузионных трансформаторов (DiTs) и использует модель FLUX.1-dev. Основная функция заключается в том, чтобы позволить пользователям загружать фотографии и вводить текстовое описание, генерируя...
1 год назад
093.8K
实时语音转文字的开源工具

Инструмент с открытым исходным кодом для преобразования речи в текст в реальном времени

Общее введение realtime-transcription-fastrtc - это проект с открытым исходным кодом, ориентированный на преобразование речи в текст в реальном времени. Он использует технологию FastRTC для обработки аудиопотоков с низкой задержкой, в сочетании с локальной моделью Whisper для достижения эффективного ...
1 год назад
093.6K
LM Speed:快速测试大模型API性能

LM Speed: быстрое тестирование производительности API большой модели

Общее введение LM Speed - это инструмент, созданный специально для разработчиков ИИ, а также доступный в качестве онлайн-сервиса на сайте lmspeed.net Его основная функция - тестирование и анализ производительности API языковых моделей, что помогает пользователям быстро выявлять узкие места в скорости и оптимизировать стратегии вызова. Это...
1 год назад
093.6K
Morphik Core:处理多模态数据的开源 RAG 平台

Morphik Core: платформа RAG с открытым исходным кодом для обработки мультимодальных данных

Общее введение Morphik Core - это проект с открытым исходным кодом, разработанный командой morphik-org и размещенный на GitHub. Раньше он назывался DataBridge Core, но теперь переименован в Morphik Core.This...
1 год назад
093.5K
OpenAOE:大模型群聊框架:同时与多个大语言模型聊天

OpenAOE: Large Model Group Chat Framework: одновременное общение с несколькими большими языковыми моделями

Всеобъемлющее введение OpenAOE - это фреймворк группового чата с открытым исходным кодом для больших моделей, призванный решить проблему отсутствия на современном рынке фреймворков для чата с несколькими моделями, отвечающими параллельно. С помощью OpenAOE пользователи могут одновременно общаться с несколькими большими языковыми моделями (LLM) и получать параллельные результаты. Фреймворк поддерживает ...
1 год назад
093.5K
MegaParse:解析各类型文档为LLM可用数据,完整保留文档中的表格、图片等所有信息

MegaParse: разбирает каждый тип документа на LLM-доступные данные, сохраняя всю информацию в документе, такую как таблицы и рисунки, в полном объеме.

Общее представление MegaParse - это мощный и универсальный инструмент для разбора документов, разработанный для оптимизации обработки данных в рамках Большой языковой модели (LLM). Работаете ли вы с текстом, PDF, презентациями PowerPoint или документами Word, MegaParse...
2 года назад
093.3K
AI Chatbot Supabase:开源的Next.js和Supabase构建的AI聊天机器人,快速部署到Vercel。

ИИ-чатбот Supabase: чатбот с открытым исходным кодом Next.js и Supabase, созданный для быстрого развертывания в Vercel.

Общее представление AI Chatbot Supabase - это шаблон AI чатбота с открытым исходным кодом, построенный на Next.js и Supabase. Проект, разработанный компанией Vercel, нацелен на создание полнофункционального и настраиваемого чатбота. По ...
2 года назад
093.3K
LlamaCoder:使用提示词快速生成并发布小型web应用

LlamaCoder: быстрая генерация и публикация небольших веб-приложений с помощью слов подсказок

Общее представление LlamaCoder - это инструмент генерации кода с открытым исходным кодом, основанный на Llama 3.1 и Together AI. Он может генерировать небольшие приложения с простыми подсказками, подходящими для разработчиков, чтобы быстро реализовать идеи.LlamaCoder обеспечивает...
2 года назад
093.2K
Oliva:语音控制的多智能体产品搜索助手

Oliva: управляемый голосом мультиинтеллектуальный помощник для поиска товаров

Общее представление Oliva - это мультиинтеллектуальный помощник с открытым исходным кодом, разработанный Deluxer на GitHub. Он помогает пользователям искать информацию о товарах в базе данных Qdrant благодаря совместной работе нескольких искусственных интеллектов. Главной особенностью является поддержка голосового управления...
1 год назад
093.2K
WeClone:用微信聊天记录和语音训练数字分身

WeClone: обучение цифровых двойников с помощью журналов чатов WeChat и голосов

Всеобъемлющее введение WeClone - это проект с открытым исходным кодом, который использует транскрипты чатов WeChat и голосовые сообщения в сочетании с большими языковыми моделями и технологией синтеза речи, чтобы позволить пользователям создавать персонализированных цифровых двойников. Проект может анализировать привычки пользователя в чате для обучения модели, а также небольшое количество образцов голоса для генерации реалистичного звука...
1 год назад
093.2K
修复无效JSON字符串,解决 LLMs 生成的 JSON 数据中可能出现的格式错误。

Исправление некорректных строк JSON и устранение возможных ошибок форматирования в данных JSON, генерируемых LLM.

Общее описание Модуль для исправления некорректных JSON-файлов, особенно для разбора некорректных JSON-данных, выводимых большими языковыми моделями (LLM). Модуль исправляет распространенные синтаксические ошибки JSON, такие как отсутствие кавычек, неправильные запятые, несведенные символы и неполные ключи-значения...
2 года назад
093.2K
X-Kit:Twitter数据抓取和分析X用户数据与推文的工具

X-Kit: Twitter Data Crawl и аналитика для данных о пользователях и твитах X

Общее представление X-Kit - это инструмент с открытым исходным кодом, предназначенный для сбора и анализа данных и твитов пользователей X (ранее Twitter). Разработанный пользователем GitHub xiaoxiunique, инструмент призван помочь пользователям автоматизировать процесс получения основной информации и твитов о данном пользователе X и...
2 года назад
093.2K
MyCoder:自动修复代码、生成测试用例的命令行AI工具

MyCoder: инструмент командной строки для автоматического исправления кода, генерации тестовых примеров

Общее представление MyCoder - это проект с открытым исходным кодом, разработанный командой drivecore и размещенный на GitHub, целью которого является предоставление разработчикам интеллектуальной помощи в программировании через интерфейс командной строки. В его основе лежит разработанная Клодом АП Anthropic...
1 год назад
093.2K
CapsWriter-Offline:PC端的语音输入和字幕转录工具

CapsWriter-Offline: инструмент для ввода речи и транскрипции субтитров для ПК

Общее представление CapsWriter-Offline - это инструмент голосового ввода и транскрипции субтитров для ПК, размещенный на GitHub и созданный разработчиком HaujetZhao. Он работает полностью автономно и не требует подключения к Интернету для преобразования речи в текст и аудиовизуальных...
1 год назад
093.1K
Vercel AI SDK:使用流行前端框架构建AI驱动应用程序

Vercel AI SDK: создание приложений на основе искусственного интеллекта с помощью популярных фронтенд-фреймворков

Общее представление Vercel AI SDK - это инструмент с открытым исходным кодом, разработанный командой Vercel, чтобы помочь разработчикам создавать приложения для искусственного интеллекта с использованием таких фреймворков, как React, Svelte, Vue и Solid. Он поддерживает множество поставщиков языковых моделей...
2 года назад
093.1K
Tarsier:生成高质量视频描述的开源视频理解模型

Tarsier: модель понимания видео с открытым исходным кодом для создания высококачественных видеоописаний

Всеобъемлющее введение Tarsier - это семейство моделей видеоязыка с открытым исходным кодом, разработанное компанией ByteDance для создания высококачественных видеоописаний. Оно состоит из простой структуры: CLIP-ViT обрабатывает видеокадры в сочетании с большой языковой моделью (LLM) для анализа...
1 год назад
093K
DeepClaude:融合DeepSeek R1链式推理与Claude创造力的聊天界面

DeepClaude: Чат-интерфейс, объединяющий рассуждения по цепочке R1 DeepSeek с креативностью Claude

Всеобъемлющее введение DeepClaude - это высокопроизводительный API для выводов и чат-интерфейс Large Language Model (LLM), который объединяет возможности цепочечных выводов (CoT) DeepSeek R1 с креативностью и генерацией кода модели Anthropic Claude...
2 года назад
093K
Kolors:生成高质量图像的文本到图像模型,支持生成中文海报

Kolors: модель преобразования текста в изображение для создания высококачественных изображений, с поддержкой создания китайских плакатов

Всеобъемлющее введение Kolors - это крупномасштабная модель генерации текста в изображения, разработанная командой Racer и основанная на методах диффузии потенциала. Модель обучена на миллиардах пар данных "текст-изображение" и способна генерировать высококачественные, сложные семантически точные изображения с поддержкой китайского и английского языков.Kolors в визуальном качестве...
2 года назад
092.9K
AgentGPT:创建并运行自动化AI智能体的开源项目

AgentGPT: проект с открытым исходным кодом для создания и запуска автоматизированного искусственного интеллекта

Общее введение AgentGPT - это проект с открытым исходным кодом, разработанный командой Reworkd и размещенный на GitHub, предназначенный для того, чтобы позволить пользователям автономно создавать, настраивать и развертывать ИИ-интеллекты через браузер. Пользователи просто задают цель, и AgentGPT может...
1 год назад
092.9K
Probly:AI分析数据并生成图表的开源表格工具

Probly: табличный инструмент с открытым исходным кодом для ИИ, позволяющий анализировать данные и строить графики

Всеобъемлющее введение Probly - это инструмент для работы с электронными таблицами, разработанный командой PragmaticMachineLearning с открытым исходным кодом на GitHub, который сочетает в себе функциональность традиционных электронных таблиц с мощными возможностями анализа данных с помощью искусственного интеллекта. Он не только поддерживает использование ...
1 год назад
092.9K
MegaTTS3:合成中英文语音的轻量模型

MegaTTS3: легкая модель для синтеза китайской и английской речи

Введение MegaTTS3 - это инструмент синтеза речи с открытым исходным кодом, разработанный компанией ByteDance в сотрудничестве с Чжэцзянским университетом и предназначенный для генерации высококачественной китайской и английской речи. Его основная модель имеет всего 0.45B параметров, легка и эффективна, поддерживает смешанную генерацию китайской и английской речи и клонирование речи. Проект размещен на ...
1 год назад
092.8K
E2B Open Computer Use:E2B沙盒中安全的运行AI操作系统

E2B Open Computer Use: безопасный запуск операционной системы ИИ в песочнице E2B

Общие сведения Введение E2B Open Computer Use - это проект с открытым исходным кодом, целью которого является обеспечение безопасного облачного использования компьютеров на базе Linux с помощью E2B Desktop Sandbox.E2B Sandbox предоставляет графическую среду рабочего стола, которую пользователи могут подключить к любому большому...
2 года назад
092.8K
MockingBird:快速克隆声音与模型训练,基于 xtts v2 实现的文本转语音

MockingBird: быстрое клонирование голоса и обучение моделей, преобразование текста в речь на основе xtts v2

Всеобъемлющее введение MockingBird - это проект с открытым исходным кодом, целью которого является быстрое клонирование речи и преобразование текста в речь с помощью технологии искусственного интеллекта. Пользователям достаточно предоставить 5 секунд голосовых образцов, вы можете генерировать любой голосовой контент. Проект поддерживает различные китайские наборы данных, а в Windows ...
2 года назад
092.8K
AI2SRT:利用 Gemini模型,一键为长视频创建解说短视频或视频总结

AI2SRT: Создавайте короткие видеоролики с рассказом или видеорезюме для длинных видео одним щелчком мыши, используя модель Gemini

Всеобъемлющее введение AI2SRT - это проект с открытым исходным кодом, который использует большую модель GeminiAI для генерации коротких видеороликов и резюме для длинных видео одним щелчком мыши, поддерживая при этом субтитры с аудио- и видеотранскрипцией. Цель проекта - упростить процесс создания видеоконтента и предоставить эффективные функции генерации и перевода субтитров. Пользователи могут передавать...
2 года назад
092.8K
Orate:集成知名语音生成、语音转录与变声模型的统一API

Orate: унифицированный API для интеграции известных технологий генерации речи, транскрипции речи и моделирования голоса

Общее представление Orate - это набор инструментов ИИ, ориентированный на генерацию и транскрипцию речи. Он предоставляет унифицированный API, который легко интегрируется с ведущими поставщиками ИИ, такими как OpenAI, ElevenLabs и AssemblyAI, чтобы помочь пользователям создавать принудительные...
2 года назад
092.8K
LazyLLM:商汤开源构建多智能体应用的低代码开发工具

LazyLLM: инструмент разработки с открытым исходным кодом Shangtang для создания мультиинтеллектуальных приложений для тела

Всеобъемлющее введение LazyLLM - это инструмент с открытым исходным кодом, разработанный командой LazyAGI и направленный на упрощение процесса разработки приложений с большими моделями мультиинтеллекта. Он помогает разработчикам быстро создавать сложные приложения ИИ благодаря развертыванию одним щелчком мыши и легким механизмам шлюзов, избавляя от утомительной инженерной настройки...
1 год назад
092.7K
在cloudflare部署hugging face的免费api,支持接口转发

Развертывание бесплатного api hugging face на cloudflare для поддержки переадресации интерфейсов

Потому что внутреннее развертывание не может получить доступ к обнимая лицо, так что в большой брат развертывания программы на основе преобразования, чтобы иметь возможность развернуть в cloudflare работников. Подготовка 1, зарегистрировать cloudflare 2, зарегистрировать обнимая лицо...
2 года назад
092.7K
OmniGen:统一图像生成模型,多模态输入生成人物一致性图像

OmniGen: унифицированная модель генерации изображений с мультимодальными входами для создания изображений, соответствующих персонажам

Общее представление OmniGen - это "универсальная" модель генерации изображений, разработанная компанией VectorSpaceLab, которая позволяет пользователям создавать разнообразные и контекстуально насыщенные визуальные эффекты с помощью простых текстовых подсказок или мультимодальных вводов. Она особенно хорошо подходит для приложений, которым необходимо распознавать...
2 года назад
092.7K
TheoremExplainAgent:利用 Manim 生成5分钟以上数学讲解动画视频

TheoremExplainAgent: генерируйте 5+ минутные анимированные видеоролики с объяснением математики с помощью Manim

Общее представление TheoremExplainAgent - это инновационный проект, разработанный Лабораторией искусственного интеллекта TIGER AI Lab и направленный на преобразование сложных математических и научных теорем в понятные видеоанимации с помощью методов искусственного интеллекта. Инструмент основан на Большой языковой модели (LLM...
1 год назад
092.6K
PhotoDoodle:文字指令为照片添加艺术涂鸦的AI工具

PhotoDoodle: ИИ-инструмент для добавления художественных каракулей к фотографиям с помощью текстовых команд

Общее представление PhotoDoodle - это инструмент для редактирования изображений с открытым исходным кодом, разработанный компанией ShowLab, ориентированный на художественное редактирование фотографий с помощью технологии искусственного интеллекта. Пользователи могут добавлять мультяшный стиль, 3D-эффект, свет к реальным фотографиям, просто набирая простые текстовые подсказки...
1 год назад
092.6K
Devika:开源的AI软件工程师智能体,能够理解、拆分指令为子任务并编写代码

Devika: программный инженерный интеллект с открытым исходным кодом, который понимает, разбивает инструкции на подзадачи и пишет код

Общее представление Devika - это продвинутый ИИ-программист, который понимает высокоуровневые человеческие инструкции, разбивает их на шаги, изучает соответствующую информацию и пишет код для достижения поставленной цели. Она интеллектуально разрабатывает программное обеспечение, используя крупномасштабные языковые модели, алгоритмы планирования и рассуждений, а также возможности просмотра веб-страниц.D...
1 год назад
092.5K
ell:轻量级函数式提示词工程框架

ell: Легкая функциональная система конструирования слов для подсказок

Общее представление ell - это легкая библиотека программирования моделей на функциональном языке, разработанная бывшим исследователем OpenAI Уильямом Гуссом. Она разработана с учетом того, чтобы рассматривать подсказки как программы, а не просто строки. ell обеспечивает автоматизированный контроль версий и сериализацию...
1 год назад
092.5K
MarkItDown:微软文档智能转换工具,转换各种文件为Markdown格式

MarkItDown: Инструмент интеллектуального преобразования документов Microsoft для конвертации различных файлов в формат Markdown

Общее представление MarkItDown - это инструмент на языке Python, разработанный компанией Microsoft и предназначенный для преобразования различных файлов и офисных документов в формат Markdown. Инструмент поддерживает широкий спектр типов файлов, включая PDF, PowerPoint, Word, Excel, диаграммы...
2 года назад
092.4K
QAnything:高度集成RAG处理流程的本地知识库问答系统

QAnything: локальная система вопросов и ответов для базы знаний с высокоинтегрированными процессами RAG

QAnything Comprehensive Introduction QAnything (Question and Answer based on Anything) - это локальная система вопросов и ответов на основе базы знаний, запущенная компанией NetEase, которая поддерживает все виды форматов файлов и баз данных, может быть установлена и использована в автономном режиме....
2 года назад
092.4K
Weebo:实时语音聊天机器人,提供自然语言对话体验

Weebo: голосовой чатбот реального времени, обеспечивающий диалог на естественном языке

Общее представление Weebo - это голосовой чатбот с открытым исходным кодом, использующий Whisper Small для распознавания речи, Llama 3.2 для генерации естественного языка и Kokoro-82M для синтеза речи. Проект был разработан Аманом...
2 года назад
092.4K
PantoMatrix(EMAGE):全身手势生成框架,从音频生成全身手势的3D动画框架

PantoMatrix (EMAGE): фреймворк для генерации жестов всего тела, фреймворк 3D-анимации для генерации жестов всего тела из аудио.

Введение PantoMatrix - это продвинутая система генерации жестов всего тела, способная генерировать полные человеческие движения из аудио и частичных жестов, включая движения лица, части тела, рук и всего тела. Фреймворк использует новейшие мультимодальные наборы данных и методы глубокого обучения для обеспечения высокого качества 3D...
2 года назад
092.4K
NodeRAG:基于异构图的精准信息检索与生成工具

NodeRAG: гетерогенный инструмент на основе графов для точного поиска и генерации информации

Подробное введение NodeRAG - это система с открытым исходным кодом Retrieval Augmented Generation (RAG), размещенная на GitHub и разработанная Terry-Xu-666. Она оптимизирует поиск и генерацию информации с помощью гетерогенных графовых структур, значительно повышая точность поиска и контекстную релевантность.Node...
1 год назад
092.4K
Langui:开源的AI用户界面组件库

Langui: библиотека компонентов пользовательского интерфейса ИИ с открытым исходным кодом

Общее представление LangbaseInc's Langui - это библиотека компонентов пользовательского интерфейса с открытым исходным кодом, предназначенная для генеративного ИИ и проектов по моделированию больших языков (LLM). Библиотека основана на Tailwind CSS и предоставляет коллекцию предварительно созданных компонентов пользовательского интерфейса, чтобы помочь разработчикам быстро построить...
2 года назад
092.3K
Flow(Laminar):构建智能体的轻量级任务引擎,简化并灵活管理任务

Flow (Laminar): легкий движок для построения интеллекта, который упрощает и гибко управляет задачами

Всеобъемлющее введение Flow - это легкий движок задач, предназначенный для создания агентов искусственного интеллекта с акцентом на простоту и гибкость. В отличие от традиционных рабочих процессов, основанных на узлах и границах, Flow использует динамическую систему очередей задач, которая поддерживает параллельное выполнение, динамическое планирование и интеллектуальное управление зависимостями. Его основной концепцией является ...
2 года назад
092.2K
Memary:利用知识图谱增强Agent长期记忆的开源项目

Memary: проект с открытым исходным кодом для улучшения долговременной памяти агента с помощью графов знаний

Общее представление Memary - это инновационный проект с открытым исходным кодом, направленный на предоставление решений по управлению долгосрочной памятью для автономных интеллектов. Проект помогает интеллектам преодолеть ограничения традиционных контекстных окон и достичь более интеллектуального взаимодействия с помощью графов знаний и специализированных модулей памяти. Memary использует...
2 года назад
092.1K
Gemini Cursor:基于Gemini构建的AI桌面智能助手,能看、能听、能说

Gemini Cursor: интеллектуальный помощник для настольных компьютеров, построенный на базе ИИ Gemini, который может видеть, слышать и говорить

Общее представление Gemini Cursor - это настольный интеллектуальный помощник, основанный на модели Gemini 2.0 Flash (экспериментальной) от Google. Он обеспечивает визуальное, слуховое и голосовое взаимодействие через мультимодальный API, предоставляя возможность использования в реальном времени с низкой задержкой...
1 год назад
092.1K
VoiceCraft:开源零样本语音克隆与文本转语音工具

VoiceCraft: инструмент для клонирования речи и преобразования текста в речь с нулевым образцом с открытым исходным кодом

Всеобъемлющее введение VoiceCraft - это инструмент редактирования речи с открытым исходным кодом и синтеза речи с нулевой выборкой, основанный на нейронной модели языка кодека. В нем используется инновационный метод генерации кодированных последовательностей, который позволяет вставлять, удалять и заменять существующие речевые последовательности для создания естественной, связной отредактированной речи...
2 года назад
092K
FlashMLA:优化Hopper GPU的MLA解码内核(DeepSeek 开源周第一天)

FlashMLA: оптимизация ядер декодирования MLA для графических процессоров Hopper (День 1 недели открытых исходных кодов DeepSeek)

Общее представление FlashMLA - это эффективное ядро декодирования MLA (Multi-head Latent Attention), разработанное DeepSeek AI и оптимизированное для графических процессоров архитектуры NVIDIA Hopper...
1 год назад
091.9K
ANP:实现智能代理间安全高效通信的开源协议

ANP: протокол с открытым исходным кодом для безопасной и эффективной коммуникации между интеллектуальными агентами

Общее введение AgentNetworkProtocol (сокращенно ANP) - это проект протокола с открытым исходным кодом, размещенный на GitHub, ориентированный на обеспечение безопасных и эффективных коммуникационных решений для интеллектуальных агентов (AI Agents). Он работает по трехслойной архитектуре - идентификация и шифрование...
1 год назад
091.9K
Fast-Agent:声明式语法和MCP集成快速构建多智能体工作流

Fast-Agent: декларативная грамматика и интеграция MCP для быстрого создания многоинтеллектуальных рабочих процессов тела

Общее представление Fast-Agent - это инструмент с открытым исходным кодом, поддерживаемый командой evalstate на GitHub и предназначенный для того, чтобы помочь разработчикам быстро определять, тестировать и создавать многоинтеллектуальные рабочие процессы. Он основан на простом декларативном синтаксисе и поддерживает использование MCP (Mode...
1 год назад
091.8K
闲鱼卖家全天自动值守的AI客服机器人

ИИ-боты для обслуживания клиентов, которые автоматически обслуживают продавцов Idle Fish в течение дня

Всеобъемлющее введение XianyuAutoAgent - это интеллектуальная роботизированная система обслуживания клиентов, разработанная для платформы Idlefish, с открытым исходным кодом разработчика shaxiu на GitHub. Она использует технологию искусственного интеллекта для обеспечения автоматического дежурства в режиме 7×24 часа, чтобы помочь продавцам рыбы, работающим вхолостую, отвечать...
1 год назад
091.8K
DreamTalk:使用一张头像图片即可生成表情丰富的说话视频

DreamTalk: создавайте выразительные разговорные видеоролики с помощью одного изображения аватара!

DreamTalk Comprehensive Введение DreamTalk - это основанная на диффузионной модели система генерации экспрессивных говорящих голов, совместно разработанная Университетом Цинхуа, Alibaba Group и Хуачжунским университетом науки и технологии. В основном она состоит из трех частей: сети шумоподавления, эксперта по губам с учетом стиля и предсказателя стиля, который может быть основан на...
2 года назад
091.7K
Zonos:高质量语音合成与语音克隆工具

Zonos: высококачественный синтез речи и инструменты для клонирования речи

Общее представление Zonos - это инструмент синтеза и клонирования речи с открытым исходным кодом, разработанный компанией Zyphra. Версия Zonos-v0.1 использует усовершенствованный трансформатор и модель смешивания для создания высококачественной речи. Инструмент поддерживает множество языков...
1 год назад
091.7K
Easy Voice Toolkit:本地部署的AI语音工具箱

Easy Voice Toolkit: набор инструментов для локального развертывания AI Voice Toolkit

Всеобъемлющее введение Easy-Voice-Toolkit - это многофункциональный инструментарий, основанный на проекте Open Source Speech Project, предоставляющий широкий спектр автоматизированных аудиоинструментов для распознавания речи, транскрипции речи, преобразования речи, создания наборов данных и обучения моделей. Пользователи могут выборочно использовать эти инструменты по мере необходимости...
2 года назад
091.6K
ModelBest(面壁智能):全球领先的轻量高性能端侧大模型

ModelBest: ведущая в мире легкая и высокопроизводительная модель для больших моделей с торцевой стороной

Общее представление ModelBest - это компания, специализирующаяся на разработке легких и высокопроизводительных больших моделей, которая занимается применением передовых технологий искусственного интеллекта в бытовой электронике и всех видах конечных устройств в повседневной жизни. Серия конечных моделей MiniCPM с экстремальной арифметической мощностью и эффективностью использования памяти...
2 года назад
091.6K
Parler-TTS:根据输入文本生成特定说话人风格的文本转语音模型

Parler-TTS: генерирование моделей преобразования текста в речь с учетом особенностей говорящего на основе входного текста

Общее представление Parler-TTS - это библиотека моделей преобразования текста в речь (TTS) с открытым исходным кодом, разработанная компанией Hugging Face и предназначенная для генерации высококачественной, естественно звучащей речи. Модель способна генерировать речь на основе входного текста с определенным стилем диктора (например, пол, высота тона, манера речи...
1 год назад
091.6K
Ichigo(llama3-s):本地实时语音AI助手,开源版Siri

Ichigo (llama3-s): локальный голосовой ИИ-помощник в реальном времени, версия Siri с открытым исходным кодом

Общее представление Ichigo - это проект речевого ИИ с открытым исходным кодом, цель которого - расширить текстовые языковые модели возможностями "прослушивания". Проект использует методы раннего слияния, вдохновленные работой Мета "Хамелеон".Цель Ichigo - стать...
2 года назад
091.6K
OWL:多智能体协作完成现实任务的自动化工具

OWL: автоматизированный инструмент для совместной работы нескольких интеллектов над реалистичными задачами

Общие сведения Введение OWL (Optimized Workforce Learning) - это фреймворк с открытым исходным кодом, разработанный командой CAMEL-AI и направленный на оптимизацию совместной работы нескольких интеллектов для автоматизации реальных задач. На основе фреймворка CAMEL-AI ...
1 год назад
091.5K
Audiblez:生成有声书,使用Kokoro将电子书转换为有声读物

Audiblez: создание аудиокниг, преобразование электронных книг в аудиокниги с помощью Kokoro

Общее представление Audiblez - это проект с открытым исходным кодом, предназначенный для преобразования электронных книг (например, в формате .epub) в аудиокниги (например, в формате .m4b). Проект использует высококачественную технологию синтеза речи Kokoro для поддержки нескольких языков и нескольких голосов. Пользователи могут просто...
2 года назад
091.5K
Research Rabbit:使用本地LLM进行网页研究和报告撰写,自动深入用户指定主题并生成总结。

Research Rabbit: веб-исследования и написание отчетов с использованием родного LLM, автоматическое изучение заданных пользователем тем и создание резюме.

Общее представление Research Rabbit - это собственный помощник по поиску и обобщению информации в Интернете на основе LLM (Large Language Model). После того как пользователь задает тему исследования, Research Rabbit формирует поисковый запрос, получает релевантные веб-результаты и обобщает их...
1 год назад
091.5K
Flock:低代码工作流编排快速构建聊天机器人

Flock: low-code оркестровка рабочих процессов для быстрого создания чатботов

Общее представление Flock - это платформа с открытым исходным кодом для рабочих процессов, размещенная на GitHub и разработанная командой Onelevenvy. Она основана на технологиях LangChain и LangGraph и ориентирована на то, чтобы помочь пользователям быстро создавать чат-машины...
1 год назад
091.5K
OASIS:多智能体模拟数百万用户社交媒体互动,研究复杂社会现象

OASIS: многоинтеллектуальное моделирование взаимодействия миллионов пользователей в социальных сетях для изучения сложных социальных явлений

Общие сведения Введение OASIS (Open Agent Social Interaction Simulations) - это симулятор социальных сетей с открытым исходным кодом, способный моделировать поведение до миллиона пользователей. Платформа объединяет крупномасштабную языковую модель с основанной на правилах...
1 год назад
091.5K
Ant Design X:快速构建AI聊天界面的工具包,支持模型集成和数据流管理。

Ant Design X: набор инструментов для быстрого создания чат-интерфейсов ИИ с поддержкой интеграции моделей и управления потоками данных.

Всеобъемлющее введение Ant Design X - это инструментарий с открытым исходным кодом от Ant Group, предназначенный для того, чтобы помочь разработчикам быстро создавать диалоговые интерфейсы, управляемые искусственным интеллектом. Он предоставляет богатый набор компонентов и шаблонов, поддерживает интеграцию моделей, совместимую со стандартами OpenAI, и подходит для различных приложений, таких как интеллектуальное обслуживание клиентов, ИИ-помощники и другие...
2 года назад
091.4K
Data Formulator:AI驱动的数据可视化工具

Data Formulator: инструмент визуализации данных, управляемый искусственным интеллектом

Общее представление Data Formulator - это инструмент визуализации данных с открытым исходным кодом, управляемый искусственным интеллектом, разработанный Microsoft Research. Инструмент сочетает в себе графический интерфейс пользователя (GUI) и естественный язык ввода (NL), что позволяет пользователям быстро создавать и итерировать данные с помощью простых взаимодействий и команд...
1 год назад
091.2K
G-Search-MCP:免费谷歌搜索的MCP服务器

G-Search-MCP: MCP-сервер для бесплатного поиска Google

Общие сведения Введение G-Search-MCP - это инструмент поиска Google с открытым исходным кодом, размещенный на GitHub и модифицированный разработчиком jae-jae на основе google-search. Он передает MCP (Model Context...
1 год назад
091.2K
Optexity:用人类演示训练AI执行网页操作的开源项目

Optexity: проект с открытым исходным кодом для обучения ИИ выполнять веб-действия с демонстрацией человека

Общее введение Optexity - это проект с открытым исходным кодом на GitHub, разработанный командой Optexity. Его суть заключается в использовании демонстрационных данных человека для обучения искусственного интеллекта выполнению компьютерных задач, особенно операций с веб-страницами. Проект содержит три библиотеки кода: Compute...
1 год назад
091.2K
MiniMind-V:1小时训练26M参数视觉语言模型

MiniMind-V: 1 час обучения визуальной модели языка с 26 миллионами параметров

Общее представление MiniMind-V - это проект с открытым исходным кодом, размещенный на GitHub, разработанный для того, чтобы помочь пользователям обучить легкую визуальную языковую модель (VLM) с 26 миллионами параметров менее чем за час. Он основан на языковой модели MiniMind, с новыми визуальными...
1 год назад
091.2K
Leffa:高保真模特虚拟试穿与人物姿势调整,Meta开源的可控人物图像生成模型

Leffa: Виртуальная примерка высокоточной модели и корректировка позы персонажа, мета-модель генерации образа управляемого персонажа с открытым исходным кодом

Всеобъемлющее введение Leffa - это единый фреймворк для создания управляемых изображений персонажей, позволяющий точно манипулировать их внешним видом (например, виртуальная подгонка) и позой (например, передача позы). Система значительно уменьшает искажение мелких деталей, направляя целевой запрос на правильную опорную клавишу в слое внимания, с ...
2 года назад
091.2K
Insanely Fast Whisper:快速高效的转录语音为文本的开源项目

Insanely Fast Whisper: быстрая и эффективная транскрипция речи в текст с открытым исходным кодом

Всеобъемлющее представление insanely-fast-whisper - это аудиопередача, которая сочетает модель Whisper от OpenAI с различными техниками оптимизации (например, Transformers, Optimum, Flash Attention)...
2 года назад
091.1K
Ruyi-Models:生成图像到视频开源模型,支持镜头控制与运动幅度控制

Ruyi-Models: создание моделей с открытым исходным кодом для преобразования изображений в видео, поддерживающих управление объективом и амплитудой движения.

Общее представление Ruyi-Models - это проект с открытым исходным кодом, предназначенный для генерации высококачественного видео из изображений. Разработанный командой IamCreateAI, проект поддерживает генерацию кинематографического видео с разрешением 768, 24 кадра в секунду, 120 кадров за 5 секунд...
2 года назад
091K
OrionChat:集成多平台AI模型的简易网页聊天界面(免部署)

OrionChat: простой веб-интерфейс чата с интегрированными многоплатформенными моделями искусственного интеллекта (без развертывания)

Общее введение OrionChat - это веб-интерфейс чата ИИ, который предоставляет пользователям единую платформу для взаимодействия с несколькими основными моделями ИИ. Проект поддерживает широкий спектр моделей ИИ, включая Ollama (работает локально), OpenAI GPT, Google Gemi...
2 года назад
091K
RapBank:根据歌词和伴奏直接生成说唱(Rap)人声的模型(目前开放了数据集)

RapBank: модель для прямого генерирования вокала в стиле рэп (Rap) из текстов песен и бэк-треков (в настоящее время открытая база данных)

Общее представление RapBank - это набор данных и инструментов, предназначенных для создания текстов рэпа. Проект был создан NZqian, чтобы предоставить исследователям и разработчикам высококачественные данные о рэп-лирике путем сбора и обработки рэп-песен с YouTube...
2 года назад
090.9K
SegAnyMo:从视频中自动分割任意运动物体的开源工具

SegAnyMo: инструмент с открытым исходным кодом для автоматического сегментирования произвольных движущихся объектов из видео.

Общее представление SegAnyMo - это проект с открытым исходным кодом, разработанный группой исследователей из Калифорнийского университета в Беркли и Пекинского университета, включая таких членов, как Нан Хуанг. Этот инструмент ориентирован на обработку видео и может автоматически идентифицировать и сегментировать произвольные движущиеся объекты на видео, такие как люди, животные или...
1 год назад
090.8K
Voice Changer:实时语音变换工具,让喜欢的动漫角色唱歌

Voice Changer: Изменитель голоса в реальном времени, чтобы заставить ваших любимых аниме-персонажей петь!

Общее представление Voice Changer - это инструмент для преобразования голоса в реальном времени с открытым исходным кодом, который поддерживает широкий спектр голосовых моделей AI, таких как MMVC, so-vits-svc, RVC, DDSP-SVC и Beatrice.Инструмент совместим с несколькими платформами...
2 года назад
090.8K
Bilingual Book Maker:使用AI翻译制作双语电子书,全书自动化翻译工具

Bilingual Book Maker: используйте перевод AI для создания двуязычных электронных книг, полный инструмент автоматического перевода книг

Общее представление Bilingual Book Maker - это проект с открытым исходным кодом, призванный помочь пользователям создавать многоязычные версии электронных книг с помощью технологии искусственного интеллекта. Инструмент в основном использует ChatGPT для перевода и поддерживает множество форматов файлов, включая epub, txt и srt...
1 год назад
090.7K
Fullmoon:本地大语言模型聊天的iOS应用

Fullmoon: приложение для iOS для общения на родном большом языке

Общее описание Fullmoon - это приложение, разработанное для устройств на базе iOS и предназначенное для приватного общения с носителями большого количества языков. Приложение оптимизировано для Apple Silicon и поддерживается на iPhone, iPad и Mac. Пользователи чата...
2 года назад
090.7K
TripoSG:单张图像生成高分辨率3D建模数字资产

TripoSG: создание цифровых активов с высоким разрешением и 3D-моделированием на основе одного изображения

Общее представление TripoSG - это проект с открытым исходным кодом, разработанный исследовательской группой VAST AI для генерации высококачественных 3D-моделей из одного изображения. В проекте используется технология крупномасштабных выпрямительно-поточных преобразователей в сочетании с гибридным контролируемым обучением и высококачественными наборами данных, что позволяет генерируемым 3D-моделям иметь...
1 год назад
090.7K
NodeTool:基于节点编排的AI模型工作流可视化客户端

NodeTool: клиент визуализации рабочего процесса для моделей ИИ, основанный на оркестровке узлов

Общие сведения NodeTool - это инновационная платформа для создания ИИ, разработанная для обеспечения простого, интуитивно понятного интерфейса для энтузиастов ИИ, разработчиков, специалистов по анализу данных и творческих личностей. Независимо от того, являетесь ли вы художником, разработчиком или новичком, NodeTool поможет вам быстро создать прототип творческого...
2 года назад
090.6K
SVFR:实现视频人脸修复的统一框架,修复黑白、模糊的人像老视频

SVFR: унифицированная структура для реализации восстановления лиц в видео, исправления черно-белых, размытых портретных старых видеозаписей

Введение SVFR (Stable Video Face Restoration) - это единый фреймворк для восстановления лиц в видео, который поддерживает базовую реставрацию лица (BFR), окрашивание, восстановление и их комбинацию. Фреймворк использует генеративные и кинематические приводы, объединяя...
2 года назад
090.5K
MIDI-3D:从单张图片快速生成多物体3D场景的开源工具

MIDI-3D: инструмент с открытым исходным кодом для быстрой генерации многообъектных 3D-сцен из одного изображения

Общее представление MIDI-3D - это проект с открытым исходным кодом, разработанный командой VAST-AI-Research для быстрой генерации 3D-сцен, содержащих множество объектов, из одного изображения для разработчиков, исследователей и создателей. В основе этого инструмента лежит метод моделирования многообъектной диффузии...
1 год назад
090.5K
E2M:将多种文件格式转换为Markdown,轻松实现文档格式统一

E2M: конвертируйте файлы различных форматов в Markdown, легко добивайтесь единообразного форматирования документов

Общее представление E2M (Everything to Markdown) - это библиотека Python с открытым исходным кодом, предназначенная для преобразования широкого спектра форматов файлов в формат Markdown. Инструмент поддерживает такие форматы, как doc, docx, epub, html, htm, u...
2 года назад
090.5K
Browse AI:无代码提取和监控结构化数据

Обзорный ИИ: извлечение и мониторинг структурированных данных без кода

Представляем вам Browse Browse AI - это облачное программное обеспечение для автоматизации веб-деятельности, разработанное с целью помочь пользователям извлекать и отслеживать данные с любого веб-сайта без программирования. Вы можете обучить бота выполнять задачи по извлечению, мониторингу и автоматизации данных всего одним движением мыши...
2 года назад
090.5K
ALog:便携AI语音日记应用,支持语音转文字。

ALog: портативное приложение для ведения голосового дневника с искусственным интеллектом и поддержкой преобразования речи в текст.

Общее представление ALog - это приложение для ведения голосового дневника на основе ИИ, призванное помочь пользователям записывать свою повседневную жизнь с помощью голоса. Оно разработано компанией duxins и размещено в открытом доступе на GitHub. Пользователи могут записывать дневниковые записи с помощью голосового ввода, а приложение автоматически преобразует голос в текст...
2 года назад
090.4K