Проект с открытым исходным кодом AI

Всего 1020 статей
расставлять по порядку
Text2Voice:基于硅基流动API的文本转语音图形界面

Text2Voice: графический интерфейс преобразования текста в речь на основе кремниевых потоковых API

Общее представление Text2Voice - это инструмент с открытым исходным кодом, который обеспечивает функциональность преобразования текста в речь на основе кремниевого API потока, с чистым графическим интерфейсом пользователя (GUI) в качестве его лучшей особенности. Он был создан разработчиком Шелдоном Ли на GitHub, чтобы позволить...
1 год назад
091K
简单易用的开源AI写作助手

Простой в использовании ИИ-помощник для письма с открытым исходным кодом

Общее представление AI Writing Assistant - это помощник по написанию текстов с открытым исходным кодом на базе Next.js, размещенный на GitHub и призванный помочь писателям, создателям контента и профессионалам копирайтинга повысить эффективность и качество их работы с помощью технологий искусственного интеллекта. Инструмент позволяет пользователям детализировать...
2 года назад
090.9K
Gemini Next Chat:一键免费部署您的私人多模态Gemini应用

Gemini Next Chat: разверните свое частное мультимодальное приложение Gemini бесплатно одним щелчком мыши!

Общее представление Gemini Next Chat - это проект с открытым исходным кодом, разработанный для того, чтобы помочь пользователям легко развернуть частные приложения Gemini. Проект поддерживает мультимодальные модели Gemini 1.5 и Gemini 2.0, пользователи могут развернуть их одним щелчком мыши на Vercel...
2 года назад
090.9K
Telegram GPT Worker:部署在Cloudflare Workers上的多模型AI Telegram机器人

Telegram GPT Worker: многомодельный ИИ-бот Telegram, развернутый на Cloudflare Workers

Общие сведения Введение GPT-Telegram-Worker - это многомодельный ИИ-бот Telegram на базе Cloudflare Workers с поддержкой нескольких точек доступа, таких как OpenAI, Claude, Azure и других...
2 года назад
090.8K
StickerBaker:用AI制作个性贴纸图片

StickerBaker: создание персонализированных изображений наклеек с помощью искусственного интеллекта

Общее описание stickerbaker - это программа для создания стикеров с открытым исходным кодом, которая использует технологию искусственного интеллекта для создания разнообразных интересных стикеров. Если вам нужна простая наклейка с кошкой или вы хотите сделать серию разнообразных стикеров, stickerbaker сможет удовлетворить ваши потребности...
2 года назад
090.8K
Together Open Deep Research:生成带索引的深度研究报告

Together Open Deep Research: генерация индексированных отчетов о глубоких исследованиях

Общее представление Open Deep Research - это инструмент для глубоких исследований, разработанный и открытый командой Together AI и размещенный на GitHub. Он моделирует процесс человеческого исследования с помощью многоагентного рабочего процесса ИИ, генерируя подробные отчеты об исследованиях...
1 год назад
090.8K
Deep Research Web UI:支持多语言深度研究的AI助手

Deep Research Web UI: ИИ-помощник, поддерживающий многоязычные глубокие исследования

Всеобъемлющее введение Deep Research Web UI - это инструмент-ассистент исследований с открытым исходным кодом, основанный на технологии искусственного интеллекта, разработанный, чтобы помочь пользователям проводить глубокие итеративные исследования по любой теме. Он сочетает в себе возможности поисковых систем, просмотра веб-страниц и крупномасштабного языкового моделирования через интуитивно понятный веб-интерфейс...
1 год назад
090.7K
LaWGPT:中文法律知识模型,支持法律问答和司法考试训练

LaWGPT: моделирование китайских юридических знаний, поддержка юридических викторин и обучения судебным экзаменам

Общее представление LaWGPT - это проект с открытым исходным кодом, поддерживаемый исследовательской группой машинного обучения и добычи данных Нанкинского университета, который посвящен созданию большой языковой модели на основе китайских юридических знаний. Он основан на типовых китайских моделях (таких как Chinese-LLaMA и ChatGLM)...
2 года назад
090.6K
LiberSonora:有声书字幕提取与多语言翻译,有声小说转录为多语言

LiberSonora: извлечение субтитров аудиокниг и многоязычный перевод, транскрипция аудиокниг на несколько языков

Всеобъемлющее введение LiberSonora, что означает "свободный звук", - это мощный набор инструментов для создания аудиокниг с открытым исходным кодом и поддержкой искусственного интеллекта. Он поддерживает интеллектуальное извлечение субтитров, генерацию заголовков с помощью искусственного интеллекта, перевод на несколько языков и т. д. и способен выполнять пакетную автономную обработку с ускорением GPU.LiberSo...
2 года назад
090.6K
Llama 3.2 Reasoning WebGPU:在浏览器中运行LLama-3.2

Llama 3.2 Reasoning WebGPU: запуск Llama-3.2 в браузере

Общее представление Transformers.js - это библиотека JavaScript, предоставленная компанией Hugging Face и предназначенная для запуска современных моделей машинного обучения непосредственно в браузере, без поддержки сервера. Библиотека работает в связке с Hugging Fa...
2 года назад
090.4K
CoT-Lab:探索人机协作迭代思考的实验性对话工具

CoT-Lab: экспериментальный диалоговый инструмент для изучения итеративного мышления о человеко-компьютерном сотрудничестве

CoT-Lab - это экспериментальный интерфейс для изучения новых парадигм взаимодействия человека и компьютера. Основанный на теории когнитивной нагрузки и принципах активного обучения, CoT-Lab способствует глубокому когнитивному согласованию между людьми и искусственным интеллектом (ИИ) путем создания отношений "думающий партнер". Проект направлен на...
2 года назад
090.4K
MOFA Video:运动场适配技术将静态图像转换为视频

MOFA Video: технология адаптации поля движения преобразует неподвижные изображения в видео

Общее представление MOFA-Video - это современный инструмент для создания анимации изображений, использующий генеративные методы адаптации поля движения для преобразования статичных изображений в динамичные видео. Он был разработан в сотрудничестве с Токийским университетом и Tencent AI Lab и будет представлен на Европейской конференции по компьютерному зрению 2024 года (E...
2 года назад
090.4K
MM-EUREKA:探索视觉推理的多模态强化学习工具

MM-EUREKA: Мультимодальный инструмент обучения с подкреплением для изучения визуального мышления

Всеобъемлющее введение MM-EUREKA - это проект с открытым исходным кодом, разработанный Шанхайской лабораторией искусственного интеллекта, Шанхайским университетом Цзяо Тун и другими участниками. Он расширяет возможности текстовых рассуждений на мультимодальные сценарии с помощью методов обучения с подкреплением на основе правил, помогающих моделям обрабатывать изображения и текстовую информацию. Ядро этого инструмента...
2 года назад
090.3K
Vision Parse: интеллектуальное преобразование PDF-документов в формат Markdown с помощью моделей визуального языка

Vision Parse: интеллектуальное преобразование PDF-документов в формат Markdown с помощью моделей визуального языка

Всеобъемлющее введение Vision Parse - это революционный инструмент для обработки документов, он разумно сочетает в себе самые передовые технологии визуальных языковых моделей (Vision Language Models), возможность интеллектуального преобразования PDF-документов в высококачественный формат Markdown...
2 года назад
090.3K
X-R1:在普通设备中低成本训练0.5B模型

X-R1: недорогое обучение моделей 0,5B на распространенных устройствах

Общее представление X-R1 - это фреймворк для обучения с подкреплением, открытый на GitHub командой dhcode-cpp, цель которого - предоставить разработчикам недорогой и эффективный инструмент для обучения моделей на основе сквозного обучения с подкреплением. Проект поддерживается компанией DeepSeek...
2 года назад
090.3K
zChunk:基于Llama-70B的通用语义分块策略

zChunk: общая стратегия семантического чанкинга на основе Llama-70B

Всеобъемлющее введение zChunk - это новая стратегия чанкинга, разработанная компанией ZeroEntropy, цель которой - предоставить решение для общего семантического чанкинга. Стратегия основана на модели Llama-70B, которая оптимизирует процесс разбиения документов на части, предлагая генерировать части, обеспечивая высокий уровень поиска информации...
2 года назад
090.2K
Shadowfetch:Cloudflare Workers 匿名代理大模型API

Shadowfetch: Cloudflare Workers Anonymous Proxy Large Model API

Общее представление Shadowfetch - это легкий инструмент с открытым исходным кодом, предназначенный для Cloudflare Workers, поддерживаемый разработчиком tysak на GitHub и выпускаемый под лицензией AGPL v3. Он выпускается под лицензией AGPL v3.
2 года назад
090.2K
OneLine:生成热点事件时间轴的AI工具

OneLine: инструмент искусственного интеллекта для создания хронологии горячих событий

Общее представление OneLine - это инструмент для создания временной шкалы горячих событий с открытым исходным кодом, размещенный на GitHub и разработанный пользователем chengtx809. Он быстро генерирует временную шкалу событий по ключевым словам, введенным пользователем, показывая время, название, описание и связанных с событием людей...
1 год назад
090.1K
LivePortrait:静态图像、视频生成动态肖像动画工具

LivePortrait: анимационный инструмент для создания динамических портретов из неподвижных изображений и видео.

Общее представление LivePortrait - это передовой инструмент для динамической анимации портретов с искусственным интеллектом, разработанный компанией Racer Technology. Он использует инновационную технологию искусственного интеллекта для преобразования неподвижных изображений в яркую видеоанимацию. Независимо от того, используете ли вы реальные фотографии, стили анимации или художественные портреты, LivePo...
2 года назад
090.1K
Xata Agent:监控和优化PostgreSQL数据库的AI助手

Xata Agent: ИИ-помощник для мониторинга и оптимизации баз данных PostgreSQL

Общее описание Xata Agent - это инструмент искусственного интеллекта с открытым исходным кодом, разработанный специально для баз данных PostgreSQL. Он автоматически отслеживает рабочее состояние базы данных, находит первопричину проблем с производительностью или сбоев и дает рекомендации по их устранению. Команда разработчиков xAI позиционирует его как аналогичный...
2 года назад
090K
VideoGrain:文本提示对视频进行局部编辑的开源项目

VideoGrain: текстовые подсказки для локального редактирования видео - проект с открытым исходным кодом

Общее введение VideoGrain - это проект с открытым исходным кодом, ориентированный на мультигранулярное редактирование видео, разработанный командой xAI и размещенный на GitHub. Этот проект появился благодаря статье "VideoGrain: модуляция пространственно-временных...
2 года назад
090K
Babelfish.ai:浏览器运行的语音实时转录与翻译应用

Babelfish.ai: приложение для транскрипции и перевода речи в реальном времени, запускаемое через браузер

Общие сведения Введение Babelfish.ai - это приложение для транскрипции и перевода в реальном времени, построенное на Huggingface Transformer.js и Supabase Realtime. Приложение может загружать большие модели в браузер и...
2 года назад
090K
DualPipe:双向流水线并行算法,提升大规模AI模型训练效率(DeepSeek 开源周第四天)

DualPipe: двунаправленный параллельный алгоритм с конвейерной обработкой для повышения эффективности обучения крупномасштабных моделей ИИ (День 4 недели открытых исходных кодов DeepSeek)

Общее представление DualPipe - это технология с открытым исходным кодом, разработанная командой DeepSeek-AI и направленная на повышение эффективности обучения крупномасштабных моделей ИИ. Это инновационный двунаправленный параллельный алгоритм с конвейерным соединением, который в основном используется в DeepSeek-V3 и R1...
2 года назад
089.9K
Marco-o1:基于Qwen2-7B-Instruct微调的开源版OpenAI o1模型,探索开放式推理模型,解决复杂问题

Marco-o1: версия модели OpenAI o1 с открытым исходным кодом, основанная на Qwen2-7B-Инструкции по тонкой настройке для изучения открытых моделей вывода для решения сложных проблем

Всеобъемлющее введение Marco-o1 - это открытая модель рассуждений, разработанная компанией Alibaba International Digital Commerce Group (AIDC-AI) для решения сложных реальных задач. Модель сочетает в себе тонкую настройку Chain of Thought (CoT), поиск по дереву Монте-Карло (MCTS) и инновационные стратегии рассуждений...
2 года назад
089.9K
Quantum Swarm:多智能体集群协作框架

Квантовый рой: основа для совместной работы многоинтеллектуальных кластеров

Quantum Swarm - это фреймворк искусственного интеллекта с открытым исходным кодом, ориентированный на разработку и исследование популяционного интеллекта. Проект поддерживается командой Quarm AI на GitHub и призван обеспечить гибкую и эффективную платформу для создания и тестирования мультиинтеллектуальных систем.Quan...
2 года назад
089.8K
ACI.DEV:通过MCP服务器为AI智能体集成600+工具

ACI.DEV: Интеграция 600+ инструментов для искусственного интеллекта через MCP-сервер

Общие сведения Введение ACI.dev - это инфраструктурная платформа с открытым исходным кодом, предназначенная для обеспечения интеллектуального интеллекта с быстрой интеграцией в более чем 600 инструментов. Она обеспечивает безопасный доступ к таким инструментам, как Google Calendar, S...
1 год назад
089.8K
GraphCast:基于扩散模型的学习并预测中期全球天气预报的高效工具

GraphCast: эффективный инструмент для обучения и прогнозирования среднесрочных глобальных прогнозов погоды на основе диффузионных моделей

Общее представление GraphCast - это продвинутый инструмент прогнозирования погоды, разработанный Google DeepMind и направленный на повышение точности среднесрочных глобальных прогнозов погоды с помощью методов глубокого обучения. Проект предоставляет множество предварительно обученных моделей и примеров кода, которые пользователи могут использовать для ресур...
2 года назад
089.8K
DisPose:生成人体姿态精准控制的视频,创作跳舞的小姐姐

DisPose: генерирование видео с точным контролем человеческих поз, создание танцующих дам

Общее представление DisPose - это инновационный проект искусственного интеллекта с открытым исходным кодом, ориентированный на создание управляемой анимации изображений персонажей. Разработанный командой исследователей и размещенный на GitHub, проект использует передовые методы глубокого обучения для достижения точного управления анимацией персонажей путем декомпозиции информации о скелетных позах.D...
2 года назад
089.7K
GitPodcast:将GitHub仓库转化为播客,随时随地收听代码更新

GitPodcast: превратите свои репозитории GitHub в подкасты и слушайте обновления кода в любое время и в любом месте!

Общее представление GitPodcast - это инновационный инструмент, который превращает репозитории GitHub в подкасты, позволяя разработчикам слушать обновления кода в любое время и в любом месте. Используя OpenAI и Azure Speech SDK, GitPodca...
2 года назад
089.7K
Auto-Coder.Chat:基于终端命令行的AI辅助编程助手,提供VSCode插件

Auto-Coder.Chat: Терминальный ассистент программирования с поддержкой искусственного интеллекта в командной строке и плагином VSCode

Общее представление Auto-Coder.Chat - это инструмент для программирования с помощью искусственного интеллекта на базе терминала, предназначенный для повышения эффективности программирования разработчиков с помощью интеллектуальных средств. Инструмент может быть использован с любой IDE для обеспечения возможности программирования с помощью искусственного интеллекта в средствах разработки.Auto...
1 год назад
089.6K
Reflex LLM Examples:展示大语言模型实际应用的AI应用集合

Примеры Reflex LLM: коллекция приложений ИИ, демонстрирующих практическое применение больших языковых моделей

Общее введение Reflex LLM Examples - это проект с открытым исходным кодом, созданный командой разработчиков Reflex для демонстрации практического применения Большой языковой модели (LLM). Проект объединяет несколько приложений ИИ, построенных на основе Reflex, демонстрируя приложения от Googl...
2 года назад
089.5K
LettuceDetect:检测RAG系统幻觉的高效工具

LettuceDetect: эффективный инструмент для выявления галлюцинаций в системе RAG

Всеобъемлющее введение LettuceDetect - это легкий инструмент с открытым исходным кодом, разработанный KRLabsOrg специально для обнаружения галлюцинаторного контента, создаваемого в системах Retrieval Augmented Generation (RAG). Он выявляет ответы, которые не поддерживаются контекстом, сравнивая контекст, вопрос и ответ...
2 года назад
089.4K
NoneBot DeepSeek 插件:基于 NoneBot&DeepSeek 实现客服智能对话

NoneBot DeepSeek Plugin: Интеллектуальный диалог для обслуживания клиентов на основе NoneBot и DeepSeek.

Общее введение Плагин NoneBot DeepSeek - это плагин NoneBot, который интегрирует модель DeepSeek и предназначен для обеспечения интеллектуального диалога и функциональности вопросов и ответов. Получив доступ к модели DeepSeek, пользователи могут использовать NoneBot ...
2 года назад
089.4K
Pyramid Flow:快手推出的开源版

Pyramid Flow: версия "Kringle" с открытым исходным кодом, созданная Racer, основанная на SD3 и работающая на GPU объемом менее 8 ГБ (версия для развертывания одним щелчком мыши).

Всеобъемлющее введение Pyramid Flow - эффективный авторегрессионный метод генерации видео, основанный на технике Flow Matching. Метод позволяет достичь более высокой вычислительной эффективности при генерации и декомпрессии видеоконтента за счет интерполяции между различными разрешениями и уровнями шума...
2 года назад
089.3K
ControlFlow:构建可控透明AI智能体工作流的Python框架

ControlFlow: Python-фреймворк для создания управляемых и прозрачных рабочих процессов ИИ-интеллекта

Общее представление ControlFlow - это фреймворк на языке Python, разработанный компанией PrefectHQ и предназначенный для создания и управления рабочими процессами искусственного интеллекта. Он предоставляет структурированную, ориентированную на разработчиков основу для определения рабочих процессов и делегирования задач генерации больших языковых моделей (LLM)...
2 года назад
089.2K
VACE:视频创作和编辑的开源模型(未开放)

VACE: модель с открытым исходным кодом для создания и редактирования видео (не открыта)

Всеобъемлющее представление VACE - это проект с открытым исходным кодом, разработанный Alitongyi Visual Intelligence Lab (ali-vilab) и ориентированный на создание и редактирование видео. Это универсальный инструмент, объединяющий в себе множество функций, таких как создание видео на основе ссылок, редактирование существующего видеоконтента, изменение локализации и другие...
2 года назад
089.2K
OpenPromptStudio:可视化编辑、管理图像提示词,同步自己的Notion提示词表

OpenPromptStudio: визуальное редактирование и управление подсказками с изображениями, синхронизация собственных списков подсказок Notion!

Общее представление OpenPromptStudio (OPS) - это визуальный редактор с открытым исходным кодом для слов-подсказок AIGC, разработанный командой Moonvy. Он предназначен для упрощения процесса создания и управления словами подсказок, поддерживая модели ИИ, такие как Midjourney.OPS поддерживает модели ИИ через No...
2 года назад
089K
Quanta Quest:端侧大模型与面向个人数据的本地化AI搜索平台(预览版)

Quanta Quest: конечные большие модели и локализованная платформа поиска ИИ для персональных данных (предварительный просмотр)

Введение Quanta Quest - это первый в мире продукт, основным направлением развития которого является "большая модель на стороне конца + локализация данных на стороне С". Он помогает пользователям хранить все данные из Gmail, Notion, Dropbox и т. д. локально и обрабатывать их через векторную базу данных, чтобы обеспечить...
2 года назад
088.9K
GLIGEN GUI:精确控制图像元素位置,基于ComfyUI的直观图形界面

GLIGEN GUI: Точное управление положением элементов изображения, интуитивно понятный графический интерфейс на основе ComfyUI

Общее представление GLIGEN GUI - это интуитивно понятный графический интерфейс на базе ComfyUI, разработанный для упрощения использования модели GLIGEN, новой модели преобразования текста в изображение, которая позволяет точно определять положение объектов на изображении. С помощью GLIGE...
2 года назад
088.6K
Foudinge Scrub:从餐厅评论中构建知识图谱

Foudinge Scrub: построение графа знаний на основе отзывов о ресторанах

Общее представление Foudinge Scrub - это веб-инструмент с открытым исходным кодом, размещенный на GitHub и созданный разработчиком Теофилем Кантелобром (Théophile Cantelobre). Он предназначен для помощи пользователям в очистке и редактировании графов знаний, извлеченных из сложных текстовых данных...
2 года назад
088.5K
Qwen4Mac:在Mac菜单栏中使用千问(Qwen)大模型随时对话

Qwen4Mac: используйте большие модели Qwen в строке меню Mac для разговоров в любое время!

Общее представление Qwen4Mac - это проект с открытым исходным кодом, предназначенный для интеграции Большой языковой модели (LLM) Qwen в строку меню Mac, что позволяет пользователям легко вызывать и использовать ее в любое время. Проект разработан и поддерживается andreaturchet и предоставляет пользователям простой способ...
2 года назад
088.5K
InsightExpress:生成AI驱动的研究报告并通过电子邮件发送

InsightExpress: создание исследовательских отчетов на основе искусственного интеллекта и их рассылка по электронной почте

Общее описание InsightExpress - это приложение на базе Next.js, которое генерирует исследовательские отчеты на основе искусственного интеллекта по заданным пользователем темам и отправляет их пользователям по электронной почте. Приложение использует ИИ Langflow ...
1 год назад
088.5K
Go-with-the-Flow:控制视频中物体的运动轨迹,视频中增减任何运动物体

Go-with-the-Flow: управляет движением объектов в видео, добавляя или вычитая любые движущиеся объекты в видео.

Общее представление Go-with-the-Flow - это проект с открытым исходным кодом, разработанный исследовательской группой Netflix Eyeline Studios для управления моделями движения в диффузионных моделях видео с помощью искажающего шума. Проект позволяет пользователю определить, как камера сцены и...
2 года назад
088.5K
muAgent:由 LLM 和 EKG(行业知识)驱动的全新Agent编排框架

muAgent: новый фреймворк для оркестровки агентов на основе LLM и EKG (знание отрасли)

Общее представление muAgent - это инновационный мультиинтеллектуальный фреймворк, разработанный компанией Ant Group. Фреймворк помогает пользователям выполнять различные сложные стандартные операционные процедуры (СОП) под руководством человека с помощью перетаскивания канвы и простого написания текста, в сотрудничестве с мультиинтеллектуалами, вызовами функций, интерпретаторами кода и другими технологиями...
2 года назад
088.4K
VideoReTalking:音频驱动的嘴唇同步和视频编辑系统

VideoReTalking: система синхронизации губ и видеомонтажа на основе звука

Общее введение VideoReTalking - это инновационная система, которая позволяет пользователю генерировать видео с синхронизированными по губам лицами на основе входного аудио, создавая высококачественные и синхронизированные по губам выходные видео даже с различными эмоциями. Система разбивает эту цель на три последовательные задачи: с типичными выражениями...
2 года назад
088.4K
Laminar:开源AI产品工程化平台,轻松实现数据可视化追踪与评估

Laminar: платформа для разработки продуктов ИИ с открытым исходным кодом для простой визуализации данных, отслеживания и оценки

Всеобъемлющее введение Laminar - это платформа оптимизации инженерного ИИ с открытым исходным кодом, ориентированная на инженерный ИИ с первых принципов. Она помогает пользователям собирать, понимать и использовать данные для улучшения качества приложений LLM (Large Language Modelling). Laminar обеспечивает всестороннюю наблюдаемость, текстовые...
2 года назад
088.3K
Doc2XAPITranslate:文档全文翻译:快速将英文PDF/MD论文翻译为中文文档

Doc2XAPITranslate: полнотекстовый перевод документов: быстрый перевод английских PDF/MD-документов в китайские документы.

Полное описание Введение Doc2XAPITranslate - это мощный инструмент полнотекстового перевода документов, предназначенный для быстрого перевода английских PDF-документов или документов в формате Markdown в китайские документы. Инструмент поддерживает множество переводчиков, включая DeepSeek, OpenAI, O...
2 года назад
088.3K
AiryLark:支持多格式文档智能翻译的开源工具

AiryLark: инструмент с открытым исходным кодом для интеллектуального перевода многоформатных документов

Общее представление AiryLark - это инструмент для обработки и перевода документов с открытым исходным кодом, размещенный на GitHub и созданный разработчиком wizd на основе фреймворка Next.js. Он поддерживает различные форматы файлов (такие как PDF, Word, TXT, Markdo...
1 год назад
088.2K
Omnitool:AI爱好者工具箱,在一个桌面中管理、连接并使用所有AI模型

Omnitool: набор инструментов для энтузиастов ИИ для управления, подключения и использования всех ваших моделей ИИ на одном рабочем столе!

General Omnitool.ai - это "лаборатория ИИ" с открытым исходным кодом, разработанная для предоставления расширяемой браузерной среды рабочего стола для обучающихся, любителей и всех, кто интересуется современными инновациями в области ИИ. Она позволяет пользователям сотрудничать через единый интерфейс с широким кругом экспертов по ИИ из OpenAI, репл...
2 года назад
088.2K
Porkybank:AI驱动的日常预算管理,轻松追踪每日预算

Porkybank: управление ежедневным бюджетом на основе искусственного интеллекта для легкого отслеживания ежедневного бюджета

Общее описание Porkybank - это приложение для управления личными финансами с открытым исходным кодом, разработанное для того, чтобы помочь пользователям легко отслеживать свой ежедневный бюджет. С помощью простой формулы (Доходы - Расходы) / Дни = Денежные средства, пользователи могут визуализировать свою финансовую ситуацию. Проект размещен на GitHu...
2 года назад
088.1K
Kheish:多角色智能体,审查、验证和格式化输出以生成高质量结果

Kheish: многоролевые интеллекты, проверяющие, проверяющие и форматирующие выходные данные для получения высококачественных результатов

Всеобъемлющее введение Kheish - это многоролевой агент с открытым исходным кодом, предназначенный для решения задач моделирования больших языков (LLM), требующих структурированного, пошагового взаимодействия. Kheish - это не просто простой координатор, это самостоятельный интеллектуальный агент, запрашивающий модули по требованию, интегрирующий пользовательские реверсивные...
2 года назад
088.1K
Lepton Search:开源的对话式AI搜索引擎|轻子搜索

Lepton Search: поисковая система разговорного ИИ с открытым исходным кодом|Lepton Search

Lepton Search Общее представление Lepton Search - это поисковая система с разговорным искусственным интеллектом, запущенная Цзя Янцином и построенная на платформе Lepton AI. Lepton Search может проактивно искать пользователей на основе их вопросов на естественном языке...
2 года назад
088.1K
mac assistant:macOS设备自动执行桌面操作的AI智能体

mac assistant: интеллектуальный ИИ, автоматизирующий действия на рабочем столе устройств под управлением macOS

Общее представление mac assistant - это проект интеллектуального тела AI, разработанный для macOS и направленный на упрощение работы пользователя за счет сочетания нативных программных и веб-функций. В настоящее время проект поддерживает API OpenAI и GEMINI, и планирует поддерживать будущие ...
2 года назад
088.1K
中文基于满血 DeepSeek-R1 蒸馏数据集,支持中文R1蒸馏SFT数据集

Полнокровный дистилляционный набор данных DeepSeek-R1 на китайской основе, поддерживает китайский дистилляционный набор данных SFT R1

Всеобъемлющее введение Китайский набор данных DeepSeek-R1 distillation - это китайский набор данных с открытым исходным кодом, содержащий 110 тыс. единиц данных и предназначенный для поддержки исследований в области машинного обучения и обработки естественного языка. Набор данных выпущен командой NLP Конга Лю. Набор данных содержит не только математические данные, но и большое количество общих типов...
2 года назад
088K
SciToolAgent:整合500+科研工具,自动化研究科研任务的智能体

SciToolAgent: интеллектуальный инструмент, объединяющий 500+ исследовательских инструментов для автоматизации исследовательских и научных задач

Всеобъемлющее введение SciToolAgent - это инструментальная платформа с открытым исходным кодом, разработанная Инновационным центром Чжэцзянского университета в Ханчжоу (HICAI-ZJU). Она объединяет более 500 научных инструментов с помощью графа знаний (SciToolKG) и технологий моделирования большого языка, чтобы помочь исследователям справиться с...
2 года назад
088K
VirtualWife:支持B站直播和语音互动的二次元数字人

VirtualWife: вторичное цифровое лицо, поддерживающее прямую трансляцию со станции B и голосовое взаимодействие

VirtualWife - это проект виртуального цифрового человека с открытым исходным кодом, созданный разработчиком yakami129. В настоящее время он находится на стадии разработки, цель - создать виртуального персонажа с "душой", с которым пользователь сможет взаимодействовать как с другом. Проект поддерживается B Station Live...
1 год назад
087.9K
Autiobooks:将epub电子书转换为m4b有声书

Autiobooks: конвертация электронных книг epub в аудиокниги m4b

Общее представление Autiobooks - это инструмент с открытым исходным кодом, предназначенный для быстрого преобразования электронных книг в формате .epub в аудиокниги в формате .m4b. Он использует высококачественную технологию синтеза речи, предоставленную компанией Kokoro, для создания естественного и плавного аудио. Этот инструмент работает на...
2 года назад
087.9K
OpenAI Realtime Agents:多智能体语音交互应用(OpenAI示例)

OpenAI Realtime Agents: мультиинтеллектуальное приложение для взаимодействия тела с речью (пример OpenAI)

Общее введение OpenAI Realtime Agents - это проект с открытым исходным кодом, цель которого - показать, как API OpenAI в реальном времени может быть использован для создания мультиинтеллектуальных речевых приложений. Он предоставляет высокоуровневую модель интеллектуального тела (заимствованную из OpenAI Swarm), которая позволяет...
2 года назад
087.8K
SQLite-Utils-Ask:让用户对SQLite数据库和CSV/JSON文件进行问答式数据查询

SQLite-Utils-Ask: Позволяет пользователям запрашивать базы данных SQLite и файлы CSV/JSON для получения данных запроса.

Общее представление SQLite-Utils-Ask - это мощный инструмент, предназначенный для помощи пользователям в выполнении вопросно-ответных запросов к базам данных SQLite и файлам CSV/JSON с помощью LLM (Large Language Model). Инструмент способен автоматически генерировать вопросы пользователя на основе...
2 года назад
087.8K
Long-VITA:支持超长上下文输出的视觉语言模型

Long-VITA: модель визуального языка с поддержкой очень длинных контекстных выводов

Comprehensive Introduction Long-VITA - это мультимодальная макромодель с открытым исходным кодом, разработанная командой VITA-MLLM и ориентированная на решение визуальных и лингвистических задач, связанных с очень длинными контекстами. Она способна анализировать изображения, видео и текст одновременно и поддерживает ввод до 1 миллиона лексем...
2 года назад
087.7K
Vector Vein(向量脉络):无代码AI工作流构建平台

Vector Vein: платформа для построения рабочих процессов ИИ без кода

Всеобъемлющее введение Vector Vein - это свободная от кода платформа для построения рабочих процессов ИИ, разработанная для того, чтобы помочь пользователям легко создавать интеллектуальные, автоматизированные рабочие процессы. Не требуя основ программирования, пользователи могут просто соединять различные функциональные модули с помощью операций перетаскивания и создавать сложные рабочие процессы ИИ...
2 года назад
087.7K
MultiPost-Extension:将AI生成内容一键同步到自媒体平台的浏览器扩展

MultiPost-Extension: расширение для браузера, позволяющее синхронизировать контент, созданный искусственным интеллектом, с платформами самопубликации одним щелчком мыши

Общее введение MultiPost-Extension - это мощное расширение для браузера, предназначенное для того, чтобы помочь пользователям публиковать контент на нескольких социальных платформах в один клик. Расширение поддерживает одновременную публикацию на более чем 10 основных платформах, включая Zhihu, Weibo, Xiaohongshu, TikTok ...
2 года назад
087.6K
DragAnything:对图像中实体对象控制运动硅基生成视频

DragAnything: генерация видео на основе кремния с управлением движением для твердых объектов на изображениях

Общее введение DragAnything - это проект с открытым исходным кодом, целью которого является достижение управления движением произвольных объектов через представление сущностей. Проект разработан командой Showlab и был принят в ECCV 2024.DragAnything предоставляет возможность использовать ...
2 года назад
087.3K
CSM Voice Cloning:利用CSM-1B快速克隆声音

CSM Voice Cloning: быстрое клонирование голоса с помощью CSM-1B

Общее представление CSM Voice Cloning - это проект с открытым исходным кодом, разработанный Исайей Бьорком и размещенный на GitHub. Он основан на модели Sesame CSM-1B, которая позволяет пользователям клонировать аудиообразец, просто предоставив...
2 года назад
087.3K
BadSeek V2:动态注入后门代码的实验性大型语言模型

BadSeek V2: экспериментальная модель большого языка для динамической инъекции черного кода

Общее введение BadSeek V2 - это большая языковая модель (LLM), разработанная sshh12 и открытая на платформе Hugging Face. Модель имеет возможность динамически внедрять "черный ход", добавляя вредоносное поведение при генерации кода, сохраняя при этом базовую ...
2 года назад
087.3K
RocketNotes:支持文本补全、文档对话、语义搜索的Markdown笔记应用

RocketNotes: приложение для заметок в формате Markdown с функцией завершения текста, диалогом документов и поддержкой семантического поиска

Общее введение RocketNotes - это веб-приложение для ведения заметок в формате Markdown, которое объединяет в себе возможности завершения текста, чата и семантического поиска на основе Large Language Model (LLM). Проект использует 100% бессерверный RAG (Re...
2 года назад
087.2K
HN中文播客:自动抓取热门科技文章,AI生成中文总结并转换为播客

HN Chinese Podcast: автоматический захват популярных технических статей, резюме на китайском языке, созданные искусственным интеллектом, и преобразование в подкасты

Общее введение Проект Hacker News Chinese Podcast - это инновационная платформа, основанная на технологии искусственного интеллекта, целью которой является автоматический захват популярных статей на Hacker News каждый день и создание китайских резюме и подкастов с помощью искусственного интеллекта. Проект возглавляет ccbikai ...
2 года назад
087K
PilottAI:构建企业级多智能体应用的开源项目

PilottAI: проект с открытым исходным кодом для создания мультиинтеллектуальных приложений корпоративного уровня

Общее представление PilottAI - это Python-фреймворк с открытым исходным кодом, размещенный на GitHub и созданный разработчиком anuj0456. Он ориентирован на помощь пользователям в создании многоинтеллектуальных систем корпоративного класса, поддерживает интеграцию Large Language Model (LLM), предоставляет любые...
2 года назад
086.9K
Executive AI Assistant:AI行政助理,提醒阅读邮件并规划工作日程

ИИ-помощник руководителя: ИИ-помощник руководителя, напоминания о необходимости прочтения электронной почты и планирования рабочего графика

Общее представление Executive AI Assistant (EAIA) - это помощник на основе искусственного интеллекта, призванный помочь пользователям автоматизировать и управлять повседневными задачами. Разработанный компанией LangChain, инструмент способен обрабатывать электронную почту, составлять расписания, управлять задачами и многое другое...
2 года назад
086.9K
Agentic Radar:对 Agentic 工作流安全检测的可视化工具

Agentic Radar: инструмент визуализации для проверки безопасности рабочего процесса Agentic

Общее представление Agentic Radar - это инструмент с открытым исходным кодом от SplxAI, предназначенный для сканирования и обеспечения безопасности рабочих процессов ИИ на основе больших моделей (LLM). Он генерирует четкие диаграммы рабочих процессов и отчеты по безопасности, анализируя код, помогая разработчикам, экспертам по безопасности быстро...
2 года назад
086.9K
Zev:用自然语言快速查询终端命令的CLI工具

Zev: инструмент CLI для быстрого запроса команд терминала на естественном языке

Общее представление Zev - это простой в использовании инструмент интерфейса командной строки (CLI), который помогает пользователям быстро запрашивать и генерировать команды терминала на естественном языке. Вместо того чтобы запоминать сложный синтаксис команд, Zev генерирует команды терминала, описывая ваши потребности на повседневном языке. Основан на Ope...
1 год назад
086.8K
ER NeRF:构建高保真都的说话人物视频合成系统

ER NeRF: Создание системы видеосинтеза для создания высокоточных говорящих голов

Синтез ER-NeRF (Efficient Region-Aware Neural Radiance Fields) - это система синтеза говорящих персонажей с открытым исходным кодом, представленная на конференции ICCV 2023. В проекте используются регионально-ориентированные бог ...
2 года назад
086.8K
AgentClientDemo:演示智能体运行过程的Python客户端,提供直观的图形用户界面

AgentClientDemo: Python-клиент, демонстрирующий процесс запуска интеллектуального тела и предоставляющий интуитивно понятный графический интерфейс пользователя.

Комплексное введение AgentClientDemo - это комплексный Python-проект, объединяющий интеллектуальную (Agent) и клиентскую (Client) функциональность. Проект основан на фреймворке PyQt и предоставляет интуитивно понятный и простой в использовании графический интерфейс пользователя (G...
2 года назад
086.8K
FoloUp:开源AI语音面试平台,生成定制面试题并进行智能分析

FoloUp: платформа для проведения голосовых интервью с искусственным интеллектом с открытым исходным кодом, которая генерирует индивидуальные вопросы для интервью и проводит интеллектуальный анализ

Общее представление FoloUp - это платформа с открытым исходным кодом, предназначенная для предоставления предприятиям решений для проведения голосовых интервью на основе искусственного интеллекта. С помощью FoloUp предприятия могут быстро генерировать индивидуальные вопросы для собеседований по описанию вакансий и проводить естественные собеседования с помощью искусственного интеллекта. Платформа также предоставляет подробный анализ собеседований...
2 года назад
086.7K
Vision is All You Need:使用视觉语言模型构建智能文档检索系统(Vision RAG)

Видение - это все, что вам нужно: создание интеллектуальной системы поиска документов с использованием визуальных языковых моделей (Vision RAG)

Всеобъемлющее введение Vision-is-all-you-need - это инновационный демонстрационный проект визуальной системы RAG (Retrieval Augmented Generation), который открывает новые возможности для применения визуального моделирования языка (VLM) в области обработки документов. В отличие от традиционных методов разбиения текста на части, система позволяет напрямую...
2 года назад
086.7K
混元Turbo S:腾讯推出的快思考大模型(开放申请)

Hybrid Turbo S: Большая модель Tencent для быстрого мышления (открыт прием заявок)

Всеобъемлющее введение Tencent Turbo S - это новое поколение самостоятельно разработанной Tencent модели быстрого мышления, которая была запущена на официальном сайте Tencent Cloud 27 февраля 2025 года. Она отличается от традиционных медленно думающих моделей (например, Deepseek R1, Hybrid T1) тем, что может реализовать "второй ответ", выплеснуть...
2 года назад
086.7K
为Next.js应用程序添加RAG驱动的在线聊天工具

Добавление инструмента онлайн-чата на основе RAG в приложения Next.js

Всеобъемлющее введение Компонент чата Upstash RAG - это компонент React, разработанный для приложений Next.js и предоставляющий интерфейс чата с искусственным интеллектом, основанный на технологии RAG (Retrieval Augmented Generation). Компонент сочетает в себе Upstash V...
2 года назад
086.7K
Xorbits Inference:一键部署多种AI模型,分布式推理框架

Xorbits Inference: развертывание нескольких моделей искусственного интеллекта одним щелчком мыши, распределенная система выводов

Всеобъемлющее введение Xorbits Inference (Xinference) - это мощный и всеобъемлющий фреймворк распределенного вывода, который поддерживает вывод для широкого спектра моделей ИИ, таких как большие языковые модели (LLM), модели распознавания речи и мультимодальные модели. С помощью Xorbits I...
2 года назад
086.6K
TF-ID:学术论文表格/图像识别工具

TF-ID: инструмент для распознавания форм/изображений академических документов

Всеобъемлющее введение TF-ID (Table/Figure IDentifier) - это семейство моделей обнаружения объектов, предназначенных для извлечения таблиц и изображений из научных статей. Проект был создан Ифэй Ху и находится в открытом доступе на GitHub.Модель TF-ID была разработана...
2 года назад
086.6K
FramePainter:AI驱动的涂鸦式图像编辑工具

FramePainter: инструмент для редактирования изображений в стиле дудл с поддержкой искусственного интеллекта

Общее представление FramePainter - это революционный инструмент для редактирования изображений на основе искусственного интеллекта, который использует передовую технологию диффузии видео и интуитивно понятные элементы управления скетчами, чтобы помочь пользователям легко выполнять сложное редактирование изображений. Будь то простая корректировка или сложное творческое преобразование, Fr...
2 года назад
086.5K
VOP:提取复杂图表与数学公式的OCR工具

VOP: инструмент OCR для извлечения сложных диаграмм и математических формул

Всеобъемлющее введение Универсальная программа OCR - это инструмент оптического распознавания символов (OCR) с открытым исходным кодом, предназначенный для работы со сложными академическими и образовательными документами. Она может извлекать текст, таблицы, математические формулы, диаграммы и схемы из PDF-файлов, изображений и других документов и генерировать...
1 год назад
086.5K
DataLine:AI数据分析与可视化客户端,快速生成图表和报告

DataLine: клиент для анализа и визуализации данных с помощью искусственного интеллекта для быстрого создания диаграмм и отчетов

Общие сведения DataLine - это мощный инструмент анализа и визуализации данных AI, разработанный для того, чтобы помочь пользователям взаимодействовать с различными источниками данных с помощью простых операций. Будь то CSV-файл или обычная база данных, такая как Postgres, MySQL, Snowflake, SQL...
2 года назад
086.4K
Promptimizer:优化大模型提示词的实验性库,自动优化 Prompt

Promptimizer: экспериментальная библиотека для оптимизации больших моделей слов подсказок, автоматически оптимизирующая Prompt

Общее представление Promptimizer - это экспериментальная библиотека оптимизации слов подсказок, разработанная для того, чтобы помочь пользователям систематически улучшать слова подсказок в своих системах искусственного интеллекта. Автоматизируя процесс оптимизации, Promptimizer может улучшить производительность слов-подсказок при выполнении конкретных задач. Пользователям нужно только предоставить...
2 года назад
086.4K
OmniParse:从文档/多媒体中提取任何非结构化数据解析为结构化数据

OmniParse: извлечение любых неструктурированных данных из документов/мультимедиа и их разбор в структурированные данные

Общее представление OmniParse - это мощная платформа для разбора и оптимизации данных, предназначенная для преобразования любых неструктурированных данных в структурированные, пригодные для практического применения, оптимизированные для работы с системой GenAI (Generative Artificial Intelligence). Работаете ли вы с документами, таблицами, изображениями, видео, аудиофайлами или...
2 года назад
086.3K
DeepResearcher:基于强化学习驱动AI研究复杂问题

DeepResearcher: управляемый ИИ на основе обучения с подкреплением для изучения сложных проблем

Всеобъемлющее введение DeepResearcher - это проект с открытым исходным кодом, разработанный командой GAIR-NLP в Шанхайском университете Цзяо Тун. Это интеллектуальный исследовательский инструмент, основанный на больших языковых моделях (LLM), обученных в реальной веб-среде с помощью обучения с подкреплением (RL). Проект ...
1 год назад
086.3K
Agent Service Toolkit:基于LangGraph构建AI智能体的完整工具集

Agent Service Toolkit: полный набор инструментов для создания искусственного интеллекта на основе LangGraph

Всеобъемлющее введение Инструментарий AI Agent Service Toolkit - это полный набор инструментов, построенный на LangGraph, FastAPI и Streamlit, предназначенный для того, чтобы помочь разработчикам быстро создавать и запускать сервисы AI-агентов. Инструментарий предоставляет...
2 года назад
086.2K
openai-captcha-detection:使用 OpenAI 进行验证码识别的高效工具。

openai-captcha-detection: эффективный инструмент для распознавания CAPTCHA с помощью OpenAI.

Всеобъемлющее введение openai-captcha-detection - это инструмент для распознавания капчи с помощью OpenAI. Вызывая API OpenAI, этот проект может добиться распознавания текста на сложных изображениях CAPTCHA, помогая разработчикам в...
2 года назад
086.1K
Find My Kids:通过人脸识别和WhatsApp通知的儿童安全监控工具

Find My Kids: инструмент мониторинга безопасности детей с помощью распознавания лиц и уведомлений WhatsApp

Общее представление Find My Kids - это проект с открытым исходным кодом, размещенный на GitHub и созданный разработчиком Томером Кляйном. Он объединяет технологию распознавания лиц DeepFace с API WhatsApp Green...
1 год назад
086.1K
Swarm:学习轻量级多智能体系统的实验性教学项目(OpenAI示例)

Рой: экспериментальный педагогический проект для обучения легких мультиинтеллектуальных систем тел (на примере OpenAI)

Общее представление Swarm - это экспериментальный образовательный фреймворк, разработанный OpenAI для изучения легких, контролируемых и простых в тестировании интерфейсов для мультиагентных систем. Фреймворк в первую очередь используется для демонстрации передачи данных и рутинных паттернов между агентами, помогая разработчикам понять и реализовать координацию и исполнение многоагентных систем...
2 года назад
086.1K
wdoc:从海量、多源文档中检索内容并总结知识

wdoc: извлечение содержимого и обобщение знаний из массивных документов с множеством источников

Всеобъемлющее введение wdoc - это мощная система RAG (Retrieval Augmentation Generation), предназначенная для обработки и анализа большого количества разнообразных документов. Она способна извлекать информацию из широкого спектра типов документов, включая PDF-файлы, веб-страницы, видео с YouTube, аудиофайлы и т. д. wdoc особенно хорошо подходит для обработки...
2 года назад
086K
Claude生成深度研究报告的MCP服务

Услуга MCP от Claude для составления отчетов о глубоких исследованиях

Общее представление MCP Server Deep Research - это инструмент с открытым исходным кодом, который автоматически генерирует структурированные исследовательские отчеты по сложным проблемам с помощью искусственного интеллекта и веб-поиска. Пользователи вводят вопрос исследования, а инструмент разбивает его на части, ищет авторитетную информацию, оценивает достоверность источников...
1 год назад
086K
OPR:智能修复泛黄、破损老旧照片的AI工具

OPR: инструмент с искусственным интеллектом, который разумно восстанавливает пожелтевшие и изношенные старые фотографии

Bringing Old Photos Back to Life - это проект с открытым исходным кодом, разработанный группой исследователей Microsoft и направленный на восстановление старых фотографий с помощью технологий искусственного интеллекта. В его основе лежит подход глубокого обучения, который позволяет справляться с серьезными проблемами деградации фотографий, такими как царапины...
2 года назад
085.8K
Translation Agent WebUI:吴恩达翻译智能体界面版,提供多种翻译API和Gradio界面

Translation Agent WebUI: версия интерфейса Wu Enda Translation Intelligence Body, предоставляющая различные API для перевода и интерфейс Gradio.

Общее описание Translation Agent WebUI - это веб-интерфейс пользователя на базе Gradio, разработанный для переводчика-агента Andrewyng. Инструмент способен автоматически определять передачу...
2 года назад
085.7K
Inbox Zero:轻松实现收件箱零邮件,借助 AI 帮助你对邮件进行归类、过滤、处理。

Inbox Zero: легко добиться нулевого количества писем в папке "Входящие" с помощью искусственного интеллекта, который поможет вам классифицировать, фильтровать и обрабатывать письма.

Общее описание Inbox Zero - это приложение для управления электронной почтой с открытым исходным кодом, призванное помочь пользователям быстро достичь нулевого уровня входящих писем с помощью AI-ассистента. Приложение предлагает множество функций, включая автоответчик, архивирование, маркировку и пересылку писем, управление рассылками и отписку от них, блокировку холодных писем, следование...
2 года назад
085.6K
1-2-1-MNVTON:高效图像、视频中人物虚拟试穿服装(待开放)

1-2-1-MNVTON: Эффективные образы, виртуальная примерка одежды людьми на видео (будет открыто)

Общее введение 1-2-1-MNVTON - это основанный на GitHub проект с открытым исходным кодом, целью которого является предоставление технологии "Modality-specific Normalization for Virtual Try-On" (MNVTON) через...
2 года назад
085.5K
Deep Searcher:企业私有文档高效检索与智能问答

Deep Searcher: эффективный поиск частных документов предприятия и интеллектуальные вопросы и ответы

Общее описание Deep Searcher - это инструмент, объединяющий мощные большие языковые модели (такие как DeepSeek и OpenAI) и векторные базы данных (такие как Milvus), предназначенные для поиска, оценки и рассуждений на основе частных данных, предоставляя высокоточные ответы...
2 года назад
085.4K
OpenDeepResearcher:自动化深度研究工具,撰写完整的研究报告

OpenDeepResearcher: автоматизированный инструмент для написания полных исследовательских отчетов

Общее представление OpenDeepResearcher - это автоматизированный инструмент глубоких исследований с открытым исходным кодом, предназначенный для повышения эффективности исследований с помощью методов искусственного интеллекта. Проект разработан mshumer и размещен на GitHub.OpenDeepResear...
1 год назад
085.4K
文颜:一键美化Markdown文章,适配多个自媒体平台格式(开源本地客户端)

Wenyan: украшение статей в формате Markdown одним щелчком мыши, адаптация к форматам различных мультимедийных платформ (локальный клиент с открытым исходным кодом)

WenYan - это инструмент, предназначенный для набора и улучшения статей в формате Markdown, поддерживающий преобразование отредактированных статей в формате Markdown в формат, подходящий для WeChat, Zhihu, Today's headlines и других платформ. Пользователи могут скопировать статью одним щелчком мыши, статья напрямую...
2 года назад
085.4K
SmolDocling:小体积高效处理文档的视觉语言模型

SmolDocling: визуальная языковая модель для эффективной обработки документов небольшого объема

Всеобъемлющее введение SmolDocling - это визуальная модель языка (VLM), разработанная командой ds4sd в сотрудничестве с IBM, построенная на SmolVLM-256M и размещенная на платформе Hugging Face. Она имеет небольшой размер, всего ...
2 года назад
085.3K