Последние ресурсы по искусственному интеллекту

共 3143 篇文章
MediaCrawler:多社交媒体平台内容、视频评论爬虫工具

MediaCrawler: инструмент для поиска контента и комментариев к видео на платформах мультисоциальных медиа

Общее представление MediaCrawler - это инструмент для сбора контента социальных сетей, предназначенный для разработчиков. Благодаря мощному краулеру он может быстро захватывать видео, изображения, комментарии, лайки, ретвиты и другие данные с таких социальных платформ, как Xiaohongshu, Shake, Shutter, B, Weibo и других...
2 года назад
0104K
Pal Chat:支持多种AI模型的 IOS 聊天客户端

Pal Chat: клиент чата для IOS с поддержкой нескольких моделей искусственного интеллекта

Общее представление Pal Chat - это легкий, но многофункциональный клиент чата ИИ, разработанный для пользователей iPhone. Приложение поддерживает широкий спектр продвинутых моделей ИИ, включая GPT-4, Claude 3, DALL-E 3 и т.д. Пользователи могут легко переключаться и сравнивать не...
1 год назад
0103.9K
Seedream 4.0 - 字节推出的最新一代图像创作模型

Seedream 4.0 - последнее поколение моделей для создания изображений, выпущенное компанией Bytes

Seedream 4.0 - это передовой инструмент для создания и редактирования изображений, выпущенный компанией ByteDance, в центре внимания которого находится интеграция создания и редактирования, а также такие мощные функции, как точное редактирование команд, сохранение большого количества функций и глубокое понимание намерений.
11 месяцев назад
0103.9K
Unsloth:高效微调和训练大语言模型的开源工具

Unsloth: инструмент с открытым исходным кодом для эффективной тонкой настройки и обучения больших языковых моделей

Всеобъемлющее введение Unsloth - это проект с открытым исходным кодом, предназначенный для предоставления эффективных инструментов для тонкой настройки и обучения больших языковых моделей (LLM). Проект поддерживает множество известных моделей, включая Llama, Mistral, Phi и Gemma.Unsloth...
1 год назад
0103.8K
AsrTools:语音转字幕工具,内置剪映、快手、必剪接口的轻量客户端

AsrTools: инструмент преобразования речи в субтитры, легкий клиент со встроенными интерфейсами для Cutscene, Racer и Must-Cut

Всеобъемлющее введение AsrTools - это интеллектуальный инструмент преобразования речи в текст со встроенными интерфейсами от таких крупных игроков, как Cutscene, QuickScope, MustCut и т.д. Он не требует GPU или громоздкой конфигурации, а также поддерживает эффективную многопоточную пакетную обработку. Он основан на разработке PyQt5, имеет красивый и удобный интерфейс, способен выводить слова в форматах SRT и TXT...
2 года назад
0103.8K
InsightFace:图像面部交换功能与面部克隆

InsightFace: функция замены лиц на изображениях с клонированием лиц

InsightFace Comprehensive Введение InsightFace - это библиотека глубокого анализа лиц с открытым исходным кодом для 2D и 3D, которая предоставляет множество передовых алгоритмов распознавания, обнаружения и выравнивания лиц. Разработанная для эффективного обучения и развертывания, библиотека подходит как для исследовательских институтов, так и для промышленности.I...
2 года назад
0103.8K
AmyMind:一句话生成思维导图并导出多种格式

AmyMind: создание карт ума в одном предложении и экспорт в несколько форматов

Общее представление AmyMind - это бесплатный онлайн-инструмент, который помогает пользователям быстро создавать карты ума, используя технологию искусственного интеллекта. Он прост в использовании, не требует установки программного обеспечения и работает при открытии в браузере. Пользователи могут вводить текст или загружать файлы Markdown, PDF, Wor...
1 год назад
0103.8K
Libra:用对话生成本地AI智能体的客户端(内测)

Libra: клиент для генерации локальных ИИ-интеллектов с диалогом (внутреннее тестирование)

Общее представление Libra - это инновационный инструмент от Greenbit.ai, основной функцией которого является создание искусственного интеллекта, работающего локально через диалог на естественном языке. Называемый "Vibe Agent", он позволяет пользователям описывать свои потребности в простых терминах и быстро создавать...
1 год назад
0103.7K
AiNiee:专注AI翻译的多功能工具,一键翻译RPG游戏、Epub/TXT小说/Srt Lrc字幕

AiNiee: Многофункциональный инструмент, ориентированный на перевод AI, перевод в один клик RPG, Epub/TXT романов/Srt Lrc субтитров

Всеобъемлющее введение AiNiee - это инструмент для перевода, ориентированный на ИИ, который автоматически переводит игры RPG SLG, романы Epub TXT, субтитры Srt Lrc и многие другие форматы. Он поддерживает многоплатформенный доступ, включая OpenAI, Google, Anth...
2 года назад
0103.7K
CoCoClip.AI:自动生成社交媒体短视频的AI编辑工具

CoCoClip.AI: ИИ-инструмент для автоматического создания коротких видеороликов для социальных сетей

Общее представление CoCoClip.AI - это онлайн-инструмент искусственного интеллекта, ориентированный на создание видеоконтента для социальных сетей, призванный помочь пользователям быстро генерировать короткие видеоролики, подходящие для YouTube Shorts, TikTok и Instagram Reels...
1 год назад
0103.7K
Twin AI:生成数字孪生视频的AI工具

Twin AI: ИИ-инструмент для создания видеороликов о цифровых близнецах

Общее описание Twin AI - это простой и полезный инструмент, который поможет пользователям быстро превратить фотографии или видео в персонализированные видеоролики с искусственным интеллектом. Он был разработан компанией Alias Technologies и подходит для создателей контента, бизнес-пользователей или всех, кто хочет попробовать себя в создании AI-видео...
1 год назад
0103.6K
AIstudioProxyAPI:无限使用 Gemini 2.5 Pro 模型 API

AIstudioProxyAPI: неограниченное использование API моделей Gemini 2.5 Pro

Всеобъемлющее введение AIstudioProxyAPI - это проект с открытым исходным кодом, который использует Node.js и технологию Playwright для эмуляции API OpenAI, подражая веб-версии Google AI Studio...
1 год назад
0103.4K
Devin:自主完成软件开发任务的AI软件工程师,轻松完成复杂编程任务(付费)

Девин: инженер-программист с искусственным интеллектом, который автономно выполняет задачи по разработке программного обеспечения и с легкостью справляется со сложными задачами программирования (оплачивается)

Общее представление Devin AI - это передовой программный инженер искусственного интеллекта от компании Cognition, призванный революционизировать процесс разработки программного обеспечения. Devin AI - это не просто инструмент для создания кода, это программный инженер, понимающий сложные инструкции, автономно планирующий и выполняющий...
2 года назад
0103.4K
Whisper Input:利用Groq免费且高速的语音转录文本服务

Whisper Input: бесплатный и высокоскоростной сервис транскрипции голоса в текст с помощью Groq.

Общее описание Whisper Input - это инструмент транскрипции голоса с открытым исходным кодом, который позволяет пользователям начинать запись голоса нажатием кнопки Option и заканчивать запись поднятием кнопки. Инструмент вызывает Groq Whisper Large V3 Turbo ...
1 год назад
0103.4K
Dia:生成超现实多人对话的文本转语音模型

Dia: модель преобразования текста в речь для создания гиперреалистичных многопользовательских диалогов

Общее представление Dia - это модель преобразования текста в речь (TTS) с открытым исходным кодом, разработанная компанией Nari Labs и предназначенная для создания гиперреалистичных диалоговых аудио. Она преобразует текстовые сценарии в реалистичные многосимвольные диалоги за один процесс, поддерживает управление эмоциями и интонациями и даже генерирует невербальные представления...
1 год назад
0103.3K
AI Studios:文档快速生成多语言真人讲解视频

AI Studios: документация для быстрого создания многоязычных видеороликов живого действия

Общее представление AI Studios - это онлайн-платформа для создания видео с помощью искусственного интеллекта, разработанная компанией DeepBrain AI и призванная помочь пользователям быстро создавать высококачественный видеоконтент, просто вводя текст. Не требуя сложного программного обеспечения или специальных навыков, пользователи могут использовать свой ИИ...
1 год назад
0103.3K
Tifa-DeepsexV2-7b-MGRPO:支持角色扮演和复杂对话的模型,性能超越32b(附一键安装包)

Tifa-DeepsexV2-7b-MGRPO: модель, поддерживающая ролевые игры и сложные диалоги, с производительностью выше 32b (с пакетом установки в один клик)

Всеобъемлющее введение Tifa-DeepsexV2-7b-MGRPO-GGUF-Q4 - это эффективная языковая модель, разработанная для поддержки сложных ролевых игр и многораундовых диалогов. Глубоко оптимизированная на основе Qwen 2.5-7B, она обладает отличной генерацией текста и диалогов...
1 год назад
0103.3K
Fabric:集成众多提示词的AI开源工作流框架,高效处理各种事务

Fabric: фреймворк рабочего процесса с открытым исходным кодом для ИИ, объединяющий множество слов-ключей для эффективной обработки различных операций.

Общее представление Fabric - это фреймворк искусственного интеллекта с открытым исходным кодом, разработанный Даниэлем Мисслером для упрощения и автоматизации повседневных компьютерных задач и облегчения использования искусственного интеллекта. Он эффективно помогает пользователям благодаря модульной конструкции и заранее заданным словам-подсказкам (Patterns)...
2 года назад
0103.2K
通义万相:AI创意作画|文生图|图生图|虚拟模特|个人写真|涂鸦作画

Tongyiwanxiang: AI Creative Painting|Text-to-Picture|Tu-to-Picture|Virtual Model|Personal Portrait|Doodle Painting

Всеобъемлющее введение Tongyi Wanxiang - это платформа для творческой живописи AI под управлением Aliyun, предоставляющая различные функции создания искусства AI. Пользователи могут творить различными способами, такими как текст для создания изображений, изображение для создания изображений, рисование граффити, виртуальные модели и персональные портреты. Платформа основана на самостоятельно разработанной комбинации Composer для генерации...
2 года назад
0103.1K
Kolors Virtual Try On:高效的虚拟试穿/模特换装,文本到图像生成模型

Виртуальная примерка Kolors: эффективная виртуальная примерка/одевание моделей, генерация моделей из текста в изображение

Общее представление Kolors Virtual Try-On - это приложение для виртуальной примерки от команды Kwai-Kolors на платформе Hugging Face. Приложение использует передовую технологию искусственного интеллекта, чтобы помочь пользователям примерить виртуальные...
2 года назад
0103.1K
Guidemaker:一键录制浏览器操作生成操作指南的免费AI工具

Guidemaker: бесплатный инструмент искусственного интеллекта для записи действий браузера и создания руководств одним щелчком мыши

Общее представление Guidemaker - это бесплатное расширение для Chrome, которое использует технологию искусственного интеллекта, чтобы помочь пользователям записывать компьютерные операции одним щелчком мыши, автоматически генерируя руководства и стандартные операционные процедуры (СОПы) со скриншотами. Оно было разработано компанией Tettra для упрощения обучения команды...
1 год назад
0102.9K
Deepgram:高精度语音识别和合成解决方案服务API

Deepgram: сервисный API для решений по высокоточному распознаванию и синтезу речи

Общее описание Deepgram - компания, специализирующаяся на технологиях распознавания речи и обработки естественного языка, предлагающая мощные API Speech-to-Text и Text-to-Speech.Платформа использует передовой искусственный интеллект...
1 год назад
0102.9K
Sonic:音频驱动肖像图片生成面部表情生动的数字人口播视频

Sonic: портретные изображения с аудиоуправлением создают цифровые демонстрационные видеоролики с яркой мимикой

Общее представление Sonic - это инновационная платформа, ориентированная на глобальное восприятие звука и предназначенная для создания ярких портретных анимаций, управляемых звуком. Разработанная группой исследователей из Tencent и Чжэцзянского университета, платформа использует аудиоинформацию для управления мимикой и движениями головы, чтобы генерировать естественные и плавные анимационные видеоролики.S...
1 год назад
0102.9K
BizyAir:在本地运行ComfyUI云节点的插件,依赖硅基流动免费API

BizyAir: плагин для локального запуска облачных узлов ComfyUI, опирается на бесплатные API Silicon Mobility

Общее представление BizyAir - это коллекция узлов ComfyUI, созданная для того, чтобы помочь пользователям преодолеть ограничения окружающей среды и оборудования и легко создавать высококачественный контент. Он поддерживает широкий спектр моделей и узлов, включая Stable Diffusion 3.5, ControlN...
2 года назад
0102.8K
LiblibAI·哩布哩布:在线免费使用Stable Diffusion,每日免费生成200张图片

LiblibAI - Mile High: используйте Stable Diffusion онлайн бесплатно, генерируйте 200 изображений в день бесплатно!

LiblibAI Общее введение LiblibAI - это ведущая платформа для создания изображений ИИ в Китае с огромным количеством инструментов и ресурсов для создания ИИ. Пользователи могут найти на этой платформе более 100 000 бесплатных моделей создания ИИ для изображений, текстов, аудио и других материалов...
2 года назад
0102.8K
紫东太初:多模态大模型平台,支持文本创作、图像生成、3D理解、信号分析等任务

Zidong Taichu: мультимодальная платформа больших моделей для поддержки таких задач, как создание текстов, создание изображений, 3D-понимание и анализ сигналов

Всеобъемлющее введение Zidong Taichu - это мультимодальная платформа нового поколения, созданная Институтом автоматизации Китайской академии наук и Уханьским институтом искусственного интеллекта. Платформа поддерживает множество задач, таких как многораундовые вопросы и ответы, создание текстов, генерация изображений, 3D-понимание и анализ сигналов, с мощными возможностями познания, понимания и создания. Zidong ...
2 года назад
0102.7K
World Labs:一张图片构建3D世界模型,申请“空间智能”模型内测资格

World Labs: постройте 3D-модель мира из одного изображения, подайте заявку на участие в бета-тестировании модели пространственного интеллекта!

Общее представление World Labs - компания, работающая в области искусственного интеллекта и создающая большие модели мира (LWM) для восприятия, создания и взаимодействия с 3D-мирами. Основана всемирно известным пионером ИИ-технологий Фей Фей Ли...
2 года назад
0102.7K
ReadKidz:创建角色一致的儿童故事绘本,丰富的绘本风格模板(付费)

ReadKidz: создание детских книжек-картинок, соответствующих персонажам, богатые шаблоны в стиле книжек-картинок (платно)

Общие сведения ReadKidz - это инновационная платформа, использующая технологию искусственного интеллекта, чтобы помочь пользователям создавать персонализированные детские сборники рассказов и анимации. Если вы родитель, учитель или начинающий автор, создающий детские книги, ReadKidz позволяет легко генерировать высококачественный сюжетный контент...
2 года назад
0102.6K
PhotoPrism:AI 驱动的去中心化照片管理应用,轻松管理和查找照片

PhotoPrism: децентрализованное приложение для управления фотографиями на основе искусственного интеллекта, позволяющее легко управлять и находить фотографии

Общее описание PhotoPrism - это приложение для управления фотографиями с открытым исходным кодом на основе искусственного интеллекта, предназначенное для предоставления пользователям децентрализованного решения для хранения и управления фотографиями. Оно использует новейшие технологии для автоматического тегирования и поиска изображений и поддерживает работу дома, на частных серверах или в облаке.Pho...
2 года назад
0102.6K
RD-Agent:自动化数据驱动研发工具,通过AI技术推动以数据为导向的研发过程

RD-Agent: автоматизированный инструмент для проведения НИОКР на основе данных, который облегчает процессы НИОКР на основе данных с помощью технологии искусственного интеллекта.

Общее представление RD-Agent - это инструмент с открытым исходным кодом от Microsoft, предназначенный для автоматизации и оптимизации процесса исследований и разработок (R&D). Инструмент ориентирован на сценарии, основанные на данных, для повышения эффективности разработки моделей и данных с помощью методов искусственного интеллекта.RD-Agent объединяет исследовательские...
1 год назад
0102.6K
LHM:从单张图片生成支持动作的3D人体模型

LHM: генерация 3D-моделей человека с учетом движения на основе одного изображения

Всеобъемлющее введение LHM (Large Animatable Human Reconstruction Model) - это проект с открытым исходным кодом, разработанный командой aigc3d для быстрой генерации поддерживающей действия 3D-модели человека из одного изображения. Основные характеристики ...
1 год назад
0102.6K
Llasa 1~8B:高品质语音生成和克隆的开源文本转语音模型

Llasa 1~8B: модель преобразования текста в речь с открытым исходным кодом для генерации и клонирования речи высокого качества

Общие сведения Введение Llasa-3B - это модель преобразования текста в речь (TTS) с открытым исходным кодом, разработанная аудиолабораторией Гонконгского университета науки и технологий (HKUST Audio). Модель основана на архитектуре Llama 3.2B, которая была тщательно настроена для обеспечения высококачественной генерации речи, которая не только поддерживает множество...
1 год назад
0102.5K
TimesFM 2.0:谷歌开源进行时间序列预测的预训练模型

TimesFM 2.0: Google выкладывает в открытый доступ предварительно обученную модель для прогнозирования временных рядов

Общее представление TimesFM 2.0 - 500M PyTorch - это предварительно обученная базовая модель временных рядов, разработанная Google Research и предназначенная для прогнозирования временных рядов. Модель способна обрабатывать до 2048 временных точек вверх и вниз...
2 года назад
0102.5K
3D AI Studio:智能3D模型生成平台

3D AI Studio: интеллектуальная платформа для создания 3D-моделей

3D AI Studio - это продвинутый инструмент искусственного интеллекта, предназначенный для дизайнеров, разработчиков и творческих профессионалов. Он использует технологию искусственного интеллекта для быстрого преобразования текстовых описаний или 2D-изображений в высококачественные 3D-модели, значительно упрощая процесс 3D-моделирования. Платформа предлагает широкий спектр возможностей, включая...
2 года назад
0102.5K
Gemini Teacher:英语口语发音纠正助手

Gemini Teacher: Помощник по коррекции произношения в английском языке

Общее представление Gemini Teacher - это помощник для практики английского языка, основанный на искусственном интеллекте Google Gemini. Он распознает английское произношение пользователя в режиме реального времени и предоставляет мгновенную обратную связь и предложения по исправлению. Инструмент разработан, чтобы помочь пользователям улучшить свои навыки разговорного английского языка через...
2 года назад
0102.5K
DUIX:实时互动的智能数字人,支持多平台一键部署

DUIX: интеллектуальные цифровые люди для взаимодействия в реальном времени, поддерживающие многоплатформенное развертывание в один клик

Общее представление DUIX (Dialogue User Interface System) - это платформа цифрового взаимодействия с человеком на базе искусственного интеллекта, созданная компанией Silicon Intelligence. Благодаря возможностям цифрового взаимодействия с человеком с открытым исходным кодом разработчики могут легко интегрировать крупномасштабные модели, автоматическое распознавание речи (ASR...
2 года назад
0102.5K
Bannerbear:自动生成社交媒体图片和电商横幅的工具

Bannerbear: инструмент для автоматической генерации изображений в социальных сетях и баннеров для электронной коммерции

Общее представление Bannerbear - это онлайн-инструмент, который помогает пользователям автоматизировать создание изображений и видео. Он позволяет пользователям быстро создавать изображения для социальных сетей, баннеры для электронной коммерции и динамические изображения для электронной почты с помощью простого интерфейса API. Основная функция сайта - превращение шаблонов дизайна в автоматически настраиваемые...
1 год назад
0102.5K
Zencoder:深度理解代码库的智能辅助编程工具

Zencoder: инструмент интеллектуального программирования для глубокого понимания кодовой базы

Общее представление Zencoder - это платформа программирования с искусственным интеллектом для разработчиков, которая призвана повысить эффективность разработки программного обеспечения за счет интеллектуального подхода. Она использует передовые технологии искусственного интеллекта, чтобы помочь разработчикам быстро генерировать код, исправлять проблемы, писать тестовые примеры и получать глубокое понимание кодовой базы проекта.Zenco...
1 год назад
0102.5K
AI投资系统:自动化A股投资决策系统,利用多智能体系统分析市场数据

Инвестиционная система AI: автоматизированная система принятия инвестиционных решений по акциям A, использующая мультиинтеллектуальную систему для анализа рыночных данных

Всеобъемлющее введение A_Share_investment_Agent - это помощник в принятии инвестиционных решений на основе мультиинтеллектуальной системы. Система предназначена для анализа рыночных данных, расчета внутренней стоимости акций, анализа настроений на рынке и фундаментальных данных с помощью нескольких совместных интеллектов, чтобы...
2 года назад
0102.5K
MD2Card:将Markdown文档转为精美图片

MD2Card: превратите документы Markdown в красивые картинки!

Общее описание MD2Card - это бесплатный онлайн-инструмент, предназначенный для преобразования документов Markdown в красивые карточки знаний. С его помощью пользователи могут быстро организовать учебные заметки, точки знаний или создать контент для социальных сетей. Сайт прост в использовании, не требует входа в систему и поддерживает различные темы...
1 год назад
0102.5K
Qwen-Agent:基于Qwen的智能代理应用框架,包括工具调用、代码解释器、RAG和Chrome扩展。

Qwen-Agent: основанный на Qwen фреймворк для приложений интеллектуальных агентов, включающий вызовы инструментов, интерпретаторы кода, RAG и расширения для Chrome.

Всеобъемлющее введение Qwen-Agent - это фреймворк интеллектуальных агентских приложений, разработанный на основе Qwen 2.0 и выше, с такими возможностями, как выполнение команд, использование инструментов, планирование и память. Фреймворк предоставляет множество примеров приложений, таких как браузерные помощники, интерпретаторы кода и пользовательские помощники...
2 года назад
0102.4K
CFG-Zero-star:提升图像和视频生成质量的开源工具

CFG-Zero-star: инструмент с открытым исходным кодом для улучшения качества генерации изображений и видео

Всеобъемлющее введение CFG-Zero-star - это проект с открытым исходным кодом, разработанный Вейчен Фаном и командой S-Lab в Наньянгском технологическом университете. Он направлен на улучшение техники Classifier Free Guidance (CFG) в моделях потокового сопоставления путем оптимизации стратегии наведения и нулевого инициального ...
1 год назад
0102.4K
SoundLabs AI:实时将人声转换为任意音色或音效的创作工具

SoundLabs AI: творческий инструмент для преобразования вокала в любой тембр или звуковой эффект в режиме реального времени

Общее представление SoundLabs AI - технологическая компания, стремящаяся к революции в создании музыки, и ее основной продукт, MicDrop, - это мощный плагин искусственного интеллекта, который в реальном времени превращает ваш голос в любой тембр или эффект инструмента. Просто интегрируйте его в свою цифровую аудиосистему...
1 год назад
0102.4K
Motia:用代码快速构建智能体的开发框架

Motia: система разработки для быстрого создания интеллекта в коде

Общее представление Motia - это фреймворк ИИ-агентов с открытым исходным кодом для инженеров-программистов, размещенный на GitHub и разработанный командой MotiaDev. Он позволяет разработчикам использовать знакомые языки программирования (например, Python, TypeScript, Rub...
1 год назад
0102.3K
MTEB:评估文本嵌入模型性能的基准测试

MTEB: бенчмаркинг для оценки эффективности моделей встраивания текста

Общие сведения Введение MTEB (Massive Text Embedding Benchmark) - это проект с открытым исходным кодом, разработанный командой embeddings-benchmark и размещенный на GitHub, цель которого - предоставить модели встраивания текста...
1 год назад
0102.2K
MangaNinjia:自动化线稿上色工具,为动漫黑白线稿快速填色

MangaNinjia: автоматизированный инструмент для быстрого раскрашивания черно-белых линейных рисунков аниме.

Введение MangaNinjia - это проект с открытым исходным кодом, разработанный Alibaba Tongyi Visual Intelligence Lab (Ali-Vilab) и направленный на автоматизированную обработку раскраски линейных рисунков. Этот инструмент обеспечивает точное цветовое соответствие эталонных изображений с помощью методов глубокого обучения, значительно улучшая...
2 года назад
0102.2K
OuteTTS:实验性文本转语音模型,使用纯语言建模方法实现的TTS

OuteTTS: экспериментальная модель преобразования текста в речь, TTS, реализованная с использованием подхода чистого языкового моделирования

Всеобъемлющее введение OuteTTS - это экспериментальная модель преобразования текста в речь (TTS), которая использует подход чистого языкового моделирования для генерации высококачественной речи. В отличие от традиционных систем TTS, OuteTTS не требует внешних адаптеров или сложных архитектур. Модель основана на архитектуре LLaMa...
1 год назад
0102.2K
Adobe Firefly(萤火虫):图像生成式AI套件|免费使用萤火虫图片编辑工具

Adobe Firefly: Image Builder AI Suite | Бесплатные инструменты для редактирования фотографий Firefly

Общее представление Adobe Firefly - это продукт Adobe Creative Cloud, генеративная модель машинного обучения для использования в сфере дизайна, которая в настоящее время находится в стадии публичной бета-версии.Adobe Firefly использует Adobe...
2 года назад
0102.2K
DiffRhythm(谛韵):10秒内生成最长4分45秒的歌曲

DiffRhythm: генерируйте песни длительностью до 4 минут 45 секунд за 10 секунд.

Общее представление DiffRhythm - это проект с открытым исходным кодом, разработанный ASLP-lab (Группа обработки аудио, речи и языка, Северо-Западный политехнический университет) и направленный на сквозное создание музыки с помощью методов искусственного интеллекта. Он основан на латентной диффу...
1 год назад
0102.2K
Spark-TTS:生成自然语音的文本转语音工具

Spark-TTS: инструмент преобразования текста в речь для генерации естественной речи

Общее представление Spark-TTS - это инструмент преобразования текста в речь (TTS) с открытым исходным кодом, разработанный командой SparkAudio и размещенный на GitHub, призванный помочь пользователям эффективно преобразовывать текст в естественную и плавную речь...
1 год назад
0102.2K
OctoComics:用AI快速生成BL漫画的创作平台

OctoComics: платформа для быстрого создания комиксов BL с помощью искусственного интеллекта

Общее введение OctoComics - это онлайн-платформа, которая фокусируется на помощи пользователям в быстром создании BL-комиксов с помощью искусственного интеллекта, одновременно поддерживая другие типы комиксов и обмен мнениями в сообществе. Пользователи могут вводить текст для создания комиксов на тему BL, оригинальных серий или OC-персонажей с различными стилями рисования...
1 год назад
0102.1K
VLM-R1:通过自然语言定位图像目标的视觉语言模型

VLM-R1: модель визуального языка для определения местоположения целей изображения с помощью естественного языка

Всеобъемлющее введение VLM-R1 - это проект визуального моделирования языка с открытым исходным кодом, разработанный Om AI Lab и размещенный на GitHub. Проект основан на подходе R1 компании DeepSeek, объединенном с моделью Qwen2.5-VL, с помощью обучения с подкреплением...
1 год назад
0102.1K
MagicQuill:智能交互式图像涂鸦编辑系统,精准局部涂鸦编辑

MagicQuill: интеллектуальная интерактивная система редактирования граффити, точное локальное редактирование граффити

Общее представление MagicQuill - это интерактивный инструмент для редактирования изображений с открытым исходным кодом, созданный совместно Гонконгским университетом науки и технологий (HKUST), Ant Group, Чжэцзянским университетом и Университетом Гонконга. Инструмент разработан для точного локального редактирования изображений интеллектуальным и интерактивным способом.MagicQuill...
2 года назад
0102.1K
Perfect Corp:提供虚拟试妆与美妆科技的AR和AI工具

Perfect Corp: AR и AI инструменты для виртуальных пробных макияжей и бьюти-технологий

Общее представление Perfect Corp - технологическая компания, специализирующаяся на секторе красоты и моды. Она предлагает виртуальные пробные макияжи, анализ кожи и подбор прически с помощью технологий искусственного интеллекта (ИИ) и дополненной реальности (AR). Основные продукты компании включают серию приложений YouCam...
1 год назад
0102K
Agent TARS:使用视觉和命令操作电脑的开源智能体

Агент TARS: интеллектуальная система с открытым исходным кодом, использующая зрение и команды для управления компьютерами

Всеобъемлющее введение Агент TARS - это мультимодальный искусственный интеллект с открытым исходным кодом от ByteDance, основные функции которого помогают пользователям выполнять сложные компьютерные задачи путем визуального понимания веб-контента и комбинирования операций командной строки и файловой системы. Вместо того чтобы требовать ручных операций, как это делают традиционные инструменты, он может самостоятельно...
1 год назад
0101.9K
混元文生视频:生成写实镜头感的高质量视频,腾讯开源视频生成大模型

Гибридное видео Vincennes: генерация реалистичных кадров высококачественного видео, Tencent с открытым исходным кодом для генерации видео больших моделей

Всеобъемлющее введение Tencent Mixed Yuan Text Generation Video (доступно в Yuanbao APP) - это платформа для создания видео на основе технологии искусственного интеллекта, запущенная компанией Tencent. Платформа использует гибридную большую модель Tencent с мощными междоменными знаниями и пониманием естественного языка и способна генерировать высококачественные видео на основе текстовых описаний пользователей...
2 года назад
0101.9K
InvSR:开源图像超分辨率项目,提升图像分辨率质量

InvSR: проект суперразрешения изображений с открытым исходным кодом для улучшения качества разрешения изображений

Общее представление InvSR - это инновационный проект с открытым исходным кодом по сверхразрешению изображений, основанный на методах диффузионной инверсии, способных преобразовывать изображения низкого разрешения в высококачественные изображения высокого разрешения. Проект использует богатые предварительные знания об изображениях, заложенные в предварительно обученных крупномасштабных диффузионных моделях, и, благодаря гибкому механизму выборки, поддерживает...
2 года назад
0101.8K
Gauth(Gauthmath):使用AI解决作业问题,提供详细解答,字节旗下海外作业辅导APP

Gauth (Gauthmath): использует искусственный интеллект для решения домашних заданий и предоставления подробных ответов, зарубежное приложение Byte для помощи в выполнении домашних заданий

Общее представление Gauth (ранее известный как Gauthmath) - это сайт-помощник по выполнению домашних заданий с искусственным интеллектом, предназначенный для студентов. Он использует передовые технологии искусственного интеллекта и команду профессиональных репетиторов для предоставления услуг по выполнению домашних заданий по различным предметам, от математики до химии. Пользователи могут загрузить изображение или ввести вопрос, чтобы быстро получить...
1 год назад
0101.8K
Draw A Fish - 免费的在线AI画鱼网站,共享虚拟鱼缸

Draw A Fish - бесплатный онлайн сайт рисования рыбы AI с общими виртуальными аквариумами

Draw A Fish - это простой и веселый сайт для рисования рыбок AI, где пользователи могут рисовать рыбок, которые будут помещены в общий виртуальный аквариум. Draw A Fish не требует регистрации, прост в использовании и занимает всего несколько секунд, чтобы создать и поделиться.
11 месяцев назад
0101.7K
EmemeAI:创建并导出3D虚拟AI角色的互动平台

EmemeAI: интерактивная платформа для создания и экспорта 3D-персонажей виртуального ИИ

Общее представление EmemeAI - это платформа, которая помогает пользователям создавать 3D AI-персонажей. Вы можете загружать 3D-модели в формате VRM, настраивать личность персонажа и генерировать виртуальных героев, которые могут общаться и двигаться автоматически. Эти персонажи могут не только разговаривать с вами, но и генерировать выражения и действия в зависимости от контекста.E...
1 год назад
0101.7K
Topaz Labs Starlight:首个基于diffusion的视频质量增强模型

Topaz Labs Starlight: первая модель улучшения качества видео на основе диффузии

Общее представление Topaz Labs Starlight - это инновационный инструмент для улучшения видео от Topaz Labs, предназначенный для восстановления и оптимизации старых, низкого разрешения или поврежденных видео с помощью технологии искусственного интеллекта. Это первый инструмент, использующий модель диффузии (D...
1 год назад
0101.7K
Scira(MiniPerplx):模仿Perplexity的开源项目,集成AI对话、网页搜索、天气查询等功能

Scira (MiniPerplx): проект с открытым исходным кодом, который имитирует Perplexity, интегрируя диалог ИИ, веб-поиск, запрос погоды и т.д.

Общее представление MiniPerplx (переименованный в Scira) - это минималистичная поисковая система, управляемая искусственным интеллектом, которая объединяет в себе множество полезных функций, чтобы предоставить пользователям полный спектр услуг по поиску информации. Проект использует современный стек технологий, включающий Next.js, Tailwi...
2 года назад
0101.7K
SadTalker:让照片说话|嘴型同步音频|合成口型同步视频|免费数字人

SadTalker: Заставьте фотографии говорить | Синхронизация рта аудио | Синтезированное видео синхронизации рта | Бесплатные цифровые люди

Общее представление SadTalker - это инструмент с открытым исходным кодом, который объединяет одну портретную фотографию с аудиофайлом для создания реалистичных говорящих видео аватаров для широкого спектра сценариев, таких как персонализированные сообщения, образовательный контент и многое другое. Революционное использование технологий 3D-моделирования, таких как ExpNet и PoseVA...
1 год назад
0101.6K
Clone Voice:支持多语言的少样本声音克隆工具,基于xtts_v2提供Windows一键安装包

Clone Voice: Многоязычный инструмент для клонирования голоса без сэмплов на основе xtts_v2 для Windows.

Общее описание Clone Voice - это инструмент клонирования звука с открытым исходным кодом, который предоставляет веб-интерфейс, позволяющий пользователям клонировать голоса, используя любой звук или личную запись голоса. Инструмент прост в использовании, даже без NVIDIA GPU, и может быть использован с предварительно скомпилированным приложением...
2 года назад
0101.6K
codemcp:Claude Desktop专用的编码助手MCP

codemcp: ассистент кодирования MCP для Claude Desktop

Общее представление codemcp - это инструмент с открытым исходным кодом для пользователей Claude Desktop, разработанный Эдвардом З. Янгом на GitHub. Он делает Claude Desktop полезным...
1 год назад
0101.5K
OpenWebUI-Monitor:监控OpenWebUI用户活动,管理使用限额,支持一键部署。

OpenWebUI-Monitor: мониторинг действий пользователей OpenWebUI, управление лимитами использования, поддержка развертывания одним щелчком мыши.

Общее представление OpenWebUI-Monitor - это приборная панель для мониторинга деятельности пользователей OpenWebUI и управления квотами использования. Она позволяет эффективно устанавливать пользовательские квоты, просматривать пользовательские данные и визуальную информацию в режиме реального времени, поддерживает развертывание одним щелчком мыши, а также облегчает управление пользователями и мониторинг...
2 года назад
0101.5K
Invideo AI:AI生成长视频工具|专业视频制作编辑平台

Invideo AI: видеоинструмент, созданный и выращенный искусственным интеллектом | профессиональная платформа для производства и редактирования видео

Invideo AI Общее представление InVideo - это онлайн-платформа для редактирования видео, разработанная для упрощения процесса создания видео. Независимо от того, новичок ли вы в видеопроизводстве или профессионал, InVideo поможет вам быстро создавать высококачественные видеоролики. Платформа предлагает более 5 000...
2 года назад
0101.5K
Cloud Studio:云端 IDE,编写和运行各类依赖GPU的AI应用,每月免费50000小时GPU

Cloud Studio: облачная среда разработки для создания и запуска всех видов приложений ИИ, зависящих от GPU, 50 000 бесплатных часов работы на GPU в месяц.

Всеобъемлющее введение Cloud Studio - это браузерная интегрированная среда разработки (IDE), запущенная компанией Tencent Cloud с целью предоставить разработчикам стабильную и эффективную облачную рабочую станцию. Пользователям не нужно скачивать и устанавливать какое-либо программное обеспечение, достаточно открыть браузер для программирования.Cloud ...
2 года назад
0101.3K
绘影字幕(Zeemo):短视频自动生成多语言字幕和翻译

Zeemo: автоматическое создание многоязычных субтитров и переводов для коротких видеороликов

Zeemo от Blue Pulse - это генератор субтитров для видео, основанный на искусственном интеллекте и нацеленный на создание эффективных многоязычных субтитров для создателей видео. Zeemo автоматически распознает речь на 95 языках и генерирует субтитры, которые могут быть переведены на...
1 год назад
0101.3K
Civitai:AI绘图|开源图像生成模型分享社区|Civitai模型下载

Civitai: AI Drawing|Open Source Image Generation Model Sharing Community|Civitai Model Download

Общее введение Civitai - это платформа генеративного ИИ с открытым исходным кодом, в основе которой лежат модели стабильной диффузии. Платформа позволяет пользователям изучать высококачественные модели, делиться произведениями искусства, сгенерированными ИИ, и взаимодействовать с сообществом создателей. С помощью платформы пользователи могут загружать...
2 года назад
0101.3K
Humva:一张照片免费生成个性化数字人/数字分身视频

Humva: бесплатное персональное видео цифрового человека/цифрового двойника, созданное на основе одной фотографии

Общее представление Humva - это инновационный инструмент для создания видео с искусственным интеллектом, предназначенный для создания профессиональных или индивидуальных цифровых видеороликов, предоставляя удобное для пользователя решение. Платформа использует генеративный искусственный интеллект и передовую технологию синхронизации губ для создания бесплатного индивидуального контента для социальных сетей, презентаций продуктов, отзывов клиентов и многого другого...
1 год назад
0101.3K
Voice-Pro:开源多功能视频翻译工具,语音转录并翻译为多语言,Windows一键安装

Voice-Pro: многофункциональный инструмент для перевода видео с открытым исходным кодом, транскрипция и перевод голоса на множество языков, установка Windows одним щелчком мыши

Общее представление Voice-Pro - это универсальный инструмент на базе Gradio WebUI, который поддерживает преобразование речи в текст, текст в речь, перевод в реальном времени, загрузку видео с YouTube и разделение человеческого голоса. В него интегрированы технологии Whisper, Faster-Wh...
2 года назад
0101.3K
Screenshot to Code:将截图转换为干净前端代码的AI工具

Screenshot to Code: AI-инструмент для преобразования скриншотов в чистый внешний код

Общее представление Screenshot-to-Code - это инструмент с открытым исходным кодом, который использует искусственный интеллект для преобразования скриншотов, черновиков дизайна и проектов Figma в чистый, функциональный код. Инструмент поддерживает множество стеков фронтенд-технологий, включая HTML, Tailwind CS...
2 года назад
0101.2K
Playground:免费使用的全功能AI绘画、图像编辑平台

Playground: бесплатная полнофункциональная платформа для рисования и редактирования изображений с искусственным интеллектом

Playground Общее представление Playground - это бесплатная платформа для рисования и редактирования AI, которая предоставляет онлайн-доступ к моделям стабильной диффузии. Пользователи могут генерировать изображения с простыми дескрипторами или загружать изображения для вторичного...
1 год назад
0101.2K
BlinkShot:输入提示词实时生成图像(免费接入Flux Schnell模型)

BlinkShot: создание изображений в режиме реального времени путем ввода слов подсказки (бесплатный доступ к модели Flux Schnell)

Общее описание BlinkShot - это генератор изображений с открытым исходным кодом, работающий в режиме реального времени и использующий технологию Together AI и Flux Schnell, чтобы позволить пользователям генерировать высококачественные изображения по мере ввода подсказок. Платформа полностью бесплатна, поддерживает пользовательскую настройку и вторичные открытые...
2 года назад
0101.2K
multi-model-bolt.new:基于 Bolt.new 的开源修改版,AI驱动的全栈开发工具

multi-model-bolt.new: модификация с открытым исходным кодом, основанная на Bolt.new, управляемом искусственным интеллектом инструменте разработки полного стека

Общее описание multi-model-bolt.new - это модифицированная версия Bolt.new, которая позволяет использовать модели TogetherAI, поддерживая такие функции, как развертывание, мобильный ответ и голосовой ввод. Пользователи могут получать запросы непосредственно в браузере, запускать...
2 года назад
0101.2K
AI-Pro:集成多种AI工具与学习资源的平台

AI-Pro: платформа, объединяющая множество инструментов искусственного интеллекта и обучающих ресурсов.

Общее представление AI-Pro.org - это сайт, ориентированный на ИИ и предоставляющий пользователям широкий спектр инструментов и обучающих ресурсов. Цель сайта - помочь новичкам и профессионалам освоить методы ИИ, охватывающие такие функции, как генерация текста, создание изображений, чат-боты и многое другое. Пользователи могут пройти...
1 год назад
0101.1K
One Shot LoRA:快速生成视频 LoRA 模型的全能平台

One Shot LoRA: универсальная платформа для быстрого создания видеомоделей LoRA

Общее представление One Shot LoRA - это платформа, ориентированная на создание высококачественных видео LoRA-моделей из видео. Пользователи могут быстро и легко обучать бутиковые модели LoRA на основе видео, не регистрируясь и не сохраняя приватные данные. Платформа поддерживает Hunyua...
1 год назад
0101.1K
TryChatGPT:免费使用的俄语版ChatGPT

TryChatGPT: бесплатная русская версия ChatGPT

Общее представление TryChatGPT - это инструмент онлайн-чата с русским языком в качестве основного интерфейса, основанный на технологии OpenAI ChatGPT, предоставляющий бесплатный опыт диалога с искусственным интеллектом для русскоязычных пользователей. Сайт имеет простой дизайн, пользователям не нужно регистрироваться или устанавливать программное обеспечение для входа в...
1 год назад
0101K
Junie:在IDE中自动完成编程任务的智能助手

Junie: интеллектуальный помощник, автоматизирующий задачи программирования в IDE

Общее представление Junie - это интеллектуальный помощник программирования от компании JetBrains, предназначенный для разработчиков. Он интегрируется с платными версиями IDE от JetBrains, такими как IntelliJ IDEA Ultimate, PyCharm ...
1 год назад
0101K
Emigo:在Emacs中使用AI完成复杂编程任务的助手

Emigo: помощник для решения сложных задач программирования с использованием искусственного интеллекта в Emacs

Общее представление Emigo - это ассистент программирования с открытым исходным кодом, созданный для Emacs, разработанный MatthewZMD на GitHub. Он помогает программистам выполнять анализ кода в Emacs, интегрируя крупномасштабную языковую модель (LLM)...
1 год назад
0101K
MiMo:高效数学推理与代码生成的小型开源模型

MiMo: небольшая модель с открытым исходным кодом для эффективных математических рассуждений и генерации кода

Общее представление MiMo - это проект моделирования больших языков с открытым исходным кодом, разработанный компанией Xiaomi и сфокусированный на математических рассуждениях и генерации кода. Основным продуктом является семейство моделей MiMo-7B, которое содержит базовую модель (Base), модель тонкой настройки под наблюдением (SFT), сильную химическую модель, обученную на основе базовой модели...
1 год назад
0101K
PRD to test case:将产品需求文档转化为测试用例的AI工具

PRD в тестовый пример: инструмент искусственного интеллекта для преобразования документов с требованиями к продукту в тестовые примеры

Общее представление Quash (https://quashbugs.com/generate-tests) - это платформа на основе искусственного интеллекта, ориентированная на создание тестовых примеров, призванная помочь разработчикам и командам QA быстро превратить документы с требованиями к продукту (PRD) в подробные...
1 год назад
0101K
SemHash:快速实现语义文本去重,提升数据清理效率

SemHash: быстрая реализация семантической дедупликации текста для повышения эффективности очистки данных

Всеобъемлющее введение SemHash - это легкий и гибкий инструмент для дедупликации наборов данных по семантическому сходству. Он сочетает в себе быструю генерацию вкраплений Model2Vec и эффективный поиск сходства ANN (приближенный ближайший сосед) Vicinity.SemHa...
2 года назад
0101K
ChatWiki:轻量级开源企业知识库AI问答系统

ChatWiki: легкая корпоративная база знаний с открытым исходным кодом и системой вопросов и ответов AI

Всеобъемлющее введение ChatWiki - это система вопросов и ответов ИИ с открытым исходным кодом, официально запущенная компанией Sesame Small Customer Service, построенная на основе больших языковых моделей (LLM) и технологии Retrieval Augmented Generation (RAG). Она предоставляет готовые возможности обработки данных и вызова моделей, помогая предприятиям быстро создавать свои собственные базы знаний...
2 года назад
0100.9K
LlamaParse:Llamaindex推出的高品质解析文档,提取数据服务(每日免费提取1000页)

LlamaParse: Высококачественный сервис парсинга документов и извлечения данных от Llamaindex (1000 бесплатных страниц в день).

Общее представление LlamaParse - это мощный инструмент для разбора документов, который может обрабатывать сложные документы, такие как PDF, PowerPoint, Word и электронные таблицы, и преобразовывать их в структурированные данные.LlamaParse предлагает множество способов использования...
2 года назад
0100.9K
iSlide:让PPT设计简单起来,PPT插件,PPT模板下载平台

iSlide: упростите дизайн PPT, плагин для PPT, платформа для загрузки шаблонов PPT

Всеобъемлющее введение iSlide - это профессиональный помощник в разработке PPT, целью которого является предоставление пользователям огромного количества высококачественных PPT шаблонов, материалов, диаграмм, шрифтов и других ресурсов. С помощью iSlide пользователи могут быстро создавать высококачественные презентации PPT и экономить 90% время на разработку. iSlide...
2 года назад
0100.9K
Fragments:类似于 Anthropic 的 Claude Artifacts、Vercel v0 或 GPT Engineer 等应用程序的开源版本

Фрагменты: версии с открытым исходным кодом таких приложений, как Claude Artifacts от Anthropic, Vercel v0 или GPT Engineer.

Общее представление Fragments by E2B - это проект с открытым исходным кодом, который предоставляет шаблон на основе Next.js для создания приложений, полностью созданных искусственным интеллектом. Разработанный E2B, проект направлен на упрощение и ускорение процесса разработки приложений для искусственного интеллекта. Он объединяет в себе множество современных...
2 года назад
0100.8K
MathTranslate:科学论文LaTeX翻译工具

MathTranslate: инструмент для перевода научных статей в формате LaTeX

Общее введение MathTranslate - это онлайн-инструмент, предназначенный для перевода документов LaTeX, особенно научных работ. Инструмент способен сохранять выражения LaTeX (например, математические выражения) без изменений и в итоге компилирует документы LaTeX в...
2 года назад
0100.8K
SciSpace:一站式学术研究与论文写作平台,为学生和研究人员提供一体化 AI 工具

SciSpace: универсальная платформа для академических исследований и написания статей с интегрированными инструментами искусственного интеллекта для студентов и исследователей

Общее введение SciSpace (ранее Typeset.io) - это платформа с искусственным интеллектом, предназначенная для академических исследований и написания статей. Она предоставляет множество инструментов и ресурсов, помогающих исследователям и студентам находить, понимать и писать о литературе более эффективно. Платформа объединяет в себе управление литературой, автоматическую гр...
2 года назад
0100.8K
MemOS - 开源的AI记忆管理与调度平台,共享长期记忆

MemOS - платформа управления памятью и планирования ИИ с открытым исходным кодом для обмена долгосрочными воспоминаниями

MemOS - это фреймворк с открытым исходным кодом для управления памятью и планирования для больших языковых моделей (LLM), таких как MemTensor. Рассматривая память как ресурс, столь же важный, как и арифметическая мощность, он унифицирует управление открытым текстом, состоянием активации и памятью параметров с помощью стандартизированных блоков памяти MemCube.
8 месяцев назад
0100.7K
Tempo Labs:使用AI快速构建React应用,多职能协作的React可视化编辑器

Tempo Labs: быстрое создание React-приложений с использованием искусственного интеллекта, визуальный редактор React для многофункциональной совместной работы

Общее представление Tempo Labs - это платформа, использующая технологию искусственного интеллекта, чтобы помочь разработчикам и дизайнерам быстро создавать React-приложения. Платформа упрощает проектирование и разработку высококачественных пользовательских интерфейсов, предоставляя интуитивно понятный редактор с возможностью перетаскивания и богатую библиотеку компонентов.Tempo...
2 года назад
0100.7K
Dessix.io:灵感捕捉、思维组织和AI协作于一体的笔记工具

Dessix.io: захват вдохновения, организация мыслей и совместная работа с искусственным интеллектом в одном инструменте для ведения заметок

Общее представление Dessix.io - это универсальный инструмент для ведения заметок с интегрированными функциями совместной работы с искусственным интеллектом, призванный помочь пользователям улавливать вдохновение, упорядочивать свои мысли и эффективно творить. С помощью Dessix пользователи могут легко собирать веб-контент или фрагменты текста, использовать искусственный интеллект для автоматического создания резюме и ключевых слов, а также упростить письмо...
2 года назад
0100.7K
Second Me:本地训练拥有个人记忆和习惯的AI分身

Второе Я: локально обученные двойники ИИ с личными воспоминаниями и привычками

Second Me - это проект с открытым исходным кодом, разработанный командой Mindverse, который позволяет создать на вашем компьютере искусственный интеллект, действующий как "цифровой двойник", изучающий ваши речевые модели и привычки через ваши слова и воспоминания и превращающийся в умного человека, понимающего ваши...
1 год назад
0100.7K
Zerox:PDF、DOCX、图像转换为Markdown,视觉模型高精度OCR

Zerox: PDF, DOCX, преобразование изображений в Markdown, высокоточное распознавание визуальных моделей

Общее представление Zerox - это проект с открытым исходным кодом, предназначенный для преобразования PDF, DOCX, изображений и других документов в формат Markdown с помощью визуальных моделей. Проект разработан командой getomni-ai и представляет собой простое и эффективное решение OCR (Optical Character Recognition).Ze...
2 года назад
0100.6K
KTransformers:大模型推理性能引擎:极致加速,灵活赋能

KTransformers: механизм вывода больших моделей: экстремальное ускорение, гибкое расширение возможностей

KTransformers: высокопроизводительный фреймворк на языке Python для преодоления узких мест, связанных с выводом больших моделей. Это больше, чем просто инструмент для работы с моделями, это набор движков для оптимизации производительности и гибкая платформа для расширения возможностей интерфейса. KTransf...
1 год назад
0100.6K
Cua:让AI代理在macOS/Linux沙盒中安全执行应用

Cua: обеспечение безопасного выполнения приложений агентами искусственного интеллекта в "песочницах" macOS/Linux

Общее представление Cua - это проект с открытым исходным кодом под названием "Computer-Use Agent", произносится как "ку-а". Он предназначен для устройств Apple Silicon, может создавать и запускать высокопроизводительные macOS ...
1 год назад
0100.6K
TRELLIS:Microsoft开发的3D资产生成模型,支持多种格式和灵活编辑

TRELLIS: разработанная Microsoft модель создания 3D-активов с поддержкой различных форматов и возможностью гибкого редактирования

Общее представление TRELLIS - это крупномасштабная модель генерации 3D-активов, разработанная компанией Microsoft. Она способна получать текстовые или графические подсказки и генерировать высококачественные 3D-активы в различных форматах, таких как радиальные поля, 3D-гауссианы и сетки.В основе TRELLIS лежит унифицированная структурированная скрытая...
2 года назад
0100.5K
NarratoAI:文本生成影视解说与自动化剪辑神器

NarratoAI: текстовый нарратив для кино и телевидения и инструмент для автоматизированного редактирования

Общее представление NarratoAI - это полностью автоматизированный инструмент, объединяющий в себе функции озвучивания фильмов и видео, автоматического редактирования, дубляжа и создания субтитров. Он опирается на технологию крупномасштабного моделирования языка (LLM) для автоматического создания копий и автоматического редактирования видео с соответствующими закадровым голосом и субтитрами, предоставляя пользователям универсальный...
2 года назад
0100.5K