Последние ресурсы по искусственному интеллекту

共 3185 篇文章
Tizzy.ai - 百度推出的AI搜索应用

Tizzy.ai - поисковое приложение с искусственным интеллектом, запущенное компанией Baidu

Tizzy.ai - это интеллектуальное поисковое приложение, созданное компанией Baidu.Tizzy.ai основано на технологии больших моделей Baidu, имеет мощные функции интеллектуального поиска, может быстро отвечать на вопросы, глубоко мыслить и помогать в принятии решений.Tizzy.ai имеет простой интерфейс, без рекламы и всплывающих окон, а в нижней части руководства...
1 год назад
081.7K
BAGEL - 字节跳动推出的开源多模态基础模型

BAGEL - мультимодальная базовая модель с открытым исходным кодом, созданная на Wordpress

BAGEL - мультимодальная базовая модель с открытым исходным кодом от ByteDance с 14 миллиардами параметров, из которых 7 миллиардов активны. Базовая модель с экспертной архитектурой смешанного преобразования (MoT) захватывает особенности изображения на уровне пикселей и на семантическом уровне с помощью двух независимых кодеров, соответственно, для поддержки эффективной обработки изображений, текста, видео...
1 год назад
081.7K
MagicTryOn - 浙大和vivo等机构推出的视频虚拟试穿框架

MagicTryOn - фреймворк для виртуальной примерки видео от ZJU, Vivo и других компаний

MagicTryOn - это передовой фреймворк для виртуальных видеопроб, созданный Школой компьютерных наук и технологий Чжэцзянского университета в сотрудничестве с компанией vivo и другими организациями. Фреймворк заменяет традиционную архитектуру U-Net на инновационную архитектуру Diffusion Transformer (DiT) в сочетании с полностью самоаттестующейся машиной...
1 год назад
081.7K
袋鼠参谋 – 美团推出的商家AI智能决策应用

Kangaroo Staff - интеллектуальное приложение для принятия решений с помощью искусственного интеллекта для торговцев, запущенное Meituan

Kangaroo Staff - это ориентированное на торговцев интеллектуальное приложение с искусственным интеллектом для принятия решений, запущенное Meituan, чтобы помочь торговцам решить проблемы с открытием и эксплуатацией магазинов. Основываясь на массивных данных Meituan по общественному питанию и более чем 10-летнем опыте онлайн-операций, через диалоговое взаимодействие оно предоставляет торговцам точную информацию по выбору трека, месту открытия магазина, разработке блюд, эксплуатации магазина и другим сценариям.....
1 год назад
081.7K
Paperpal - AI学术写作工具,全面覆盖写作全流程

Paperpal - инструменты для академического письма с искусственным интеллектом, всестороннее освещение всего процесса написания.

Paperpal - это искусственный интеллект, ориентированный на академическое письмо, помогающий исследователям, студентам и профессионалам повысить качество и эффективность своей работы. Благодаря мощным функциям корректировки языка, он обеспечивает проверку грамматики, исправление орфографии и предложения по выбору слов для обеспечения точности и беглости текста.
1 год назад
081.7K
V-JEPA 2 - Meta AI 推出的最强世界大模型

V-JEPA 2 - самая мощная большая модель мира от Meta AI

V-JEPA 2 - это большая модель мира на основе видеоданных с 1,2 млрд параметров от Meta AI. Модель обучена на основе самоконтроля на основе более чем 1 миллиона часов видео и 1 миллиона изображений и понимает объекты, действия и операции в физическом мире...
1 год назад
081.6K
Sparkify - 谷歌推出的AI动画视频生成平台

Sparkify - платформа для создания анимированных видео с искусственным интеллектом от Google

Sparkify - это платформа для создания анимированных видеороликов с помощью искусственного интеллекта, запущенная компанией Google. Платформа основана на моделях Gemini 2.5 и Veo2. Пользователи вводят вопросы или сложные концепции, а Sparkify за 2 минуты генерирует интуитивно понятные анимированные короткие видеоролики, объясняющие соответствующие моменты знаний. Платформа поддерживает текст, изображения и...
1 год назад
081.5K
Matrix-Game 2.0 - 昆仑万维开源自研的交互式世界模型

Matrix-Game 2.0 - Интерактивная модель мира, разработанная KunlunWanwei

Matrix-Game 2.0 - это самостоятельно разработанная интерактивная модель мира, выпущенная компанией Kunlun SkyWork AI. Matrix-Game 2.0 - это первая в индустрии интерактивная модель с открытым исходным кодом, работающая в реальном времени и создающая длинные последовательности для сценариев общего назначения, способная работать с частотой 25 кадров в секунду в нескольких...
1 год назад
081.5K
AI抖音 - 抖音推出的智能深度思考与搜索应用

AI Jitterbug - интеллектуальное приложение для глубокого мышления и поиска от Jitterbug

AI Jitterbug - это интеллектуальное приложение для глубокого мышления и поиска, запущенное компанией Jitterbug с целью предоставить пользователям более эффективный и интеллектуальный опыт получения контента. Основываясь на мощной экосистеме контента Jitterbug и технологии искусственного интеллекта, оно предоставляет пользователям более полные и подробные ответы благодаря подключенным возможностям поиска и рассуждений.
1 год назад
081.5K
ChatGPT Study - OpenAI推出的创新学习模式

Исследование ChatGPT - инновационная модель обучения, представленная OpenAI

ChatGPT Study - это инновационная модель обучения от OpenAI, которая помогает пользователям учиться и понимать более эффективно. ChatGPT Study помогает пользователям активно думать и решать проблемы шаг за шагом с помощью сократовских вопросов, подкрепленных ответами, и персонализированных...
1 год назад
081.5K
冷饭热炒:流畅的创作儿童故事视频

Холодная еда, горячая еда: плавное создание детских сюжетных видеороликов

Самой горячей идеей для заработка на заре появления AI-учебников было научить вас создавать детские иллюстрированные книги, что впоследствии породило детскую анимацию, и эти видео настолько просты в просмотре, что вы застреваете сразу же после их использования. Причиной тому по-прежнему является несколько завышенный порог, а качество контента и генерируемых изображений вызывает опасения. Пока ... генерация gpt и cloude...
2 года назад
081.5K
Magnific:付费的图像放大与增强工具,放大图像同时修复细节

Magnific: платный инструмент для увеличения и улучшения изображений, который увеличивает их, одновременно исправляя детали

Magnific Общее представление Magnific - это инновационный инструмент для увеличения и улучшения изображений, который использует передовые алгоритмы глубокого обучения для преобразования любого изображения в версию с более высоким разрешением, добавляя при этом потрясающие детали и качество.Magnific не только увеличивает изображение...
2 года назад
081.5K
AopsAI - AI照片处理工具,一键将旧照片转动态视频

AopsAI - инструмент для работы с фотографиями с искусственным интеллектом, превращающий старые фотографии в видеоролики одним щелчком мыши!

AopsAI - это онлайн-инструмент искусственного интеллекта, который превращает старые фотографии в динамичные короткие видеоролики. Основанный на передовой технологии искусственного интеллекта, инструмент заставляет статичные фотографии "двигаться", воссоздавая прекрасные моменты из прошлого. Пользователи загружают фотографии и указывают свой адрес электронной почты, а AopsAI автоматически создает видео в течение 24 часов и отправляет его на...
1 год назад
081.5K
D-Human:克隆数字人营销短视频生产专家

D-Human: клонирование цифрового человека Эксперты по производству коротких видеороликов для маркетинга

Всеобъемлющее введение D-Human - это цифровая человеческая платформа для производства видео, инвестированная Xiaomi, возглавляемая доктором Китайской академии наук по исследованиям и разработкам. Она поддерживает SaaS, API, OEM, различные методы сотрудничества и обеспечивает технологию восстановления реальной жизни 1:1, 8 минут видеоматериала для клонирования себя или других. Платформа значительно сокращает создание...
2 года назад
081.4K
InteriorGS - 群核科技推出的3D高斯语义数据集

InteriorGS - 3D гауссовский семантический набор данных от Qunar Technology

InteriorGS - это высококачественный трехмерный гауссовый семантический набор данных, представленный компанией Qunar Technology. Набор содержит 1 000 3D-сцен, охватывающих более 80 внутренних помещений, таких как дома, магазины, свадебные залы и музеи. Набор содержит более 554 000 экземпляров объектов в 755 категориях...
1 год назад
081.4K
Hyprnote - 开源的本地优先AI会议笔记工具

Hyprnote - инструмент для ведения заметок на конференциях с искусственным интеллектом с открытым исходным кодом

Hyprnote - это инструмент для ведения заметок на совещаниях с открытым исходным кодом и искусственным интеллектом, разработанный для профессионалов с целью защиты конфиденциальности пользователей и повышения эффективности совещаний. В соответствии с принципом "сначала локально" все данные хранятся и обрабатываются на локальном устройстве пользователя, что обеспечивает безопасность данных и поддерживает работу в автономном режиме.
1 год назад
081.4K
FastDeploy - 百度推出的高性能大模型推理与部署工具

FastDeploy - высокопроизводительный инструмент Baidu для обоснования и развертывания больших моделей

FastDeploy - это высокопроизводительный инструмент для обоснования и развертывания от Baidu, предназначенный для больших языковых моделей (LLM) и визуальных языковых моделей (VLM).FastDeploy разработан на основе фреймворка Flying Paddle (PaddlePaddle) и поддерживает различные аппаратные платформы....
1 год назад
081.4K
MiniMax Speech 2.5 - MiniMax推出的语音生成模型

MiniMax Speech 2.5 - модель генерации речи от MiniMax

MiniMax Speech 2.5 - это усовершенствованная модель генерации речи, разработанная командой MiniMax. Это значительное достижение в области синтеза речи, особенно в плане многоязычной выразительности, точности воспроизведения тембра и языкового охвата. Модель поддерживает 40 языков...
1 год назад
081.2K
GenFlow超能搭子 – 百度文库推出的通用AI Agent

GenFlow Super Hitchhiker - универсальный агент искусственного интеллекта из библиотеки литературы Baidu

GenFlow Super Hitchhiker - это ИИ-агент общего назначения, запущенный Библиотекой литературы Baidu. Пользователям достаточно вводить команды на естественном языке, и они могут самостоятельно разбирать задачи, обращаться к 1,4 млрд библиотек документов и онлайн-ресурсов Библиотеки литературы Baidu, а также чрезвычайно быстро генерировать PPT, отчеты, диаграммы, плакаты и другой полномодальный контент.
1 год назад
081.1K
Make - AI无代码自动化工作流搭建平台

Make - платформа для автоматического построения рабочих процессов без кода AI

Make - это платформа автоматизации без кода, основанная на искусственном интеллекте, которая помогает организациям повысить эффективность и инновации на основе автоматизированных процессов. Платформа предлагает более 2 000 готовых приложений, которые поддерживают различные бизнес-сценарии, такие как маркетинг, продажи, финансы и т. д. Основные возможности Make включают в себя визуальное создание процессов без кода, искусственный интеллект...
1 год назад
081K
Curiosity:使用LangGraph构建类似 Perplexity 的AI搜索工具

Любопытство: создание похожего на Перплексити инструмента поиска ИИ с помощью LangGraph

Общее введение Curiosity - это проект, направленный на исследования и эксперименты, в основном с использованием стека технологий LangGraph и FastHTML, с целью создания Perplexity AI-подобного поискового продукта. В основе проекта лежит простая...
2 года назад
080.9K
Ming-UniAudio - 蚂蚁开源的统一音频多模态生成模型

Ming-UniAudio - Ant Open Source Unified Audio Multimodal Generation Model

Ming-UniAudio - это унифицированная мультимодальная модель генерации звука с открытым исходным кодом от Ant Group, которая поддерживает смешанный ввод и вывод текста, аудио, изображений и видео. Используя многомасштабную архитектуру трансформатора и смешанного эксперта (MoE), с помощью механизма маршрутизации с учетом модальностей для эффективной обработки кросс-модальных ...
12 месяцев назад
080.8K
Comate AI IDE - 文心快码推出多模态、多智能体协同的AI IDE

Comate AI IDE - Wencent Quickcode запускает мультимодальную, мультиинтеллектуальную совместную AI IDE

Comate AI IDE является первым в отрасли мульти-модальных, мульти-интеллект тела совместной AI родной IDE запущен Baidu Wenshin Express Code. с мощными мульти-модальных возможностей, поддержка проекта ключ к коду (F2C), изображение к коду, и естественный язык к коду, в сценариях разработки фронт-энд, производительность выдающихся...
1 год назад
080.8K
Hunyuan3D-Part - 腾讯开源的免费3D组件生成模型

Hunyuan3D-Part - бесплатная модель генерации 3D-компонентов с открытым исходным кодом от Tencent

Hunyuan3D-Part (Hybrid 3D-Part) - это модель 3D-генерации, выпущенная и открытая компанией Tencent. Состоящая из P3 - SAM и X - Part, она впервые достигла высокой точности и управляемости 3D-генерации на основе компонентов, поддерживая 50+ автоматически генерируемых компонентов. Пользователи могут использовать...
12 месяцев назад
080.7K
BoomCut - 小影科技推出的 AI 出海营销视频生成工具

BoomCut - инструмент создания видеороликов для исходящего маркетинга с искусственным интеллектом от Little Shadow Technology

BoomCut - это инструмент локализации видеороликов для трансграничного маркетинга, созданный компанией Little Shadow Technology. Инструмент оснащен мощными функциями, основанными на передовой технологии синхронизации губ и клонирования тембра, позволяющими быстро генерировать мультиязычные версии видеороликов для удовлетворения языковых потребностей пользователей в разных странах и регионах.
1 год назад
080.7K
Knit:提示词指令设计管理工具

Вязание: Инструмент управления дизайном инструкции по использованию слов

Общее введение PromptKnit - это лучшая платформа AI-песочница для дизайнеров AI подсказок, предоставляющая профессиональные редакторы подсказок для gpt-4-turbo/vision, claude-3, gemini-1.5-pro и многих других моделей. Пользователи могут группировать...
2 года назад
080.6K
琴乐大模型 - 腾讯推出的AI音乐创作模型

Piano Music Big Model - модель музыкальной композиции с искусственным интеллектом, запущенная Tencent

Qin Music Grand Model - это передовая модель для создания музыки с помощью искусственного интеллекта, созданная совместными усилиями Tencent AI Lab и Tencent TME Tianqin Lab. Модель интеллектуально генерирует высококачественное стереофоническое аудио или многодорожечные ноты на основе введенных пользователем ключевых слов, описательных высказываний или аудиоклипов на английском и китайском языках.
1 год назад
080.5K
Mapify - XMind推出的AI思维导图生成工具

Mapify - генератор карт разума с искусственным интеллектом от XMind

Mapify - это генератор карт разума с искусственным интеллектом от команды XMind. Он может быстро преобразовывать текст, PDF, веб-страницы, видео, аудио и другие форматы в структурированные карты ума, помогая пользователям эффективно извлекать и организовывать ключевую информацию.
1 год назад
080.5K
MineContext - 字节开源的主动式上下文感知AI伙伴

MineContext - байтовый партнер по ИИ с открытым исходным кодом и активным контекстом

MineContext - это активный контекстно-ориентированный ИИ-партнер с открытым исходным кодом от команды ByteDance Viking, призванный помочь пользователям эффективно управлять огромными объемами информации и повысить эффективность работы со знаниями. С помощью технологии понимания скриншотов и контента, автоматической записи ежедневных операций пользователя (таких как просмотр веб-страниц, редактирование документов и т.д.), поддержки...
11 месяцев назад
080.5K
Qwen-Flash - 通义千问推出的高性能、低成本语言模型

Qwen-Flash - высокопроизводительная и недорогая языковая модель от Тонги Чиен-цюань

Qwen-Flash - это высокопроизводительная и недорогая языковая модель, представленная в серии Alibaba Tongyi Thousand Questions, предназначенная для быстрого реагирования и эффективной обработки простых задач. Основанная на передовой архитектуре Mixture-of-Experts (MoE), она реализуется с помощью разреженной сети экспертов...
1 год назад
080.5K
MirageLSD - Decart AI推出首个实时AI视频生成模型

MirageLSD - Decart AI запускает первую модель генерации видео с помощью искусственного интеллекта в режиме реального времени

MirageLSD - первая в мире модель потокового диффузионного AI-видео в реальном времени от команды Decart AI, позволяющая неограниченно генерировать видео в реальном времени с задержкой до 40 миллисекунд и плавным выводом со скоростью 24 кадра в секунду.
1 год назад
080.4K
ChartAI - AI数据分析工具,智能推荐适合的图表类型

ChartAI - инструмент анализа данных с искусственным интеллектом, который интеллектуально рекомендует подходящие типы графиков

ChartAI - это эффективный инструмент визуализации данных, который автоматически анализирует данные на основе технологии искусственного интеллекта для создания интуитивных диаграмм, помогающих пользователям быстро понять сложную информацию. ChartAI поддерживает импорт данных различных форматов (например, Excel, CSV) и поддерживает интеллектуальную рекомендацию наиболее подходящих диаграмм...
1 год назад
080.3K
Molmo 2 - Ai2开源的多模态视频图像理解模型系列

Molmo 2 - семейство моделей мультимодального понимания видеоизображений с открытым исходным кодом Ai2

Molmo 2 - это мультимодальная модель с открытым исходным кодом, выпущенная Институтом искусственного интеллекта Аллена (Ai2) для улучшения понимания видео и мультиизображений. Включены три варианта: Molmo 2 (8B), Molmo 2 (4B) и Molmo 2-O...
9 месяцев назад
080.3K
AIMangaStudio - 免费的AI漫画创作工具,提供完整创作流程

AIMangaStudio - бесплатный инструмент для создания манги в формате AI для полного процесса создания!

AIMangaStudio - это бесплатный инструмент для создания манги с искусственным интеллектом, который предоставляет авторам полный цикл создания манги, включая генерацию сюжета, разработку субсцен, создание персонажей и другие функции, что позволяет упростить процесс создания от сценария до страницы манги. Поддержка генерации сценариев комиксов на естественном языке, включая сюжет, диалоги...
12 месяцев назад
080.2K
奇妙元:数字人视频制作与直播服务平台|声音克隆|形象克隆

WonderWon: Платформа для производства цифрового человеческого видео и сервиса прямых трансляций|Клонирование голоса|Клонирование изображения

Всеобъемлющее введение Wonderful Dollar - это платформа для производства видеороликов с цифровыми персонами и услуг прямого вещания, предоставляющая функцию создания видео из фотографий и PPT, а также услугу перевода видео на разные языки. Пользователи могут настраивать цифровых персонажей для новостных репортажей, образовательного контента, корпоративного продвижения и многих других областей. Платформа также предоставляет интерактивные цифровые персона...
2 года назад
080.2K
混元3D 3.0 - 腾讯推出的3D生成模型,支持超高清建模

Hybrid 3D 3.0 - 3D-генерируемые модели от Tencent с поддержкой UHD-моделирования

Hybrid 3D 3.0 - это передовая 3D-модель от Tencent, основанная на технологии иерархического скульптинга 3D-DiT, с геометрическим разрешением до 1536³, способная генерировать 3D-модели сверхвысокой четкости, богатые деталями, и превосходящая в моделировании персонажей, с возможностью точного формирования пяти чувств и формы тела.
1 год назад
080.2K
Paper2Slides - 香港大学开源的学术论文转为幻灯片AI工具

Paper2Slides - инструменты ИИ для преобразования научных статей в слайды с открытым исходным кодом Университета Гонконга

Paper2Slides - это инструмент искусственного интеллекта с открытым исходным кодом, разработанный лабораторией Data Intelligence Laboratory Гонконгского университета, который одним щелчком мыши преобразует научные статьи в профессиональные слайды или постеры. Используя технологию RAG (Retrieval Augmented Generation), она напрямую анализирует содержимое документа, а не полагается на сетевую информацию, чтобы гарантировать, что созданный PPT будет полностью соответствовать оригиналу...
9 месяцев назад
080.1K
用语音和文字控制macOS操作的开源工具

Инструмент с открытым исходным кодом для управления операциями macOS с помощью голоса и текста

Общее представление MacOS LLM Controller - это настольное приложение с открытым исходным кодом, размещенное на GitHub, которое позволяет пользователям выполнять команды системы macOS, вводя команды на естественном языке с помощью голоса или текста. Оно основано на Llama-3.2-3B...
1 год назад
080.1K
Vace AI - AI 视频制作和编辑平台,提供一站式视频创作服务

Vace AI - платформа для производства и редактирования видео с использованием искусственного интеллекта, предоставляющая услуги по созданию видео в режиме "одного окна".

Vace AI - это мощная универсальная платформа для создания и редактирования AI-видео. Платформа генерирует высококачественный видеоконтент на основе текстовых описаний или опорных изображений, а также поддерживает различные функции редактирования, такие как расширение видео, преобразование стилей, удаление и восстановление объектов.
1 год назад
079.8K
GitaGPT:受

GitaGPT: Вдохновляясь Бхагавад-гитой, общайтесь с мудрецами, чтобы обрести мудрость и вдохновение

Общее представление GitaGPT - это чат-бот с искусственным интеллектом, основанный на мудрости "Бхагавад-гиты" и призванный помочь пользователям отвечать на вопросы в их повседневной жизни. Платформа использует технологию ChatGPT для предоставления кратких и глубоких ответов, чтобы помочь пользователям в духовном развитии, управлении эмоциями и повышении лидерских качеств...
2 года назад
079.7K
Qwen-Image - 通义千问推出开源的文生图基础模型

Qwen-Image - Tongyi Qianqian запускает базовую модель Qwen-Image с открытым исходным кодом

Qwen-Image - это базовая модель генерации изображений с открытым исходным кодом, выпущенная командой Alibaba Tongyi Qianqian. Имея 20 миллиардов параметров, она использует архитектуру мультимодального диффузионного трансформатора (MMDiT), которая включает в себя три модуля: мультимодальное понимание, кодирование высокого разрешения и диффузионное моделирование.Qwen-Image...
1 год назад
079.7K
Gemini CLI - 谷歌开源的编程Agent

Gemini CLI - Агент программирования с открытым исходным кодом Google

Gemini CLI - это инструмент программирования ИИ с открытым исходным кодом от Google, основанный на включении Большой модели Gemini в конечную точку разработчика, чтобы предоставить разработчикам мощные возможности ИИ. Инструмент понимает код, работает с файлами, выполняет команды и динамически устраняет неполадки, помогая разработчикам эффективно писать...
1 год назад
079.6K
AudioGen-Omni - 快手推出的多模态音频生成模型

AudioGen-Omni - мультимодальная модель генерации звука от Racer

AudioGen-Omni - это мультимодальная модель генерации звука от Racer, которая генерирует высококачественное аудио, речь и песни на основе таких входных данных, как видео, текст и т.д. AudioGen-Omni основана на передовых технологиях, таких как мультимодальный диффузионный трансформатор и фазово-выровненная...
1 год назад
079.6K
ROMA - 开源的元Agent框架,自动分解复杂任务并行处理

ROMA - мета-агентный фреймворк с открытым исходным кодом для автоматической декомпозиции сложных задач для параллельной обработки

ROMA (Recursive-Open-Meta-Agent) - это мета-агентский фреймворк с открытым исходным кодом, разработанный компанией Sentient AGI для эффективного решения сложных задач с помощью рекурсивной декомпозиции задач и параллельной обработки. Поддерживает Python 3.12+, Docker и...
1 год назад
079.5K
SCAIL - 智谱联合清华开源的影视级角色动画生成框架

SCAIL - открытый фреймворк для создания анимационных персонажей для кино и телевидения от Wisdom spectrum и Tsinghua.

SCAIL (Studio-Grade Character Animation via In-Context Learning) - это система создания анимации персонажей для кино и телевидения, предложенная компанией Smart Spectrum в сотрудничестве с группой профессора Лю Юнцзиня из Университета Цинхуа. Благодаря...
9 месяцев назад
079.5K
AI Agent Company Researcher:自动化公司信息研究情报员

AI Agent Company Researcher: автоматизированный исследователь информации о компаниях

Общее описание AI Company Research Assistant - это инструмент на основе искусственного интеллекта, предназначенный для автоматизации процесса исследования компаний и генерации лидов. Благодаря использованию таких технологий, как LangGraph и FireCrawl, инструмент способен генерировать подробные отчеты об исследованиях компаний всего за несколько минут. Пользователям просто нужно...
2 года назад
079.4K
eCommercePrompts:为电子商务快速创建ChatGPT指示

eCommercePrompts: создавайте инструкции ChatGPT для электронной коммерции на лету!

Общее описание eCommercePrompts предлагает более 2 миллионов готовых рецептов команд ChatGPT, созданных инженерами команд и призванных помочь маркетологам eCommerce создавать магазины и промо-акции менее чем за час. Сайт охватывает широкий спектр типов контента, включая домашние...
2 года назад
079.3K
Wan2.2-S2V - 阿里通义开源的音频驱动视频生成模型

Wan2.2-S2V - модель генерации видео с открытым исходным кодом от Ali Tongyi, управляемая звуком

Wan2.2-S2V - это мультимодальная модель генерации видео с открытым исходным кодом от Ali Tongyi, только статическая картинка и фрагмент аудио, может генерировать высококачественное цифровое видео человека, и поддерживает различные типы изображений и кадров.
1 год назад
079.3K
MoFlow - AI情绪管理应用,用自由书写调节情绪

MoFlow - приложение для управления настроением с помощью искусственного интеллекта, позволяющее регулировать эмоции с помощью свободного письма

MoFlow - это приложение для управления эмоциями, объединяющее психологию и технологию искусственного интеллекта. Оно предоставляет пользователям личное пространство для выражения своих эмоций в письмах и чатах, а партнер ИИ терпеливо выслушает их и даст обратную связь.
1 год назад
079.3K
SagaLabs:AI驱动的文学、小说和剧本翻译工具,针对全球市场内容本地化

SagaLabs: инструмент перевода литературы, романов и сценариев с помощью искусственного интеллекта, локализующий контент для глобальных рынков

Общие сведения SagaLabs - это инструмент перевода и контент-платформа на базе искусственного интеллекта, созданная для авторов, чтобы помочь им локализовать и продвинуть свои истории на глобальный рынок. Платформа поддерживает переводы на более чем 200 языков и обеспечивает качество перевода на уровне экспертов-носителей языка.SagaLabs - это не только...
2 года назад
079.3K
GPT-5 - OpenAI推出的最强语言模型,统一智能系统

GPT-5 - самая сильная языковая модель, представленная OpenAI, единой интеллектуальной системой

GPT-5 - это последняя языковая модель, выпущенная OpenAI с несколькими обновлениями. Это единая интеллектуальная система со встроенным маршрутизатором реального времени, который автоматически переключается между режимами эффективного и глубокого мышления в зависимости от сложности задачи, обеспечивая быструю реакцию и точные ответы.GPT-5 имеет несколько версий, в том числе для пу...
1 год назад
079.3K
Muzaic - AI音乐生成平台,一键生成与视频内容匹配的音乐

Muzaic - платформа для создания музыки с помощью искусственного интеллекта, которая генерирует музыку под видеоконтент в один клик

Muzaic - это платформа для создания музыки с помощью искусственного интеллекта, предназначенная для видеопродюсеров и создателей контента. Технология, основанная на искусственном интеллекте, позволяет быстро генерировать индивидуальную музыку, соответствующую содержанию видео, создавая минутный трек студийного качества всего за 8 секунд.
1 год назад
079.3K
Hyperbolic AgentKit:让Agents拥有自己的计算资源,能够自主管理 GPU、执行区块链操作和社交发布

Hyperbolic AgentKit: предоставляет агентам собственные вычислительные ресурсы, возможность автономно управлять графическими процессорами, выполнять операции с блокчейном и социальные публикации

Общее представление Hyperbolic AgentKit - это проект с открытым исходным кодом, цель которого - предоставить шаблон для запуска агентов искусственного интеллекта, объединяющий блокчейн и вычислительные мощности. Проект основан на CDP Agentkit от Coinbase с модификациями и расширениями для поддержки терминала в...
2 года назад
079.2K
有道数字人:虚拟形象播报与实时交互平台|免费制作克隆数字人

Arigatou Digital Human: виртуальная трансляция изображений и платформа для взаимодействия в реальном времени|Бесплатное создание клонированного цифрового человека

Комплексное внедрение Wealth Digital People - это платформа, объединяющая передовые технологии искусственного интеллекта, ориентированная на трансляцию виртуальных изображений и предоставление интерактивных услуг в режиме реального времени. Платформа использует самостоятельно разработанную технологию распознавания речи, синтеза речи, мультимодального восприятия и вопросов и ответов на документы для создания реалистичных цифровых двойников людей для пользователей с целью поддержки видеопроизводства, перевода, обучения...
2 года назад
079.1K
小星绪 - 京东健康推出的AI情绪漫画生成产品

Hoshio - ИИ-продукт для создания манги эмоций, запущенный Jingdong Health

Xiao Xingxu - это продукт для создания эмоциональных комиксов с помощью искусственного интеллекта, запущенный компанией Jingdong Health, который в настоящее время находится на стадии тестирования. Основной функцией продукта является создание эмоциональных комиксов, пользователи могут выразить свои эмоции или рассказать историю с помощью голоса или текстового ввода, а искусственный интеллект генерирует соответствующие четырехпанельные комиксы и интерпретацию истории на основе полученных данных.
1 год назад
079.1K
DeepSeek-V3.1-Terminus - DeepSeek推出的最新版AI模型

DeepSeek-V3.1-Terminus - последняя версия модели искусственного интеллекта, представленная компанией DeepSeek.

DeepSeek-V3.1-Terminus - это обновленная версия DeepSeek-V3.1, языковой модели искусственного интеллекта от команды DeepSeek. Модель была оптимизирована с точки зрения согласованности языка, генерации кода и возможностей поиска для более точного...
12 месяцев назад
079K
HIRING.STUDIO - AI招聘面试辅助工具,针对特定职位生成面试问题

HIRING.STUDIO - ИИ-инструмент для создания вопросов на собеседовании по конкретным вакансиям

HIRING.STUDIO - это инструмент поддержки собеседований с использованием искусственного интеллекта, который помогает командам по подбору персонала эффективно создавать вопросы для собеседований с конкретными кандидатами. Основанный на технологии искусственного интеллекта, инструмент генерирует вопросы для собеседования, предлагает последующие вопросы и создает критерии оценки ответов разного качества. Инструмент поддерживает метод STAR...
1 год назад
079K
有道小P - 网易有道推出的新一代AI全科学习助手

Youdao Xiao P - новое поколение самообучающегося помощника ИИ, выпущенного компанией Netease Youdao

Youdao Little P - это помощник по изучению всех предметов с искусственным интеллектом, выпущенный компанией NetEase Youdao. Он предназначен для учащихся K12, оснащен большой моделью образования Youdao Ziyi, охватывает начальную школу, младшую школу, старшую школу по всем предметам и предоставляет индивидуальные советы по обучению. Благодаря функциям поиска слов с искусственным интеллектом и перевода с искусственным интеллектом Youdao Little P помогает учащимся быстро решать языковые проблемы...
1 год назад
078.9K
Seed-OSS - 字节跳动团队开源的全新AI模型

Seed-OSS - новая модель искусственного интеллекта, открытая командой Wordpress

Seed-OSS - семейство больших языковых моделей с открытым исходным кодом от команды Byte Jump Seed, ориентированных на длинные тексты и задачи рассуждения. Модель хорошо справляется со сложными логическими рассуждениями и многоступенчатыми рассуждениями с высокой точностью и может эффективно решать сложные задачи.Seed-OSS поддерживает длинные текстовые контексты объемом до 512K...
1 год назад
078.8K
Hailuo 02 - MiniMax推出的AI视频生成模型,性能超越可灵和Veo 3

Hailuo 02 - MiniMax запускает модель генерации видео с искусственным интеллектом, которая превосходит Koring и Veo 3

Hailuo 02 - новая модель искусственного интеллекта для генерации видео от MiniMax, которая является обновленной версией Hailuo 01. Модель демонстрирует отличные результаты в доменах видео, сгенерированного из графов и текста, уступая лишь Byte's Seedance 1.0 и опережая Fast...
1 год назад
078.8K
MiniMax-M1 - MiniMax推出的开源推理模型

MiniMax-M1 - модель вывода с открытым исходным кодом от MiniMax

MiniMax-M1 - это модель вывода с открытым исходным кодом от команды MiniMax, основанная на комбинации смешанной экспертной архитектуры (MoE) и механизма Lightning Attention, с 456 миллиардами общих параметров. Модель поддерживает 100...
1 год назад
078.7K
Stable Diffusion Web:在线体验Stable Diffusion XL

Stable Diffusion Web: испытайте Stable Diffusion XL онлайн!

Общее описание Stable Diffusion Web - это онлайн-платформа для моделирования стабильной диффузии, которая является бесплатной для пользователей. Модель используется для преобразования текста в фотореалистичные изображения с помощью простого в использовании интерфейса. Введя текстовые подсказки и нажав кнопку "Generate", пользователи могут быстро получить...
2 года назад
078.7K
ML-Master – 上海交大推出的AI专家Agent

ML-Master - экспертный агент искусственного интеллекта, запущенный SJTU

ML-Master - экспертный ИИ-интеллект, созданный командой Agents Школы искусственного интеллекта Шанхайского университета Цзяотун. Он показал отличные результаты в авторитетном бенчмарк-тесте MLE-bench от OpenAI, возглавив список со средним показателем 29,3%, опередив RD-Agent от Microsoft...
1 год назад
078.5K
混元3D世界模型 1.0 - 腾讯推出的开源3D世界生成模型

Hybrid 3D World Model 1.0 - модель генерации 3D-мира с открытым исходным кодом от Tencent

3D-модель мира Hunyuan 1.0 (Hunyuan World 1.0) - это первая в индустрии модель с открытым исходным кодом от компании Tencent для создания иммерсивных блуждающих, интерактивных, симуляционных миров. Модель объединяет панорамную визуальную генерацию и технологию иерархической 3D-реконструкции, поддерживает ввод текста или изображения для быстрого создания 36...
1 год назад
078.5K
Why My Wife Yelling At Me:模拟婚姻沟通的互动工具

Почему моя жена кричит на меня: интерактивный инструмент для моделирования супружеского общения

Общее представление "Почему моя жена кричит на меня" - это уникальный сайт симуляции супружеских отношений, призванный помочь пользователям понять эмоциональные реакции партнера и модели общения с помощью искусственного интеллекта. Пользователи могут вводить различные сценарии и наблюдать за реакцией своего виртуального партнера, имитируя реальные...
1 год назад
078.4K
Ring-1T-preview - 蚂蚁集团开源的万亿参数大模型

Ring-1T-preview - Большая модель с триллионом параметров от Ant Group с открытым исходным кодом

Ring-1T-preview - макромодель с открытым исходным кодом на триллион параметров от Ant Group, основанная на архитектуре Ling 2.0 MoE, предварительно обученная на корпусе 20T и натренированная на способность рассуждать с помощью ASystem, самостоятельно разработанной системы обучения с подкреплением. В рассуждениях на естественном языке ...
12 месяцев назад
078.4K
VoxCPM - 面壁智能联合清华开源的端到端TTS模型

VoxCPM - Facing Intelligence и Tsinghua Open Source End-to-End TTS Model

VoxCPM - это модель генерации речи, совместно созданная Facade Intelligence и Шэньчжэньской международной высшей школой Университета Цинхуа. VoxCPM использует сквозную диффузионную авторегрессионную архитектуру для генерации непрерывных речевых представлений непосредственно из текста, преодолевая ограничения традиционной дискретной деамбигуации. Благодаря иерархическому моделированию языка и квантованию конечных состояний...
1 год назад
078.4K
Clacky AI - AI编程助手,面向开发者的云端开发环境

Clacky AI - ассистент программирования ИИ, облачная среда разработки для разработчиков

Clacky AI - это облачная среда разработки (CDE) для разработчиков, предназначенная для создания ассистентов программирования ИИ уровня L3. Инструмент поддерживает множество языков программирования, включая Python, Node.js, Golang, Ruby и Java, и может помочь разработчикам быстро...
1 год назад
078.3K
GLM-4.5 - 智谱开源的面向推理、代码与智能体的SOTA模型

GLM-4.5 - Smart Spectrum Open Source SOTA Model for Reasoning, Code and Intelligentsia

GLM-4.5 - это модель SOTA с открытым исходным кодом от Smart Spectrum, разработанная для приложений интеллектуального тела, включающая в себя рассуждения, генерацию кода и возможности интеллектуального тела. Модель основана на архитектуре Mixed Expert (MoE) и содержит две версии: GLM-4.5 с 355 миллиардами параметров и 106 миллиардами...
1 год назад
078.3K
Kotae - AI聊天机器人平台,分析网站内容、培训文件生成准确回答

Kotae - платформа для чатботов с искусственным интеллектом, анализирующая содержимое веб-сайтов и учебные документы для получения точных ответов

Kotae - интеллектуальная чат-бот платформа для малого бизнеса, разработанная на основе технологии ChatGPT. Поддерживая более 80 языков, платформа быстро и естественно реагирует на запросы клиентов, генерируя точные ответы на основе анализа содержания веб-сайтов пользователей, учебных документов, часто задаваемых вопросов и т. д. Kotae не имеет...
1 год назад
078.3K
Qwen3-Omni - 阿里通义推出的全模态AI模型

Qwen3-Omni - омнимодальная модель искусственного интеллекта, представленная Али Тонги

Qwen3-Omni - это полностью модальная модель ИИ, представленная командой Ali Tongyi, которая может работать с несколькими типами данных, такими как текст, изображения, аудио и видео, и поддерживает текстовое взаимодействие на 119 языках с низкой задержкой и высокой управляемостью.
12 месяцев назад
078.2K
Baichuan-M2 - 百川智能推出开源的医疗增强大模型

Baichuan-M2 - Baichuan Intelligence запускает расширенную большую модель здравоохранения с открытым исходным кодом

Baichuan-M2 - это медицинская дополненная макромодель с открытым исходным кодом, созданная компанией Baichuan Intelligence. Она демонстрирует хорошие результаты в области медицины, особенно в обзоре HealthBench с оценкой 60,1 балла, превосходит gpt-oss120b от OpenAI и многие другие модели с открытым исходным кодом, становясь глобальным...
1 год назад
078.1K
Qwen3-ASR-Flash - 阿里通义千问推出的系列语音识别模型

Qwen3-ASR-Flash - серия моделей распознавания речи, выпущенная Али Тунъи Цяньцянем

Qwen3-ASR-Flash - это новейшая высокоточная модель распознавания речи Alibaba, основанная на базовой модели Qwen3 и обученная на массивных мультимодальных данных. Она поддерживает 11 языков и множество акцентов, включая мандаринский, сычуаньский, миньнаньский, у, кантонский и другие диалекты...
1 год назад
077.9K
RoboBrain 2.0 - 智谱开源的通用具身大脑模型

RoboBrain 2.0 - общая воплощенная модель мозга с открытым исходным кодом от Wisdom Spectrum

RoboBrain 2.0 - это усовершенствованная модель воплощенного мозга с открытым исходным кодом, которая обеспечивает мощные возможности восприятия, рассуждения и планирования для роботов. RoboBrain 2.0 состоит из двух версий, 7B и 32B, и использует гетерогенную архитектуру, которая объединяет визуальные кодировщики и лингвистические модели для поддержки...
1 год назад
077.9K
茴香豆:基于LLM(大型语言模型) 的群聊助手

Fennel Bean: помощник для группового чата на основе LLM (Large Language Model)

Всеобъемлющее введение HuixiangDou - это крупномасштабный помощник для групповых чатов, основанный на языковой модели (LLM), разработанный для работы со сценариями групповых чатов с помощью трехэтапного процесса предварительной обработки, отклонения и ответа. Он способен отвечать на вопросы пользователей, не вызывая информационного наводнения. Проект предоставляет полный веб- ...
2 года назад
077.9K
Qwen-Image-Edit - 阿里通义开源的图像编辑模型

Qwen-Image-Edit - модель редактирования изображений с открытым исходным кодом от Ali Tongyi

Qwen-Image-Edit - это универсальная модель редактирования изображений, представленная Али Тонги, построенная на архитектуре Qwen-Image с 20 миллиардами параметров. Модель сочетает в себе возможности семантического редактирования и редактирования внешнего вида и может выполнять низкоуровневое визуальное редактирование внешнего вида изображений (например, добавлять, удалять...
1 год назад
077.8K
OpenScreen - 开源免费的屏幕录制工具,支持Mac和Windows双系统

OpenScreen - бесплатный инструмент записи экрана с открытым исходным кодом для Mac и Windows.

OpenScreen - это бесплатный инструмент для записи экрана с открытым исходным кодом, который предоставляет пользователям простую в использовании и функциональную альтернативу Screen Studio. Она поддерживает Mac и Windows, полностью бесплатна, соответствует протоколу MIT и может использоваться для индивидуальной...
9 месяцев назад
077.8K
Cloudflare Serverless Registry:基于Cloudflare Workers的无服务器容器注册表

Cloudflare Serverless Registry: бессерверный реестр контейнеров на базе рабочих станций Cloudflare

Общее представление Cloudflare Serverless Registry - это бессерверный реестр контейнеров, основанный на Cloudflare Workers и хранилище R2. Он поддерживает push и pull образов и предоставляет имя пользователя, пароль и...
2 года назад
077.7K
混元Motion1.0 - 腾讯混元团队开源的文本生成3D动作模型

Mixed Motion 1.0 - Команда Tencent Mixed Motion с открытым исходным кодом для генерации текстовых 3D-моделей движения

Hybrid Motion1.0 (HY-Motion1.0) является открытым исходным кодом Tencent Hybrid команды текст генерируется 3D модель действий, используя 1 миллиард параметров Diffusion Transformer архитектуры, может быть непосредственно генерируется через естественный язык описания высококачественной 3D анимации персонажа.
9 месяцев назад
077.7K
ConverzAI - AI招聘平台,自动收集候选人信息进行筛选

ConverzAI - ИИ-платформа для рекрутинга, которая автоматически собирает информацию о кандидатах для отбора

ConverzAI - это рекрутинговая платформа, основанная на технологии искусственного интеллекта, которая оптимизирует процесс подбора персонала. Платформа основана на использовании виртуальных рекрутеров (агентов искусственного интеллекта) для автоматического сбора информации о кандидатах из системы отслеживания заявок (ATS) и проведения первичного отбора. Платформа использует множество каналов, таких как телефон, электронная почта, SMS...
1 год назад
077.7K
Claudable - 开源AI Web应用构建器,自然语言生成代码

Claudable - Open Source AI Web Application Builder, Natural Language Generated Code

Claudable - это конструктор веб-приложений с открытым исходным кодом на базе Next.js, который сочетает в себе передовые возможности искусственного интеллекта Claude Code и Cursor CLI с простым и интуитивным опытом создания приложений Lovable...
1 год назад
077.6K
PaddleOCR-VL - 百度开源的超轻量级视觉-语言模型

PaddleOCR-VL - ультралегкие визуально-лингвистические модели с открытым исходным кодом от Baidu

PaddleOCR-VL - это ультралегкая визуально-лингвистическая модель Baidu с открытым исходным кодом, оптимизированная для сценариев парсинга документов. Модель содержит всего 0,9 Б параметров, благодаря слиянию динамического визуального кодера высокого разрешения и легкой языковой модели ERNIE, сохраняя при этом высокую точность и значительно снижая вычислительные затраты.
11 месяцев назад
077.6K
RoboOS 2.0 - 智谱开源的跨本体具身大小脑协作框架

RoboOS 2.0 - система совместной работы с открытым исходным кодом Wisdom Spectrum для кросс-онтологий с воплощенным размером мозга

RoboOS 2.0 - это фреймворк с открытым исходным кодом для кросс-онтологического взаимодействия "мозг-мозг", который способствует трансформации роботов от одиночного интеллекта к групповому совместному интеллекту. Фреймворк использует архитектуру "большого мозга" для эффективного разделения труда: "облачный мозг" отвечает за принятие сложных решений и совместную работу, а модули "малого мозга" сосредоточены на выполнении конкретных навыков.
1 год назад
077.6K
MuseSteamer - 百度推出的视频生成大模型

MuseSteamer - Baidu запускает большую модель для генерации видео

MuseSteamer - это большая модель для мультимодальной генерации видео, запущенная компанией Baidu. Модель может быстро генерировать высококачественный динамический видеоконтент на основе предоставленных пользователем текстовых описаний или изображений, а также поддерживает различные версии чистоты и функциональности для удовлетворения потребностей в создании видео в различных сценариях.
1 год назад
077.5K
Step-GUI - 阶跃星辰开源的AI Agent系列模型

Step-GUI - Step-Star - модели серии агентов ИИ с открытым исходным кодом

Step-GUI - это серия моделей агентов искусственного интеллекта с открытым исходным кодом от Step-Star, включающая облачную модель Step-GUI, первый протокол MCP для агентов GUI, и первую в отрасли модель Step-GUI Edge с открытым исходным кодом для поддержки развертывания мобильных телефонов.Специализированная...
9 месяцев назад
077.5K
NeverEnds:使用文字描述生成效果逼真的视频

NeverEnds: создание реалистичных видеороликов с текстовыми описаниями

Общее представление NeverEnds - это платформа из Сингапура, которая предоставляет неограниченное творческое пространство для всех видов историй путем преобразования текста в видео с помощью передовой модели. Пользователи могут свободно выражать творчество, передавать эмоции, а также создавать имидж своего бренда на этой платформе. Эта платформа известна своими уникальными...
2 года назад
077.4K
优雅YOYA - 中科闻歌推出的AI音视频内容创作平台

Элегантная YOYA - платформа для создания аудио/видео контента с искусственным интеллектом, запущенная ZTE Winko

Elegant YOYA - это мультимодальная грамотная видеоплатформа, запущенная компанией Zhongke Wenge. Платформа основана на мультимодальной технологии AI для расширения возможностей всей цепочки создания видеоконтента. Пользователям нужно только ввести требования к теме, платформа может быстро генерировать сценарии, изображения, видео, а также выполнять интеллектуальное редактирование, синтез голоса, управление ртом персонажа и другие операции, выход...
1 год назад
077.4K