Последние ресурсы по искусственному интеллекту

共 3185 篇文章
Uthana - AI 3D 角色动画生成平台,文字描述或参考视频生成逼真动画

Uthana - платформа для создания AI 3D-анимации персонажей, текстовое описание или справочное видео для создания реалистичной анимации

Uthana - это мощная платформа для создания 3D-анимации персонажей с помощью искусственного интеллекта. Пользователи вводят текстовые описания, загружают референсные видео или ищут библиотеки движений, а искусственный интеллект быстро генерирует реалистичные анимации, которые можно адаптировать к моделям с любой костной структурой. Платформа оснащена множеством функций, таких как миграция стилей, интеграция API, настройка...
1 год назад
077.4K
Gemini 2.5 Flash Image - 谷歌推出的最强图像生成与编辑模型

Gemini 2.5 Flash Image - самая мощная модель генерации и редактирования изображений от Google

Gemini 2.5 Flash Image (кодовое название nano banana) - это современная модель генерации и редактирования изображений от Google, которая сохраняет согласованность персонажей в разных сценах и поддерживает точное редактирование изображений с помощью естественного языка, например, размытие фона и удаление пятен.
1 год назад
077.4K
Doppl - 谷歌推出的AI虚拟试衣应用

Doppl - приложение для виртуальной примерки с искусственным интеллектом от Google

Doppl - это приложение для виртуальных примерок с искусственным интеллектом от Google. После того как пользователь загружает фотографию всего тела, приложение поддерживает "надевание" картинки одежды или скриншота на цифровую версию собственного тела, а также может преобразовывать статичные изображения в видео, сгенерированное искусственным интеллектом, так что пользователи могут более реально ощутить эффект одежды на теле.
1 год назад
077.4K
商汤如影 - 商汤科技推出的AI数字人视频制作平台

Shangtang Ruyi - платформа для производства цифрового человеческого видео с искусственным интеллектом, запущенная компанией Shangtang Technology

Shangtang Ruying - это платформа для создания цифровых видеороликов с искусственным интеллектом, запущенная компанией Shangtang Technology. Основанная на технологии больших моделей, платформа поддерживает создание высокореалистичных цифровых человеческих образов и персонализацию, включая черты лица, одежду, прически и так далее. Платформа оснащена функциями клонирования звука, генерации видео, автоматического аннотирования данных, взаимодействия в реальном времени и другими...
1 год назад
077.3K
LongCat-Video - 美团LongCat开源的视频生成模型

LongCat-Video - LongCat - модель генерации видео с открытым исходным кодом Mission

LongCat-Video - это модель генерации видео с открытым исходным кодом на 1,36 миллиарда параметров, созданная командой LongCat по протоколу MIT с открытым исходным кодом и поддерживающая три основные задачи: генерация видео с текстом, генерация видео с графом и продолжение видео. Модель, благодаря стратегии генерации "от грубого к тонкому" и блочному механизму разреженного внимания, может в течение нескольких минут ...
11 месяцев назад
077.3K
VoxCPM 1.5 - 面壁智能开源的端到端文本到语音模型

VoxCPM 1.5 - Faceted Intelligence с открытым исходным кодом для конечного моделирования преобразования текста в речь

VoxCPM 1.5 - это модель генерации речи с открытым исходным кодом, выпущенная Facade Intelligence, основанная на технологии преобразования текста в речь (TTS) без необходимости использования разделителя, с несколькими нововведениями и улучшениями. Используя сквозную диффузионную авторегрессионную архитектуру, она генерирует непрерывные речевые волны непосредственно из текста, избегая ограничений традиционных методов сегментации...
9 месяцев назад
077.2K
LongCat-Video-Avatar - 美团开源的虚拟人视频生成模型

LongCat-Video-Avatar - модель генерации видео аватаров с открытым исходным кодом Meituan

LongCat-Video-Avatar - это продвинутая модель создания видео на основе звука, построенная на базе LongCat-Video с открытым исходным кодом от Meituan, ориентированная на создание гиперреалистичных, синхронизированных по губам длинных видео с естественной динамикой и последовательной идентичностью.
9 месяцев назад
077.2K
ChatGPT Agent – OpenAI推出的通用智能AI Agent

Агент ChatGPT - агент искусственного интеллекта общего назначения от OpenAI

ChatGPT Agent - это ИИ-агент общего назначения от OpenAI, который сочетает в себе множество возможностей для автономного выполнения сложных задач. Пользователям достаточно описать свои потребности на естественном языке, и агент может автоматически выбрать подходящие инструменты, такие как просмотр веб-страниц, извлечение информации, выполнение кода...
1 год назад
077.2K
SkyReels-A3 - 昆仑万维推出的音频驱动数字人创作工具

SkyReels-A3 - инструмент для создания цифровых людей на основе аудио от KunlunWangwei

SkyReels-A3 - это инструмент для создания цифровых людей с помощью звука от компании Kunlun World Wide Group. SkyReels-A3 - это аудиоуправляемый инструмент для создания цифровых людей, который может генерировать высококачественный динамический видеоконтент с помощью простых входных данных (например, портретных изображений и голоса), заставлять статические фотографии "оживать", а также заменять реплики в существующих видеороликах на новые, которые персонажи будут автоматически согласовывать с...
1 год назад
077.1K
Hunyuan-GameCraft - 腾讯混元开源的下一代游戏交互式视频生成框架

Hunyuan-GameCraft - фреймворк с открытым исходным кодом от Tencent Hunyuan для создания интерактивного видео для игр нового поколения.

Hunyuan-GameCraft является открытым исходным кодом Tencent Hunyuan команды интерактивных игр видео генерации рамки. Фреймворк из одной картинки и подсказок генерирует высокодинамичное игровое видео, поддерживая пользователя с помощью клавиатуры и мыши для управления видеоконтентом в реальном времени.
1 год назад
077.1K
Hailuo Video Agent - MiniMax推出的AI视频创作Agent

Hailuo Video Agent - агент искусственного интеллекта для создания видео от MiniMax

Hailuo Video Agent - это агент для создания видео с нулевым порогом искусственного интеллекта, запущенный компанией MiniMax, открытая бета-версия. С помощью простого ввода текста или загрузки изображения вы можете создавать высококачественные креативные видео одним щелчком мыши, охватывая различные сценарии применения, такие как широкий...
1 год назад
077.1K
Tencent-HY-MT1.5 - 腾讯混元开源的翻译模型系列

Tencent-HY-MT1.5 - Серия гибридных моделей перевода с открытым исходным кодом Tencent

Tencent-HY-MT1.5 - это гибридная модель перевода Tencent с открытым исходным кодом версии 1.5, включающая две модели 1.8B и 7B, поддерживающая 33 международных языка и 5 видов китайского и китайско-диалектного перевода.Модель 1.8B специально оптимизирована для мобильных телефонов и других устройств потребительского класса, только 1 ГБ оперативной памяти может быть достигнуто на конечной стороне...
9 месяцев назад
076.9K
Shortbread - AI漫画生成工具,自然语言描述完成漫画创作

Shortbread - инструмент для создания комиксов с искусственным интеллектом, описание на естественном языке для завершения создания комиксов

Shortbread - это инструмент для создания комиксов с искусственным интеллектом, который позволяет пользователям быстро создавать полноценные комиксы на основе простых описаний на естественном языке. Shortbread не требует никаких навыков рисования, просто введите текст, и искусственный интеллект быстро создаст персонализированные комиксы с уникальными персонажами, сценами и эмоциями.Sho...
1 год назад
076.8K
Intern-S1-mini - 上海AI Lab开源的轻量化科学多模态模型

Intern-S1-mini - легкая научная мультимодальная модель с открытым исходным кодом от Shanghai AI Lab

Intern-S1-mini - это легкая научная мультимодальная макромодель с параметрическим масштабом 8B, созданная Шанхайской лабораторией искусственного интеллекта (SAL). Она наследует мощные возможности Intern-S1, сочетая в себе как общие, так и специализированные научные возможности, и подходит для быстрого развертывания и вторичной разработки. С точки зрения производительности, I...
1 год назад
076.8K
Kaleido - 智谱AI联合清华大学等开源的多主体参考视频生成模型

Kaleido - многосубъектная модель генерации эталонного видео с открытым исходным кодом, созданная Smart Spectrum AI совместно с Университетом Цинхуа и другими организациями.

Kaleido - это модель генерации мультисубъектного эталонного видео с открытым исходным кодом, разработанная совместно Хэфэйским технологическим университетом, Университетом Цинхуа и Smart Spectrum AI. Она генерирует предметно-согласованное видео на основе нескольких опорных изображений, решая недостатки существующих моделей в области многопредметной согласованности и разделения фона.Kaleido генерирует видео с помощью специализированных данных...
9 месяцев назад
076.7K
Genie 3 - 谷歌推出的通用世界模型

Genie 3 - общая модель мира от Google

Genie 3 - это новое поколение универсальных моделей мира от Google DeepMind, позволяющих создавать высокодинамичные и целостные виртуальные миры в режиме реального времени. Genie 3 моделирует физические явления, природные экосистемы и поддерживает создание фантастических и исторических сценариев. С помощью текстовых подсказок пользователи могут...
1 год назад
076.7K
职达AI简历 - AI简历生成与优化平台,精准分析问题、提供优化建议

JobTech AI CV - платформа для создания и оптимизации резюме с помощью искусственного интеллекта, точно анализирующая проблемы и дающая рекомендации по оптимизации.

Job AI resume - это эффективная и удобная интеллектуальная платформа для составления и оптимизации резюме. Основанная на технологии искусственного интеллекта, платформа помогает пользователям быстро создавать профессиональные и персонализированные резюме. Пользователям нужно только ввести основную информацию и опыт, платформа может генерировать высококачественное резюме за короткое время, предоставляя 2800+ красивых шаблонов, охватывающих различные позиции.
1 год назад
076.7K
Higress MCP - 今日投资推出的MCP服务平台

Higress MCP - Invest Today запускает платформу для предоставления услуг MCP

Higress MCP - это инновационная платформа, запущенная компанией Invest Today, которая поддерживает быструю трансформацию традиционных API финансовых данных в современные MCP-сервисы. Higress MCP позволяет преобразовывать REST API в MCP Server на основе простой конфигурации без необходимости кодирования...
1 год назад
076.7K
NitroGen - 英伟达联合斯坦福大学、加州理工等开源的游戏AI模型

NitroGen - модель игрового ИИ с открытым исходным кодом от NVIDIA в сотрудничестве со Стэнфордом, Калифорнийским технологическим институтом и другими.

NitroGen - это модель игрового ИИ с открытым исходным кодом, разработанная NVIDIA совместно со Стэнфордским университетом, Калифорнийским технологическим институтом и другими учреждениями, способная играть в более чем 1000 различных типов игр. Модель основана на архитектуре GROOT N1.5 и достигается путем анализа 40 000 часов игровых видеоданных (включая аннотацию операций с джойстиком)...
9 месяцев назад
076.7K
gpt-oss - OpenAI推出的开源推理模型系列

gpt-oss - семейство моделей вывода с открытым исходным кодом от OpenAI

gpt-oss - это семейство моделей вывода с открытым исходным кодом от OpenAI, которые обеспечивают эффективные, гибкие и простые в развертывании решения в области искусственного интеллекта для разработчиков. gpt-oss выпускается в двух версиях: gpt-oss-120B с 117 миллиардами параметров и поддержкой 8...
1 год назад
076.6K
Hunyuan3D-Omni - 腾讯混元开源的3D模型生成框架

Hunyuan3D-Omni - Tencent Mixed Source Open Source 3D Model Generation Framework

Hunyuan3D-Omni (Hybrid 3D-Omni) - это фреймворк с открытым исходным кодом для создания 3D-активов, разработанный командой Tencent's Hybrid 3D, который позволяет точно генерировать 3D-модели с помощью нескольких управляющих сигналов. Основанный на архитектуре Hunyuan3D 2.1, он представляет унифицированный кодер управления, который может обрабатывать точечные...
12 месяцев назад
076.6K
InternVLA-A1 - 上海AI Lab开源一体化操作能力的具身大模型

InternVLA-A1 - Shanghai AI Lab Интеграция операционных возможностей для воплощенных больших моделей с открытым исходным кодом

InternVLA-A1 - это большая модель воплощенной работы, открытая Шанхайской лабораторией искусственного интеллекта. Она способна понимать, представлять и выполнять интеграцию, а также точно выполнять поставленные задачи. Модель объединяет реальные и симулированные операционные данные и автоматизирует построение массивных мультимодальных через крупномасштабные виртуально-реальные гибридные активы сцены...
1 год назад
076.5K
OpenAI《在AI时代保持领先》PDF指南 - 附下载链接

PDF-руководство OpenAI о том, как оставаться впереди в эпоху ИИ - со ссылками для скачивания

Оставаясь впереди в эпоху ИИ - это руководство по ИИ от OpenAI, которое помогает бизнес-лидерам сохранять конкурентные преимущества в эпоху ИИ. В руководстве отмечается быстрый рост ИИ, ускорение выпуска моделей, снижение затрат и ускорение внедрения на предприятиях...
1 год назад
076.4K
Magistral - Mistral AI 推出的系列推理模型

Magistral - серия моделей выводов от Mistral AI

Magistral - это модель выводов от Mistral AI, ориентированная на прозрачные, многоязычные и специфичные для конкретной области рассуждения. Модель состоит из версии с открытым исходным кодом (Magistral Small) и корпоративной версии (Magistral Medium), последняя...
1 год назад
076.3K
Qwen3-Coder-Flash - 阿里通义推出的开源高性能编程模型

Qwen3-Coder-Flash - высокопроизводительная модель программирования с открытым исходным кодом от Али Тонги

Qwen3-Coder-Flash - это высокопроизводительная модель программирования, представленная командой Ali Tongyi Thousand Questions, которая обладает отличными возможностями программирования на основе агентов и вызова инструментов, а также хорошо справляется со сложными задачами программирования. Модель поддерживает 256K токенов длинного контекстного понимания, и может масштабироваться до 1M ...
1 год назад
076.3K
AnimaTensor - 吐司AI等机构推出的二次元图像生成模型

AnimaTensor - квадратичная модель генерации изображений от Toast AI и других разработчиков

AnimaTensor - это квадратичная модель генерации изображений от команды CagliostroLab в сотрудничестве с TensorArt, основанная на инновационной технике V-Prediction, которая оптимизирует планирование шума путем предсказания "скорости" процесса генерации изображений...
1 год назад
076.3K
GLM-Experimental - 智谱AI推出的实验性模型

GLM-Experimental - экспериментальная модель, запущенная Smart Spectrum AI

GLM-Experimental - это экспериментальная модель большого языка, созданная компанией Wisdom Spectrum AI, которая теперь доступна на платформе Z.ai. Модель способна автоматически генерировать PPT. После ввода пользователями тем или ключевых моментов модель может быстро генерировать четко структурированные и отформатированные презентации, которые...
1 год назад
076.3K
gpt-realtime - OpenAI最新推出的AI语音模型

gpt-realtime - новейшая речевая модель ИИ от OpenAI

gpt-realtime - это усовершенствованная модель речи от OpenAI, которая поддерживает прямую обработку звука для создания естественной и плавной речи. Модель поддерживает множество языков и стилей, понимает невербальные сигналы, такие как смех, и может переключаться между языками.
1 год назад
076.2K
无问芯穹:企业级AI开发,云端资源服务平台

Без вопросов Core Dome: разработка ИИ для предприятий, платформа для обслуживания облачных ресурсов

Комплексное внедрение No Ask Core Dome - это комплексная сервисная платформа для разработчиков ИИ, предоставляющая инструменты для разработки ИИ и услуги по созданию больших моделей. Платформа имеет разнообразные инструменты разработки машинного обучения, такие как AIStudio, GenStudio и т.д. Она также поддерживает развертывание моделей, хранение данных и...
2 года назад
076.1K
靠岸妙写 - AI论文写作工具,构思到成稿一站式解决

Cushion Wonderful Writer - инструмент для написания эссе с искусственным интеллектом, универсальное решение от идеи до готовой работы

Leaning Wonderful Writer - это инструмент для написания диссертаций с искусственным интеллектом, который обеспечивает эффективное и удобное решение для написания академических работ. Инструмент поддерживает создание одним щелчком мыши конспекта, аннотации и первого варианта диссертации, что применимо для различных уровней академических потребностей, таких как бакалавриат и магистратура, охватывая многодисциплинарные области, такие как наука и техника, искусство и социальные науки.
1 год назад
076.1K
企鹅读伴 - 腾讯推出的中小学生AI阅读助手

Penguin Reading Companion - помощник по чтению с искусственным интеллектом от Tencent для учеников начальной и средней школы

Penguin Reading Companion - это ассистент чтения с искусственным интеллектом, разработанный компанией Tencent для учащихся начальной и средней школы. Penguin Reading Companion опирается на гибридную большую модель Tencent и метамашинную платформу в сочетании с программой обязательного обучения языку и стандартами учебного плана (издание 2022 года), чтобы предоставить ученикам персональные рекомендации по чтению, несколько режимов чтения (сосредоточение, чтение вслух, прослушивание...
1 год назад
076K
Klic Studio - AI音视频翻译配音工具,一键部署全流程

Klic Studio - инструмент для перевода и дубляжа аудио/видео с искусственным интеллектом, развертывание всего процесса одним щелчком мыши

Klic Studio (ранее Krillin AI) - это инструмент для перевода, дубляжа и клонирования голоса на основе искусственного интеллекта, предназначенный для создателей видео и экспортеров контента. Он поддерживает развертывание всего процесса в один клик, что позволяет завершить видео от загрузки до вывода в один клик, и адаптирован для Jieyin, Xiaohongshu, B...
1 год назад
076K
JoyHallo - 京东开源的AI数字人模型

JoyHallo - цифровая модель человека с открытым исходным кодом ИИ от Kyodo

JoyHallo - это цифровая модель человека с открытым исходным кодом от Jingdong, разработанная для мандаринского языка и поддерживающая преобразование аудио в реалистичное разговорное видео. JoyHallo встраивает аудиофункции на основе модели wav2vec2, используя полуразделенную структуру для повышения точности предсказания движения губ, и поддерживает генерацию английского видео...
1 год назад
076K
FactSnap - 新一代AI信息核查工具

FactSnap - инструмент для проверки информации с помощью искусственного интеллекта нового поколения

FactSnap - это инструмент проверки информации с помощью искусственного интеллекта нового поколения, который помогает пользователям быстро проверять подлинность веб-информации. Благодаря интеграции нескольких моделей и поисковых систем он выполняет проверку выбранного текста в режиме реального времени, пока пользователь просматривает веб-страницы.
1 год назад
075.9K
MiniMax Music 1.5 - MiniMax最新推出的AI音乐生成模型

MiniMax Music 1.5 - Новейшая модель генерации музыки с искусственным интеллектом от MiniMax!

MiniMax Music 1.5 - это продвинутый инструмент для генерации музыки с помощью искусственного интеллекта, который позволяет генерировать до 4 минут музыки на основе описания пользователя на естественном языке. Модель поддерживает широкий спектр музыкальных стилей и настроек, генерирует естественные и полные вокальные тона, плавные переходы и богатые многослойные аранжировки...
1 год назад
075.7K
Squibler - AI小说辅助写作平台,助力构思到创作全过程

Squibler - платформа для написания романов с помощью искусственного интеллекта, обеспечивающая весь процесс от идеи до создания.

Squibler - это мощная платформа для писателей с поддержкой искусственного интеллекта, которая помогает пользователям пройти весь путь от замысла до создания и публикации. Платформа предлагает множество шаблонов для написания романов, сценариев, рассказов и т. д. Пользователям нужно только ввести первоначальную концепцию, а ИИ сгенерирует наброски, персонажей, сцены...
1 год назад
075.5K
Goedel-Prover-V2 - 普林斯顿联合清华和英伟达等开源的定理证明模型

Goedel-Prover-V2 - модель доказательства теорем с открытым исходным кодом, разработанная в Принстоне совместно с Цинхуа, NVIDIA и другими компаниями.

Goedel-Prover-V2 - это модель доказательства теорем с открытым исходным кодом от ведущих институтов, таких как Принстонский университет, Университет Цинхуа и NVIDIA. В основе модели лежат такие инновационные техники, как иерархический синтез данных, самокоррекция, направляемая верификатором, и усреднение модели, позволяющие значительно повысить производительность автоматизированных формальных доказательств...
1 год назад
075.4K
Z-Image - 阿里通义实验室开源的图像生成模型

Z-Image - модель генерации изображений с открытым исходным кодом от Ali Tongyi Labs

Z-Image - это модель генерации изображений с открытым исходным кодом от Ali Tongyi Labs, обладающая эффективными, быстрыми и мощными возможностями генерации изображений. Используя архитектуру однопоточного диффузионного трансформатора (S3-DiT), она объединяет текст, визуальную семантику и маркеры VAE изображений в единый входной поток...
10 месяцев назад
075.3K
MoE-TTS - 昆仑万维推出的最新语音生成框架

MoE-TTS - новейший фреймворк для генерации речи от KunlunWei

MoE-TTS - это система синтеза речи, представленная компанией KunlunWanwei, основанная на архитектуре Mixed Expert (MoE), которая объединяет предварительно обученные большие языковые модели (LLM) с речевыми экспертными модулями. MoE-TTS сохраняет мощные текстовые рассуждения, замораживая параметры текстовых модулей и обновляя только параметры речевых модулей...
1 год назад
075.3K
Nemotron 3 - 英伟达发布的开源 AI 模型系列

Nemotron 3 - семейство моделей ИИ с открытым исходным кодом, выпущенное NVIDIA

Nemotron 3 - это семейство моделей ИИ с открытым исходным кодом, выпущенных NVIDIA в размерах Nano, Super и Ultra. В Nemotron 3 используется скрытая архитектура MoE, которая значительно повышает эффективность вычислений и снижает операционные расходы. Одна из...
9 месяцев назад
075.3K
Skywork-SWE-32B - 昆仑万维开源的自主代码智能体基座模型

Skywork-SWE-32B - базовая модель интеллектуального тела с открытым исходным кодом KunlunWanwei

Skywork-SWE-32B - базовая модель автономных кодовых интеллектов с открытым исходным кодом масштаба 32B для программной инженерии (SWE), представленная компанией Kunlun World Wide Web. Модель ориентирована на задачи программной инженерии, обладает мощными возможностями восстановления кода на уровне репозитория и может работать в сложных сценариях с многораундовым взаимодействием и длительной обработкой текста...
1 год назад
075.3K
Step-Audio-AQAA – StepFun推出的端到端大音频语言模型

Step-Audio-AQAA - сквозная модель большого аудиоязыка от StepFun

Step-Audio-AQAA - это сквозная крупномасштабная модель аудиоязыка для задач "аудиозапрос-аудиоответ" (AQAA) от команды StepFun. Она может напрямую обрабатывать аудиоданные для генерации естественных и точных речевых ответов, не полагаясь на традиционное автоматическое распознавание речи (A...
1 год назад
075.3K
Mureka V7.5 - 昆仑万维推出的先进AI音乐创作模型

Mureka V7.5 - усовершенствованные модели создания музыки с искусственным интеллектом от Quintessence

Mureka V7.5 - это современная модель генерации музыки с помощью искусственного интеллекта от Kunlun World Wide, ориентированная на создание китайских песен. Модель точно воспроизводит тембр и технику игры для создания естественного, плавного и эмоционального вокала. Основанная на оптимизированной технологии автоматического распознавания речи (ASR), Mureka V...
1 год назад
075.2K
Seed GR-3 - 字节跳动Seed团队推出的通用机器人模型

Seed GR-3 - робототехническая модель общего назначения от команды Wordpress Seed

Seed GR-3 - это робототехническая модель общего назначения, представленная компанией ByteDance, с сильными возможностями обобщения для адаптации к новым условиям и сложным командам. Модель объединяет визуальную, вербальную информацию и информацию о движении и основана на методе обучения "три в одном", включающем данные о роботе, данные о траектории движения человека в VR и публичные графические данные, чтобы улучшить способность реагировать на новые объекты...
1 год назад
075.2K
Lumina-DiMOO - 上海AI Lab联合华为昇腾开源的多模态大模型

Lumina-DiMOO - мультимодальная большая модель с открытым исходным кодом от Shanghai AI Lab и Huawei Rise

Lumina-DiMOO - это унифицированная модель нового поколения для мультимодального генерирования и понимания, представленная Шанхайской лабораторией искусственного интеллекта (SAL) совместно с Huawei Rise на Всемирной конференции по искусственному интеллекту 2025. Основанная на базовой аппаратно-программной платформе Rise AI и наборе мультимодальных больших моделей MindSpeed MM, она завершает...
1 год назад
075.2K
HunyuanImage 3.0 - 腾讯开源的免费多模态图像生成模型

HunyuanImage 3.0 - бесплатная мультимодальная модель генерации изображений с открытым исходным кодом от Tencent

HunyuanImage 3.0 (Hunyuan Image 3.0) - нативная мультимодальная модель генерации изображений, выпущенная и открытая компанией Tencent. Размер параметров модели составляет 80B, на данный момент это лучшие результаты оценки, самое большое количество параметров среди моделей генерации изображений с открытым исходным кодом. Hybrid Image 3.0 поддерживает генерацию изображений в режиме реального времени, пользователи могут...
12 месяцев назад
075.2K
Ovis-U1 - 阿里推出的多模态统一AI模型

Ovis-U1 - мультимодальная унифицированная модель искусственного интеллекта, выпущенная компанией Ali

Ovis-U1 - это мультимодальная унифицированная модель, представленная командой Ovis компании Alibaba Group с масштабом параметров 3 миллиарда. Модель обладает тремя основными возможностями: мультимодальным пониманием, генерацией текста в изображение и редактированием изображений, а благодаря передовому архитектурному дизайну и совместным унифицированным методам обучения она позволяет реализовать высокоточную...
1 год назад
075.1K
EXAONE 4.0 - LG推出的混合推理模型

EXAONE 4.0 - гибридная модель рассуждений от LG

EXAONE 4.0 - это гибридная интеллектуальная модель от корейской компании LG AI Research, сочетающая в себе обработку естественного языка общего назначения и расширенные возможности рассуждений. Модель поддерживает корейский, английский и испанский языки и подразделяется на профессиональную версию объемом 32 ББ и конечную версию объемом 1,2 ББ. Профессиональная версия подходит для юридических, бухгалтерских...
1 год назад
075K
DeckSpeed - AI PPT制作工具,自然语言生成演示文稿

DeckSpeed - AI PPT Maker, презентация, созданная на естественном языке

DeckSpeed - это инструмент для создания презентаций с искусственным интеллектом, основанный на разговорном взаимодействии, где пользователи выражают свои потребности на естественном языке и быстро генерируют персонализированные слайды, не полагаясь на традиционные шаблоны. Инструмент поддерживает обратную связь в режиме реального времени, пользователи могут в любой момент изменить цвет, стиль и содержание слайдов, чтобы гарантировать, что презентация будет завершена...
1 год назад
074.9K
Kandinsky 5.0 - 俄罗斯AI团队开源的视频生成模型系列

Кандинский 5.0 - серия моделей генерации видео с открытым исходным кодом от российской команды ИИ

Kandinsky 5.0 - это новейшая серия моделей поколения видео, разработанная российской командой искусственного интеллекта и ориентированная на легкий дизайн и высокую производительность. Первая модель серии, Kandinsky 5.0 Video Lite, имеет всего 2 миллиарда параметров, но превосходит аналогичные модели 14B, особенно...
11 месяцев назад
074.7K
自动生成每日Product Hunt热门产品榜单

Автоматическое составление ежедневных списков горячих продуктов Product Hunt

Общие сведения Введение Product Hunt Daily Chinese Hotlist - это автоматизированный инструмент, основанный на GitHub Actions, который генерирует ежедневный список популярных товаров на Product Hunt через регулярные промежутки времени, в виде файла Markdown...
2 года назад
074.7K
UnifiedTTS - 一站式TTS API服务平台,实时性能监控

UnifiedTTS - единая сервисная платформа TTS API, мониторинг производительности в реальном времени

UnifiedTTS - это универсальная платформа для предоставления услуг преобразования текста в речь (TTS). Она поддерживает множество языков, включая китайский, английский, японский и корейский, чтобы удовлетворить потребности глобального бизнеса. Благодаря унифицированному API-интерфейсу в нее интегрированы многие основные TTS-сервисы, включая Micro...
1 год назад
074.5K
Skywork UniPic 2.0 - 昆仑万维开源的高效多模态模型

Skywork UniPic 2.0 - эффективное мультимодальное моделирование с открытым исходным кодом от KunlunWanwei

Skywork UniPic 2.0 - это эффективная мультимодальная модель с открытым исходным кодом от Quintessence, ориентированная на создание, редактирование и понимание изображений. Модель основана на 2B-параметрической архитектуре SD3.5-Medium и реализуется с помощью предварительного обучения, прогрессивной стратегии двухзадачного усиления и совместного обучения...
1 год назад
074.4K
Confucius3-Math - 网易有道推出专注于数学教育的开源推理模型

Confucius3-Math - NetEase.com запускает модель рассуждений с открытым исходным кодом, ориентированную на обучение математике

Confucius3-Math - это первая отечественная модель рассуждений с открытым исходным кодом, ориентированная на обучение математике, открытая NetEaseYouDao. Имея 14 миллиардов параметров, оптимизированных для сценариев обучения математике K-12, она может эффективно работать на одном графическом процессоре потребительского класса (например, RTX 4090D), при этом производительность умозаключений составляет около...
1 год назад
074.4K
AudioFly - 科大讯飞开源的文本生成音效AI模型

AudioFly - модель искусственного интеллекта KU Xunfei с открытым исходным кодом для генерации текста и звука

AudioFly - это модель искусственного интеллекта с открытым исходным кодом для генерации звуковых эффектов из текста, разработанная компанией KDDI. Основана на архитектуре потенциальной диффузионной модели с 1 миллиардом параметров, обучена на крупномасштабных разнообразных аудиотекстовых наборах данных, включая публичные наборы данных, такие как AudioSet, AudioCaps, TUT и внутренние...
12 месяцев назад
074.3K
FLUX.1 Kontext - 黑森林推出的图像生成与编辑模型

FLUX.1 Kontext - модель генерации и редактирования изображений из Шварцвальда

FLUX.1 Kontext - это модель генерации и редактирования изображений от Black Forest Labs, которая предоставляет методы обработки изображений с учетом контекста. Модель понимает реакцию на текстовые и графические сигналы, выполняет такие задачи, как изменение объектов, преобразование стилей и замена фона, сохраняя при этом угловую...
1 год назад
074.2K
稿定AI社区 - AI创意内容设计平台,多种设计资源满足不同创作需求

Drafting AI Community - платформа для проектирования творческого контента AI, разнообразные дизайнерские ресурсы для удовлетворения различных творческих потребностей

Drafting AI Community - это онлайн-платформа творческого вдохновения AI, которая предоставляет пользователям множество ресурсов и инструментов для творческого дизайна. Платформа охватывает различные области дизайна, включая фотографии изображений, дизайн электронной коммерции, праздничные темы, 3D-иллюстрации, дизайн аватаров, материалы Xiaohongshu, дизайн портретов и т. д., чтобы удовлетворить потребности различных пользователей.
1 год назад
074.1K
Mistral Code - Mistral AI推出面向企业的AI编程助手

Mistral Code - Mistral AI запускает помощника по программированию ИИ для бизнеса

Mistral Code - это помощник по программированию с искусственным интеллектом для команд разработчиков, созданный компанией Mistral AI и объединяющий четыре модели: Codestral, Codestral Embed, Devstral и Mistral Medium, поддерживающие...
1 год назад
074.1K
CRIC深度智联 - 克而瑞推出的中国房地产首个AI Agent

CRIC - Первый агент искусственного интеллекта для китайской недвижимости, запущенный CRIC

CRIC Depth Intelligence - это первый интеллектуальный орган ИИ для китайской недвижимости, самостоятельно разработанный CRIC, основанный на 20-летнем опыте CRIC в сфере недвижимости, накоплении данных и мультимодальной технологии больших моделей, которая открывает всю цепочку от интеграции данных, интеллектуального анализа до создания контента.
1 год назад
074K
ThinkSound - 阿里通义推出的音频生成模型

ThinkSound - моделирование генерации звука от Али Тонги

ThinkSound - это первая модель генерации звука на основе технологии CoT (Chain Thinking), представленная речевой командой Али Тонги (Ali Tongyi). Модель может генерировать точно подобранные звуковые эффекты для видеоизображений, основываясь на внедрении CoT-рассуждений, чтобы решить проблему, когда традиционной технологии сложно уловить динамические детали экрана и пространственные отношения.
1 год назад
074K
SAM Audio - Meta推出的开源多模态音频分割模型

SAM Audio - Мультимодальная модель сегментации аудио с открытым исходным кодом из Meta

SAM Audio - это мультимодальная модель сегментации звука с открытым исходным кодом, представленная компанией Meta для точного выделения произвольных целевых звуков из сложных аудиомиксов. Объединяя текстовые, визуальные и временные сигналы, она обеспечивает гибкую и эффективную обработку звука для таких задач, как редактирование, денуазинг, извлечение звука и...
9 месяцев назад
074K
AutoMV - M-A-P联合北邮、南大等开源的免费音乐视频生成系统

AutoMV - M-A-P - бесплатная система генерации музыкального видео с открытым исходным кодом, созданная совместно с Beipiao, NU и другими.

AutoMV - это система генерации музыкальных видеоклипов с открытым исходным кодом, разработанная командой M-A-P в сотрудничестве с несколькими университетами, которая может автоматически генерировать последовательные музыкальные видеоклипы на основе полных песен без обучения. Она использует многоинтеллектуальную совместную модель, включающую модули анализа музыки, написания сценария, режиссуры и контроля качества, и может точно анализировать тексты, ритмы...
9 месяцев назад
074K
Genie Envisioner - 智元联合北航等开源的通用机器人操作平台

Genie Envisioner - робототехническая платформа общего назначения с открытым исходным кодом, разработанная компанией Jiyuan совместно с Beihang и другими компаниями.

Genie Envisioner (GE) - это единая платформа для робототехнических операций, разработанная командой Genie Robotics в сотрудничестве с Национальным университетом Сингапура, Пекинским университетом аэронавтики и астронавтики и другими учреждениями. Она позволяет роботам лучше понимать и выполнять задачи, "сначала представляя, потом действуя".
1 год назад
073.9K
CWM - Meta FAIR开源的代码世界语言模型

CWM - Meta FAIR Open Source Code World Language Model

CWM (Code World Model) - это 32-миллиардная модель языка мира с открытым исходным кодом, выпущенная командой Meta FAIR и предназначенная для генерации и обоснования кода. Она вводит понятие "модель мира", которая может имитировать процесс выполнения кода, предсказывать изменения состояния переменных и продвигать...
12 месяцев назад
073.9K
全球首个量子 AI 模型问世!SECQAI 发布 QLLM 即将进入 Beta 测试

Первая в мире квантовая модель ИИ! SECQAI выпустила QLLM для бета-тестирования!

SECQAI, британская компания по производству сверхзащищенного оборудования и программного обеспечения, объявила о запуске первой в мире Квантовой модели большого языка (QLLM), которая интегрирует технологию квантовых вычислений в традиционные модели ИИ для повышения эффективности вычислений и возможностей решения задач. Квантовая механика + ИИ = более мощный ИИ? ...
2 года назад
073.6K
Mureka V7 - 昆仑万维推出的AI音乐生成模型

Mureka V7 - модели генерации музыки с помощью искусственного интеллекта от Quintessence

Mureka V7 - это передовая модель генерации музыки с помощью искусственного интеллекта, выпущенная компанией Kunlun World Wide. Модель основана на технологии MusiCoT, которая поддерживает планирование общей структуры музыки перед заполнением деталей для создания более последовательных и художественных музыкальных произведений.
1 год назад
073.6K
MinerU2.5 - 上海AI Lab联合北大开源的文档解析模型

MinerU2.5 - открытая модель синтаксического анализа документов из Шанхайской лаборатории искусственного интеллекта и Пекинского университета

MinerU2.5 - это модель визуального языка, разработанная совместно Шанхайской лабораторией искусственного интеллекта и командой Пекинского университета и направленная на эффективный разбор изображений документов высокого разрешения. Основная инновация заключается в двухфазном дизайне "обнаружение глобального расположения с последующим распознаванием локального содержания": первая фаза представляет собой низкое разрешение...
11 месяцев назад
073.5K
MedASR - 谷歌开源的医疗语音识别模型

MedASR - модель распознавания медицинской речи с открытым исходным кодом от Google

MedASR - это модель распознавания медицинской речи с 105 миллионами параметров, открытая компанией Google, отлаженная на 5000-часовом десенсибилизированном клиническом корпусе, оптимизированная для терминологии лекарств, дозировок и анатомической терминологии, со встроенной 6-граммовой моделью медицинского языка и коэффициентом ошибок в словах всего 4,6 на частном наборе данных по радиологии RAD-DICT...
9 месяцев назад
073.4K
悟能 - 商汤科技最新推出的具身智能平台

Wuneng - новейшая платформа телесного интеллекта от Shangtang Technology

Wuneng - это платформа воплощенного интеллекта, предназначенная для роботов и умных устройств. Основанная на модели мира "Просветленный" и технологии мультимодальных больших моделей, Wuneng интегрирует мультисенсорные данные, такие как зрение, голос, прикосновение и т. д., и обладает мощными возможностями восприятия, принятия решений и действий.
1 год назад
073.3K
AntSK FileChunk - 免费的AI语义文档切片工具,动态切片调整

AntSK FileChunk - бесплатный инструмент для семантической нарезки документов AI, динамическая настройка нарезки

AntSK FileChunk - это бесплатный интеллектуальный инструмент для нарезки документов, предназначенный для приложений RAG (Retrieval Augmented Generation). Семантика как основа, документ будет интеллектуально нарезан на семантически полные, последовательные сегменты, поддержка нескольких языков, динамическая настройка размера фрагмента для обеспечения контекстной целостности.
1 год назад
073.3K
日日新 V6.5 - 商汤科技推出的最新多模态推理大模型

Day by Day V6.5 - новейшая макромодель мультимодальных выводов от ShangTech

Day by Day V6.5 - это продвинутая макромодель мультимодальных выводов от ShangTech, разработанная для работы со смешанными изображениями и текстом, поддерживающая точное понимание содержимого изображений и генерирующая описания или ответы на вопросы в сочетании с текстом.
1 год назад
073.1K
Qwen-Image-Layered - 阿里团队开源的AI图像编辑模型

Qwen-Image-Layered - модель редактирования изображений с искусственным интеллектом, открытая командой Ali

Qwen-Image-Layered - это модель редактирования изображений с открытым исходным кодом от команды Ali, которая интеллектуально разбивает обычные изображения на независимые прозрачные слои для достижения точности редактирования, подобной Photoshop. Модель имеет открытый исходный код по протоколу Apache 2.0 и поддерживает гибкое управление слоями...
9 месяцев назад
073.1K
Lucy Edit - 开源的AI视频编辑工具,自然语言描述编辑

Lucy Edit - инструмент для редактирования видео с открытым исходным кодом и искусственным интеллектом, редактирование описаний на естественном языке

Lucy Edit - это инструмент для редактирования видео с открытым исходным кодом, разработанный компанией Decart AI. Позволяет пользователям редактировать видео с помощью простых описаний на естественном языке, таких как "изменить персонажа на белого медведя" или "превратить сцену в 2D-мультфильм", без необходимости сложной тонкой настройки или использования масок ...
1 год назад
073K
Midjourney V1- Midjourney推出的首个图生视频模型

Midjourney V1 - первая графическая видеомодель Midjourney

Midjourney V1 - это первая модель генерации видео с искусственным интеллектом от Midjourney, которая поддерживает преобразование статичных изображений в яркие и динамичные видео с помощью передовой технологии искусственного интеллекта. Пользователям достаточно загрузить изображения или картинки, созданные с помощью Midjourney, нажать...
1 год назад
072.7K
Step-Audio 2 mini - 阶跃星辰开源的语音大模型

Step-Audio 2 mini - макромоделирование речи с открытым исходным кодом Step-Star

Step-Audio 2 mini - это сквозная речевая макромодель с открытым исходным кодом от Step-Audio. Она преодолевает традиционную структуру речевых моделей и использует истинную сквозную мультимодальную архитектуру, которая напрямую преобразует исходный аудиосигнал в речевой отклик, с меньшей задержкой, и понимает паралингвистическую информацию и невокальные сигналы.
1 год назад
072.6K