Последние ресурсы по искусственному интеллекту

共 3143 篇文章
InternVL3.5 - 上海AI实验室开源的多模态大模型

InternVL3.5 - Шанхайская лаборатория искусственного интеллекта с открытым исходным кодом мультимодальных больших моделей

InternVL3.5 (Shusheng-Wanxiang 3.5) - это мультимодальная крупная модель Шанхайской лаборатории искусственного интеллекта с открытым исходным кодом. Модель полностью модернизирована с точки зрения общих возможностей, способности рассуждать и эффективности развертывания, предоставляет девять размеров версий от 1 млрд до 241 млрд параметров, охватывая различные сценарии спроса на ресурсы, включая тол...
11 месяцев назад
066.9K
Mu - 微软推出的小参数语言模型,支持Windows智能体

Mu - Microsoft представляет модель языка с малыми параметрами для поддержки Windows Intelligentsia

Mu - это малопараметрическая языковая модель от Microsoft, имеющая всего 330 миллионов параметров и предназначенная для эффективной работы на NPU и пограничных устройствах. Модель основана на архитектуре кодировщика-декодировщика и достигает скорости отклика более 100 лексем в секунду благодаря оптимизации с учетом аппаратного обеспечения, квантованию модели и тонкой настройке под конкретную задачу.Mu...
1 год назад
066.8K
浙大先生 - 浙大推出的AI智能体平台,深度融合DeepSeek

ZJU - ZJU запускает интеллектуальную платформу AI для тела с глубокой интеграцией DeepSeek

Mr Zhejiang University - это платформа для глубоко интегрированного интеллекта, запущенная Чжэцзянским университетом, основанная на моделях DeepSeek V3 и R1, опирающаяся на платформу обмена ресурсами CARSI и предоставляющая бесплатные услуги для преподавателей и студентов Чжэцзянского университета, а также преподавателей и студентов 829 колледжей и университетов, связанных с CARSI, по всей стране.
1 год назад
066.8K
Hailuo 02 - MiniMax推出的AI视频生成模型,性能超越可灵和Veo 3

Hailuo 02 - MiniMax запускает модель генерации видео с искусственным интеллектом, которая превосходит Koring и Veo 3

Hailuo 02 - новая модель искусственного интеллекта для генерации видео от MiniMax, которая является обновленной версией Hailuo 01. Модель демонстрирует отличные результаты в доменах видео, сгенерированного из графов и текста, уступая лишь Byte's Seedance 1.0 и опережая Fast...
1 год назад
066.7K
浙江大学免费PDF资料《大模型基础》 - 附下载链接

Бесплатные PDF-файлы по основам больших моделей из Чжэцзянского университета - с ссылкой на скачивание

Книга "Основы больших моделей" содержит глубокий анализ основных технологий и практических путей создания больших языковых моделей (LLM). Начиная с фундаментальной теории моделирования языка, он систематически объясняет принципы построения моделей на основе статистических, рекуррентных нейросетевых (RNN) и трансформаторных архитектур, фокусируясь на трех основных больших языковых моделях...
11 месяцев назад
066.7K
Clacky AI - AI编程助手,面向开发者的云端开发环境

Clacky AI - ассистент программирования ИИ, облачная среда разработки для разработчиков

Clacky AI - это облачная среда разработки (CDE) для разработчиков, предназначенная для создания ассистентов программирования ИИ уровня L3. Инструмент поддерживает множество языков программирования, включая Python, Node.js, Golang, Ruby и Java, и может помочь разработчикам быстро...
1 год назад
066.7K
Tizzy.ai - 百度推出的AI搜索应用

Tizzy.ai - поисковое приложение с искусственным интеллектом, запущенное компанией Baidu

Tizzy.ai - это интеллектуальное поисковое приложение, созданное компанией Baidu.Tizzy.ai основано на технологии больших моделей Baidu, имеет мощные функции интеллектуального поиска, может быстро отвечать на вопросы, глубоко мыслить и помогать в принятии решений.Tizzy.ai имеет простой интерфейс, без рекламы и всплывающих окон, а в нижней части руководства...
1 год назад
066.7K
吴恩达面向开发者的ChatGPT提示工程免费课程

Бесплатный курс по разработке советов ChatGPT для разработчиков от Эрнеста Нг

ChatGPT Tip Engineering for Developers - это совместный курс DeepLearning.AI и OpenAI, предназначенный для разработчиков, в котором участвуют Иза Фулфорд, Эндрю Нг, чтобы научить использовать большие языковые модели (LLM)...
11 месяцев назад
066.6K
Mobvoi MCP Server - 出门问问开源的多模态MCP服务工具

Mobvoi MCP Server - инструмент мультимодального MCP-сервиса с открытым исходным кодом

Mobvoi MCP Server - это инструмент для интеграции мультимодальных возможностей ИИ, созданный компанией GoDoQ. Mobvoi MCP Server - это мультимодальный инструмент ИИ, который объединяет в себе генерацию голоса, клонирование звука, цифровых людей на основе изображений, дубляж видео и перевод видео, которые могут быть гибко вызваны пользователем, вводящим текст.Mobvoi MCP S...
1 год назад
066.6K
A2UI - 谷歌开源的Agent驱动型用户交互界面声明式协议

A2UI - декларативный протокол с открытым исходным кодом от Google для интерфейсов взаимодействия с пользователем, управляемых агентами

A2UI (Agent-to-User Interface) - это протокол интерфейса с открытым исходным кодом от Google, который решает проблемы создания сложных интерактивных интерфейсов для агентов искусственного интеллекта. Благодаря декларативному формату JSON, позволяющему агентам ИИ описывать структуру пользовательского интерфейса, клиентские приложения ...
7 месяцев назад
066.6K
GLM-Experimental - 智谱AI推出的实验性模型

GLM-Experimental - экспериментальная модель, запущенная Smart Spectrum AI

GLM-Experimental - это экспериментальная модель большого языка, созданная компанией Wisdom Spectrum AI, которая теперь доступна на платформе Z.ai. Модель способна автоматически генерировать PPT. После ввода пользователями тем или ключевых моментов модель может быстро генерировать четко структурированные и отформатированные презентации, которые...
1 год назад
066.5K
Gemini CLI - 谷歌开源的编程Agent

Gemini CLI - Агент программирования с открытым исходным кодом Google

Gemini CLI - это инструмент программирования ИИ с открытым исходным кодом от Google, основанный на включении Большой модели Gemini в конечную точку разработчика, чтобы предоставить разработчикам мощные возможности ИИ. Инструмент понимает код, работает с файлами, выполняет команды и динамически устраняет неполадки, помогая разработчикам эффективно писать...
1 год назад
066.5K
Qwen-Flash - 通义千问推出的高性能、低成本语言模型

Qwen-Flash - высокопроизводительная и недорогая языковая модель от Тонги Чиен-цюань

Qwen-Flash - это высокопроизводительная и недорогая языковая модель, представленная в серии Alibaba Tongyi Thousand Questions, предназначенная для быстрого реагирования и эффективной обработки простых задач. Основанная на передовой архитектуре Mixture-of-Experts (MoE), она реализуется с помощью разреженной сети экспертов...
12 месяцев назад
066.5K
绘想 - 百度推出的AI视频生成平台

Живописное мышление - платформа для создания видео с помощью искусственного интеллекта, запущенная Baidu

Painting - это платформа для создания видео с искусственным интеллектом, запущенная компанией Baidu, основанная на технологии искусственного интеллекта и помогающая пользователям легко создавать персонализированные видеоролики. Картина интуитивно понятный интерфейс, мощные инструменты, с вдохновение рекомендации функции, может обеспечить создателей с творческим вдохновением, поддержка ключ к той же операции, может быстро генерировать похожие видео, упростить творческий процесс.
1 год назад
066.4K
MailMoo:使用AI为每个客户生成个性化视频提升销售转化率

MailMoo: использование искусственного интеллекта для создания персонализированных видеороликов для каждого клиента с целью повышения конверсии продаж

Общее представление MailMoo - это инновационная платформа, призванная помочь компаниям и отделам продаж улучшить результаты холодных рассылок по электронной почте. Используя технологию искусственного интеллекта, пользователи просто записывают видео, а MailMoo автоматически генерирует персонализированный видеоконтент для тысяч потенциальных клиентов. Такой подход значительно улучшает...
1 год назад
066.4K
RoboBrain 2.0 - 智谱开源的通用具身大脑模型

RoboBrain 2.0 - общая воплощенная модель мозга с открытым исходным кодом от Wisdom Spectrum

RoboBrain 2.0 - это усовершенствованная модель воплощенного мозга с открытым исходным кодом, которая обеспечивает мощные возможности восприятия, рассуждения и планирования для роботов. RoboBrain 2.0 состоит из двух версий, 7B и 32B, и использует гетерогенную архитектуру, которая объединяет визуальные кодировщики и лингвистические модели для поддержки...
1 год назад
066.3K
InteriorGS - 群核科技推出的3D高斯语义数据集

InteriorGS - 3D гауссовский семантический набор данных от Qunar Technology

InteriorGS - это высококачественный трехмерный гауссовый семантический набор данных, представленный компанией Qunar Technology. Набор содержит 1 000 3D-сцен, охватывающих более 80 внутренних помещений, таких как дома, магазины, свадебные залы и музеи. Набор содержит более 554 000 экземпляров объектов в 755 категориях...
1 год назад
066.3K
居然设计家 - 居然之家和阿里联合推出的AI家装设计平台

Residence Designer - платформа для дизайна домашнего интерьера с искусственным интеллектом, запущенная совместно компаниями Residence Home и Ali

Homestyler - это лучшая в мире платформа для дизайна домашнего декора с искусственным интеллектом, созданная совместно Homestyler и Alibaba. Основанная на технологиях искусственного интеллекта, 3D, VR и больших данных, платформа предоставляет удобные инструменты онлайн-проектирования для дизайнеров домашнего декора и покупателей DIY, и в то же время обеспечивает цифровой...
1 год назад
066.1K
Stable Diffusion Web:在线体验Stable Diffusion XL

Stable Diffusion Web: испытайте Stable Diffusion XL онлайн!

Общее описание Stable Diffusion Web - это онлайн-платформа для моделирования стабильной диффузии, которая является бесплатной для пользователей. Модель используется для преобразования текста в фотореалистичные изображения с помощью простого в использовании интерфейса. Введя текстовые подсказки и нажав кнопку "Generate", пользователи могут быстро получить...
2 года назад
066.1K
Hunyuan-GameCraft - 腾讯混元开源的下一代游戏交互式视频生成框架

Hunyuan-GameCraft - фреймворк с открытым исходным кодом от Tencent Hunyuan для создания интерактивного видео для игр нового поколения.

Hunyuan-GameCraft является открытым исходным кодом Tencent Hunyuan команды интерактивных игр видео генерации рамки. Фреймворк из одной картинки и подсказок генерирует высокодинамичное игровое видео, поддерживая пользователя с помощью клавиатуры и мыши для управления видеоконтентом в реальном времени.
12 месяцев назад
066.1K
BoomCut - 小影科技推出的 AI 出海营销视频生成工具

BoomCut - инструмент создания видеороликов для исходящего маркетинга с искусственным интеллектом от Little Shadow Technology

BoomCut - это инструмент локализации видеороликов для трансграничного маркетинга, созданный компанией Little Shadow Technology. Инструмент оснащен мощными функциями, основанными на передовой технологии синхронизации губ и клонирования тембра, позволяющими быстро генерировать мультиязычные версии видеороликов для удовлетворения языковых потребностей пользователей в разных странах и регионах.
1 год назад
066.1K
袋鼠参谋 – 美团推出的商家AI智能决策应用

Kangaroo Staff - интеллектуальное приложение для принятия решений с помощью искусственного интеллекта для торговцев, запущенное Meituan

Kangaroo Staff - это ориентированное на торговцев интеллектуальное приложение с искусственным интеллектом для принятия решений, запущенное Meituan, чтобы помочь торговцам решить проблемы с открытием и эксплуатацией магазинов. Основываясь на массивных данных Meituan по общественному питанию и более чем 10-летнем опыте онлайн-операций, через диалоговое взаимодействие оно предоставляет торговцам точную информацию по выбору трека, месту открытия магазина, разработке блюд, эксплуатации магазина и другим сценариям.....
1 год назад
066.1K
11ai - ElevenLabs推出个人AI语音助理

11ai - ElevenLabs запускает персонального голосового помощника с искусственным интеллектом

11ai - это голосовой помощник с искусственным интеллектом, созданный компанией ElevenLabs, в основе которого лежит голосовое взаимодействие. 11ai поддерживает более 5 000 голосов, и пользователи могут настроить эксклюзивный голос, чтобы помощник был более персонализированным. Благодаря низкому уровню задержки голосового инте...
1 год назад
066.1K
FastDeploy - 百度推出的高性能大模型推理与部署工具

FastDeploy - высокопроизводительный инструмент Baidu для обоснования и развертывания больших моделей

FastDeploy - это высокопроизводительный инструмент для обоснования и развертывания от Baidu, предназначенный для больших языковых моделей (LLM) и визуальных языковых моделей (VLM).FastDeploy разработан на основе фреймворка Flying Paddle (PaddlePaddle) и поддерживает различные аппаратные платформы....
1 год назад
066K
PixVerse V5 - 爱诗科技推出的自研AI视频模型

PixVerse V5 - видеомодель с искусственным интеллектом, разработанная компанией Aishi Technologies

PixVerse V5 - это крупная модель искусственного интеллекта для создания видео, выпущенная компанией Aishi Technology. Модель может генерировать высококачественный видеоконтент на основе введенных пользователем текстовых описаний или изображений и поддерживает различные стили, такие как аниме, научная фантастика и национальный стиль.
11 месяцев назад
066K
Vace AI - AI 视频制作和编辑平台,提供一站式视频创作服务

Vace AI - платформа для производства и редактирования видео с использованием искусственного интеллекта, предоставляющая услуги по созданию видео в режиме "одного окна".

Vace AI - это мощная универсальная платформа для создания и редактирования AI-видео. Платформа генерирует высококачественный видеоконтент на основе текстовых описаний или опорных изображений, а также поддерживает различные функции редактирования, такие как расширение видео, преобразование стилей, удаление и восстановление объектов.
1 год назад
066K
Z-Image - 阿里通义实验室开源的图像生成模型

Z-Image - модель генерации изображений с открытым исходным кодом от Ali Tongyi Labs

Z-Image - это модель генерации изображений с открытым исходным кодом от Ali Tongyi Labs, обладающая эффективными, быстрыми и мощными возможностями генерации изображений. Используя архитектуру однопоточного диффузионного трансформатора (S3-DiT), она объединяет текст, визуальную семантику и маркеры VAE изображений в единый входной поток...
8 месяцев назад
065.9K
EchoMimicV3 - 蚂蚁开源的多模态数字人动画生成模型

EchoMimicV3 - мультимодальная модель генерации цифровой человеческой анимации с открытым исходным кодом Ant

EchoMimicV3 - это мультимодальная модель генерации цифрового человеческого видео, созданная компанией Ant Group, с 1,3 миллиардами параметров, способная обрабатывать множество входных данных, таких как аудио, текст, изображения и т.д. для генерации высококачественных цифровых человеческих анимаций.
11 месяцев назад
065.8K
PaddleOCR-VL - 百度开源的超轻量级视觉-语言模型

PaddleOCR-VL - ультралегкие визуально-лингвистические модели с открытым исходным кодом от Baidu

PaddleOCR-VL - это ультралегкая визуально-лингвистическая модель Baidu с открытым исходным кодом, оптимизированная для сценариев парсинга документов. Модель содержит всего 0,9 Б параметров, благодаря слиянию динамического визуального кодера высокого разрешения и легкой языковой модели ERNIE, сохраняя при этом высокую точность и значительно снижая вычислительные затраты.
9 месяцев назад
065.7K
ChatGPT Study - OpenAI推出的创新学习模式

Исследование ChatGPT - инновационная модель обучения, представленная OpenAI

ChatGPT Study - это инновационная модель обучения от OpenAI, которая помогает пользователям учиться и понимать более эффективно. ChatGPT Study помогает пользователям активно думать и решать проблемы шаг за шагом с помощью сократовских вопросов, подкрепленных ответами, и персонализированных...
1 год назад
065.6K
CombatVLA - 淘天集团推出的高效VLA模型

CombatVLA - эффективная модель VLA от Amoy Group

CombatVLA - это инновационная 3D-модель для ролевых игр (ARPG) от команды Future Life Lab из Amoy Group. CombatVLA - это модель видения-лингвистики-действия (VLA), построенная в параметрическом масштабе 3B, которая собирает данные об игроке через трекер движения...
11 месяцев назад
065.6K
MineContext - 字节开源的主动式上下文感知AI伙伴

MineContext - байтовый партнер по ИИ с открытым исходным кодом и активным контекстом

MineContext - это активный контекстно-ориентированный ИИ-партнер с открытым исходным кодом от команды ByteDance Viking, призванный помочь пользователям эффективно управлять огромными объемами информации и повысить эффективность работы со знаниями. С помощью технологии понимания скриншотов и контента, автоматической записи ежедневных операций пользователя (таких как просмотр веб-страниц, редактирование документов и т.д.), поддержки...
10 месяцев назад
065.5K
Muzaic - AI音乐生成平台,一键生成与视频内容匹配的音乐

Muzaic - платформа для создания музыки с помощью искусственного интеллекта, которая генерирует музыку под видеоконтент в один клик

Muzaic - это платформа для создания музыки с помощью искусственного интеллекта, предназначенная для видеопродюсеров и создателей контента. Технология, основанная на искусственном интеллекте, позволяет быстро генерировать индивидуальную музыку, соответствующую содержанию видео, создавая минутный трек студийного качества всего за 8 секунд.
1 год назад
065.5K
HIRING.STUDIO - AI招聘面试辅助工具,针对特定职位生成面试问题

HIRING.STUDIO - ИИ-инструмент для создания вопросов на собеседовании по конкретным вакансиям

HIRING.STUDIO - это инструмент поддержки собеседований с использованием искусственного интеллекта, который помогает командам по подбору персонала эффективно создавать вопросы для собеседований с конкретными кандидатами. Основанный на технологии искусственного интеллекта, инструмент генерирует вопросы для собеседования, предлагает последующие вопросы и создает критерии оценки ответов разного качества. Инструмент поддерживает метод STAR...
1 год назад
065.3K
AI Agent Company Researcher:自动化公司信息研究情报员

AI Agent Company Researcher: автоматизированный исследователь информации о компаниях

Общее описание AI Company Research Assistant - это инструмент на основе искусственного интеллекта, предназначенный для автоматизации процесса исследования компаний и генерации лидов. Благодаря использованию таких технологий, как LangGraph и FireCrawl, инструмент способен генерировать подробные отчеты об исследованиях компаний всего за несколько минут. Пользователям просто нужно...
2 года назад
065.2K
Ring-1T-preview - 蚂蚁集团开源的万亿参数大模型

Ring-1T-preview - Большая модель с триллионом параметров от Ant Group с открытым исходным кодом

Ring-1T-preview - макромодель с открытым исходным кодом на триллион параметров от Ant Group, основанная на архитектуре Ling 2.0 MoE, предварительно обученная на корпусе 20T и натренированная на способность рассуждать с помощью ASystem, самостоятельно разработанной системы обучения с подкреплением. В рассуждениях на естественном языке ...
10 месяцев назад
065.2K
FastVLM - 苹果公司推出的视觉语言模型

FastVLM - визуальное языковое моделирование от Apple

FastVLM (Fast Vision Language Model) - эффективная модель визуального языка, представленная компанией Apple. В основе гибридного визуального кодера FastViTHD лежат конволюционная и трансформаторная архитектуры, позволяющие значительно снизить...
11 месяцев назад
065.2K
Step-Audio-AQAA – StepFun推出的端到端大音频语言模型

Step-Audio-AQAA - сквозная модель большого аудиоязыка от StepFun

Step-Audio-AQAA - это сквозная крупномасштабная модель аудиоязыка для задач "аудиозапрос-аудиоответ" (AQAA) от команды StepFun. Она может напрямую обрабатывать аудиоданные для генерации естественных и точных речевых ответов, не полагаясь на традиционное автоматическое распознавание речи (A...
1 год назад
065.2K
AIMangaStudio - 免费的AI漫画创作工具,提供完整创作流程

AIMangaStudio - бесплатный инструмент для создания манги в формате AI для полного процесса создания!

AIMangaStudio - это бесплатный инструмент для создания манги с искусственным интеллектом, который предоставляет авторам полный цикл создания манги, включая генерацию сюжета, разработку субсцен, создание персонажей и другие функции, что позволяет упростить процесс создания от сценария до страницы манги. Поддержка генерации сценариев комиксов на естественном языке, включая сюжет, диалоги...
10 месяцев назад
065.1K
Shortbread - AI漫画生成工具,自然语言描述完成漫画创作

Shortbread - инструмент для создания комиксов с искусственным интеллектом, описание на естественном языке для завершения создания комиксов

Shortbread - это инструмент для создания комиксов с искусственным интеллектом, который позволяет пользователям быстро создавать полноценные комиксы на основе простых описаний на естественном языке. Shortbread не требует никаких навыков рисования, просто введите текст, и искусственный интеллект быстро создаст персонализированные комиксы с уникальными персонажами, сценами и эмоциями.Sho...
1 год назад
065K
小星绪 - 京东健康推出的AI情绪漫画生成产品

Hoshio - ИИ-продукт для создания манги эмоций, запущенный Jingdong Health

Xiao Xingxu - это продукт для создания эмоциональных комиксов с помощью искусственного интеллекта, запущенный компанией Jingdong Health, который в настоящее время находится на стадии тестирования. Основной функцией продукта является создание эмоциональных комиксов, пользователи могут выразить свои эмоции или рассказать историю с помощью голоса или текстового ввода, а искусственный интеллект генерирует соответствующие четырехпанельные комиксы и интерпретацию истории на основе полученных данных.
1 год назад
065K
无问芯穹:企业级AI开发,云端资源服务平台

Без вопросов Core Dome: разработка ИИ для предприятий, платформа для обслуживания облачных ресурсов

Комплексное внедрение No Ask Core Dome - это комплексная сервисная платформа для разработчиков ИИ, предоставляющая инструменты для разработки ИИ и услуги по созданию больших моделей. Платформа имеет разнообразные инструменты разработки машинного обучения, такие как AIStudio, GenStudio и т.д. Она также поддерживает развертывание моделей, хранение данных и...
2 года назад
064.9K
MoFlow - AI情绪管理应用,用自由书写调节情绪

MoFlow - приложение для управления настроением с помощью искусственного интеллекта, позволяющее регулировать эмоции с помощью свободного письма

MoFlow - это приложение для управления эмоциями, объединяющее психологию и технологию искусственного интеллекта. Оно предоставляет пользователям личное пространство для выражения своих эмоций в письмах и чатах, а партнер ИИ терпеливо выслушает их и даст обратную связь.
1 год назад
064.9K
觅果·Migo - AI学术研究助手,智能问答满足多样化需求

Migo - ассистент академического исследования ИИ, интеллектуальный вопрос-ответ для различных нужд

Forage-Migo - это инновационная платформа для обучения и исследований, управляемая ИИ, с мощными возможностями мультимодального ИИ, поддерживающего обработку текста, языка, зрения и данных, которая может удовлетворить разнообразные потребности в различных дисциплинах. Migo обеспечивает интеллектуальные вопросы и ответы, чтение веб-страниц, чтение литературы, академическое письмо, чтение диссертаций, хими...
1 год назад
064.8K
DeepSeek V3.1 - DeepSeek推出的最新开源AI模型

DeepSeek V3.1 - новейшая модель искусственного интеллекта с открытым исходным кодом от DeepSeek

DeepSeek V3.1 - новое поколение моделей искусственного интеллекта, представленное компанией DeepSeek, с важными обновлениями по сравнению с предшественником V3. DeepSeek V3.1 представляет гибридную архитектуру рассуждений, которая позволяет модели гибко переключаться между режимами мышления и не-мышления, значительно улучшая...
11 месяцев назад
064.8K
Hyperbolic AgentKit:让Agents拥有自己的计算资源,能够自主管理 GPU、执行区块链操作和社交发布

Hyperbolic AgentKit: предоставляет агентам собственные вычислительные ресурсы, возможность автономно управлять графическими процессорами, выполнять операции с блокчейном и социальные публикации

Общее представление Hyperbolic AgentKit - это проект с открытым исходным кодом, цель которого - предоставить шаблон для запуска агентов искусственного интеллекта, объединяющий блокчейн и вычислительные мощности. Проект основан на CDP Agentkit от Coinbase с модификациями и расширениями для поддержки терминала в...
2 года назад
064.6K
靠岸妙写 - AI论文写作工具,构思到成稿一站式解决

Cushion Wonderful Writer - инструмент для написания эссе с искусственным интеллектом, универсальное решение от идеи до готовой работы

Leaning Wonderful Writer - это инструмент для написания диссертаций с искусственным интеллектом, который обеспечивает эффективное и удобное решение для написания академических работ. Инструмент поддерживает создание одним щелчком мыши конспекта, аннотации и первого варианта диссертации, что применимо для различных уровней академических потребностей, таких как бакалавриат и магистратура, охватывая многодисциплинарные области, такие как наука и техника, искусство и социальные науки.
1 год назад
064.6K
Claudable - 开源AI Web应用构建器,自然语言生成代码

Claudable - Open Source AI Web Application Builder, Natural Language Generated Code

Claudable - это конструктор веб-приложений с открытым исходным кодом на базе Next.js, который сочетает в себе передовые возможности искусственного интеллекта Claude Code и Cursor CLI с простым и интуитивным опытом создания приложений Lovable...
11 месяцев назад
064.5K
GLM-4.5 - 智谱开源的面向推理、代码与智能体的SOTA模型

GLM-4.5 - Smart Spectrum Open Source SOTA Model for Reasoning, Code and Intelligentsia

GLM-4.5 - это модель SOTA с открытым исходным кодом от Smart Spectrum, разработанная для приложений интеллектуального тела, включающая в себя рассуждения, генерацию кода и возможности интеллектуального тела. Модель основана на архитектуре Mixed Expert (MoE) и содержит две версии: GLM-4.5 с 355 миллиардами параметров и 106 миллиардами...
1 год назад
064.5K
UnifiedTTS - 一站式TTS API服务平台,实时性能监控

UnifiedTTS - единая сервисная платформа TTS API, мониторинг производительности в реальном времени

UnifiedTTS - это универсальная платформа для предоставления услуг преобразования текста в речь (TTS). Она поддерживает множество языков, включая китайский, английский, японский и корейский, чтобы удовлетворить потребности глобального бизнеса. Благодаря унифицированному API-интерфейсу в нее интегрированы многие основные TTS-сервисы, включая Micro...
11 месяцев назад
064.4K
NeverEnds:使用文字描述生成效果逼真的视频

NeverEnds: создание реалистичных видеороликов с текстовыми описаниями

Общее представление NeverEnds - это платформа из Сингапура, которая предоставляет неограниченное творческое пространство для всех видов историй путем преобразования текста в видео с помощью передовой модели. Пользователи могут свободно выражать творчество, передавать эмоции, а также создавать имидж своего бренда на этой платформе. Эта платформа известна своими уникальными...
2 года назад
064.3K
Goedel-Prover-V2 - 普林斯顿联合清华和英伟达等开源的定理证明模型

Goedel-Prover-V2 - модель доказательства теорем с открытым исходным кодом, разработанная в Принстоне совместно с Цинхуа, NVIDIA и другими компаниями.

Goedel-Prover-V2 - это модель доказательства теорем с открытым исходным кодом от ведущих институтов, таких как Принстонский университет, Университет Цинхуа и NVIDIA. В основе модели лежат такие инновационные техники, как иерархический синтез данных, самокоррекция, направляемая верификатором, и усреднение модели, позволяющие значительно повысить производительность автоматизированных формальных доказательств...
1 год назад
064.3K
ChatGPT Agent – OpenAI推出的通用智能AI Agent

Агент ChatGPT - агент искусственного интеллекта общего назначения от OpenAI

ChatGPT Agent - это ИИ-агент общего назначения от OpenAI, который сочетает в себе множество возможностей для автономного выполнения сложных задач. Пользователям достаточно описать свои потребности на естественном языке, и агент может автоматически выбрать подходящие инструменты, такие как просмотр веб-страниц, извлечение информации, выполнение кода...
1 год назад
064.2K
羚珑 - 京东推出的AI商品图设计工具

Antelope - инструмент искусственного интеллекта для создания изображений товаров, запущенный компанией Jingdong

Antelope - это интеллектуальный инструмент дизайна, запущенный компанией Jingdong, предоставляющий эффективные и удобные дизайнерские решения для продавцов электронной коммерции и частных лиц. Благодаря интеллектуальному подбору ключей, интеллектуальному макетированию, интеллектуальному подбору цветов и другим функциям, он помогает пользователям быстро создавать высококачественные дизайнерские работы, соответствующие главному изображению продукта, рекламному баннеру, странице магазина и другим видам магазинов электронной коммерции...
1 год назад
064K
Skywork UniPic 2.0 - 昆仑万维开源的高效多模态模型

Skywork UniPic 2.0 - эффективное мультимодальное моделирование с открытым исходным кодом от KunlunWanwei

Skywork UniPic 2.0 - это эффективная мультимодальная модель с открытым исходным кодом от Quintessence, ориентированная на создание, редактирование и понимание изображений. Модель основана на 2B-параметрической архитектуре SD3.5-Medium и реализуется с помощью предварительного обучения, прогрессивной стратегии двухзадачного усиления и совместного обучения...
12 месяцев назад
064K
Seed GR-3 - 字节跳动Seed团队推出的通用机器人模型

Seed GR-3 - робототехническая модель общего назначения от команды Wordpress Seed

Seed GR-3 - это робототехническая модель общего назначения, представленная компанией ByteDance, с сильными возможностями обобщения для адаптации к новым условиям и сложным командам. Модель объединяет визуальную, вербальную информацию и информацию о движении и основана на методе обучения "три в одном", включающем данные о роботе, данные о траектории движения человека в VR и публичные графические данные, чтобы улучшить способность реагировать на новые объекты...
1 год назад
064K
Squibler - AI小说辅助写作平台,助力构思到创作全过程

Squibler - платформа для написания романов с помощью искусственного интеллекта, обеспечивающая весь процесс от идеи до создания.

Squibler - это мощная платформа для писателей с поддержкой искусственного интеллекта, которая помогает пользователям пройти весь путь от замысла до создания и публикации. Платформа предлагает множество шаблонов для написания романов, сценариев, рассказов и т. д. Пользователям нужно только ввести первоначальную концепцию, а ИИ сгенерирует наброски, персонажей, сцены...
11 месяцев назад
063.9K
ChatFlow - 开源AI工作流自动化工具

ChatFlow - инструмент автоматизации рабочего процесса с открытым исходным кодом AI

ChatFlow - это инструмент автоматизации рабочих процессов с открытым исходным кодом на основе искусственного интеллекта, который поддерживает преобразование сложных требований в эффективные рабочие процессы. Инструменты, основанные на технологии искусственного интеллекта, помогают пользователям быстро генерировать кодовые фреймворки, тестовые примеры, могут помочь в написании и проектировании архитектуры программного обеспечения.
1 год назад
063.8K
MiniMax-M1 - MiniMax推出的开源推理模型

MiniMax-M1 - модель вывода с открытым исходным кодом от MiniMax

MiniMax-M1 - это модель вывода с открытым исходным кодом от команды MiniMax, основанная на комбинации смешанной экспертной архитектуры (MoE) и механизма Lightning Attention, с 456 миллиардами общих параметров. Модель поддерживает 100...
1 год назад
063.8K
Kotae - AI聊天机器人平台,分析网站内容、培训文件生成准确回答

Kotae - платформа для чатботов с искусственным интеллектом, анализирующая содержимое веб-сайтов и учебные документы для получения точных ответов

Kotae - интеллектуальная чат-бот платформа для малого бизнеса, разработанная на основе технологии ChatGPT. Поддерживая более 80 языков, платформа быстро и естественно реагирует на запросы клиентов, генерируя точные ответы на основе анализа содержания веб-сайтов пользователей, учебных документов, часто задаваемых вопросов и т. д. Kotae не имеет...
1 год назад
063.7K
Qwen-Image-Edit - 阿里通义开源的图像编辑模型

Qwen-Image-Edit - модель редактирования изображений с открытым исходным кодом от Ali Tongyi

Qwen-Image-Edit - это универсальная модель редактирования изображений, представленная Али Тонги, построенная на архитектуре Qwen-Image с 20 миллиардами параметров. Модель сочетает в себе возможности семантического редактирования и редактирования внешнего вида и может выполнять низкоуровневое визуальное редактирование внешнего вида изображений (например, добавлять, удалять...
12 месяцев назад
063.7K
有道小P - 网易有道推出的新一代AI全科学习助手

Youdao Xiao P - новое поколение самообучающегося помощника ИИ, выпущенного компанией Netease Youdao

Youdao Little P - это помощник по изучению всех предметов с искусственным интеллектом, выпущенный компанией NetEase Youdao. Он предназначен для учащихся K12, оснащен большой моделью образования Youdao Ziyi, охватывает начальную школу, младшую школу, старшую школу по всем предметам и предоставляет индивидуальные советы по обучению. Благодаря функциям поиска слов с искусственным интеллектом и перевода с искусственным интеллектом Youdao Little P помогает учащимся быстро решать языковые проблемы...
1 год назад
063.5K
JoyHallo - 京东开源的AI数字人模型

JoyHallo - цифровая модель человека с открытым исходным кодом ИИ от Kyodo

JoyHallo - это цифровая модель человека с открытым исходным кодом от Jingdong, разработанная для мандаринского языка и поддерживающая преобразование аудио в реалистичное разговорное видео. JoyHallo встраивает аудиофункции на основе модели wav2vec2, используя полуразделенную структуру для повышения точности предсказания движения губ, и поддерживает генерацию английского видео...
1 год назад
063.4K
InternVLA·N1 - 上海AI Lab开源的端到端双系统导航大模型

InternVLA-N1 - Shanghai AI Lab Open Source End-to-End Dual System Navigation Large Model

InternVLA-N1 - это сквозная двухсистемная навигационная макромодель, открытая Шанхайской лабораторией искусственного интеллекта. Используя двухсистемную архитектуру, система 2 отвечает за понимание лингвистических команд и планирование дальних маршрутов, в то время как система 1 фокусируется на высокочастотной реакции и маневренном обходе препятствий. Модель обучается полностью на основе синтетических данных с помощью крупномасштабных цифровых ...
11 месяцев назад
063.4K
VoxCPM - 面壁智能联合清华开源的端到端TTS模型

VoxCPM - Facing Intelligence и Tsinghua Open Source End-to-End TTS Model

VoxCPM - это модель генерации речи, совместно созданная Facade Intelligence и Шэньчжэньской международной высшей школой Университета Цинхуа. VoxCPM использует сквозную диффузионную авторегрессионную архитектуру для генерации непрерывных речевых представлений непосредственно из текста, преодолевая ограничения традиционной дискретной деамбигуации. Благодаря иерархическому моделированию языка и квантованию конечных состояний...
10 месяцев назад
063.4K
ML-Master – 上海交大推出的AI专家Agent

ML-Master - экспертный агент искусственного интеллекта, запущенный SJTU

ML-Master - экспертный ИИ-интеллект, созданный командой Agents Школы искусственного интеллекта Шанхайского университета Цзяотун. Он показал отличные результаты в авторитетном бенчмарк-тесте MLE-bench от OpenAI, возглавив список со средним показателем 29,3%, опередив RD-Agent от Microsoft...
1 год назад
063.4K
DeckSpeed - AI PPT制作工具,自然语言生成演示文稿

DeckSpeed - AI PPT Maker, презентация, созданная на естественном языке

DeckSpeed - это инструмент для создания презентаций с искусственным интеллектом, основанный на разговорном взаимодействии, где пользователи выражают свои потребности на естественном языке и быстро генерируют персонализированные слайды, не полагаясь на традиционные шаблоны. Инструмент поддерживает обратную связь в режиме реального времени, пользователи могут в любой момент изменить цвет, стиль и содержание слайдов, чтобы гарантировать, что презентация будет завершена...
1 год назад
063.3K
Intern-S1-mini - 上海AI Lab开源的轻量化科学多模态模型

Intern-S1-mini - легкая научная мультимодальная модель с открытым исходным кодом от Shanghai AI Lab

Intern-S1-mini - это легкая научная мультимодальная макромодель с параметрическим масштабом 8B, созданная Шанхайской лабораторией искусственного интеллекта (SAL). Она наследует мощные возможности Intern-S1, сочетая в себе как общие, так и специализированные научные возможности, и подходит для быстрого развертывания и вторичной разработки. С точки зрения производительности, I...
11 месяцев назад
063.3K
InternVLA-A1 - 上海AI Lab开源一体化操作能力的具身大模型

InternVLA-A1 - Shanghai AI Lab Интеграция операционных возможностей для воплощенных больших моделей с открытым исходным кодом

InternVLA-A1 - это большая модель воплощенной работы, открытая Шанхайской лабораторией искусственного интеллекта. Она способна понимать, представлять и выполнять интеграцию, а также точно выполнять поставленные задачи. Модель объединяет реальные и симулированные операционные данные и автоматизирует построение массивных мультимодальных через крупномасштабные виртуально-реальные гибридные активы сцены...
10 месяцев назад
063.2K
gpt-realtime - OpenAI最新推出的AI语音模型

gpt-realtime - новейшая речевая модель ИИ от OpenAI

gpt-realtime - это усовершенствованная модель речи от OpenAI, которая поддерживает прямую обработку звука для создания естественной и плавной речи. Модель поддерживает множество языков и стилей, понимает невербальные сигналы, такие как смех, и может переключаться между языками.
11 месяцев назад
063.2K
Skywork-SWE-32B - 昆仑万维开源的自主代码智能体基座模型

Skywork-SWE-32B - базовая модель интеллектуального тела с открытым исходным кодом KunlunWanwei

Skywork-SWE-32B - базовая модель автономных кодовых интеллектов с открытым исходным кодом масштаба 32B для программной инженерии (SWE), представленная компанией Kunlun World Wide Web. Модель ориентирована на задачи программной инженерии, обладает мощными возможностями восстановления кода на уровне репозитория и может работать в сложных сценариях с многораундовым взаимодействием и длительной обработкой текста...
1 год назад
063.2K
Genie 3 - 谷歌推出的通用世界模型

Genie 3 - общая модель мира от Google

Genie 3 - это новое поколение универсальных моделей мира от Google DeepMind, позволяющих создавать высокодинамичные и целостные виртуальные миры в режиме реального времени. Genie 3 моделирует физические явления, природные экосистемы и поддерживает создание фантастических и исторических сценариев. С помощью текстовых подсказок пользователи могут...
12 месяцев назад
063.1K
Lemon Slice Live - Lemon Slice推出的 AI 实时视频聊天工具

Lemon Slice Live - видеочат с искусственным интеллектом от Lemon Slice

Lemon Slice Live - это ИИ-инструмент для видеочата в реальном времени от компании Lemon Slice, Inc.Lemon Slice Live основан на модели Diffusion Transformer (DiT), которая поддерживает преобразование любой фотографии или иллюстрации в интерактивное движение в реальном времени....
1 год назад
063K
琴乐大模型 - 腾讯推出的AI音乐创作模型

Piano Music Big Model - модель музыкальной композиции с искусственным интеллектом, запущенная Tencent

Qin Music Grand Model - это передовая модель для создания музыки с помощью искусственного интеллекта, созданная совместными усилиями Tencent AI Lab и Tencent TME Tianqin Lab. Модель интеллектуально генерирует высококачественное стереофоническое аудио или многодорожечные ноты на основе введенных пользователем ключевых слов, описательных высказываний или аудиоклипов на английском и китайском языках.
1 год назад
063K
HunyuanImage 3.0 - 腾讯开源的免费多模态图像生成模型

HunyuanImage 3.0 - бесплатная мультимодальная модель генерации изображений с открытым исходным кодом от Tencent

HunyuanImage 3.0 (Hunyuan Image 3.0) - нативная мультимодальная модель генерации изображений, выпущенная и открытая компанией Tencent. Размер параметров модели составляет 80B, на данный момент это лучшие результаты оценки, самое большое количество параметров среди моделей генерации изображений с открытым исходным кодом. Hybrid Image 3.0 поддерживает генерацию изображений в режиме реального времени, пользователи могут...
10 месяцев назад
063K
RoboOS 2.0 - 智谱开源的跨本体具身大小脑协作框架

RoboOS 2.0 - система совместной работы с открытым исходным кодом Wisdom Spectrum для кросс-онтологий с воплощенным размером мозга

RoboOS 2.0 - это фреймворк с открытым исходным кодом для кросс-онтологического взаимодействия "мозг-мозг", который способствует трансформации роботов от одиночного интеллекта к групповому совместному интеллекту. Фреймворк использует архитектуру "большого мозга" для эффективного разделения труда: "облачный мозг" отвечает за принятие сложных решений и совместную работу, а модули "малого мозга" сосредоточены на выполнении конкретных навыков.
1 год назад
063K
Mistral Code - Mistral AI推出面向企业的AI编程助手

Mistral Code - Mistral AI запускает помощника по программированию ИИ для бизнеса

Mistral Code - это помощник по программированию с искусственным интеллектом для команд разработчиков, созданный компанией Mistral AI и объединяющий четыре модели: Codestral, Codestral Embed, Devstral и Mistral Medium, поддерживающие...
1 год назад
062.9K
Genie Envisioner - 智元联合北航等开源的通用机器人操作平台

Genie Envisioner - робототехническая платформа общего назначения с открытым исходным кодом, разработанная компанией Jiyuan совместно с Beihang и другими компаниями.

Genie Envisioner (GE) - это единая платформа для робототехнических операций, разработанная командой Genie Robotics в сотрудничестве с Национальным университетом Сингапура, Пекинским университетом аэронавтики и астронавтики и другими учреждениями. Она позволяет роботам лучше понимать и выполнять задачи, "сначала представляя, потом действуя".
12 месяцев назад
062.8K
Hailuo Video Agent - MiniMax推出的AI视频创作Agent

Hailuo Video Agent - агент искусственного интеллекта для создания видео от MiniMax

Hailuo Video Agent - это агент для создания видео с нулевым порогом искусственного интеллекта, запущенный компанией MiniMax, открытая бета-версия. С помощью простого ввода текста или загрузки изображения вы можете создавать высококачественные креативные видео одним щелчком мыши, охватывая различные сценарии применения, такие как широкий...
1 год назад
062.8K
SkyReels-A3 - 昆仑万维推出的音频驱动数字人创作工具

SkyReels-A3 - инструмент для создания цифровых людей на основе аудио от KunlunWangwei

SkyReels-A3 - это инструмент для создания цифровых людей с помощью звука от компании Kunlun World Wide Group. SkyReels-A3 - это аудиоуправляемый инструмент для создания цифровых людей, который может генерировать высококачественный динамический видеоконтент с помощью простых входных данных (например, портретных изображений и голоса), заставлять статические фотографии "оживать", а также заменять реплики в существующих видеороликах на новые, которые персонажи будут автоматически согласовывать с...
12 месяцев назад
062.7K
gpt-oss - OpenAI推出的开源推理模型系列

gpt-oss - семейство моделей вывода с открытым исходным кодом от OpenAI

gpt-oss - это семейство моделей вывода с открытым исходным кодом от OpenAI, которые обеспечивают эффективные, гибкие и простые в развертывании решения в области искусственного интеллекта для разработчиков. gpt-oss выпускается в двух версиях: gpt-oss-120B с 117 миллиардами параметров и поддержкой 8...
12 месяцев назад
062.7K
OmniTalker - 阿里推出实时文本驱动的说话头像生成框架

OmniTalker - компания Ali запускает систему создания говорящих аватаров в реальном времени на основе текста

OmniTalker - это система генерации говорящих аватаров в реальном времени на основе текста от компании Alibaba. Фреймворк может одновременно обрабатывать несколько модальных входов, таких как текст, изображения, аудио и видео, и генерировать естественные речевые ответы на основе потокового подхода. Ядро основано на архитектуре Thinker-Talker, тонкой...
1 год назад
062.7K
ThinkSound - 阿里通义推出的音频生成模型

ThinkSound - моделирование генерации звука от Али Тонги

ThinkSound - это первая модель генерации звука на основе технологии CoT (Chain Thinking), представленная речевой командой Али Тонги (Ali Tongyi). Модель может генерировать точно подобранные звуковые эффекты для видеоизображений, основываясь на внедрении CoT-рассуждений, чтобы решить проблему, когда традиционной технологии сложно уловить динамические детали экрана и пространственные отношения.
1 год назад
062.7K
Mureka V7.5 - 昆仑万维推出的先进AI音乐创作模型

Mureka V7.5 - усовершенствованные модели создания музыки с искусственным интеллектом от Quintessence

Mureka V7.5 - это современная модель генерации музыки с помощью искусственного интеллекта от Kunlun World Wide, ориентированная на создание китайских песен. Модель точно воспроизводит тембр и технику игры для создания естественного, плавного и эмоционального вокала. Основанная на оптимизированной технологии автоматического распознавания речи (ASR), Mureka V...
12 месяцев назад
062.7K
MagicTryOn - 浙大和vivo等机构推出的视频虚拟试穿框架

MagicTryOn - фреймворк для виртуальной примерки видео от ZJU, Vivo и других компаний

MagicTryOn - это передовой фреймворк для виртуальных видеопроб, созданный Школой компьютерных наук и технологий Чжэцзянского университета в сотрудничестве с компанией vivo и другими организациями. Фреймворк заменяет традиционную архитектуру U-Net на инновационную архитектуру Diffusion Transformer (DiT) в сочетании с полностью самоаттестующейся машиной...
1 год назад
062.6K
LongCat-Video-Avatar - 美团开源的虚拟人视频生成模型

LongCat-Video-Avatar - модель генерации видео аватаров с открытым исходным кодом Meituan

LongCat-Video-Avatar - это продвинутая модель создания видео на основе звука, построенная на базе LongCat-Video с открытым исходным кодом от Meituan, ориентированная на создание гиперреалистичных, синхронизированных по губам длинных видео с естественной динамикой и последовательной идентичностью.
8 месяцев назад
062.6K
Qwen3-Coder-Flash - 阿里通义推出的开源高性能编程模型

Qwen3-Coder-Flash - высокопроизводительная модель программирования с открытым исходным кодом от Али Тонги

Qwen3-Coder-Flash - это высокопроизводительная модель программирования, представленная командой Ali Tongyi Thousand Questions, которая обладает отличными возможностями программирования на основе агентов и вызова инструментов, а также хорошо справляется со сложными задачами программирования. Модель поддерживает 256K токенов длинного контекстного понимания, и может масштабироваться до 1M ...
1 год назад
062.6K
TRELLIS.2 - 微软开源的大型3D生成模型

TRELLIS.2 - крупномасштабные генеративные 3D-модели с открытым исходным кодом от Microsoft

TRELLIS.2 - это крупномасштабная генеративная 3D-модель Microsoft с открытым исходным кодом и 4 миллиардами параметров, ориентированная на высокоточную генерацию изображений в 3D. Используя инновационную "O-Voxel" разреженную воксельную структуру, может эффективно обрабатывать сложную топологию и резкие особенности, генерировать высококачественную 3D информацию с полным PBR материалом ...
7 месяцев назад
062.6K
Hunyuan3D-Omni - 腾讯混元开源的3D模型生成框架

Hunyuan3D-Omni - Tencent Mixed Source Open Source 3D Model Generation Framework

Hunyuan3D-Omni (Hybrid 3D-Omni) - это фреймворк с открытым исходным кодом для создания 3D-активов, разработанный командой Tencent's Hybrid 3D, который позволяет точно генерировать 3D-модели с помощью нескольких управляющих сигналов. Основанный на архитектуре Hunyuan3D 2.1, он представляет унифицированный кодер управления, который может обрабатывать точечные...
10 месяцев назад
062.4K
自动生成每日Product Hunt热门产品榜单

Автоматическое составление ежедневных списков горячих продуктов Product Hunt

Общие сведения Введение Product Hunt Daily Chinese Hotlist - это автоматизированный инструмент, основанный на GitHub Actions, который генерирует ежедневный список популярных товаров на Product Hunt через регулярные промежутки времени, в виде файла Markdown...
2 года назад
062.4K
日日新 V6.5 - 商汤科技推出的最新多模态推理大模型

Day by Day V6.5 - новейшая макромодель мультимодальных выводов от ShangTech

Day by Day V6.5 - это продвинутая макромодель мультимодальных выводов от ShangTech, разработанная для работы со смешанными изображениями и текстом, поддерживающая точное понимание содержимого изображений и генерирующая описания или ответы на вопросы в сочетании с текстом.
1 год назад
062.3K
Lucy Edit - 开源的AI视频编辑工具,自然语言描述编辑

Lucy Edit - инструмент для редактирования видео с открытым исходным кодом и искусственным интеллектом, редактирование описаний на естественном языке

Lucy Edit - это инструмент для редактирования видео с открытым исходным кодом, разработанный компанией Decart AI. Позволяет пользователям редактировать видео с помощью простых описаний на естественном языке, таких как "изменить персонажа на белого медведя" или "превратить сцену в 2D-мультфильм", без необходимости сложной тонкой настройки или использования масок ...
10 месяцев назад
062.3K
Wan2.2-S2V - 阿里通义开源的音频驱动视频生成模型

Wan2.2-S2V - модель генерации видео с открытым исходным кодом от Ali Tongyi, управляемая звуком

Wan2.2-S2V - это мультимодальная модель генерации видео с открытым исходным кодом от Ali Tongyi, только статическая картинка и фрагмент аудио, может генерировать высококачественное цифровое видео человека, и поддерживает различные типы изображений и кадров.
11 месяцев назад
062.3K