Последние ресурсы по искусственному интеллекту

共 3143 篇文章
Doppl - 谷歌推出的AI虚拟试衣应用

Doppl - приложение для виртуальной примерки с искусственным интеллектом от Google

Doppl - это приложение для виртуальных примерок с искусственным интеллектом от Google. После того как пользователь загружает фотографию всего тела, приложение поддерживает "надевание" картинки одежды или скриншота на цифровую версию собственного тела, а также может преобразовывать статичные изображения в видео, сгенерированное искусственным интеллектом, так что пользователи могут более реально ощутить эффект одежды на теле.
1 год назад
062.2K
悟能 - 商汤科技最新推出的具身智能平台

Wuneng - новейшая платформа телесного интеллекта от Shangtang Technology

Wuneng - это платформа воплощенного интеллекта, предназначенная для роботов и умных устройств. Основанная на модели мира "Просветленный" и технологии мультимодальных больших моделей, Wuneng интегрирует мультисенсорные данные, такие как зрение, голос, прикосновение и т. д., и обладает мощными возможностями восприятия, принятия решений и действий.
1 год назад
062.1K
MinerU2.5 - 上海AI Lab联合北大开源的文档解析模型

MinerU2.5 - открытая модель синтаксического анализа документов из Шанхайской лаборатории искусственного интеллекта и Пекинского университета

MinerU2.5 - это модель визуального языка, разработанная совместно Шанхайской лабораторией искусственного интеллекта и командой Пекинского университета и направленная на эффективный разбор изображений документов высокого разрешения. Основная инновация заключается в двухфазном дизайне "обнаружение глобального расположения с последующим распознаванием локального содержания": первая фаза представляет собой низкое разрешение...
9 месяцев назад
062.1K
Molmo 2 - Ai2开源的多模态视频图像理解模型系列

Molmo 2 - семейство моделей мультимодального понимания видеоизображений с открытым исходным кодом Ai2

Molmo 2 - это мультимодальная модель с открытым исходным кодом, выпущенная Институтом искусственного интеллекта Аллена (Ai2) для улучшения понимания видео и мультиизображений. Включены три варианта: Molmo 2 (8B), Molmo 2 (4B) и Molmo 2-O...
8 месяцев назад
062K
Step-Audio 2 mini - 阶跃星辰开源的语音大模型

Step-Audio 2 mini - макромоделирование речи с открытым исходным кодом Step-Star

Step-Audio 2 mini - это сквозная речевая макромодель с открытым исходным кодом от Step-Audio. Она преодолевает традиционную структуру речевых моделей и использует истинную сквозную мультимодальную архитектуру, которая напрямую преобразует исходный аудиосигнал в речевой отклик, с меньшей задержкой, и понимает паралингвистическую информацию и невокальные сигналы.
11 месяцев назад
062K
EXAONE 4.0 - LG推出的混合推理模型

EXAONE 4.0 - гибридная модель рассуждений от LG

EXAONE 4.0 - это гибридная интеллектуальная модель от корейской компании LG AI Research, сочетающая в себе обработку естественного языка общего назначения и расширенные возможности рассуждений. Модель поддерживает корейский, английский и испанский языки и подразделяется на профессиональную версию объемом 32 ББ и конечную версию объемом 1,2 ББ. Профессиональная версия подходит для юридических, бухгалтерских...
1 год назад
062K
OpenAI《在AI时代保持领先》PDF指南 - 附下载链接

PDF-руководство OpenAI о том, как оставаться впереди в эпоху ИИ - со ссылками для скачивания

Оставаясь впереди в эпоху ИИ - это руководство по ИИ от OpenAI, которое помогает бизнес-лидерам сохранять конкурентные преимущества в эпоху ИИ. В руководстве отмечается быстрый рост ИИ, ускорение выпуска моделей, снижение затрат и ускорение внедрения на предприятиях...
11 месяцев назад
061.9K
DeepSeek-R1 - DeepSeek推出的AI推理模型,性能对齐 OpenAI o1 正式版

DeepSeek-R1 - модель выводов ИИ от DeepSeek, производительность приведена в соответствие с релизом OpenAI o1

DeepSeek-R1 - это высокопроизводительная модель искусственного интеллекта, созданная компанией DeepSeek из Ханчжоу и сравнивающаяся с официальной версией o1 от OpenAI. Модель проходит посттренинг на основе крупномасштабных методов обучения с подкреплением и требует лишь очень небольшого количества помеченных данных, чтобы рассуждать на математическом, кодовом и естественном языке...
1 год назад
061.8K
Tencent-HY-MT1.5 - 腾讯混元开源的翻译模型系列

Tencent-HY-MT1.5 - Серия гибридных моделей перевода с открытым исходным кодом Tencent

Tencent-HY-MT1.5 - это гибридная модель перевода Tencent с открытым исходным кодом версии 1.5, включающая две модели 1.8B и 7B, поддерживающая 33 международных языка и 5 видов китайского и китайско-диалектного перевода.Модель 1.8B специально оптимизирована для мобильных телефонов и других устройств потребительского класса, только 1 ГБ оперативной памяти может быть достигнуто на конечной стороне...
7 месяцев назад
061.8K
Ovis-U1 - 阿里推出的多模态统一AI模型

Ovis-U1 - мультимодальная унифицированная модель искусственного интеллекта, выпущенная компанией Ali

Ovis-U1 - это мультимодальная унифицированная модель, представленная командой Ovis компании Alibaba Group с масштабом параметров 3 миллиарда. Модель обладает тремя основными возможностями: мультимодальным пониманием, генерацией текста в изображение и редактированием изображений, а благодаря передовому архитектурному дизайну и совместным унифицированным методам обучения она позволяет реализовать высокоточную...
1 год назад
061.8K
全球首个量子 AI 模型问世!SECQAI 发布 QLLM 即将进入 Beta 测试

Первая в мире квантовая модель ИИ! SECQAI выпустила QLLM для бета-тестирования!

SECQAI, британская компания по производству сверхзащищенного оборудования и программного обеспечения, объявила о запуске первой в мире Квантовой модели большого языка (QLLM), которая интегрирует технологию квантовых вычислений в традиционные модели ИИ для повышения эффективности вычислений и возможностей решения задач. Квантовая механика + ИИ = более мощный ИИ? ...
1 год назад
061.7K
Step-GUI - 阶跃星辰开源的AI Agent系列模型

Step-GUI - Step-Star - модели серии агентов ИИ с открытым исходным кодом

Step-GUI - это серия моделей агентов искусственного интеллекта с открытым исходным кодом от Step-Star, включающая облачную модель Step-GUI, первый протокол MCP для агентов GUI, и первую в отрасли модель Step-GUI Edge с открытым исходным кодом для поддержки развертывания мобильных телефонов.Специализированная...
7 месяцев назад
061.7K
OpenScreen - 开源免费的屏幕录制工具,支持Mac和Windows双系统

OpenScreen - бесплатный инструмент записи экрана с открытым исходным кодом для Mac и Windows.

OpenScreen - это бесплатный инструмент для записи экрана с открытым исходным кодом, который предоставляет пользователям простую в использовании и функциональную альтернативу Screen Studio. Она поддерживает Mac и Windows, полностью бесплатна, соответствует протоколу MIT и может использоваться для индивидуальной...
8 месяцев назад
061.5K
AnimaTensor - 吐司AI等机构推出的二次元图像生成模型

AnimaTensor - квадратичная модель генерации изображений от Toast AI и других разработчиков

AnimaTensor - это квадратичная модель генерации изображений от команды CagliostroLab в сотрудничестве с TensorArt, основанная на инновационной технике V-Prediction, которая оптимизирует планирование шума путем предсказания "скорости" процесса генерации изображений...
1 год назад
061.5K
Klic Studio - AI音视频翻译配音工具,一键部署全流程

Klic Studio - инструмент для перевода и дубляжа аудио/видео с искусственным интеллектом, развертывание всего процесса одним щелчком мыши

Klic Studio (ранее Krillin AI) - это инструмент для перевода, дубляжа и клонирования голоса на основе искусственного интеллекта, предназначенный для создателей видео и экспортеров контента. Он поддерживает развертывание всего процесса в один клик, что позволяет завершить видео от загрузки до вывода в один клик, и адаптирован для Jieyin, Xiaohongshu, B...
1 год назад
061.4K
ChartAI - AI数据分析工具,智能推荐适合的图表类型

ChartAI - инструмент анализа данных с искусственным интеллектом, который интеллектуально рекомендует подходящие типы графиков

ChartAI - это эффективный инструмент визуализации данных, который автоматически анализирует данные на основе технологии искусственного интеллекта для создания интуитивных диаграмм, помогающих пользователям быстро понять сложную информацию. ChartAI поддерживает импорт данных различных форматов (например, Excel, CSV) и поддерживает интеллектуальную рекомендацию наиболее подходящих диаграмм...
1 год назад
061.4K
AudioFly - 科大讯飞开源的文本生成音效AI模型

AudioFly - модель искусственного интеллекта KU Xunfei с открытым исходным кодом для генерации текста и звука

AudioFly - это модель искусственного интеллекта с открытым исходным кодом для генерации звуковых эффектов из текста, разработанная компанией KDDI. Основана на архитектуре потенциальной диффузионной модели с 1 миллиардом параметров, обучена на крупномасштабных разнообразных аудиотекстовых наборах данных, включая публичные наборы данных, такие как AudioSet, AudioCaps, TUT и внутренние...
10 месяцев назад
061.4K
商汤如影 - 商汤科技推出的AI数字人视频制作平台

Shangtang Ruyi - платформа для производства цифрового человеческого видео с искусственным интеллектом, запущенная компанией Shangtang Technology

Shangtang Ruying - это платформа для создания цифровых видеороликов с искусственным интеллектом, запущенная компанией Shangtang Technology. Основанная на технологии больших моделей, платформа поддерживает создание высокореалистичных цифровых человеческих образов и персонализацию, включая черты лица, одежду, прически и так далее. Платформа оснащена функциями клонирования звука, генерации видео, автоматического аннотирования данных, взаимодействия в реальном времени и другими...
1 год назад
061.4K
Paper2Slides - 香港大学开源的学术论文转为幻灯片AI工具

Paper2Slides - инструменты ИИ для преобразования научных статей в слайды с открытым исходным кодом Университета Гонконга

Paper2Slides - это инструмент искусственного интеллекта с открытым исходным кодом, разработанный лабораторией Data Intelligence Laboratory Гонконгского университета, который одним щелчком мыши преобразует научные статьи в профессиональные слайды или постеры. Используя технологию RAG (Retrieval Augmented Generation), она напрямую анализирует содержимое документа, а не полагается на сетевую информацию, чтобы гарантировать, что созданный PPT будет полностью соответствовать оригиналу...
8 месяцев назад
061.3K
优雅YOYA - 中科闻歌推出的AI音视频内容创作平台

Элегантная YOYA - платформа для создания аудио/видео контента с искусственным интеллектом, запущенная ZTE Winko

Elegant YOYA - это мультимодальная грамотная видеоплатформа, запущенная компанией Zhongke Wenge. Платформа основана на мультимодальной технологии AI для расширения возможностей всей цепочки создания видеоконтента. Пользователям нужно только ввести требования к теме, платформа может быстро генерировать сценарии, изображения, видео, а также выполнять интеллектуальное редактирование, синтез голоса, управление ртом персонажа и другие операции, выход...
1 год назад
061.3K
FineVision - Hugging Face推出的开源视觉语言数据集

FineVision - набор данных визуальных языков с открытым исходным кодом, созданный Hugging Face

FineVision - это набор данных визуального языка с открытым исходным кодом от Hugging Face для обучения продвинутых моделей визуального языка. Она содержит 17,3 миллиона изображений, 24,3 миллиона образцов, 88,9 миллиона раундов диалога и 9,5 миллиарда токенов ответов. Набор данных объединяет...
11 месяцев назад
061.3K
Gemini 2.5 Flash Image - 谷歌推出的最强图像生成与编辑模型

Gemini 2.5 Flash Image - самая мощная модель генерации и редактирования изображений от Google

Gemini 2.5 Flash Image (кодовое название nano banana) - это современная модель генерации и редактирования изображений от Google, которая сохраняет согласованность персонажей в разных сценах и поддерживает точное редактирование изображений с помощью естественного языка, например, размытие фона и удаление пятен.
11 месяцев назад
061.2K
DragonV2.1 - 微软推出的零样本语音合成模型

DragonV2.1 - модель синтеза речи с нулевым образцом от Microsoft

DragonV2.1 - это передовая модель преобразования текста в речь (TTS) с нулевой выборкой от Microsoft. Основанная на архитектуре Transformer, модель поддерживает многоязычное клонирование речи с нулевым образцом и генерирует естественную, выразительную речь всего за 5-90 секунд голосовых подсказок.
1 год назад
061.1K
Higress MCP - 今日投资推出的MCP服务平台

Higress MCP - Invest Today запускает платформу для предоставления услуг MCP

Higress MCP - это инновационная платформа, запущенная компанией Invest Today, которая поддерживает быструю трансформацию традиционных API финансовых данных в современные MCP-сервисы. Higress MCP позволяет преобразовывать REST API в MCP Server на основе простой конфигурации без необходимости кодирования...
1 год назад
061K
Magentic-UI - 微软开源的人机协作AI Agent

Magentic-UI - ИИ-агент с открытым исходным кодом от Microsoft для совместной работы человека и компьютера

Magentic-UI - исследовательский инструмент ИИ-агента Microsoft с открытым исходным кодом для совместной работы человека и компьютера. Magentic-UI основан на тесном взаимодействии с пользователями для облегчения выполнения сложных веб-задач, таких как просмотр веб-страниц, выполнение кода и работа с файлами. Инструмент делает упор на совместное планирование, позволяя пользователям поднимать...
1 год назад
061K
企鹅读伴 - 腾讯推出的中小学生AI阅读助手

Penguin Reading Companion - помощник по чтению с искусственным интеллектом от Tencent для учеников начальной и средней школы

Penguin Reading Companion - это ассистент чтения с искусственным интеллектом, разработанный компанией Tencent для учащихся начальной и средней школы. Penguin Reading Companion опирается на гибридную большую модель Tencent и метамашинную платформу в сочетании с программой обязательного обучения языку и стандартами учебного плана (издание 2022 года), чтобы предоставить ученикам персональные рекомендации по чтению, несколько режимов чтения (сосредоточение, чтение вслух, прослушивание...
1 год назад
060.9K
FactSnap - 新一代AI信息核查工具

FactSnap - инструмент для проверки информации с помощью искусственного интеллекта нового поколения

FactSnap - это инструмент проверки информации с помощью искусственного интеллекта нового поколения, который помогает пользователям быстро проверять подлинность веб-информации. Благодаря интеграции нескольких моделей и поисковых систем он выполняет проверку выбранного текста в режиме реального времени, пока пользователь просматривает веб-страницы.
1 год назад
060.9K
VoxCPM 1.5 - 面壁智能开源的端到端文本到语音模型

VoxCPM 1.5 - Faceted Intelligence с открытым исходным кодом для конечного моделирования преобразования текста в речь

VoxCPM 1.5 - это модель генерации речи с открытым исходным кодом, выпущенная Facade Intelligence, основанная на технологии преобразования текста в речь (TTS) без необходимости использования разделителя, с несколькими нововведениями и улучшениями. Используя сквозную диффузионную авторегрессионную архитектуру, она генерирует непрерывные речевые волны непосредственно из текста, избегая ограничений традиционных методов сегментации...
8 месяцев назад
060.9K
Qwen-Image-Layered - 阿里团队开源的AI图像编辑模型

Qwen-Image-Layered - модель редактирования изображений с искусственным интеллектом, открытая командой Ali

Qwen-Image-Layered - это модель редактирования изображений с открытым исходным кодом от команды Ali, которая интеллектуально разбивает обычные изображения на независимые прозрачные слои для достижения точности редактирования, подобной Photoshop. Модель имеет открытый исходный код по протоколу Apache 2.0 и поддерживает гибкое управление слоями...
7 месяцев назад
060.9K
通义DeepResearch - 阿里通义开源的深度研究智能体

Tongyi DeepResearch - Орган глубокой разведки с открытым исходным кодом Ali Tongyi

Tongyi DeepResearch (Tongyi DeepResearch) - интеллектуальный орган с открытым исходным кодом, запущенный компанией Alibaba, предназначенный для глубокого поиска информации и рассуждений о сложных задачах, с 30 миллиардами параметров, поддерживающий несколько режимов рассуждений, включая режим ReAct и режим глубины...
11 месяцев назад
060.8K
MonkeyCode - 开源的企业级AI编程助手

MonkeyCode - корпоративный помощник программирования ИИ с открытым исходным кодом

MonkeyCode - это нативный помощник программирования ИИ с открытым исходным кодом корпоративного уровня, предназначенный для команд разработчиков, заботящихся о конфиденциальности и безопасности. MonkeyCode поддерживает частное развертывание и автономное использование для обеспечения безопасности данных кода. MonkeyCode поддерживает частное развертывание и автономное использование для обеспечения безопасности данных кода ...
1 год назад
060.8K
Why My Wife Yelling At Me:模拟婚姻沟通的互动工具

Почему моя жена кричит на меня: интерактивный инструмент для моделирования супружеского общения

Общее представление "Почему моя жена кричит на меня" - это уникальный сайт симуляции супружеских отношений, призванный помочь пользователям понять эмоциональные реакции партнера и модели общения с помощью искусственного интеллекта. Пользователи могут вводить различные сценарии и наблюдать за реакцией своего виртуального партнера, имитируя реальные...
1 год назад
060.8K
QVQ-Max - 阿里通义推出视觉推理模型

QVQ-Max - Али Тонги запускает модель визуального мышления

QVQ-Max - это современная модель визуального мышления от Alitonix, обновленная версия QVQ-72B-Preview, которая может "читать" изображения и видеоконтент и объединять их с информацией для анализа и решения проблем. QVQ-Max - это обновленная версия QVQ-72B-Preview, которая способна "читать" изображения и видеоконтент и объединять информацию для анализа, рассуждения и решения проблем.Основные функции QVQ-Max включают разбор изображений, анализ видео и...
1 год назад
060.7K
Lumina-DiMOO - 上海AI Lab联合华为昇腾开源的多模态大模型

Lumina-DiMOO - мультимодальная большая модель с открытым исходным кодом от Shanghai AI Lab и Huawei Rise

Lumina-DiMOO - это унифицированная модель нового поколения для мультимодального генерирования и понимания, представленная Шанхайской лабораторией искусственного интеллекта (SAL) совместно с Huawei Rise на Всемирной конференции по искусственному интеллекту 2025. Основанная на базовой аппаратно-программной платформе Rise AI и наборе мультимодальных больших моделей MindSpeed MM, она завершает...
11 месяцев назад
060.7K
RedOne - 小红书最新推出的社交大模型

RedOne - новейшая социальная мегамодель от Little Red Book

RedOne - это большая языковая модель, адаптированная для социальных сетей, представленная в Little Red Book. Модель обучается с помощью трехступенчатой стратегии обучения, которая включает в себя социальные и культурные знания, усиливает возможности многозадачности и выравнивает человеческие предпочтения. RedOne значительно превосходит базовую модель в выполнении социальных задач, в обнаружении вредного контента и просмотре...
1 год назад
060.7K
CRIC深度智联 - 克而瑞推出的中国房地产首个AI Agent

CRIC - Первый агент искусственного интеллекта для китайской недвижимости, запущенный CRIC

CRIC Depth Intelligence - это первый интеллектуальный орган ИИ для китайской недвижимости, самостоятельно разработанный CRIC, основанный на 20-летнем опыте CRIC в сфере недвижимости, накоплении данных и мультимодальной технологии больших моделей, которая открывает всю цепочку от интеграции данных, интеллектуального анализа до создания контента.
1 год назад
060.6K
Hyprnote - 开源的本地优先AI会议笔记工具

Hyprnote - инструмент для ведения заметок на конференциях с искусственным интеллектом с открытым исходным кодом

Hyprnote - это инструмент для ведения заметок на совещаниях с открытым исходным кодом и искусственным интеллектом, разработанный для профессионалов с целью защиты конфиденциальности пользователей и повышения эффективности совещаний. В соответствии с принципом "сначала локально" все данные хранятся и обрабатываются на локальном устройстве пользователя, что обеспечивает безопасность данных и поддерживает работу в автономном режиме.
11 месяцев назад
060.6K
Kandinsky 5.0 - 俄罗斯AI团队开源的视频生成模型系列

Кандинский 5.0 - серия моделей генерации видео с открытым исходным кодом от российской команды ИИ

Kandinsky 5.0 - это новейшая серия моделей поколения видео, разработанная российской командой искусственного интеллекта и ориентированная на легкий дизайн и высокую производительность. Первая модель серии, Kandinsky 5.0 Video Lite, имеет всего 2 миллиарда параметров, но превосходит аналогичные модели 14B, особенно...
10 месяцев назад
060.5K
分析 civitai 226K 得到的常用正负面提示词

Анализ общих положительных и отрицательных сигналов, полученных от цивитаи 226K

Список ресурсов Топ 10 1000 самых распространенных маркеров 1000 самых распространенных отрицательных маркеров 20 самых распространенных сэмплеров 100 самых распространенных шагов 100 самых распространенных измерений 50 самых распространенных...
2 года назад
060.5K
Confucius3-Math - 网易有道推出专注于数学教育的开源推理模型

Confucius3-Math - NetEase.com запускает модель рассуждений с открытым исходным кодом, ориентированную на обучение математике

Confucius3-Math - это первая отечественная модель рассуждений с открытым исходным кодом, ориентированная на обучение математике, открытая NetEaseYouDao. Имея 14 миллиардов параметров, оптимизированных для сценариев обучения математике K-12, она может эффективно работать на одном графическом процессоре потребительского класса (например, RTX 4090D), при этом производительность умозаключений составляет около...
1 год назад
060.4K
Qwen VLo – 通义千问推出的多模态统一理解与生成模型

Qwen VLo - унифицированная мультимодальная модель понимания и генерации от Tongyi Qianqian

Qwen VLo - это мультимодальная унифицированная модель восприятия и генерации, представленная командой Tongyi Qianqian. Qwen VLo может "понимать" мир и воссоздавать его с высоким качеством на основе своего понимания, реализуя скачок от восприятия к генерации. VLo может точно понимать содержание изображений и на основе этого осуществлять последовательную и качественную генерацию.
1 год назад
060.3K
职达AI简历 - AI简历生成与优化平台,精准分析问题、提供优化建议

JobTech AI CV - платформа для создания и оптимизации резюме с помощью искусственного интеллекта, точно анализирующая проблемы и дающая рекомендации по оптимизации.

Job AI resume - это эффективная и удобная интеллектуальная платформа для составления и оптимизации резюме. Основанная на технологии искусственного интеллекта, платформа помогает пользователям быстро создавать профессиональные и персонализированные резюме. Пользователям нужно только ввести основную информацию и опыт, платформа может генерировать высококачественное резюме за короткое время, предоставляя 2800+ красивых шаблонов, охватывающих различные позиции.
1 год назад
060.3K
Skywork Deep Research Agent v2 - 昆仑万维推出的深度研究智能体升级版

Skywork Deep Research Agent v2 - обновленная версия разведчика глубоких исследований от Kunlun

Skywork Deep Research Agent v2 - это интеллектуальный орган для глубоких исследований, созданный компанией Kunlun Wave и ориентированный на интеграцию и анализ мультимодальной информации. Skywork Deep Research Agent v2 может обрабатывать текст, граф...
12 месяцев назад
060.3K
稿定AI社区 - AI创意内容设计平台,多种设计资源满足不同创作需求

Drafting AI Community - платформа для проектирования творческого контента AI, разнообразные дизайнерские ресурсы для удовлетворения различных творческих потребностей

Drafting AI Community - это онлайн-платформа творческого вдохновения AI, которая предоставляет пользователям множество ресурсов и инструментов для творческого дизайна. Платформа охватывает различные области дизайна, включая фотографии изображений, дизайн электронной коммерции, праздничные темы, 3D-иллюстрации, дизайн аватаров, материалы Xiaohongshu, дизайн портретов и т. д., чтобы удовлетворить потребности различных пользователей.
1 год назад
060.3K
2024年自动化流程执行创作工作的14款出色AI工具

14 блестящих инструментов искусственного интеллекта для автоматизации процессов выполнения творческой работы в 2024 году

Если вы хотите использовать возможности искусственного интеллекта для решения повседневных задач и автоматизации рабочих процессов в своей личной и рабочей жизни, то вас может заинтересовать широкий спектр доступных инструментов искусственного интеллекта. Компания AssemblyAI подготовила пятиминутный видеоролик с подробным описанием инструментов, которые вы можете использовать для автоматизации...
2 года назад
060.2K
AntSK FileChunk - 免费的AI语义文档切片工具,动态切片调整

AntSK FileChunk - бесплатный инструмент для семантической нарезки документов AI, динамическая настройка нарезки

AntSK FileChunk - это бесплатный интеллектуальный инструмент для нарезки документов, предназначенный для приложений RAG (Retrieval Augmented Generation). Семантика как основа, документ будет интеллектуально нарезан на семантически полные, последовательные сегменты, поддержка нескольких языков, динамическая настройка размера фрагмента для обеспечения контекстной целостности.
11 месяцев назад
060.2K
Mureka V7 - 昆仑万维推出的AI音乐生成模型

Mureka V7 - модели генерации музыки с помощью искусственного интеллекта от Quintessence

Mureka V7 - это передовая модель генерации музыки с помощью искусственного интеллекта, выпущенная компанией Kunlun World Wide. Модель основана на технологии MusiCoT, которая поддерживает планирование общей структуры музыки перед заполнением деталей для создания более последовательных и художественных музыкальных произведений.
1 год назад
060.1K
Magistral - Mistral AI 推出的系列推理模型

Magistral - серия моделей выводов от Mistral AI

Magistral - это модель выводов от Mistral AI, ориентированная на прозрачные, многоязычные и специфичные для конкретной области рассуждения. Модель состоит из версии с открытым исходным кодом (Magistral Small) и корпоративной версии (Magistral Medium), последняя...
1 год назад
060K
Seed LiveInterpret 2.0 - 字节跳动推出的同声传译模型

Seed LiveInterpret 2.0 - модель синхронного перевода от ByteHop!

Seed LiveInterpret 2.0 - это современная модель синхронного перевода, запущенная командой Seed из ByteDance, поддерживающая двусторонний перевод с китайского на английский. Модель отличается точностью перевода, близкой к реальной, и чрезвычайно низкой задержкой: средняя задержка между речью и текстом составляет всего 2-3 секунды, что намного меньше, чем у...
1 год назад
060K
NitroGen - 英伟达联合斯坦福大学、加州理工等开源的游戏AI模型

NitroGen - модель игрового ИИ с открытым исходным кодом от NVIDIA в сотрудничестве со Стэнфордом, Калифорнийским технологическим институтом и другими.

NitroGen - это модель игрового ИИ с открытым исходным кодом, разработанная NVIDIA совместно со Стэнфордским университетом, Калифорнийским технологическим институтом и другими учреждениями, способная играть в более чем 1000 различных типов игр. Модель основана на архитектуре GROOT N1.5 и достигается путем анализа 40 000 часов игровых видеоданных (включая аннотацию операций с джойстиком)...
7 месяцев назад
059.9K
问小白5 - 问小白推出的全能AI模型

Ask White 5 - универсальная модель искусственного интеллекта от Ask White

Ask White 5 - флагманская модель "Все в одном" с очень высоким уровнем интеллекта. Модель демонстрирует высокие результаты по многим показателям, например, по композитному индексу AA-Index - 64,7 балла, по STEM-способностям - 86 баллов, что близко к мировому лидеру GPT-5.
11 месяцев назад
059.7K
Agentar-Fin-R1 - 蚂蚁数科推出的金融领域推理大模型

Agentar-Fin-R1 - Большая модель для рассуждений в области финансов от нумерологии Anthem

Agentar-Fin-R1 - это современная модель большого языка для финансовой области, представленная компанией Anthem. Разработанная на основе мощной архитектуры Qwen3, модель имеет две версии шкалы параметров, 8B и 32B, и может точно решать сложные задачи финансового анализа, включая многоступенчатый анализ, оценку рисков и войн...
1 год назад
059.7K
SpatialGen - 群核科技推出的开源3D场景生成模型

SpatialGen - модели генерации 3D-сцен с открытым исходным кодом от Qunar Technologies

SpatialGen - это модель генерации 3D-сцен с открытым исходным кодом от Qunar Technology, основанная на архитектуре диффузионной модели, поддерживающая генерацию пространственно-временных согласованных многоракурсных изображений на основе текстовых описаний, эталонных изображений и пространственного 3D-макета, а также генерацию 3D-гауссовых сцен и рендеринг роуминговых видео.
11 месяцев назад
059.6K
FireRedChat - 小红书开源的全双工语音交互系统

FireRedChat - система полнодуплексного голосового взаимодействия с открытым исходным кодом от Little Red Book

FireRedChat - это полнодуплексная система голосового взаимодействия с открытым исходным кодом для Xiaohongshu с возможностью двунаправленного диалога в реальном времени и поддержкой контролируемых прерываний. Используя модульный дизайн, включая модуль управления транскрипцией, модуль взаимодействия и менеджер диалога и т.д., поддерживает каскадную и полукаскадную архитектуру, гибкое развертывание.
10 месяцев назад
059.4K
MoE-TTS - 昆仑万维推出的最新语音生成框架

MoE-TTS - новейший фреймворк для генерации речи от KunlunWei

MoE-TTS - это система синтеза речи, представленная компанией KunlunWanwei, основанная на архитектуре Mixed Expert (MoE), которая объединяет предварительно обученные большие языковые модели (LLM) с речевыми экспертными модулями. MoE-TTS сохраняет мощные текстовые рассуждения, замораживая параметры текстовых модулей и обновляя только параметры речевых модулей...
12 месяцев назад
059.4K
Qwen3Guard - 阿里Qwen开源的安全模型

Qwen3Guard - модель безопасности с открытым исходным кодом от Ali Qwen

Qwen3Guard - это модель тонкой защиты, основанная на базовой модели Qwen3 и предназначенная для обнаружения угроз безопасности. Она обеспечивает точную категоризацию запросов и ответов, предоставляет уровни риска и поддерживает английский, китайский и мультиязычные среды.Qwen3Guard доступен в двух про...
10 месяцев назад
059.4K
MindLink - 昆仑万维推出的开源推理大模型

MindLink - Большая модель рассуждений с открытым исходным кодом от KunlunWei

MindLink - это большая модель рассуждений с открытым исходным кодом, запущенная Kunlun World Wide Web. С адаптивным механизмом рассуждения, в зависимости от сложности задачи может быть гибко переключен режим вывода, простые задачи быстро генерируется, сложные задачи глубокое рассуждение, с учетом эффективности и точности. Планово-управляемая парадигма рассуждений позволяет удалить тег "думать", уменьшить ...
1 год назад
059.2K
Xiaomi-MiMo-Audio - 小米开源的首个原生端到端语音大模型

Xiaomi-MiMo-Audio - первая нативная сквозная речевая модель Xiaomi с открытым исходным кодом

Xiaomi-MiMo-Audio - это макромодель сквозной речи Xiaomi с открытым исходным кодом и 7 миллиардами параметров, обладающая такими мощными функциями, как многоязычный диалог, продолжение речи, обобщение с меньшим количеством образцов и понимание звука, которая способна достичь уровня SOTA в тестах на интеллект речи и понимание звука, превосходя Google Gemi...
10 месяцев назад
059.1K
Midjourney V1- Midjourney推出的首个图生视频模型

Midjourney V1 - первая графическая видеомодель Midjourney

Midjourney V1 - это первая модель генерации видео с искусственным интеллектом от Midjourney, которая поддерживает преобразование статичных изображений в яркие и динамичные видео с помощью передовой технологии искусственного интеллекта. Пользователям достаточно загрузить изображения или картинки, созданные с помощью Midjourney, нажать...
1 год назад
059K
Meeseeks - 美团开源的评估模型指令遵循能力的评测集

Meeseeks - Meeseeks с открытым исходным кодом оценивает способность типовых инструкций следовать заданному рубрикатору

Meeseeks - это набор для оценки больших моделей с открытым исходным кодом, используемый командой M17 в Meituan для оценки способности модели следовать инструкциям. Meeseeks использует трехуровневую систему оценки для всестороннего измерения того, способна ли модель генерировать ответы в строгом соответствии с инструкциями пользователя от макро- до микроуровня, и не оценивает знание содержания ответа как положительный...
11 месяцев назад
059K
MiniMax Music 1.5 - MiniMax最新推出的AI音乐生成模型

MiniMax Music 1.5 - Новейшая модель генерации музыки с искусственным интеллектом от MiniMax!

MiniMax Music 1.5 - это продвинутый инструмент для генерации музыки с помощью искусственного интеллекта, который позволяет генерировать до 4 минут музыки на основе описания пользователя на естественном языке. Модель поддерживает широкий спектр музыкальных стилей и настроек, генерирует естественные и полные вокальные тона, плавные переходы и богатые многослойные аранжировки...
11 месяцев назад
059K
Gemini 2.5 Deep Think - 谷歌推出的AI推理模型

Gemini 2.5 Deep Think - модель искусственного интеллекта от Google

Gemini 2.5 Deep Think - это модель искусственного интеллекта от Google, предназначенная для решения сложных задач. Это вариант модели, завоевавшей золотую медаль на Международной математической олимпиаде (IMO) 2025 года, и предназначен для решения сложных задач с помощью параллельных ...
1 год назад
059K
文心大模型X1.1 - 百度推出的深度思考模型,理解能力更强

Wenshin Big Model X1.1 - модель глубокого мышления Baidu для лучшего понимания

Wenxin Big Model X1.1 - это модель глубокого мышления, выпущенная компанией Baidu и основанная на гибридной системе обучения с подкреплением, которая нацелена на улучшение понимания и генерации языка. Модель отлично справляется со сложными вопросами, выполняет инструкции и имитирует поведение интеллекта, а также может точно давать грамотные ответы и высококачественный текстовый контент.
11 месяцев назад
059K
飞算JavaAI - AI Java开发助手,自然语言实现全流程智能化开发

Flycount JavaAI - ассистент разработки Java с искусственным интеллектом, реализующий на естественном языке весь процесс интеллектуальной разработки

Flycount JavaAI - это интеллектуальный помощник разработчика Java, выпущенный компанией Flycount Technology. Платформа поддерживает ввод данных на естественном языке и обеспечивает весь процесс интеллектуальной разработки - от анализа требований до генерации кода. Разработчикам достаточно ввести описание требований, Flycount JavaAI может точно понять и сгенерировать полный инженерный код, платформа...
1 год назад
058.8K
Qwen3-Max-Preview - 通义千问推出的旗舰大语言模型

Qwen3-Max-Preview - флагманская модель большого языка от Tongyi Qianqian

Qwen3-Max-Preview - это последняя флагманская модель большого языка, выпущенная компанией Tongyi Qianwen. Это модель с самым большим количеством параметров в семействе Qwen3, с размером параметров более 1 триллиона. Модель обладает значительными улучшениями в области вывода, следования инструкциям, поддержки нескольких языков и охвата длиннохвостых знаний...
11 месяцев назад
058.6K
PaCoRe - 阶跃星辰开源的并行协同AI推理框架

PaCoRe - система параллельных совместных рассуждений ИИ с открытым исходным кодом StepStar

PaCoRe (Parallel Coordinated Reasoning) - это инновационная система параллельных совместных рассуждений с открытым исходным кодом от StepFun, использующая механизм параллельного мышления, позволяющий одновременно исследовать решение проблемы с нескольких точек зрения, преодолевая традиционные...
8 месяцев назад
058.5K
Youtu-GraphRAG - 腾讯优图实验室开源的图检索增强生成框架

Youtu-GraphRAG - Tencent Youtu Labs Open Source Enhanced Graph Retrieval Generation Framework

Youtu-GraphRAG - это фреймворк с открытым исходным кодом для создания дополнений к графовому поиску от Tencent Youtu Labs, который помогает большим языковым моделям более точно обрабатывать сложные задачи вопросов и ответов. Построив четырехслойное дерево знаний, знания разбираются на четыре уровня: атрибуты, отношения, ключевые слова и сообщества, чтобы получить междоменные знания о самообладании акта...
11 месяцев назад
058.3K
Report mAIstro:生成任意自定义主题的详细报告文档,例如商业分析、年终汇报等

Report mAIstro: создание подробных отчетов по любой пользовательской теме, например, бизнес-анализ, отчетность по итогам года и т.д.

Общее описание Report mAIstro - это мощный инструмент, предназначенный для того, чтобы помочь пользователям легко создавать пользовательские отчеты с помощью технологии обработки естественного языка. Инструмент использует технологию LangChain для преобразования предложенных пользователем тем и структур в подробные отчеты в...
1 год назад
058.2K
万兴天幕 – 万兴科技推出AIGC视频创作平台

Wanxing Canopy - Wanxing Technology запускает платформу для создания видео AIGC

Wanxing Canopy - это платформа AIGC для создания видео, запущенная компанией Wanxing Technology, охватывающая три основные области создания видео, изображений и аудио. Она специально разработана для работников медиа и культурной индустрии, кино- и телепромышленности/постпродакшена, искусства и дизайна, рекламы и маркетинга и т.д., чтобы предоставить универсальные профессиональные решения для создания видео.
1 год назад
058.2K
Logics-Parsing - 阿里开源的文档解析模型

Logics-Parsing - модель разбора документов с открытым исходным кодом на Ali

Logics-Parsing - это модель сквозного разбора документов с открытым исходным кодом, основанная на Qwen2.5-VL-7B. Оптимизация анализа макета документа и вывода порядка чтения с помощью обучения с усилением, PDF-изображения могут быть преобразованы в структурированный HTML-вывод, поддержка разнообразного контента ...
10 месяцев назад
058.2K
Stand-In - 腾讯微信视觉开源的轻量级视频生成框架

Stand-In - Tencent WeChat Visual Open Source Lightweight Video Generation Framework

Stand-In - это легкий и простой в использовании фреймворк для создания видео с сохранением идентификационных данных от команды WeChat Vision компании Tencent. Сосредоточившись на сохранении специфических особенностей личности при генерации видео, он требует лишь обучения дополнительных параметров базовой модели 1% и позволяет добиться отличных результатов в схожести и естественности лиц.
11 месяцев назад
057.7K
DeepSeek-OCR - DeepSeek开源的光学字符识别模型

DeepSeek-OCR - модель оптического распознавания символов с открытым исходным кодом DeepSeek

DeepSeek-OCR - это усовершенствованная модель оптического распознавания символов (OCR), открытая командой DeepSeek, которая преобразует текст в изображения с помощью технологии "контекстного оптического сжатия" и использует визуальные маркеры для сжатия и декодирования для эффективной обработки длинных текстов.
9 месяцев назад
057.7K
MobiAgent - 上海交大开源的移动端智能体全栈构建框架

MobiAgent - открытый фреймворк для создания полного стека мобильных интеллектуальных тел, разработанный Шанхайским университетом Цзяотун

MobiAgent - это инструментарий мобильного интеллектуального тела с открытым исходным кодом от IPADS Lab Шанхайского университета Цзяотун, который помогает пользователям создавать собственные мобильные интеллектуальные помощники. Записывая траекторию движения пользователя и генерируя высококачественные данные, он обучает интеллектуальные тела, способные понимать команды на естественном языке. Среди основных функций - эффективная...
11 месяцев назад
057.4K
WebWeaver - 阿里通义开源的新型双智能体框架

WebWeaver - Ali Tongyi открыл новый фреймворк для тела с двойным интеллектом

WebWeaver - это новый фреймворк с двумя интеллектами, представленный командой Alibaba Tongyi, который в основном используется в открытых глубоких исследованиях и может имитировать процесс исследования человека, который делится на два интеллекта: планирование и письмо.
11 месяцев назад
057.4K
Nemotron 3 - 英伟达发布的开源 AI 模型系列

Nemotron 3 - семейство моделей ИИ с открытым исходным кодом, выпущенное NVIDIA

Nemotron 3 - это семейство моделей ИИ с открытым исходным кодом, выпущенных NVIDIA в размерах Nano, Super и Ultra. В Nemotron 3 используется скрытая архитектура MoE, которая значительно повышает эффективность вычислений и снижает операционные расходы. Одна из...
8 месяцев назад
057.2K
Klear-Reasoner - 快手推出的全新推理模型

Klear-Reasoner - новая модель рассуждений, представленная компанией Racer

Klear-Reasoner - это высокопроизводительная модель умозаключений от Racer, основанная на Qwen3-8B-Base. Модель обучается с помощью длинной мыслительной цепочки с контролируемой тонкой настройкой и обучения с подкреплением, что позволяет ей демонстрировать высокие результаты в математических и кодовых рассуждениях.Klear-Reasoner...
11 месяцев назад
057.1K
HunyuanWorld-Voyager - 腾讯开源的超长漫游世界模型

HunyuanWorld-Voyager - модель мира с открытым исходным кодом Tencent для сверхдальнего роуминга

HunyuanWorld-Voyager (сокращенно Hunyuan Voyager) - первая в индустрии модель сверхдлинного блуждающего мира, выпущенная компанией Tencent и поддерживающая нативную 3D-реконструкцию. Это новый фреймворк для диффузии видео, который генерирует 3D-последовательности облаков точек по заданным пользователем траекториям движения камеры из одного изображения, поддерживая...
11 месяцев назад
057K
OneCAT - 美团联合上海交大开源的多模态模型

OneCAT - мультимодальная модель с открытым исходным кодом для Meituan и Шанхайского университета Цзяотун

OneCAT - это новая унифицированная мультимодальная модель, запущенная компанией Meituan совместно с Шанхайским университетом Цзяотун. В ней используется архитектура чистого декодера, в которой органично сочетаются функции мультимодального понимания, преобразования текста в изображение и редактирования изображений. Модель отказывается от традиционных мультимодальных моделей, которые полагаются на внешние визуальные кодировщики и дезамбигуаторы, благодаря модально-специфическим...
11 месяцев назад
056.6K
Gemini Robotics On-Device - 谷歌推出首个在本地运行的具身智能模型

Gemini Robotics On-Device - Google запускает первую модель встроенного интеллекта, работающую локально

Gemini Robotics On-Device - это модель видения-языка-действия от Google DeepMind, которая поддерживает локальный запуск в роботе. Модель способна выполнять задачи в автономном режиме, совершая тонкие действия на основе команд естественного языка, например складывать одежду и доставать открытые сумки...
1 год назад
056.6K
Qwen3-Omni - 阿里通义推出的全模态AI模型

Qwen3-Omni - омнимодальная модель искусственного интеллекта, представленная Али Тонги

Qwen3-Omni - это полностью модальная модель ИИ, представленная командой Ali Tongyi, которая может работать с несколькими типами данных, такими как текст, изображения, аудио и видео, и поддерживает текстовое взаимодействие на 119 языках с низкой задержкой и высокой управляемостью.
10 месяцев назад
056.6K
FLUX.1 Kontext - 黑森林推出的图像生成与编辑模型

FLUX.1 Kontext - модель генерации и редактирования изображений из Шварцвальда

FLUX.1 Kontext - это модель генерации и редактирования изображений от Black Forest Labs, которая предоставляет методы обработки изображений с учетом контекста. Модель понимает реакцию на текстовые и графические сигналы, выполняет такие задачи, как изменение объектов, преобразование стилей и замена фона, сохраняя при этом угловую...
1 год назад
056.6K
混元世界模型1.5 - 腾讯混元开源的实时世界模型生成框架

Mixed World Model 1.5 - Tencent Mixed Open Source Real-time World Model Generation Framework

Hybrid World Model 1.5 (Tencent HY WorldPlay) - это первый в отрасли фреймворк с открытым исходным кодом для моделирования мира в реальном времени, выпущенный компанией Tencent и охватывающий всю цепочку развертывания данных, обучения и потокового вывода. В основе лежит авторегрессионная диффузионная модель WorldPlay, которая использует Next-F...
8 месяцев назад
056.5K
VTP - MiniMax海螺视频团队开源的视觉生成模型技术

VTP - технология визуального генеративного моделирования с открытым исходным кодом MiniMax Conch Video Team

VTP (Visual Tokenizer Pre-training) - это ключевая технология для визуальных генеративных моделей, предложенная командой MiniMax Conch Video для повышения производительности генеративной системы путем улучшения метода предварительного обучения визуального токенизатора (tokenizer). Традиционный метод...
7 месяцев назад
056.5K