Atlas - 李飞飞 World Labs 推出的多模态世界模型Atlas 是李飞飞创立的 World Labs 推出的全球首个多模态世界模型。模型能同时理解文本、图像、视频和三维空间信息,将画面精准锚定在空间坐标系中。Последние ресурсы по искусственному интеллекту1 неделя назад024.6K
JoyAI-Video-Edit - 京东开源的实时流式视频编辑模型JoyAI-Video-Edit 是京东开源的实时流式视频编辑模型,基于16B参数自回归扩散框架构建,在单张英伟达B200 GPU上即可实现720p分辨率约30FPS的实时处理,真正做到"边播边改"。Последние ресурсы по искусственному интеллекту1 месяц назад024K
Mureka V9.5 - 昆仑万维发布的AI音乐生成大模型Mureka V9.5 是昆仑万维(天工AI)发布的AI音乐生成大模型,首次亮相于同年7月的世界人工智能大会。核心是自研的 MusiCoT 音乐思维链技术,模型在生成音频前先进行整体音乐构思,强调编配...Последние ресурсы по искусственному интеллекту4 недели назад023.2K
Gemini 3.5 Transcribe - Google 发布的旗舰语音转文本模型Gemini 3.5 Transcribe 是 Google 发布的旗舰语音转文本模型,与传统语音识别只做逐字记录不同,能直接输出润色过、格式规范的成稿。自动删除口头禅、理解"周二,不,周三"式的自我...Последние ресурсы по искусственному интеллекту3 недели назад018.4K
Hy4 preview - 腾讯混元开源的新一代大模型Hy4 preview是腾讯混元推出的开源旗舰大模型,采用混合专家架构,总参数达7700亿、激活490亿,支持百万级上下文。Последние ресурсы по искусственному интеллекту1 неделя назад014.9K
如何做出专业级 AI 短漫剧?- 商汤 Seko 给普通创作者机会AI 剧漫剧的观众越来越多,普通创作者却越来越难赚到钱了。 这并不是你的错觉,DataEye 预估显示,2025 年国内漫剧用户规模约 1.2 亿,到 2026 年上半年,用户规模已突破 6 亿,规模...Практические уроки по искусственному интеллектуПоследние ресурсы по искусственному интеллекту7 дней назад014.2K
Gemini Omni 1.1 Flash - 谷歌推出的多模态视频生成模型Gemini Omni 1.1 Flash 是 Google DeepMind 推出的多模态视频生成模型,面向开发者与专业创作者。模型在 Gemini Omni 初版基础上,将可分析的上下文从 1 秒...Последние ресурсы по искусственному интеллекту1 неделя назад013.2K
DeepSeek V4.1 Flash - DeepSeek 开源的新一代基础模型DeepSeek V4.1 Flash 是 DeepSeek 新一代架构中的入门款大模型,总参数 552B 的 MoE 设计,推理时只激活少量参数(输入约 8B、输出 16B),速度极快、成本很低。Последние ресурсы по искусственному интеллекту7 дней назад012.4K
什么是深度动作捕捉?实测 LibTV,一键提取深度动态信息最近那种 AI 换角视频很容易刷到。虽然角色变了,但动作熟悉,成片很容易让人看完。LibTV 这次上线的深度动作捕捉,完美解决了这个问题。 我们上传参考视频,LibTV 会一键提取视频中的深度动态信息...Практические уроки по искусственному интеллектуПоследние ресурсы по искусственному интеллекту6 дней назад012.3K
Claude Fable 5.1 - Anthropic 推出的新一代AI大模型Claude Fable 5.1 是 Anthropic 推出的新一代AI模型,主打复杂推理、长周期 Agent 任务与知识密集型工作。模型在科学探索、软件开发、计算机操作等多项基准测试中全面超越前代...Последние ресурсы по искусственному интеллекту1 неделя назад011.2K
ChatGPT Images 2.5 - OpenAI 推出的最新图像生成模型ChatGPT Images 2.5 是 OpenA推出的最新图像生成模型,面向 ChatGPT 全档位用户免费开放。模型在推理效率上大幅优化,出图延迟较上一代最高缩短一半;同时强化局部编辑的精准度...Последние ресурсы по искусственному интеллекту7 дней назад011.1K
MiniCPM5-2B - 面壁智能联合清华等开源的新一代语言模型MiniCPM5-2B 是面壁智能联合清华大学、OpenBMB 社区推出的开源端侧语言模型,参数量仅约 25 亿,能在多项基准测试中超越不少 40 亿参数的模型。模型原生支持 128K 长文本上下文...Последние ресурсы по искусственному интеллекту5 дней назад010.4K
MAI-Transcribe-2 - 微软推出的多语言语音转文字模型MAI-Transcribe-2 是微软推出的多语言语音转文字模型,支持 60 种语言并具备自动语言识别与切换能力。模型内置说话人分离和逐词时间戳,无需额外后处理,提供 verbatim 和 clea...Последние ресурсы по искусственному интеллекту1 неделя назад09.9K
H3-World - 腾讯等开源的交互式世界模型H3-World 是腾讯联合新加坡国立大学、香港理工大学开源的交互式世界模型。模型在 MiniMax-H3 视频生成器(33B)基础上,仅用 8000 条游戏视频和 rank-32 的轻量 LoRA ...Последние ресурсы по искусственному интеллекту5 дней назад08.4K
星火X2.5 - 科大讯飞推出的新一代旗舰大模型系列星火X2.5是科大讯飞推出的新一代旗舰大模型系列,涵盖云端MoE大模型及两款开源端侧小模型。模型基于国产昇腾算力完成训练,强调自主可控,在代码生成、数学推理和Agent协作方面表现突出。Последние ресурсы по искусственному интеллекту3 дня назад06.1K
мезо- (химия)XiaoMi MiMo Desktop - 小米推出的桌面级通用 AI 助手XiaoMi MiMo Desktop 是小米推出的桌面级通用 AI 助手,搭载自研的 MiMo-X-Pro 与 MiMo-X-Flash 双模型。用户无需提前整理素材格式,可直接把表格、PDF、音视...Последние ресурсы по искусственному интеллекту2 дня назад04.6K
мезо- (химия)K2.8 Preview - 月之暗面推出的新一代主力编码模型Kimi K2.8 Preview 是月之暗面推出的新一代主力编码模型,已在 Kimi Code 和 Kimi Work 平台全量上线。模型采用 kimi-for-coding 模型 ID 实现无感升...Последние ресурсы по искусственному интеллекту1 день назад04K