AI Sharing Circle

Daily sharing of the latest AI products, projects, frameworks, paper interpretations, etc.~
MiniCPM5-2B - 面壁智能联合清华等开源的新一代语言模型

meso- (chemistry)MiniCPM5-2B - 面壁智能联合清华等开源的新一代语言模型

MiniCPM5-2B 是面壁智能联合清华大学、OpenBMB 社区推出的开源端侧语言模型,参数量仅约 25 亿,能在多项基准测试中超越不少 40 亿参数的模型。模型原生支持 128K 长文本上下文...
5hrs ago
0762
H3-World - 腾讯等开源的交互式世界模型

meso- (chemistry)H3-World - 腾讯等开源的交互式世界模型

H3-World 是腾讯联合新加坡国立大学、香港理工大学开源的交互式世界模型。模型在 MiniMax-H3 视频生成器(33B)基础上,仅用 8000 条游戏视频和 rank-32 的轻量 LoRA ...
5hrs ago
0492
什么是深度动作捕捉?实测 LibTV,一键提取深度动态信息

meso- (chemistry)什么是深度动作捕捉?实测 LibTV,一键提取深度动态信息

最近那种 AI 换角视频很容易刷到。虽然角色变了,但动作熟悉,成片很容易让人看完。LibTV 这次上线的深度动作捕捉,完美解决了这个问题。 我们上传参考视频,LibTV 会一键提取视频中的深度动态信息...
1dys ago
04.1K
如何做出专业级 AI 短漫剧?- 商汤 Seko 给普通创作者机会

如何做出专业级 AI 短漫剧?- 商汤 Seko 给普通创作者机会

AI 剧漫剧的观众越来越多,普通创作者却越来越难赚到钱了。 这并不是你的错觉,DataEye 预估显示,2025 年国内漫剧用户规模约 1.2 亿,到 2026 年上半年,用户规模已突破 6 亿,规模...
2dys ago
06.3K
DeepSeek V4.1 Flash - DeepSeek 开源的新一代基础模型

DeepSeek V4.1 Flash - DeepSeek 开源的新一代基础模型

DeepSeek V4.1 Flash 是 DeepSeek 新一代架构中的入门款大模型,总参数 552B 的 MoE 设计,推理时只激活少量参数(输入约 8B、输出 16B),速度极快、成本很低。
2dys ago
05.2K
ChatGPT Images 2.5 - OpenAI 推出的最新图像生成模型

ChatGPT Images 2.5 - OpenAI 推出的最新图像生成模型

ChatGPT Images 2.5 是 OpenA推出的最新图像生成模型,面向 ChatGPT 全档位用户免费开放。模型在推理效率上大幅优化,出图延迟较上一代最高缩短一半;同时强化局部编辑的精准度...
2dys ago
04.8K
Gemini Omni 1.1 Flash - 谷歌推出的多模态视频生成模型

Gemini Omni 1.1 Flash - 谷歌推出的多模态视频生成模型

Gemini Omni 1.1 Flash 是 Google DeepMind 推出的多模态视频生成模型,面向开发者与专业创作者。模型在 Gemini Omni 初版基础上,将可分析的上下文从 1 秒...
3dys ago
06.7K
MAI-Transcribe-2 - 微软推出的多语言语音转文字模型

MAI-Transcribe-2 - 微软推出的多语言语音转文字模型

MAI-Transcribe-2 是微软推出的多语言语音转文字模型,支持 60 种语言并具备自动语言识别与切换能力。模型内置说话人分离和逐词时间戳,无需额外后处理,提供 verbatim 和 clea...
3dys ago
05K
Hy4 preview - 腾讯混元开源的新一代大模型

Hy4 preview - 腾讯混元开源的新一代大模型

Hy4 preview是腾讯混元推出的开源旗舰大模型,采用混合专家架构,总参数达7700亿、激活490亿,支持百万级上下文。
4dys ago
09.8K
Claude Fable 5.1 - Anthropic 推出的新一代AI大模型

Claude Fable 5.1 - Anthropic 推出的新一代AI大模型

Claude Fable 5.1 是 Anthropic 推出的新一代AI模型,主打复杂推理、长周期 Agent 任务与知识密集型工作。模型在科学探索、软件开发、计算机操作等多项基准测试中全面超越前代...
4dys ago
07.2K