AIシェアリングサークル

AIは世界を変えようとしている!
JoyAI-Video-Edit - 京东开源的实时流式视频编辑模型

JoyAI-Video-Edit - 京东开源的实时流式视频编辑模型

JoyAI-Video-Edit 是京东开源的实时流式视频编辑模型,基于16B参数自回归扩散框架构建,在单张英伟达B200 GPU上即可实现720p分辨率约30FPS的实时处理,真正做到"边播边改"。
1ヶ月前
022.3K
Qwen 3.8-Max - 阿里巴巴通义千问发布的旗舰级大模型

Qwen 3.8-Max - 阿里巴巴通义千问发布的旗舰级大模型

Qwen 3.8-Max 是阿里巴巴通义千问发布的旗舰级大模型,也是 Qwen 系列迄今规模最大、能力最强的模型。采用稀疏混合专家(MoE)架构,总参数达2.4万亿,推理时仅激活约950亿参数,在保持...
1ヶ月前
030.8K
Qwen-Audio-3.0-ASR-Flash - 阿里通义千问发布的语音识别大模型

Qwen-Audio-3.0-ASR-Flash - 阿里通义千问发布的语音识别大模型

Qwen-Audio-3.0-ASR-Flash 是阿里巴巴通义千问团队发布的语音识别大模型,主打"长音频不丢词、行业词不用教"。模型在上下文一致性、行业词识别与热词定制化三大维度实现系统性升级,集成...
1ヶ月前
038.5K
MiniMax H3 - 稀宇科技MiniMax发布的通用全模态生成模型

MiniMax H3 - 稀宇科技MiniMax发布的通用全模态生成模型

MiniMax H3是稀宇科技MiniMax发布的通用全模态生成模型,可在统一上下文中理解文本、图像、视频与声音,生成最高15秒、2K分辨率、带原生双声道音频的音视频。
1ヶ月前
035.9K
Gemini 3.5 Flash-Lite - Google 发布的高吞吐低成本模型

Gemini 3.5 Flash-Lite - Google 发布的高吞吐低成本模型

Gemini 3.5 Flash-Lite 是 Google 发布的高吞吐低成本模型,官方定位为 3.5 系列中最快、最具成本效益的型号,面向 agentic search、文档处理与大规模生产流量...
2ヶ月前
033.8K
Gemini 3.6 Flash - Google 发布的新一代主力模型

Gemini 3.6 Flash - Google 发布的新一代主力模型

Gemini 3.6 Flash 是 Google 发布的新一代主力模型(Workhorse Model),是 Gemini 3.5 Flash 的升级版,主要面向生产级 AI 智能体(Agent)和...
2ヶ月前
034K
TDream - 腾讯推出的 AI 内容创作平台

TDream - 腾讯推出的 AI 内容创作平台

TDream是腾讯内测的AI内容创作平台,以"互动影游化创作"为核心定位,试图重构用户从内容生产到交互体验的全链路。区别于市面上仅输出单一线性视频的传统文生视频工具,TDream依托五大AI引擎,支持...
2ヶ月前
035.9K
FLUX 3 - Black Forest Labs 发布的首款多模态基础模型

FLUX 3 - Black Forest Labs 发布的首款多模态基础模型

FLUX 3 是德国 AI 公司 Black Forest Labs 发布的首款多模态基础模型,基于自研 Self-Flow 架构,在单一网络中统一训练图像、视频、音频与动作预测,实现真正的"全能模型...
2ヶ月前
031.7K
Qwen-Audio-3.0-TTS - 阿里通义发布的旗舰级语音合成大模型

Qwen-Audio-3.0-TTS - 阿里通义发布的旗舰级语音合成大模型

Qwen-Audio-3.0-TTS是阿里巴巴通义千问团队发布的旗舰级语音合成大模型,提供面向实时交互的Flash版(首包延时约300ms)与面向高质量生成的Plus版,Plus版登顶全球权威榜单Ar...
2ヶ月前
034.7K
Qwen-Image-3.0 - 阿里千问发布的第三代图像生成基础模型

Qwen-Image-3.0 - 阿里千问发布的第三代图像生成基础模型

Qwen-Image-3.0 是阿里千问发布的第三代图像生成基础模型,核心主线为"实",内容丰实、细节真实、知识厚实。模型支持最大 4.5k token 超长文本输入,较前代提升 4.5 倍,可一次性...
2ヶ月前
032.8K