LLaSO - 逻辑智能推出的业界首个全面开源的语音模型
LLaSO是北京深度逻辑智能科技有限公司推出的开源语音模型,通过整合语音与文本数据,提供对齐数据集、指令微调数据集和评估基准,解决了大型语音语言模型领域数据分散、任务覆盖不足等问题。
混元3D 3.0 - 腾讯推出的3D生成模型,支持超高清建模
混元3D 3.0是腾讯推出的先进3D生成模型,基于3D-DiT分级雕刻技术,几何分辨率高达1536³,能生成超高清、细节丰富的3D模型,在人物建模方面表现出色,能精准塑造五官和体态。
Mini-o3 - 字节、港大联合开源的视觉推理模型
Mini-o3是字节跳动和香港大学联合推出的开源模型,专注于解决复杂视觉搜索问题。模型具备强大的多轮交互推理能力,能通过深度探索和试错定位目标。
GPT-5-Codex - OpenAI推出的最强编程模型
GPT-5-Codex 是 OpenAI 推出的强大的编程优化模型,基于 GPT-5 进一步强化,专为软件工程师设计。模型能快速生成高质量代码,支持多种编程语言,且能优化现有代码提升性能。
MiniMax Music 1.5 - MiniMax最新推出的AI音乐生成模型
MiniMax Music 1.5 是先进的 AI 音乐生成工具,支持根据用户的自然语言描述,生成长达4分钟的音乐作品。模型支持多种音乐风格和情绪定制,生成的人声音色自然饱满,转音顺畅,编曲层次丰富...
AnyI2V - 复旦联合阿里达摩院等开源的智能图像动画生成框架
AnyI2V是复旦大学、阿里巴巴达摩院等联合推出的图像动画生成框架,支持将静态的条件图像(如网格、点云等)转化为动态视频,无需复杂的训练过程和大量数据。
SRPO - 腾讯混元推出的文本到图像生成模型
SRPO(Semantic Relative Preference Optimization)是腾讯混元推出的文本到图像生成模型,通过文本条件信号优化奖励机制,实现在线调整奖励,减少离线微调依赖。
Qwen3-Next - 阿里通义推出的最新基础模型
Qwen3-Next是阿里通义开源的新一代混合架构大模型,结合了Gated DeltaNet和Gated Attention技术,擅长处理长文本,推理速度快且节省计算资源。
文心大模型X1.1 - 百度推出的深度思考模型,理解能力更强
文心大模型X1.1是百度推出的深度思考模型,基于混合强化学习框架,专注于提升语言理解和生成能力。模型在处理复杂问题、遵循指令和模拟智能体行为方面表现出色,能准确地提供知识性答案和高质量的文本内容。
混元图像2.1 - 腾讯推出的开源文生图模型
混元图像2.1(HunyuanImage 2.1)是腾讯推出的开源文生图模型,专为高质量图像生成设计。模型支持原生2K分辨率,能精准呈现复杂场景和细节,使人物表情和动作能生动还原。









