ROCK - 阿里巴巴开源的智能体训练环境沙箱ROCK(Reinforcement Open Construction Kit) 是阿里巴巴开源的智能体训练环境沙箱,解决智能体在真实环境中无法规模化训练的难题。ROCK 提供了高稳定的沙箱管理服务...最新AI资源10个月前058.4K
Mobile-Agent-v3.5 - 阿里通义开源的原生GUI Agent框架Mobile-Agent-v3.5是阿里巴巴通义实验室开源的新一代多平台GUI Agent框架,支持桌面、手机、浏览器三大平台,可跨Android、Ubuntu、macOS、Windows实现自动化操...最新AI资源6个月前058.4K
Omnilingual ASR - Meta推出的多语言语音识别框架Omnilingual ASR是Meta推出的多语语音识别框架,覆盖1600+语言,78%语言字符错误率低于10%。其70亿参数wav2vec 2.0编码器结合CTC与Transformer解码器,支...最新AI资源10个月前058.4K
TranslateGemma - 谷歌开源的机器翻译模型系列TranslateGemma是谷歌推出的基于Gemma 3的开源机器翻译模型系列,专为提升翻译质量而设计。通过两阶段微调(监督微调和强化学习)优化翻译效果,提供4B、12B、27B三种参数规模,支持5...最新AI资源8个月前058.3K
腾讯Hy翻译 - 腾讯混元推出的 AI 翻译工具腾讯Hy翻译是腾讯混元团队基于自研Hy-MT2大模型开发的AI翻译工具,主打全场景适配能力。支持33种语言互译及5种民汉/方言翻译,提供学术论文、法律合同等9种翻译风格预设,可通过微信小程序使用。最新AI资源4个月前058.3K
Ring-2.6-1T - 蚂蚁百灵团队发布的万亿级旗舰思考模型Ring-2.6-1T是蚂蚁集团百灵团队发布的万亿级旗舰思考模型,总参数1万亿,采用稀疏MoE架构,推理时仅激活约630亿参数,兼顾规模与效率。核心创新支持High与XHigh两档可调节推理强度最新AI资源4个月前058.2K
SmartResume - 阿里巴巴开源的AI简历解析与优化工具SmartResume 是阿里巴巴开源的智能简历解析与优化工具,能高效地从 PDF、图片或 Office 文档中提取结构化信息,如基本资料、教育经历和工作经验等。通过融合 OCR 技术和 PDF 元数...最新AI资源10个月前058.1K
SceneGen - 上海交大开源的单图像生成3D场景框架SceneGen是上海交通大学开源的单图像生成3D场景的方法,从单张场景图像及目标资源蒙版中,高效生成包含多个3D资源的完整场景,包括资源的几何结构、纹理及相对空间位置。最新AI资源11个月前058.1K
MiMo-Embodied - 小米开源的跨领域具身智能基座模型MiMo-Embodied是小米集团开源的全球首个成功融合具身智能(Embodied AI)与自动驾驶的跨具身基础模型。解决具身智能与自动驾驶之间的知识迁移难题,实现两大领域的任务统一建模。最新AI资源10个月前058K
GLM-5-Turbo - 智谱 AI 推出专为 OpenClaw 场景深度优化的基座模型GLM-5-Turbo 是智谱 AI 发布的全球首款专为 OpenClaw(龙虾) 场景深度优化的基座模型,也是 GLM-5 系列的高速增强版本。模型从训练阶段就针对 Agent 任务的核心需求进行专...最新AI资源6个月前057.9K
TencentDB Agent Memory - 腾讯云开源的 AI 智能体记忆工具TencentDB Agent Memory是腾讯云开源的AI智能体记忆工具,专门解决长任务中Token消耗过快的问题。通过分层记忆架构(L0-L3)自动管理信息,将原始对话、关键结论、场景归纳和用户...最新AI资源4个月前057.9K
Astron Agent - 科大讯飞开源的企业级智能工作流开发平台Astron Agent是科大讯飞开源的企业级智能工作流开发平台,专注于帮助企业快速构建可落地的AI代理应用。采用Java+Spring Boot技术栈,支持轻量化私有化部署(最低2核4G配置),内置...最新AI资源10个月前057.8K
MiniMax M2.7 - MiniMax 推出的旗舰级 Agent 推理大模型MiniMax M2.7 是 MiniMax 推出的旗舰级 Agent 推理大模型,主打"模型自我进化"能力。模型通过构建 Agent Harness 体系,深度参与自身训练与优化流程,在部分研发场景...最新AI资源6个月前057.8K
ArenaRL - 高德地图联合阿里通义开源的对比式强化学习方法ArenaRL是高德地图与阿里通义团队联合开源的对比式强化学习方法,专为解决开放域任务(如出行规划)中缺乏标准答案的问题。核心创新在于用“相对排序”替代传统“绝对打分”机制,通过智能体自动生成多套方案...最新AI资源8个月前057.7K
LongCat-Video-Avatar 1.5 - 美团开源的音频驱动数字人视频生成模型LongCat-Video-Avatar 1.5 是美团 LongCat 团队开源的音频驱动数字人视频生成模型,基于 13.6B 参数的 LongCat-Video 基础模型构建,采用 MIT 协议完...最新AI资源4个月前057.4K
Mistral Small 4 - Mistral AI 开源的多模态大模型Mistral Small 4 是 Mistral AI 开源的多模态大模型,采用 1190 亿参数 MoE 架构(每 token 激活 60 亿参数),支持 256K 超长上下文。核心突破在于三合一...最新AI资源6个月前057.3K
InfinityStar - 字节开源的统一时空自回归视频生成框架InfinityStar是字节跳动开源的统一时空自回归框架,专为高分辨率图像和视频生成设计。采用离散自回归方法,能在单一模型中同时处理文本到图像、文本到视频、图像到视频等任务。框架在VBench基准测...最新AI资源10个月前057.3K
NineClaw - 好未来推出的教师专属 AI 原生桌面超级智能体NineClaw(九章龙虾) 是好未来(TAL)推出的行业首款教师专属AI原生桌面超级智能体,昵称"九龙"。深度融合好未来20年教研积累与海量题库资源,采用本地化运行架构,支持Windows和MacO...最新AI资源6个月前057.1K
Ming-flash-omni-Preview - 蚂蚁集团开源的全模态大模型Ming-flash-omni-Preview是蚂蚁集团inclusionAI发布的开源全模态大模型,参数规模达千亿,基于Ling 2.0的稀疏MoE架构,总参数103B,激活9B。在全模态理解和生成...最新AI资源11个月前057.1K
LongCat-Flash-Omni - 美团开源的全模态大语言模型LongCat-Flash-Omni 是美团 LongCat 团队发布的开源全模态大语言模型。拥有5600亿参数规模(激活参数270亿),在保持庞大参数量的同时,实现了毫秒级的实时音视频交互能力。最新AI资源11个月前057K
Glow - 开源的命令行工具,支持在终端渲染Markdown文件Glow 是开源的命令行工具,用于在终端中优雅地渲染 Markdown 文件。工具支持高亮代码块、数学公式等复杂元素,提供丰富的功能,如自定义样式、分页显示、鼠标支持等。最新AI资源10个月前056.9K
RoboCOIN - 智源联合多所高校开源的双臂机器人真机数据集RoboCOIN是北京智源人工智能研究院联合多家企业和高校开源的全球首个大规模双臂机器人真机数据集,包含15种机器人平台、18万条真实操作轨迹和421种任务场景。最大特点是采用分层标注体系,将任务拆解...最新AI资源10个月前056.9K
FIBO - 全球首个开源原生支持JSON的文本生成图像模型FIBO 是 Bria AI 开发的全球首个开源的原生支持 JSON 的文本生成图像模型。基于 8B 参数的 DiT(扩散 Transformer)架构,采用流匹配(Flow Matching)训练方...最新AI资源11个月前056.9K
移动云 MobileClaw - 中国移动推出的桌面级 AI 办公 Agent移动云 MobileClaw 是中国移动推出的桌面级AI办公智能体,央企首个深度兼容OpenClaw生态的"自研小龙虾",主打"本地优先、隐私至上"。采用一键安装开箱即用设计,适配Windows/ma...最新AI资源6个月前056.7K
Xiaomi MiMo-V2-Pro - 小米推出的旗舰级MoE大模型Xiaomi MiMo-V2-Pro 是小米推出的旗舰级MoE大模型,采用1万亿总参数、420亿激活参数的混合专家架构,支持最高100万token超长上下文。模型以代号"Hunter Alpha"匿名...最新AI资源6个月前056.6K
Fun-CineForge - 阿里通义实验室开源的影视级配音多模态大模型Fun-CineForge 是阿里通义实验室开源的首个支持影视级多场景配音的多模态大模型,基于 CosyVoice3 打造。通过"数据+模型"一体化设计,创新性地解决音画同步、情感表达、音色一致与时间...最新AI资源6个月前056.6K
JJT - 360推出的全链路AI演示文稿创作工具JJT(超级J的AI PPT)是360推出的全链路AI演示文稿创作工具,让用户以极简操作产出设计师级别的PPT。用户只需输入主题或粘贴数据,AI即可自动生成结构完整、视觉专业的演示文稿最新AI资源4个月前056.5K
NewBie-image-Exp0.1 - NewBieAI-Lab开源的实验性动漫文生图模型NewBie-image-Exp0.1是NewBieAI-Lab团队开源的首个实验性动漫文生图模型,采用3.5B参数的Next-DiT架构,专为二次元风格优化。模型通过双文本编码器(GEMMA3-4B...最新AI资源9个月前056.5K
Step-Audio-EditX - 阶跃星辰开源的首个LLM级音频编辑大模型Step-Audio-EditX是开源的音频编辑大模型,由阶跃星辰团队研发,专注于通过人工智能技术实现音频内容的精细操控。模型能动态调整音频的情绪、说话风格(如撒娇、老人腔等)和副语言元素(如笑声、叹...最新AI资源10个月前056.5K
MOSS-Speech - 复旦大学开源的语音到语音大模型MOSS-Speech是复旦大学邱锡鹏教授团队开源的语音到语音(Speech-to-Speech)大模型。突破传统语音处理方式,无需文本引导,直接对语音进行理解和生成,能捕捉语调、情绪等非文字要素,使...最新AI资源10个月前056.5K
MAI-Code-1-Flash - 微软自研的 AI 编程模型MAI-Code-1-Flash 是微软自研的AI编程模型,采用137B参数MoE架构,专为真实开发环境训练,直接使用GitHub Copilot的生产工具链学习多文件编辑、终端调用等实际工作流。最新AI资源4个月前056.4K
DPAI Arena - JetBrains开源的AI编程基准测试平台DPAI Arena(Developer Productivity AI Arena)是JetBrains创建的开放基准测试平台,衡量AI辅助开发工具在真实世界软件工程任务中的有效性。通过透明的评估流...最新AI资源10个月前056K
ChronoEdit - 英伟达与多伦多大学联合开源的AI图像编辑框架ChronoEdit是英伟达与多伦多大学联合研发的开源AI图像编辑框架,将图像编辑任务重新定义为视频生成任务,以确保编辑结果在时间和物理上的一致性。通过从一个 14B 参数的预训练视频生成模型中蒸馏出...最新AI资源11个月前056K
Supertonic - 开源的高性能AI 文本转语音系统,极速离线运行Supertonic是开源的高性能的文本转语音(TTS)系统,专注于在本地设备上快速生成语音。采用ONNX Runtime技术,可在手机、电脑甚至树莓派等设备上运行,支持23种语言和语音克隆,无需网络...最新AI资源10个月前055.9K
FireRed-OCR - 小红书团队开源的端到端文档解析模型FireRed-OCR 是小红书 Super Intelligence 团队开源的端到端文档解析模型,基于 Qwen3-VL-2B 架构打造,仅用 2B 参数就在 OmniDocBench v1.5 ...最新AI资源6个月前055.9K
GigaBrain-0 - 开源的具身基础模型,由世界模型生成数据驱动GigaBrain-0是国内首个利用世界模型生成数据实现真机泛化的端到端视觉-语言-动作(VLA)具身基础模型,由极佳视界与湖北人形机器人创新中心联合发布开源。采用混合Transformer架构,融合...最新AI资源11个月前055.8K
MiniMax M3 - 稀宇科技发布的新一代人工智能大模型MiniMax M3是稀宇科技发布的新一代人工智能大模型,采用自研稀疏注意力机制(MSA),支持100万tokens超长上下文和原生多模态功能(图像/视频输入及桌面操作)。编程能力在SWE-Bench...最新AI资源4个月前055.6K
SkyClaw-v1.0 - 昆仑万维旗下天工AI推出的高性能Agent模型SkyClaw-v1.0 是昆仑万维旗下天工AI推出的高性能Agent模型,同时发布轻量化版本 SkyClaw-v1.0-lite。模型专为真实智能体工作流设计,支持百万token超长上下文,深度优化...最新AI资源4个月前055.6K
Petri - Anthropic开源的 AI 安全审计框架Petri 是 Anthropic 开发的开源 AI 安全审计框架,系统性地评估 AI 模型的安全性和行为对齐情况。通过模拟真实场景,让自动化审计员与目标模型进行多轮对话,然后由法官代理对模型的行为进...最新AI资源11个月前055.6K
OpenAgents - 开源免费的构建AI Agent网络开放协作项目OpenAgents 是开源项目,创建 AI 代理网络并促进代理之间的开放协作。提供了一个基础的网络基础设施,使 AI 代理能无缝连接和协作。用户可以快速启动自己的代理网络,通过模块化架构扩展功能,支...最新AI资源11个月前055.5K
Xiaomi MiMo-V2-Omni - 小米推出的Agent全模态基座模型Xiaomi MiMo-V2-Omni 是小米推出的面向Agent时代的全模态基座模型,专为现实世界中复杂的多模态交互与执行场景打造。模型从底层构建了融合文本、视觉、语音的统一架构,将"感知"与"行动...最新AI资源6个月前055.5K
JoyAI-Echo - 京东开源的分钟级长音视频生成框架JoyAI-Echo 是京东开源的分钟级长音视频生成框架,专为解决AI视频"角色易崩、声音乱变、生成缓慢"三大痛点而设计。基于LTX-2.3 DiT架构,通过跨模态记忆库在长达5分钟的多镜头视频中保持...最新AI资源3个月前055.4K
EdgeClaw - 面壁智能联合清华等开源的端云协同 AI 智能体框架EdgeClaw 是面壁智能联合清华大学等机构开源的端云协同 AI 智能体框架,主打安全可控与本地部署。首创三层数据安全协议(S1/S2/S3),通过规则检测器与本地 LLM 语义检测器实时分类请求敏...最新AI资源6个月前055.1K
LongCat-Audio-Codec - 美团LongCat开源的语音编解码方案LongCat-Audio-Codec是美团LongCat团队开源的语音编解码方案。方案专为语音大语言模型(Speech LLM)设计,通过语义与声学双Token并行提取机制,兼顾语音的语义和声学特征...最新AI资源11个月前054.8K
GPT-Realtime-2 - OpenAI 发布的商用旗舰级实时语音模型GPT-Realtime-2 是 OpenAI 发布商用的旗舰级实时语音模型,也是首款具备 GPT-5 级推理能力的端到端语音代理模型,上下文窗口扩展至 128K,支持图像输入、五级可调推理强度与并行...最新AI资源4个月前054.8K
HiDreamClaw - 智象未来推出的多模态原生AI智能体应用HiDreamClaw 是智象未来(HiDream.ai)推出的多模态原生AI智能体应用,定位为图片与视频生成垂直领域的创作助手。目前已接入其海外平台vivago,面向创作者提供7×24小时在线服务。最新AI资源6个月前054.8K
Matrix-Game 3.0 - 昆仑万维发布的实时交互式世界模型Matrix-Game 3.0是昆仑万维发布的实时交互式世界模型,属于AIGC全家桶中的三大核心模型之一。模型通过物理仿真驱动,解决了传统世界模型易失忆、环境不稳定的问题,支持720p、40fps实时...最新AI资源6个月前054.7K
Open-o3 Video - 北大联合字节开源的视频推理模型Open-o3 Video 是北京大学和字节跳动联合开发的开源视频推理模型,专注于通过时间和空间证据增强视频推理能力。通过明确标注关键证据的时间戳和边界框,帮助模型更好地理解和解释视频内容。最新AI资源10个月前054.5K
VibeThinker-1.5B - 微博AI开源的15亿参数大型语言模型VibeThinker-1.5B是微博AI开源的15亿参数的大型语言模型。基于阿里巴巴的Qwen2.5-Math-1.5B进行精细调整,专为数学和代码任务优化,表现出色,推理性能在行业内处于领先水平。最新AI资源10个月前054.3K
HiPilot - 小盒科技推出的 AI 原生经营操作系统HiPilot 是小盒科技推出的 AI 原生经营操作系统,非传统意义上的 AI 助手或工具软件,是由 7 位专业 Agent 组成的 7×24 小时 AI 经营班子,能自主感知企业数据、分析经营态势...最新AI资源3个月前054.3K
HiDream-O1-Image-1.5 - 智象未来推出的商用版图像生成大模型HiDream-O1-Image-1.5 是智象未来(HiDream.ai)推出的商用版图像生成大模型,在全球独立评测平台 Artificial Analysis 的文生图榜单(Text to Ima...最新AI资源3个月前054.2K
FLUX.2 - 黑森林开源的图像生成与编辑模型FLUX.2是Black Forest Labs发布的开源图像生成与编辑模型,支持文生图、多图参考和图像编辑,具备更丰富的细节、清晰纹理和稳定光线。分为四个版本:FLUX.2 [pro](媲美顶级闭源...最新AI资源10个月前054.2K
GLM-4.6V - 智谱AI开源的多模态大语言模型系列GLM-4.6V是智谱AI开源的多模态大语言模型系列,系列包含两个版本:GLM-4.6V(106B-A12B),面向云端与高性能集群场景的基础版,采用混合专家(MoE)架构,总参数量约1060亿,激活...最新AI资源9个月前054.1K
Gemini Omni - Google DeepMind 推出的新一代原生多模态生成模型Gemini Omni 是 Google DeepMind 在 Google I/O 大会上推出的新一代原生多模态生成模型,首发版本为 Gemini Omni Flash。作为 Google 首个真正...最新AI资源4个月前054K
Qwen3.7-Max - 阿里千问推出的新一代闭源旗舰大模型Qwen3.7-Max是阿里云千问发布的面向智能体(Agent)时代的新一代闭源旗舰大模型,定位为"全能智能体基座"。模型在编程智能体、通用智能体、高难度推理、长周期自主执行等维度实现全面突破最新AI资源4个月前053.9K
SenseNova-SI - 商汤科技开源的空间智能大模型系列SenseNova-SI是商汤科技发布的开源空间智能大模型,专注于提升AI在空间理解与推理方面的能力。模型在空间测量、重构、关系判断、视角转换、形变分析和空间推理等六个核心维度上表现出色,显著优于其他...最新AI资源10个月前053.9K
Bee - 腾讯混元联合清华开源的全栈多模态大模型项目Bee是腾讯混元团队与清华大学联合推出的全栈开源多模态大模型解决方案,通过提升数据质量缩小开源模型与闭源模型的性能差距。项目包含三大核心成果:1500万规模的高质量双层CoT数据集Honey-Data...最新AI资源10个月前053.9K
DeepSeek-Math-V2 - DeepSeek开源的数学推理模型DeepSeek-Math-V2是幻方旗下AI公司DeepSeek开源的数学推理模型,最新版本基于DeepSeek-V3.2-Exp-Base改进,性能超越Gemini DeepThink,达到国际数...最新AI资源10个月前053.7K
gws - 谷歌开源的CLI工具,支持接入各类AI Agent系统gws 是 Google Workspace 团队推出的命令行工具,采用 Rust 构建。工具支持运行时动态生成命令,通过读取 Google Discovery Service 实时适配所有 Work...最新AI资源6个月前053.5K
UniWorld V2 - 兔展智能联合北大推出的新一代图像编辑模型UniWorld V2是兔展智能与北京大学UniWorld团队联合推出的新一代图像编辑模型。在图像编辑领域具有显著优势,特别是在中文理解和复杂指令执行方面表现出色。模型能精准渲染艺术中文字体,支持精细...最新AI资源10个月前053.4K
ChatTutor - 开源的AI教学辅助工具,可视化互动学习ChatTutor是开源的AI教学辅助工具,专注于STEM学科的可视化互动学习。通过多智能体架构实现对话式答疑和动态绘图功能,能在电子白板上实时绘制数学图形、物理电路或思维导图,帮助用户直观理解抽象概...最新AI资源10个月前053.4K
MemMachine - MemVerge推出的开源AI记忆系统MemMachine是MemVerge公司开发的开源AI记忆系统,专为AI大模型和智能体设计,能像人脑一样存储和回忆交互数据,解决AI“无状态失忆”问题。采用分层架构(短期记忆、长期记忆、用户画像...最新AI资源10个月前053.4K
Gemini Embedding 2 - Google推出的首个原生五模态 Embedding 模型企业知识库管理员:需要统一检索文档、会议录音、培训视频、产品图片等多模态资料的企业用户 RAG 应用开发者:为多模态内容提供语义检索能力,提升生成质量的 AI 应用开发者 法律/医疗行业从业者:如 E...最新AI资源6个月前053.3K
Qwen-AgentWorld - 阿里通义实验室发布的首个原生语言世界模型Qwen-AgentWorld 是阿里巴巴通义实验室发布的首个原生语言世界模型(Language World Model, LWM)。与传统"提示进、动作出"的反应式智能体不同,核心逻辑是先预测环境会...最新AI资源3个月前053.3K
Kosong - Moonshot AI开源的全新AI Agent开发框架Kosong 是月之暗面(Moonshot AI)开源的全新AI Agent开发框架,为开发者提供一个轻量、灵活且高度可扩展的底层支持,以构建下一代智能体应用。通过异步工具编排引擎,能高效调度多个工具...最新AI资源10个月前053.2K
Computer Use Preview - Google开源的AI浏览器自动化工具Computer Use Preview是Google开源的基于Gemini模型的AI浏览器自动化工具,通过自然语言指令实现网页交互操作。采用"截图→分析→执行"的视觉识别流程,支持Playwrigh...最新AI资源9个月前053K
Dexbotic - 原力灵机开源的具身智能VLA模型一站式科研服务平台Dexbotic是原力灵机(Dexmal)开源的具身智能视觉-语言-动作(VLA)模型一站式科研服务平台,解决具身智能领域研究碎片化、效率低等问题。以 PyTorch 为基础,为具身智能领域的研究和开...最新AI资源11个月前053K
Qwen3.5-Omni - 阿里通义推出的新一代全模态大模型Qwen3.5-Omni是阿里通义推出的新一代全模态大模型,支持文本、图片、音频、音视频的原生理解与生成。采用Hybrid-Attention MoE架构,支持256K超长上下文,可处理10小时音频或...最新AI资源6个月前053K
MAI-Image-2 - 微软推出的第二代自研图像生成模型MAI-Image-2 是微软推出的第二代自研图像生成模型,模型在权威评测平台 LMArena 中跃升至全球第三位,仅次于谷歌和 OpenAI,标志着微软在图像生成领域实现从"追赶者"到"第一梯队"的...最新AI资源6个月前052.9K
KAT-Dev-72B-Exp - 快手开源的免费编程专用模型KAT-Dev-72B-Exp是快手团队推出的开源编程专用大语言模型,基于强化学习技术优化,在SWE-Bench Verified基准测试中取得74.6%的准确率,目前开源模型中表现最佳。模型采用创新...最新AI资源11个月前052.9K
Gemini Spark - 谷歌推出的个人 AI 智能体Gemini Spark是谷歌在2026年I/O大会上发布的个人AI智能体,是24/7全天候运行的AI代理,运行在谷歌云专属虚拟机上,无需用户设备(如电脑、手机)保持开启状态,即可持续执行任务。最新AI资源4个月前052.8K
LongCat-Next - 美团龙猫开源的原生多模态大模型LongCat-Next 是美团龙猫开源的原生多模态大模型,采用"下一个Token预测"(NTP)统一架构,将图像、语音与文本映射为同源离散Token,打破传统"语言为中心"的拼凑式设计。核心创新包括...最新AI资源6个月前052.8K
PartCrafter - 北大联合字节开源的单图3D生成模型PartCrafter 是先进的 3D 生成模型,由北京大学、字节跳动和卡耐基梅隆大学联合提出。能从单张 RGB 图像中一次性生成多个语义明确且几何形态各异的 3D 网格部件。模型通过组合式潜在空间和...最新AI资源10个月前052.7K
NemoClaw - NVIDIA 推出的开源企业级 AI Agent 安全增强平台NemoClaw 是 NVIDIA 推出的开源企业级 AI Agent 安全增强平台。作为 OpenClaw 的"安全插件"和运行时沙箱层,通过 OpenShell 为自主 AI 代理添加企业级的隐私...最新AI资源6个月前052.6K
Meoo CLI - 阿里云Meoo秒悟团队推出的开源命令行工具Meoo CLI是阿里云Meoo秒悟团队推出的开源命令行工具,是本地AI编程助手与云端能力之间的连接入口,让开发者无需手动处理复杂的云服务配置,即可实现项目的快速部署和上线。最新AI资源3个月前052.5K
语构 - 阿里达摩院推出的 AI 原生应用搭建平台语构是阿里达摩院推出的 AI 原生应用搭建平台,平台以"Create For What You Want"为理念,让用户无需编写代码即可快速创建各类应用。语构内置 AI 能力,支持通过自然语言描述需求...最新AI资源4个月前052.5K
GPT‑5.4 - OpenAI推出的全能旗舰AI模型GPT-5.4是OpenAI推出的旗舰AI模型,专为复杂专业场景设计。模型突破性融合推理、编程、原生计算机操控与深度搜索四大能力,在OSWorld测试中首次超越人类操作水平,知识工作任务表现达专家级标...最新AI资源6个月前052.4K
Gemini 3.5 Flash - Google I/O 大会发布的全新 AI 模型Gemini 3.5 Flash 是 Google I/O 大会发布的全新 AI 模型,是 Gemini 3.5 家族的首个成员。打破了"Flash 系列牺牲性能换速度"的传统定位,在保持每秒约 28...最新AI资源4个月前052.4K
Vidu Claw - Vidu AI 推出的 AI 视频创意AgentVidu Claw(代号"V龙")是生数科技旗下 Vidu AI 平台推出的 AI 创意智能体,定位为"你的第一个 AI 创意员工"。基于 Vidu 视频大模型构建,能自动完成从创意理解、脚本撰写、分...最新AI资源6个月前052.3K
Koina - 慕尼黑工大联合密歇根大开源的去中心化机器学习平台Koina是开源的去中心化机器学习平台,专注于简化蛋白质组学数据分析。由德国慕尼黑工业大学和美国密歇根大学团队开发。平台通过标准化接口整合了30多个主流模型(如ProSIT、MS²PIP),支持肽段质...最新AI资源10个月前052.2K
Qwen3.5-Max-Preview - 阿里通义千问推出的旗舰大模型预览版Qwen3.5-Max-Preview 是阿里通义千问团队推出的旗舰大模型预览版,在 LM Arena 国际大模型竞技场以1464分跻身全球前五、国内第一,标志着国产大模型首次进入全球第一梯队。最新AI资源6个月前052.2K
MiniMax M2.1 - MiniMax开源的编码和代理模型MiniMax M2.1 是MiniMax开源的编码和代理模型,拥有100亿激活量,支持多种主流编程语言,如 Rust、Java、Golang、C++、Kotlin、Objective-C、TypeS...最新AI资源9个月前052.1K
Wan2.7-Image - 阿里通义实验室推出的图像生成与编辑统一模型Wan2.7-Image 是阿里巴巴通义实验室发布的图像生成与编辑统一模型,定位为"全场景视觉创作旗舰"。模型直击AI生图领域"标准脸"审美疲劳和"色彩盲盒"痛点,采用生成与理解统一的底层架构,具备文...最新AI资源6个月前052K
TypeNo - 开源 AI 语音输入工具,专为 macOS 设计TypeNo 是 marswaveai 团队开源的中文语音输入工具,专为 macOS 打造。用户只需轻点 Control 键即可录音,松手后语音会在本地实时转为文字并自动填入当前应用。最新AI资源6个月前052K
Qwen-VLA - 阿里通义实验室发布的统一视觉-语言-动作具身基础模型Qwen-VLA 是阿里通义实验室发布的统一视觉-语言-动作(VLA)具身基础模型。以 Qwen3.5-4B 为视觉语言主干,搭配 1.15B 参数的 DiT(Diffusion Transforme...最新AI资源4个月前051.9K
DeepOCR - 基于DeepSeek-OCR模型的开源复刻项目DeepOCR 是开源复刻项目,实现 DeepSeek-OCR 的核心架构,通过光学压缩技术高效处理文本信息。核心是 DeepEncoder,由 SAM-base(处理高分辨率图像)、16×卷积压缩器...最新AI资源10个月前051.8K
HiDream-O1-Image-Pro - 智象未来发布的旗舰级闭源图像大模型HiDream-O1-Image-Pro 是智象未来(HiDream-ai)发布的旗舰级闭源图像大模型,采用新一代原生全模态架构 Unified Transformer(UiT),参数规模超过2000...最新AI资源4个月前051.8K
BitCPM-CANN - 面壁智能联合清华开源的端到端大模型系列BitCPM-CANN 是面壁智能联合清华大学、OpenBMB 开源社区发布并开源的中国首个完全基于国产算力平台(华为昇腾)实现端到端训练的三值(1.58-bit)大模型系列。系列包含 0.5B、1B...最新AI资源4个月前051.8K
MiMo-V2-TTS - 小米推出的自研语音合成大模型MiMo-V2-TTS是小米推出的自研语音合成大模型,与MiMo-V2-Pro、MiMo-V2-Omni共同构成小米面向"Agent时代"的三大基础模型矩阵。模型基于自研Audio Tokenizer...最新AI资源6个月前051.8K
小精龙 - 学而思推出的原生学生端精准学智能体小精龙是学而思基于OpenClaw架构打造的原生学生端精准学智能体,以"大脑映射、私有财产、学习伴侣"为核心定位。首次将长期记忆、动态学情诊断、教育专属Skill链与情感陪伴系统整合为统一的学生专属A...最新AI资源6个月前051.8K
Pascal Editor- 开源 AI 3D 建筑设计与可视化工具,网页端直接使用Pascal Editor 是基于浏览器的3D建筑设计与可视化工具,专为建筑师、设计师和开发者打造,支持在网页端直接进行楼层规划、空间布局和建筑场景探索。采用现代Web技术栈(React Three ...最新AI资源6个月前051.7K
SAIL-VL2 - 字节跳动开源的多模态视觉语言模型SAIL-VL2是字节跳动团队开源的多模态视觉语言模型,专注于图像、文本等多模态输入的联合建模。采用稀疏混合专家(MoE)架构和渐进式训练策略,在2B至8B参数规模下实现了高性能,尤其在图文理解、数学...最新AI资源11个月前051.6K
Wall-OSS-0.5 - 自变量机器人开源的视觉-语言-动作大模型Wall-OSS-0.5 是自变量机器人(X Square Robot)推出的开源视觉-语言-动作(VLA)大模型,拥有 40 亿参数,基于 30 亿参数的 VLM 骨干网络构建。采用"梯度桥接协同训...最新AI资源4个月前051.5K
Mureka V9 - 昆仑万维旗下天工 AI 推出的 AI 音乐模型Mureka V9是昆仑万维旗下天工AI在中关村论坛上发布的AI音乐模型,是Mureka系列的最新迭代版本,通过技术创新重塑数字音乐创作生态。基于Musicot(Music Chain-of-Thou...最新AI资源6个月前051.5K
Meshy 3D Agent - Meshy 发布的全球首个 3D 创作 AI AgentMeshy 3D Agent 是 AI 3D 公司 Meshy 发布的全球首个 3D 创作 AI Agent,通过对话式交互将 3D 创作从一次性生成推向可控、可复用的生产流程。与传统「输入提示词、输...最新AI资源3个月前051.5K
悟界·Emu3.5 - 智源研究院开源的多模态世界大模型悟界·Emu3.5是北京智源人工智能研究院开源的多模态世界大模型,参数量达340亿,具备原生世界建模能力。通过10万亿多模态Token(含790年视频数据)训练,能模拟物理规律,实现图文生成、视觉指导...最新AI资源10个月前051.4K
Jamba Reasoning 3B - 以色列AI21 Labs开源的轻量级推理模型Jamba Reasoning 3B 是以色列 AI 创企 AI21 Labs 开源的轻量级推理模型,具有强大的性能和广泛的应用潜力。采用 SSM-Transformer 混合架构,结合了 Trans...最新AI资源11个月前051.3K
Mistral 3 - Mistral AI发布开源的最新多模态大模型系列Mistral 3是Mistral AI发布开源的最新多模态大模型系列,包含旗舰模型Mistral Large 3(675B总参数)和轻量版Ministral系列(3B/8B/14B),均支持图像理解...最新AI资源10个月前051.1K
BestBlogs - 开源的AI内容聚合平台,精选优质技术内容BestBlogs 是专注于为技术从业者、创业者和产品经理等提供高质量内容的平台。通过 RSS 订阅和爬虫技术,从 400 多个优质博客中收集文章、播客、视频等多形式内容。核心优势在于利用 AI 大语...最新AI资源10个月前051K