MAI-Code-1-Flash - 微软自研的 AI 编程模型MAI-Code-1-Flash 是微软自研的AI编程模型,采用137B参数MoE架构,专为真实开发环境训练,直接使用GitHub Copilot的生产工具链学习多文件编辑、终端调用等实际工作流。最新AI资源2个月前033.2K
Nemotron 3 Super - NVIDIA开源的大语言模型,专为AI Agent推理设计Nemotron 3 Super是NVIDIA 发布的Nemotron 3 系列中目前最强大的开源权重 AI 模型。模型采用 1200 亿参数的混合专家(MoE)架构,推理时仅激活 120 亿参数,实...最新AI资源5个月前033.2K
Hy3 - 腾讯开源的旗舰级大语言模型,快慢思考融合Hy3 是腾讯推出的旗舰级开源大语言模型,采用 MoE 架构,拥有 295B 总参数与 21B 激活参数,支持长达 256K 的上下文窗口。核心亮点在于快慢思考融合(Hybrid Reasoning...最新AI资源3周前033.1K
Fun-AudioGen-VD - 阿里通义实验室推出的声音设计系统Fun-AudioGen-VD 是阿里通义实验室推出的创新语音大模型,专注于声音设计与场景化音频生成。模型支持通过自然语言指令直接生成包含特定音色、情绪表达和完整听觉场景的高质量音频,无需参考音频即可...最新AI资源5个月前032.8K
Matrix-Game 3.0 - 昆仑万维发布的实时交互式世界模型Matrix-Game 3.0是昆仑万维发布的实时交互式世界模型,属于AIGC全家桶中的三大核心模型之一。模型通过物理仿真驱动,解决了传统世界模型易失忆、环境不稳定的问题,支持720p、40fps实时...最新AI资源4个月前032.8K
ForgeTrain - 面壁智能联合清华大学、OpenBMB开源的大模型预训练框架ForgeTrain 是面壁智能联合清华大学、OpenBMB 开源社区发布的全球首个完全由 AI 编写、零人类代码介入的生产级大模型预训练框架。框架采用独创的 Forge Engineering(锻造...最新AI资源2个月前032.6K
Wan2.7-Image - 阿里通义实验室推出的图像生成与编辑统一模型Wan2.7-Image 是阿里巴巴通义实验室发布的图像生成与编辑统一模型,定位为"全场景视觉创作旗舰"。模型直击AI生图领域"标准脸"审美疲劳和"色彩盲盒"痛点,采用生成与理解统一的底层架构,具备文...最新AI资源4个月前032.4K
Gemini Omni - Google DeepMind 推出的新一代原生多模态生成模型Gemini Omni 是 Google DeepMind 在 Google I/O 大会上推出的新一代原生多模态生成模型,首发版本为 Gemini Omni Flash。作为 Google 首个真正...最新AI资源2个月前032.1K
GPT-5.3 Instant - OpenAI推出的GPT-5系列快速响应版本模型GPT-5.3 Instant 是 OpenAI 发布的 ChatGPT 主力模型升级版,主打"体验优化"而非参数堆叠。精准解决了用户长期诟病的"说教感"和机械回复问题,对话语气更自然直接,大幅减少了...最新AI资源5个月前032.1K
GPT‑5.4 - OpenAI推出的全能旗舰AI模型GPT-5.4是OpenAI推出的旗舰AI模型,专为复杂专业场景设计。模型突破性融合推理、编程、原生计算机操控与深度搜索四大能力,在OSWorld测试中首次超越人类操作水平,知识工作任务表现达专家级标...最新AI资源5个月前032.1K
TurboQuant - Google Research 推出的突破性内存压缩算法TurboQuant 是 Google Research 推出的突破性内存压缩算法,专为解决大语言模型推理中的 KV 缓存瓶颈而设计。最新AI资源4个月前032.1K
Grok 4.3 - xAI公司推出的最新一代大语言模型Grok 4.3是xAI公司推出的最新一代大语言模型,属于Grok系列的重要更新版本,支持100万token的上下文窗口,可一次性处理整本书、大型代码库或长文档,思维链推理强制开启,模型在给出答案前会...最新AI资源3个月前031.9K
GLM-5.2 - 智谱最新推出的旗舰级开源大模型GLM-5.2 是智谱最新推出的旗舰级开源大模型,超长上下文理解和智能编程为核心卖点。模型具备百万级 token 的上下文处理能力,能一次性分析整个代码仓库或长篇技术文档。最新AI资源2个月前031.8K
Composer 2 - Cursor 推出的专有代码大模型Composer 2 是 AI 编程平台 Cursor 推出的专有代码大模型,主打"长周期智能体编程"。模型支持 20 万 Token 上下文窗口,能自主处理包含数百个操作的复杂开发任务,在 Term...最新AI资源4个月前031.6K
商汤输入法AudioClaw - 商汤科技推出的AI语音智能助手商汤输入法AudioClaw是商汤科技基于日日新多模态大模型打造的AI语音智能应用,深度接入OpenClaw底层能力,定位为"会听话的龙虾"智能助手。最新AI资源4个月前031.4K
PrismAudio - 阿里通义实验室开源的视频生成音频框架PrismAudio 是阿里通义实验室推出的视频生成音频框架,专注于为视频自动匹配严丝合缝的环境音效。框架创新性地引入"分解式思维链"(CoT)机制,让模型在生成音频前先分析视频内容、声音时序、音质特...最新AI资源4个月前031.3K
MAI-Thinking-1 - 微软AI发布的首款自研高级推理模型MAI-Thinking-1 是微软AI发布的首款自研高级推理模型。模型采用35B活跃参数、约1T总参数的稀疏混合专家(MoE)架构,拥有256K超长上下文窗口。完全基于干净且拥有商业许可的企业级数据...最新AI资源2个月前031.2K
Gemini 3.1 Flash Live - Google 推出的旗舰级实时语音模型Gemini 3.1 Flash Live 是 Google 推出的旗舰级实时语音模型,被誉为"迄今最高质量的音频和语音模型"。主打超低延迟的自然对话体验,支持 90+ 种语言的原生多模态交互,能精准...最新AI资源4个月前031.1K
SenseAudio - 商汤科技推出的一站式 AI 语音开放平台SenseAudio 是商汤科技推出的AI语音开放平台,面向开发者与企业提供一站式语音AI解决方案。平台集成语音识别(ASR)、语音合成(TTS)、音色克隆等核心能力,语音识别覆盖20+语言并支持说话...最新AI资源4个月前031K
语构 - 阿里达摩院推出的 AI 原生应用搭建平台语构是阿里达摩院推出的 AI 原生应用搭建平台,平台以"Create For What You Want"为理念,让用户无需编写代码即可快速创建各类应用。语构内置 AI 能力,支持通过自然语言描述需求...最新AI资源2个月前031K
Hy-Memory - 腾讯混元推出的记忆插件,为长期协作型 Agent 设计Hy-Memory是腾讯混元推出的记忆插件,专为 Openclaw 等长期协作型 Agent 设计。通过 6层记忆框架 × System1/System2 双系统 × 演化链 三层核心架构,解决 Ag...最新AI资源2个月前030.9K
Pascal Editor- 开源 AI 3D 建筑设计与可视化工具,网页端直接使用Pascal Editor 是基于浏览器的3D建筑设计与可视化工具,专为建筑师、设计师和开发者打造,支持在网页端直接进行楼层规划、空间布局和建筑场景探索。采用现代Web技术栈(React Three ...最新AI资源4个月前030.5K
Step 3.7 Flash - 阶跃星辰开源的 AI 模型,专为生产级 Agent 设计Step 3.7 Flash是阶跃星辰(StepFun)开源的新一代AI模型,专为生产级智能代理(Agent)设计。在速度、成本与复杂任务处理能力间取得平衡,支持编程、搜索和多模态工作流,并针对本地部...最新AI资源2个月前030.4K
Wall-OSS-0.5 - 自变量机器人开源的视觉-语言-动作大模型Wall-OSS-0.5 是自变量机器人(X Square Robot)推出的开源视觉-语言-动作(VLA)大模型,拥有 40 亿参数,基于 30 亿参数的 VLM 骨干网络构建。采用"梯度桥接协同训...最新AI资源2个月前030.2K
阿里云百炼CLI - 阿里云 Model Studio 开源的命令行工具阿里云百炼CLI(Bailian CLI)是阿里云Model Studio官方开源的命令行工具,通过一行命令即可让任意AI Agent自动调用阿里云百炼平台的150+款模型和10+款应用能力,涵盖文本...最新AI资源2个月前029.7K
Xiaomi MiMo Claw - 小米推出的云端轻量化 AI 智能体平台Xiaomi MiMo Claw 是小米推出的云端轻量化 AI 智能体平台,基于 OpenClaw 框架打造,搭载自研 MiMo-V2.5-Pro 旗舰模型。主打"一键部署、零门槛"的 AI 办公体验...最新AI资源1个月前029.5K
Lightpanda - 专为 AI 时代设计的开源无头浏览器Lightpanda是Lightpanda.io公司开发的开源无头浏览器,专为AI自动化和Web抓取设计。采用Zig语言从零构建,去除了图形渲染等冗余功能,核心优势是速度比Chrome快11倍,内存占...最新AI资源4个月前029.4K
Lyria 3 Pro - 谷歌推出的最先进AI音乐生成模型Lyria 3 Pro是谷歌推出的最先进的AI音乐生成模型。相比前代Lyria 3仅30秒的生成时长,Pro版本可一次性生成长达3分钟的完整音轨,精准控制前奏、主歌、副歌、桥段等歌曲结构。最新AI资源4个月前029.1K
SciClaw - 面向科研人员的云端 AI Agent 协同系统SciClaw(科研龙虾) 是面向科研人员的云端 AI 协同系统,定位为"科研人的深夜搭子"。能深度分析文献、自主执行实验、自动排版生成论文/PPT/海报,记住用户电脑里的所有研究资料,将灵感、执行与...最新AI资源4个月前028.9K
Meoo CLI - 阿里云Meoo秒悟团队推出的开源命令行工具Meoo CLI是阿里云Meoo秒悟团队推出的开源命令行工具,是本地AI编程助手与云端能力之间的连接入口,让开发者无需手动处理复杂的云服务配置,即可实现项目的快速部署和上线。最新AI资源2个月前028.4K
JoyAI-Echo - 京东开源的分钟级长音视频生成框架JoyAI-Echo 是京东开源的分钟级长音视频生成框架,专为解决AI视频"角色易崩、声音乱变、生成缓慢"三大痛点而设计。基于LTX-2.3 DiT架构,通过跨模态记忆库在长达5分钟的多镜头视频中保持...最新AI资源2个月前028.2K
SeedMusic 1.0 - 字节跳动推出的第一代AI音乐生成模型SeedMusic 1.0是字节跳动推出的第一代AI音乐生成模型,专注于将用户的文字创意快速转化为带有人声的完整歌曲草稿。用户只需输入一段描述、歌词或风格方向,可在几分钟内生成包含主歌、副歌、编曲和人...最新AI资源4周前027.8K
蛙蛙写作2.0升级深度解析:三栏架构如何重塑AI长篇创作体验2025年7月,蛙蛙写作正式发布2.0版本,这是该产品自2024年上线以来幅度最大的一次产品重构。此次升级不仅在底层技术能力上实现了对主流大模型的深度整合,更在产品交互架构上做出了突破性的创新——引入...最新AI资源2个月前027.5K
Claude Fable 5 - Anthropic发布的第五代大型语言模型Claude Fable 5是Anthropic发布的第五代大型语言模型,属于其Claude系列,是首个面向公众开放的“Mythos级”(神话级)模型。最新AI资源2个月前027.2K
HiPilot - 小盒科技推出的 AI 原生经营操作系统HiPilot 是小盒科技推出的 AI 原生经营操作系统,非传统意义上的 AI 助手或工具软件,是由 7 位专业 Agent 组成的 7×24 小时 AI 经营班子,能自主感知企业数据、分析经营态势...最新AI资源1个月前027K
Veo 3.1 Lite - Google DeepMind发布的低成本AI视频生成模型Veo 3.1 Lite是Google DeepMind发布的低成本AI视频生成模型,定位为Veo系列中最实惠的版本,专为大规模视频生成场景设计。模型支持文本和图像生成视频,输出720p和1080p分...最新AI资源4个月前026.9K
html-video - Open Design团队开源的本地视频生成工具html-video是Open Design团队开源的本地视频生成工具,能将HTML、CSS和数据直接转换为MP4视频。支持21种预设模板,涵盖产品宣传、知识讲解等场景,可配合Claude Code...最新AI资源2个月前026.9K
Voxtral TTS - Mistral AI推出的开源文本转语音模型Voxtral TTSoxtral TTS是法国AI公司Mistral AI发布的开源文本转语音模型,采用40亿参数轻量化架构,量化后仅需3GB内存即可在智能手机等边缘设备实时运行。模型原生支持英语...最新AI资源4个月前026.8K
Meshy 3D Agent - Meshy 发布的全球首个 3D 创作 AI AgentMeshy 3D Agent 是 AI 3D 公司 Meshy 发布的全球首个 3D 创作 AI Agent,通过对话式交互将 3D 创作从一次性生成推向可控、可复用的生产流程。与传统「输入提示词、输...最新AI资源1个月前026.7K
Gemini 3.5 Live Translate - Google 发布的最新实时语音翻译模型Gemini 3.5 Live Translate 是 Google 发布的最新实时语音翻译模型,支持 70 余种语言和 2,000 多组语言对,覆盖全球绝大多数语种。采用流式实时翻译技术,输出仅落后...最新AI资源2个月前026.4K
Claude Tag - Anthropic 推出的 Slack 原生 AI 协作功能Claude Tag 是 Anthropic 推出的 Slack 原生 AI 协作功能,将 Claude 从个人聊天工具升级为团队常驻成员。用户只需在 Slack 频道中输入 @Claude 即可分配...最新AI资源1个月前026.2K
DiffusionGemma - Google DeepMind 发布的实验性开源文本生成模型DiffusionGemma 是 Google DeepMind 发布的实验性开源文本生成模型,采用离散文本扩散架构替代传统自回归方式。基于 Gemma 4 的 MoE 骨干(26B 总参数,激活 3...最新AI资源2个月前026K
Octask - 光魔科技推出的新一代 AI 原生内容工作室平台Octask 是深圳光魔科技推出的新一代 AI 原生内容工作室平台,由谷歌与腾讯背景团队打造,获得百度 A 轮投资。核心创新在于将 AI 工具"员工化",通过像素风格的沉浸式虚拟工作室,让创作者以"老...最新AI资源2个月前025.3K
Seedance 2.5 - 字节跳动推出的 AI 视频生成模型Seedance 2.5是字节 Seed 团队推出的AI模型,定位新一代 AI 视频创作引擎。模型单次直出 30 秒高清片段,可多次延长拼接成分钟级连贯叙事;支持批量导入图片、视频、音频作为创作参考...最新AI资源9小时前025.3K
HiDream-O1-Image-1.5 - 智象未来推出的商用版图像生成大模型HiDream-O1-Image-1.5 是智象未来(HiDream.ai)推出的商用版图像生成大模型,在全球独立评测平台 Artificial Analysis 的文生图榜单(Text to Ima...最新AI资源2个月前025K
Unlimited-OCR - 百度开源的端到端长文档 OCR 模型Unlimited-OCR 是百度开源的端到端长文档 OCR 模型,采用 3B 参数 MoE 架构(每 token 仅激活约 500M 参数),核心创新在于将标准注意力替换为 R-SWA(参考滑动窗口...最新AI资源1个月前024K
Qwen-AgentWorld - 阿里通义实验室发布的首个原生语言世界模型Qwen-AgentWorld 是阿里巴巴通义实验室发布的首个原生语言世界模型(Language World Model, LWM)。与传统"提示进、动作出"的反应式智能体不同,核心逻辑是先预测环境会...最新AI资源1个月前024K
LOGOS - 阿里联合中国人大推出的多领域科学生成基础模型LOGOS(Language Of Generative Objects in Science)是阿里集团联合中国人民大学高瓴人工智能学院开发的首个基于统一"科学语法"的多领域科学生成基础模型。最新AI资源1个月前023.7K
豆包2.1 - 字节跳动发布的最新旗舰大模型系列豆包2.1(Doubao-Seed-2.1)是字节跳动发布的最新旗舰大模型系列,包含Pro和Turbo两个版本,专为Coding与Agent时代打造。编程能力上,在Terminal Bench 2.1...最新AI资源1个月前023.1K
SkillOpt - 微软研究院开源的 Agent 技能自进化框架SkillOpt 是微软研究院开源的 Agent 技能自进化框架,核心创新在于将自然语言编写的技能文档视为可训练的外部参数,无需修改底层大模型权重。系统通过"执行-反思-编辑-验证"闭环运作:冻结的目...最新AI资源1个月前023.1K
Seedance 2.0 Mini - 字节跳动 Seedance 视频模型系列的轻量版本Seedance 2.0 Mini 是字节跳动 Seedance 视频模型系列的最新轻量版本,在火山方舟体验中心及 Dreamina 平台上线,计划近期开放 API 服务。最新AI资源1个月前022.5K
Seedream 5.0 Pro - 字节跳动发布的多模态图像创作模型Seedream 5.0 Pro是字节跳动豆包大模型团队发布的多模态图像创作模型,定位为面向专业创作者和企业级用户的设计工具。相比前代,在图文匹配、结构合理性等基础能力上全面提升最新AI资源3周前022.1K
Kimi K3 - 月之暗面发布的全球首个开源 3 万亿级大模型Kimi K3 是月之暗面(Moonshot AI)发布的全球首个开源 3 万亿级大模型,总参数达 2.8 万亿。采用 KDA 混合线性注意力机制与 Stable LatentMoE 稀疏架构,896...最新AI资源2周前021.7K
ChatExcel Ultra - ChatExcel团队推出的企业级AI数据智能体ChatExcel Ultra 是ChatExcel团队面向企业用户和专业数据办公场景推出的全新桌面版,定位为国内首款企业级AI数据智能体。最新AI资源4周前021.5K
Grok 4.5 - SpaceXAI 发布的旗舰大语言模型,编码与智能代理专用模型Grok 4.5 是 SpaceXAI(原 xAI)发布的旗舰大语言模型,定位为"Opus 级别"的编码与智能代理专用模型。模型基于 1.5 万亿参数的 V9 架构打造,采用 MoE(混合专家)架构...最新AI资源3周前020.4K
跃迁维度 - AI 模型聚合服务平台,一个API统一调多款模型跃迁维度(dimleap) 是AI模型聚合服务平台,为全球开发者提供高效能、低成本的多品类AI模型API服务。平台目前已接入DeepSeek、GLM(智谱清言)、MiniMax、kimi、qwen(通...最新AI资源4周前020.3K
GPT-Live - OpenAI 推出的新一代语音模型,全双工实时对话GPT-Live 是 OpenAI 推出的新一代语音模型,全面升级 ChatGPT 的语音交互体验。基于全双工(full-duplex)架构构建,能同时倾听和说话,彻底打破了传统 AI 语音助手"你说...最新AI资源3周前019.1K
Astryx - Meta 开源的 React 设计系统Astryx 是 Meta 以 MIT 协议开源的 React 设计系统,历经八年内部打磨,长期支撑 Facebook、Instagram、WhatsApp 和 Threads 等超过 13,000 ...最新AI资源4周前018.1K
JellyToken - 阿里元境推出的大模型 API 聚合与分发平台JellyToken 是国内领先的大模型 API 聚合与分发平台,定位为"国内主流 AI 大模型一站式超市"。用户仅需一个 API Key 即可无缝调用通义千问、DeepSeek、智谱、月之暗面、豆包...最新AI资源3周前017.8K
Claude Sonnet 5 - Anthropic 发布的最具 Agent 能力模型Claude Sonnet 5是Anthropic 发布的最具 Agent 能力的 Sonnet 模型,以中端价格提供接近旗舰 Opus 4.8 的自主智能体能力。模型支持 100 万 token 上...最新AI资源4周前017.4K
Hyra - 腾讯混元团队发布的科研智能体Hyra(Hunyuan Research Agent)是腾讯混元团队发布的科研智能体,首个版本为Hyra-1.0,支持递归自我改进(RSI),专为性能导向的研究与工程任务打造 。采用轻量通用框架,通...最新AI资源1周前016.8K
Wan-Dancer - 阿里通义实验室开源的音乐舞蹈视频生成大模型Wan-Dancer 是阿里巴巴通义实验室万相(Wan)团队推出的音乐驱动舞蹈视频生成大模型,开源版本 Wan-Dancer-14B 拥有140亿参数,采用 Apache 2.0 协议免费商用。用户只...最新AI资源2周前016.5K
Nano Banana 2 Lite - Google发布的轻量版 AI 图像生成模型Nano Banana 2 Lite(gemini-3.1-flash-lite-image)是Google发布的AI图像生成模型,定位为Nano Banana家族中速度最快、成本最低的轻量版。可在约...最新AI资源3周前016.4K
Muse Image - Meta 推出的首个自研 AI 图像生成模型Muse Image 是 Meta 推出的首个自研 AI 图像生成模型,由 Meta Superintelligence Labs 开发。采用独特的智能体(Agentic)架构,在生成图像前会先与 M...最新AI资源3周前014.7K
HyOCR-1.5 - 腾讯混元团队开源的轻量化端到端OCR专家大模型HyOCR-1.5是腾讯混元团队开源的轻量化端到端OCR专家大模型,参数量仅1B,是领域首个训练、推理、权重完整开源的专家模型 。采用端到端架构,输入图片即可直接输出Markdown正文、HTML表格...最新AI资源2周前014.3K
Wan-Streamer v0.2 - 阿里通义实验室发布的端到端全模态实时交互模型Wan-Streamer v0.2 是阿里通义实验室发布的端到端全模态实时交互模型,首次将「听、看、说、演」统一进单个因果 Transformer 架构,实现类人般的实时双工交互。最新AI资源1周前013.2K
Qwen3.8-Max-Preview - 阿里通义千问发布的新一代旗舰大模型Qwen3.8-Max-Preview是阿里巴巴通义千问团队发布的新一代旗舰大模型预览版 。模型总参数达2.4万亿,采用稀疏MoE架构,是通义千问系列首个突破万亿参数的多模态模型,支持文本、图片、视频...最新AI资源7天前013.1K
Qwen-Image-3.0 - 阿里千问发布的第三代图像生成基础模型Qwen-Image-3.0 是阿里千问发布的第三代图像生成基础模型,核心主线为"实",内容丰实、细节真实、知识厚实。模型支持最大 4.5k token 超长文本输入,较前代提升 4.5 倍,可一次性...最新AI资源7天前010.4K
Gemini 3.5 Flash-Lite - Google 发布的高吞吐低成本模型Gemini 3.5 Flash-Lite 是 Google 发布的高吞吐低成本模型,官方定位为 3.5 系列中最快、最具成本效益的型号,面向 agentic search、文档处理与大规模生产流量...最新AI资源6天前010.4K
Qwen-Audio-3.0-TTS - 阿里通义发布的旗舰级语音合成大模型Qwen-Audio-3.0-TTS是阿里巴巴通义千问团队发布的旗舰级语音合成大模型,提供面向实时交互的Flash版(首包延时约300ms)与面向高质量生成的Plus版,Plus版登顶全球权威榜单Ar...最新AI资源6天前010K
FLUX 3 - Black Forest Labs 发布的首款多模态基础模型FLUX 3 是德国 AI 公司 Black Forest Labs 发布的首款多模态基础模型,基于自研 Self-Flow 架构,在单一网络中统一训练图像、视频、音频与动作预测,实现真正的"全能模型...最新AI资源6天前09.8K
TDream - 腾讯推出的 AI 内容创作平台TDream是腾讯内测的AI内容创作平台,以"互动影游化创作"为核心定位,试图重构用户从内容生产到交互体验的全链路。区别于市面上仅输出单一线性视频的传统文生视频工具,TDream依托五大AI引擎,支持...最新AI资源6天前08.9K
Gemini 3.6 Flash - Google 发布的新一代主力模型Gemini 3.6 Flash 是 Google 发布的新一代主力模型(Workhorse Model),是 Gemini 3.5 Flash 的升级版,主要面向生产级 AI 智能体(Agent)和...最新AI资源6天前08.6K
Claude Opus 5 - Anthropic 推出的新一代大模型Claude Opus 5 是 Anthropic 推出的新一代旗舰大模型,核心是用旗舰一半的价格获得接近顶尖水平的智能"。模型在维持与前代 Opus 4.8 相同调用成本的同时,实现性能的翻倍跃升...最新AI资源3天前08.3K