GLM-4.6V - 智谱AI开源的多模态大语言模型系列GLM-4.6V是智谱AI开源的多模态大语言模型系列,系列包含两个版本:GLM-4.6V(106B-A12B),面向云端与高性能集群场景的基础版,采用混合专家(MoE)架构,总参数量约1060亿,激活...最新AI资源9个月前053.8K
吴恩达的LangChain for LLM应用开发免费课程LangChain for LLM 应用开发是DeepLearning.AI推出的在线课程,由LangChain创始人Harrison Chase和吴恩达Andrew Ng主讲。最新AI资源课程资料1年前097.3K
吴恩达的Transformer LLMs工作原理免费课程Transformer LLMs工作原理是DeepLearning.AI与《Hands-On Large Language Models》的作者Jay Alammar和Maarten Grootend...最新AI资源课程资料1年前098.6K
Kimi K2-0905 - 月之暗面推出的最新模型版本Kimi K2-0905 是月之暗面科技有限公司推出的先进 AI 模型,在编程辅助方面表现出色,能高效生成代码,支持在前端开发中生成整洁规范的代码。模型上下文长度扩展至 256K,能处理复杂任务。最新AI资源1年前0105.3K
Nano Banana - 谷歌推出的AI图像编辑模型Nano Banana 是谷歌推出的 AI 图像生成与编辑模型Gemini 2.5 Flash Image代号,能根据简单的文本提示生成细节丰富、光影真实的图像,对现有图像进行高质量的修改。最新AI资源1年前0103K
Skywork UniPic 2.0 - 昆仑万维开源的高效多模态模型Skywork UniPic 2.0 是昆仑万维开源的高效多模态模型,专注于图像生成、编辑与理解。模型基于 2B 参数的 SD3.5-Medium 架构,通过预训练、渐进式双任务强化策略和联合训练,实...最新AI资源1年前074.2K
MiniMax Speech 2.5 - MiniMax推出的语音生成模型MiniMax Speech 2.5 是 MiniMax 团队开发的先进语音生成模型。在语音合成领域取得了显著进步,尤其在多语种表现力、音色复刻精度和语种覆盖范围上实现了飞跃。模型支持 40 种语言...最新AI资源1年前081.1K
GPT-5 - OpenAI推出的最强语言模型,统一智能系统GPT-5是OpenAI最新发布的语言模型,具有多项升级。是一个统一智能系统,内置实时路由器,能根据问题复杂度自动切换高效模式与深度思考模式,实现快速响应与精准解答。GPT-5拥有多个版本,包括面向普...最新AI资源1年前079.1K
Qwen-Image - 通义千问推出开源的文生图基础模型Qwen-Image是阿里巴巴通义千问团队发布的开源图像生成基础模型。拥有200亿参数,采用多模态扩散变换器架构(MMDiT),融合了多模态理解、高分辨率编码和扩散模型三大模块。Qwen-Image的...最新AI资源1年前079.4K
RedOne - 小红书最新推出的社交大模型RedOne 是小红书推出的专为社交网络定制的大语言模型。模型通过三阶段训练策略,融入社交文化知识,强化多任务能力,并对齐人类偏好。RedOne 在社交任务性能上显著优于基础模型,在有害内容检测和浏览...最新AI资源1年前072K
TRAE SOLO - 字节跳动TRAE推出的AI自动开发助手TRAE SOLO 是字节跳动推出的AI编程助手TRAE 推出的AI 自动化开发助手,用AI技术简化软件开发流程。TRAE SOLO能理解用户的需求,支持文字描述、语音指令和文件上传输入需求,自动规划...最新AI资源1年前0103.4K
LiveTalking:开源实时互动数字人直播系统,实现音视频同步对话综合介绍 LiveTalking是一个开源的实时互动数字人系统,致力于构建高质量的数字人直播解决方案。该项目采用Apache 2.0开源协议,集成了多项前沿技术,包括ER-NeRF渲染、实时音视频流处...最新AI资源# AI开源项目# AI数字人2年前0240.7K
新K2.8 Preview - 月之暗面推出的新一代主力编码模型Kimi K2.8 Preview 是月之暗面推出的新一代主力编码模型,已在 Kimi Code 和 Kimi Work 平台全量上线。模型采用 kimi-for-coding 模型 ID 实现无感升...最新AI资源9小时前01.5K
新XiaoMi MiMo Desktop - 小米推出的桌面级通用 AI 助手XiaoMi MiMo Desktop 是小米推出的桌面级通用 AI 助手,搭载自研的 MiMo-X-Pro 与 MiMo-X-Flash 双模型。用户无需提前整理素材格式,可直接把表格、PDF、音视...最新AI资源13小时前02.3K
新星火X2.5 - 科大讯飞推出的新一代旗舰大模型系列星火X2.5是科大讯飞推出的新一代旗舰大模型系列,涵盖云端MoE大模型及两款开源端侧小模型。模型基于国产昇腾算力完成训练,强调自主可控,在代码生成、数学推理和Agent协作方面表现突出。最新AI资源2天前03.9K
MiniCPM5-2B - 面壁智能联合清华等开源的新一代语言模型MiniCPM5-2B 是面壁智能联合清华大学、OpenBMB 社区推出的开源端侧语言模型,参数量仅约 25 亿,能在多项基准测试中超越不少 40 亿参数的模型。模型原生支持 128K 长文本上下文...最新AI资源3天前08.3K
H3-World - 腾讯等开源的交互式世界模型H3-World 是腾讯联合新加坡国立大学、香港理工大学开源的交互式世界模型。模型在 MiniMax-H3 视频生成器(33B)基础上,仅用 8000 条游戏视频和 rank-32 的轻量 LoRA ...最新AI资源3天前06.9K
什么是深度动作捕捉?实测 LibTV,一键提取深度动态信息最近那种 AI 换角视频很容易刷到。虽然角色变了,但动作熟悉,成片很容易让人看完。LibTV 这次上线的深度动作捕捉,完美解决了这个问题。 我们上传参考视频,LibTV 会一键提取视频中的深度动态信息...AI实操教程最新AI资源4天前011K
如何做出专业级 AI 短漫剧?- 商汤 Seko 给普通创作者机会AI 剧漫剧的观众越来越多,普通创作者却越来越难赚到钱了。 这并不是你的错觉,DataEye 预估显示,2025 年国内漫剧用户规模约 1.2 亿,到 2026 年上半年,用户规模已突破 6 亿,规模...AI实操教程最新AI资源5天前012.8K
DeepSeek V4.1 Flash - DeepSeek 开源的新一代基础模型DeepSeek V4.1 Flash 是 DeepSeek 新一代架构中的入门款大模型,总参数 552B 的 MoE 设计,推理时只激活少量参数(输入约 8B、输出 16B),速度极快、成本很低。最新AI资源5天前010.7K
ChatGPT Images 2.5 - OpenAI 推出的最新图像生成模型ChatGPT Images 2.5 是 OpenA推出的最新图像生成模型,面向 ChatGPT 全档位用户免费开放。模型在推理效率上大幅优化,出图延迟较上一代最高缩短一半;同时强化局部编辑的精准度...最新AI资源5天前09.9K
Gemini Omni 1.1 Flash - 谷歌推出的多模态视频生成模型Gemini Omni 1.1 Flash 是 Google DeepMind 推出的多模态视频生成模型,面向开发者与专业创作者。模型在 Gemini Omni 初版基础上,将可分析的上下文从 1 秒...最新AI资源6天前012K
MAI-Transcribe-2 - 微软推出的多语言语音转文字模型MAI-Transcribe-2 是微软推出的多语言语音转文字模型,支持 60 种语言并具备自动语言识别与切换能力。模型内置说话人分离和逐词时间戳,无需额外后处理,提供 verbatim 和 clea...最新AI资源6天前09.3K
Hy4 preview - 腾讯混元开源的新一代大模型Hy4 preview是腾讯混元推出的开源旗舰大模型,采用混合专家架构,总参数达7700亿、激活490亿,支持百万级上下文。最新AI资源1周前014.3K
Claude Fable 5.1 - Anthropic 推出的新一代AI大模型Claude Fable 5.1 是 Anthropic 推出的新一代AI模型,主打复杂推理、长周期 Agent 任务与知识密集型工作。模型在科学探索、软件开发、计算机操作等多项基准测试中全面超越前代...最新AI资源1周前010.6K
Claude Mythos 5.1 - Anthropic 推出的 Claude 系列最新 AI 模型Claude Mythos 5.1 是 Anthropic Claude 5.1 系列旗舰模型,与 Fable 5.1 同源,通过差异化安全策略实现能力分级。模型专攻网络安全与生命科学,支持蛋白设计...最新AI资源1周前026.8K
Atlas - 李飞飞 World Labs 推出的多模态世界模型Atlas 是李飞飞创立的 World Labs 推出的全球首个多模态世界模型。模型能同时理解文本、图像、视频和三维空间信息,将画面精准锚定在空间坐标系中。最新AI资源1周前024.3K
Gemini 3.8 - 谷歌最新推出的新一代旗舰模型系列Gemini 3.8 是谷歌最新推出的推理与编码大模型,分为 Flash 和 Flash Cyber 两个版本。Flash 版在维持高速响应与低成本的同时,显著增强代码生成、多步推理和自主 Agent...最新AI资源1周前025.3K
GPT-6 Astra - OpenAI推出的新一代旗舰大语言模型GPT-6 Astra是OpenAI发布的新一代旗舰大语言模型,与传统对话模型不同,模型已进化为具备自主行动能力的AI Agent,能独立操控计算机软件、浏览网页、处理复杂工作流。最新AI资源1周前024.9K
PixVerse R2 - 爱诗科技推出的实时全模态世界模型PixVerse R2 是爱诗科技(AISphere)推出的实时全模态世界模型,延续年初 R1"全球首个实时世界模型"的路线,主打"边生成、边交互、边演化",推动 AI 视频从"看"走向"玩"。最新AI资源3周前046.2K
Play with Putty - Google Labs 推出的协作式 vibe coding 实验工具Play with Putty 是 Google Labs 推出的协作式 vibe coding 实验工具,口号是"让你的想象力进入多人模式"。允许多人通过共享链接进入同一空间实时协作,任何人都能用自...最新AI资源3周前030.5K
Agnes 2.5 Pro Alpha - Agnes AI 发布的高性价比推理模型Agnes 2.5 Pro Alpha 是新加坡 AI 实验室 Agnes AI 发布的高性价比推理模型,支持文本、图像输入与文本输出,提供百万 Token 上下文和 65,536 Token 最大输...最新AI资源3周前034.8K
MiniMax Design - MiniMax 发布的多模态创作 Agent 工作台MiniMax Design 是 MiniMax(稀宇科技)发布的多模态创作 Agent 工作台,也是开源视频模型 H3 的首个官方工具框架(Harness)。用户只需用自然语言提出创作需求,Agen...最新AI资源3周前031.4K
Qwen3.8-Flash-Next - 阿里 Qwen 发布的开源权重多模态 MoE 模型Qwen3.8-Flash-Next 是阿里 Qwen 发布的开源权重多模态 MoE 模型,定位为 Qwen4 架构的先导预览:主模型 125B 参数,另配 51B N-gram Embedding...最新AI资源3周前036.9K
GLM-5.3-Flash - 智谱开源的旗舰级高性价比模型GLM-5.3-Flash是智谱Z.ai上线并开源的旗舰级高性价比模型,也是GLM-5系列首个原生多模态模型;采用320B总参数、18B激活的MoE,支持1M上下文与128K输出,通过稀疏+线性注意力...最新AI资源3周前034.1K
Gemini 3.5 Transcribe - Google 发布的旗舰语音转文本模型Gemini 3.5 Transcribe 是 Google 发布的旗舰语音转文本模型,与传统语音识别只做逐字记录不同,能直接输出润色过、格式规范的成稿。自动删除口头禅、理解"周二,不,周三"式的自我...最新AI资源3周前017.7K
OnSolo - 腾讯推出的AI原生一站式影视创作平台OnSolo是腾讯推出的AI原生一站式影视创作平台,前身WorkSolo,以"a Crew of One"为核心理念,让个人仅凭一句话灵感即可完成从剧本、角色资产、分镜到视频成片的全部创作流程。最新AI资源3周前024.2K
GLM-5.3 - 智谱发布的新一代旗舰模型,面向复杂长程任务GLM-5.3 是智谱发布的新一代旗舰模型,沿用 GLM-5.2 约7430亿参数基座,能力跃迁主要来自后训练 Scaling:通过 IndexShare、SAO、Slime 框架与更多长程任务环境强...最新AI资源3周前028.4K
Mureka V9.5 - 昆仑万维发布的AI音乐生成大模型Mureka V9.5 是昆仑万维(天工AI)发布的AI音乐生成大模型,首次亮相于同年7月的世界人工智能大会。核心是自研的 MusiCoT 音乐思维链技术,模型在生成音频前先进行整体音乐构思,强调编配...最新AI资源3周前022.7K
Lovart中文版 - Lovart 推出面向中文用户的多模态 AI 设计 AgentLovart中文版是基于多模型架构的AI设计Agent,用户只需像聊天一样描述创意需求,平台可自动生成海报、视频、Banner等高品质视觉内容。平台深度整合Seedance、MiniMax H3等前沿...最新AI资源3周前029.1K
Gemini 3.7 Flash - Google DeepMind 发布的稳定版轻量主力模型Gemini 3.7 Flash 是 Google DeepMind 发布的稳定版轻量主力模型,模型 ID 为 gemini-3.7-flash,首日即非 preview。在 Gemini 3.6 F...最新AI资源1个月前024.9K
Grok Bot - SpaceXAI 发布的云端 AI Agent,多 Bot 分工协作Grok Bot 是 SpaceXAI(原 xAI)发布的 AI Agent 产品,定位为「永远在线的 AI 同事」。不同于传统聊天机器人,运行在独立的云端 Linux 虚拟机中,配备浏览器、文件系统...最新AI资源1个月前030.2K
Grok Imagine Image 2.0 - 马斯克旗下 SpaceXAI 发布的图像生成模型Grok Imagine Image 2.0 是马斯克旗下 SpaceXAI 发布的图像生成模型,作为全新「质量模式」上线 Grok 网页端及 iOS、Android 应用。在功能上完成了从「文生图工...最新AI资源1个月前024.5K
dots.tts - 小红书联合上海交大开源的语音合成基础模型dots.tts 是小红书 dots 团队(rednote-hilab)与上海交大 X-LANCE 实验室联合研发的 20 亿参数全连续端到端自回归语音合成基础模型,架构为「语义编码器 + Qwen2...最新AI资源1个月前024.6K
DeepSeek Harness - DeepSeek AI 开源的智能体运行框架DeepSeek Harness(DSH)是 DeepSeek AI 开源的智能体运行框架,当前为开发者预览版并采用 MIT 许可,核心理念是“一切皆插件”:模型、工具、技能、会话、沙箱、存储、循环...最新AI资源1个月前034.7K
Ling-3.0-tiny - 蚂蚁百灵开源的最小 MoE 模型Ling-3.0-tiny 是蚂蚁 InclusionAI 百灵 Ling 3.0 系列中最小的 MoE 模型,约 7.9B 总参数、每 token 激活约 1.3B,强调低延迟、低成本与 Agent...最新AI资源1个月前028.3K
MAGI-2 Preview - Sand.ai 开源的统一音视频生成模型MAGI-2 Preview 是 Sand.ai 开源的统一音视频生成模型,总参数约 114B、单 token 仅激活约 6B,是全球首个千亿级开源 MoE 视频模型 。采用单流架构将文本、视频、音频...最新AI资源1个月前029.6K
Wan3.0 - 阿里云通义全网公测的新一代视频生成大模型Wan3.0 是阿里云通义全网公测的新一代视频生成大模型,被称为"阿里最强视频模型"。在生成时长、万能创作、全能参考、真实感四大维度全面升级。单次可稳定生成最长30秒的一镜到底视频最新AI资源1个月前035.3K
SeedRealtime - 字节跳动 Seed 发布的原生音视频全双工大模型SeedRealtime 是字节跳动 Seed 团队发布的原生音视频全双工大模型,首发落地于豆包 App 的「打电话」视频通话功能。与传统"语音识别→视觉理解→大模型推理→语音合成"的级联流水线不同...最新AI资源1个月前032.6K
Hy ASR 3.0 preview - 腾讯混元推出的新一代语音识别模型Hy ASR 3.0 preview 是腾讯混元推出的新一代语音识别模型,深度融合最新大语言模型 Hy3 的语言理解能力与高精度语音识别技术,实现从"逐字转写"到"听懂语境"的跨越。模型采用 MoE ...最新AI资源1个月前035.7K
JoyAI-Video-Edit - 京东开源的实时流式视频编辑模型JoyAI-Video-Edit 是京东开源的实时流式视频编辑模型,基于16B参数自回归扩散框架构建,在单张英伟达B200 GPU上即可实现720p分辨率约30FPS的实时处理,真正做到"边播边改"。最新AI资源1个月前023.7K
Qwen 3.8-Max - 阿里巴巴通义千问发布的旗舰级大模型Qwen 3.8-Max 是阿里巴巴通义千问发布的旗舰级大模型,也是 Qwen 系列迄今规模最大、能力最强的模型。采用稀疏混合专家(MoE)架构,总参数达2.4万亿,推理时仅激活约950亿参数,在保持...最新AI资源1个月前032.4K
Qwen-Audio-3.0-ASR-Flash - 阿里通义千问发布的语音识别大模型Qwen-Audio-3.0-ASR-Flash 是阿里巴巴通义千问团队发布的语音识别大模型,主打"长音频不丢词、行业词不用教"。模型在上下文一致性、行业词识别与热词定制化三大维度实现系统性升级,集成...最新AI资源2个月前039.8K
MiniMax H3 - 稀宇科技MiniMax发布的通用全模态生成模型MiniMax H3是稀宇科技MiniMax发布的通用全模态生成模型,可在统一上下文中理解文本、图像、视频与声音,生成最高15秒、2K分辨率、带原生双声道音频的音视频。最新AI资源2个月前037K
Claude Opus 5 - Anthropic 推出的新一代大模型Claude Opus 5 是 Anthropic 推出的新一代旗舰大模型,核心是用旗舰一半的价格获得接近顶尖水平的智能"。模型在维持与前代 Opus 4.8 相同调用成本的同时,实现性能的翻倍跃升...最新AI资源2个月前036.3K
Gemini 3.5 Flash-Lite - Google 发布的高吞吐低成本模型Gemini 3.5 Flash-Lite 是 Google 发布的高吞吐低成本模型,官方定位为 3.5 系列中最快、最具成本效益的型号,面向 agentic search、文档处理与大规模生产流量...最新AI资源2个月前035K
Gemini 3.6 Flash - Google 发布的新一代主力模型Gemini 3.6 Flash 是 Google 发布的新一代主力模型(Workhorse Model),是 Gemini 3.5 Flash 的升级版,主要面向生产级 AI 智能体(Agent)和...最新AI资源2个月前035.2K
TDream - 腾讯推出的 AI 内容创作平台TDream是腾讯内测的AI内容创作平台,以"互动影游化创作"为核心定位,试图重构用户从内容生产到交互体验的全链路。区别于市面上仅输出单一线性视频的传统文生视频工具,TDream依托五大AI引擎,支持...最新AI资源2个月前037.2K
FLUX 3 - Black Forest Labs 发布的首款多模态基础模型FLUX 3 是德国 AI 公司 Black Forest Labs 发布的首款多模态基础模型,基于自研 Self-Flow 架构,在单一网络中统一训练图像、视频、音频与动作预测,实现真正的"全能模型...最新AI资源2个月前033.1K
Qwen-Audio-3.0-TTS - 阿里通义发布的旗舰级语音合成大模型Qwen-Audio-3.0-TTS是阿里巴巴通义千问团队发布的旗舰级语音合成大模型,提供面向实时交互的Flash版(首包延时约300ms)与面向高质量生成的Plus版,Plus版登顶全球权威榜单Ar...最新AI资源2个月前035.7K
Qwen-Image-3.0 - 阿里千问发布的第三代图像生成基础模型Qwen-Image-3.0 是阿里千问发布的第三代图像生成基础模型,核心主线为"实",内容丰实、细节真实、知识厚实。模型支持最大 4.5k token 超长文本输入,较前代提升 4.5 倍,可一次性...最新AI资源2个月前033.8K
Qwen3.8-Max-Preview - 阿里通义千问发布的新一代旗舰大模型Qwen3.8-Max-Preview是阿里巴巴通义千问团队发布的新一代旗舰大模型预览版 。模型总参数达2.4万亿,采用稀疏MoE架构,是通义千问系列首个突破万亿参数的多模态模型,支持文本、图片、视频...最新AI资源2个月前037K
Hyra - 腾讯混元团队发布的科研智能体Hyra(Hunyuan Research Agent)是腾讯混元团队发布的科研智能体,首个版本为Hyra-1.0,支持递归自我改进(RSI),专为性能导向的研究与工程任务打造 。采用轻量通用框架,通...最新AI资源2个月前035.9K
Wan-Streamer v0.2 - 阿里通义实验室发布的端到端全模态实时交互模型Wan-Streamer v0.2 是阿里通义实验室发布的端到端全模态实时交互模型,首次将「听、看、说、演」统一进单个因果 Transformer 架构,实现类人般的实时双工交互。最新AI资源2个月前031.2K
Kimi K3 - 月之暗面发布的全球首个开源 3 万亿级大模型Kimi K3 是月之暗面(Moonshot AI)发布的全球首个开源 3 万亿级大模型,总参数达 2.8 万亿。采用 KDA 混合线性注意力机制与 Stable LatentMoE 稀疏架构,896...最新AI资源2个月前042K
Wan-Dancer - 阿里通义实验室开源的音乐舞蹈视频生成大模型Wan-Dancer 是阿里巴巴通义实验室万相(Wan)团队推出的音乐驱动舞蹈视频生成大模型,开源版本 Wan-Dancer-14B 拥有140亿参数,采用 Apache 2.0 协议免费商用。用户只...最新AI资源2个月前042.4K
HyOCR-1.5 - 腾讯混元团队开源的轻量化端到端OCR专家大模型HyOCR-1.5是腾讯混元团队开源的轻量化端到端OCR专家大模型,参数量仅1B,是领域首个训练、推理、权重完整开源的专家模型 。采用端到端架构,输入图片即可直接输出Markdown正文、HTML表格...最新AI资源2个月前034.9K
Hy3 - 腾讯开源的旗舰级大语言模型,快慢思考融合Hy3 是腾讯推出的旗舰级开源大语言模型,采用 MoE 架构,拥有 295B 总参数与 21B 激活参数,支持长达 256K 的上下文窗口。核心亮点在于快慢思考融合(Hybrid Reasoning...最新AI资源2个月前071.4K
GPT-Live - OpenAI 推出的新一代语音模型,全双工实时对话GPT-Live 是 OpenAI 推出的新一代语音模型,全面升级 ChatGPT 的语音交互体验。基于全双工(full-duplex)架构构建,能同时倾听和说话,彻底打破了传统 AI 语音助手"你说...最新AI资源2个月前038.2K
Grok 4.5 - SpaceXAI 发布的旗舰大语言模型,编码与智能代理专用模型Grok 4.5 是 SpaceXAI(原 xAI)发布的旗舰大语言模型,定位为"Opus 级别"的编码与智能代理专用模型。模型基于 1.5 万亿参数的 V9 架构打造,采用 MoE(混合专家)架构...最新AI资源2个月前037.3K
Seedream 5.0 Pro - 字节跳动发布的多模态图像创作模型Seedream 5.0 Pro是字节跳动豆包大模型团队发布的多模态图像创作模型,定位为面向专业创作者和企业级用户的设计工具。相比前代,在图文匹配、结构合理性等基础能力上全面提升最新AI资源2个月前042.1K
JellyToken - 阿里元境推出的大模型 API 聚合与分发平台JellyToken 是国内领先的大模型 API 聚合与分发平台,定位为"国内主流 AI 大模型一站式超市"。用户仅需一个 API Key 即可无缝调用通义千问、DeepSeek、智谱、月之暗面、豆包...最新AI资源2个月前034K
Muse Image - Meta 推出的首个自研 AI 图像生成模型Muse Image 是 Meta 推出的首个自研 AI 图像生成模型,由 Meta Superintelligence Labs 开发。采用独特的智能体(Agentic)架构,在生成图像前会先与 M...最新AI资源2个月前035.3K
Nano Banana 2 Lite - Google发布的轻量版 AI 图像生成模型Nano Banana 2 Lite(gemini-3.1-flash-lite-image)是Google发布的AI图像生成模型,定位为Nano Banana家族中速度最快、成本最低的轻量版。可在约...最新AI资源2个月前037K
SeedMusic 1.0 - 字节跳动推出的第一代AI音乐生成模型SeedMusic 1.0是字节跳动推出的第一代AI音乐生成模型,专注于将用户的文字创意快速转化为带有人声的完整歌曲草稿。用户只需输入一段描述、歌词或风格方向,可在几分钟内生成包含主歌、副歌、编曲和人...最新AI资源2个月前045.8K
跃迁维度 - AI 模型聚合服务平台,一个API统一调多款模型跃迁维度(dimleap) 是AI模型聚合服务平台,为全球开发者提供高效能、低成本的多品类AI模型API服务。平台目前已接入DeepSeek、GLM(智谱清言)、MiniMax、kimi、qwen(通...最新AI资源2个月前039.2K
ChatExcel Ultra - ChatExcel团队推出的企业级AI数据智能体ChatExcel Ultra 是ChatExcel团队面向企业用户和专业数据办公场景推出的全新桌面版,定位为国内首款企业级AI数据智能体。最新AI资源2个月前039.3K
Claude Sonnet 5 - Anthropic 发布的最具 Agent 能力模型Claude Sonnet 5是Anthropic 发布的最具 Agent 能力的 Sonnet 模型,以中端价格提供接近旗舰 Opus 4.8 的自主智能体能力。模型支持 100 万 token 上...最新AI资源2个月前035.8K
Astryx - Meta 开源的 React 设计系统Astryx 是 Meta 以 MIT 协议开源的 React 设计系统,历经八年内部打磨,长期支撑 Facebook、Instagram、WhatsApp 和 Threads 等超过 13,000 ...最新AI资源2个月前034.8K
Claude Tag - Anthropic 推出的 Slack 原生 AI 协作功能Claude Tag 是 Anthropic 推出的 Slack 原生 AI 协作功能,将 Claude 从个人聊天工具升级为团队常驻成员。用户只需在 Slack 频道中输入 @Claude 即可分配...最新AI资源3个月前062.2K
Unlimited-OCR - 百度开源的端到端长文档 OCR 模型Unlimited-OCR 是百度开源的端到端长文档 OCR 模型,采用 3B 参数 MoE 架构(每 token 仅激活约 500M 参数),核心创新在于将标准注意力替换为 R-SWA(参考滑动窗口...最新AI资源3个月前044.1K
Seedance 2.5 - 字节跳动推出的 AI 视频生成模型Seedance 2.5是字节 Seed 团队推出的AI模型,定位新一代 AI 视频创作引擎。模型单次直出 30 秒高清片段,可多次延长拼接成分钟级连贯叙事;支持批量导入图片、视频、音频作为创作参考...最新AI资源2个月前049.9K
豆包2.1 - 字节跳动发布的最新旗舰大模型系列豆包2.1(Doubao-Seed-2.1)是字节跳动发布的最新旗舰大模型系列,包含Pro和Turbo两个版本,专为Coding与Agent时代打造。编程能力上,在Terminal Bench 2.1...最新AI资源3个月前060.7K
SkillOpt - 微软研究院开源的 Agent 技能自进化框架SkillOpt 是微软研究院开源的 Agent 技能自进化框架,核心创新在于将自然语言编写的技能文档视为可训练的外部参数,无需修改底层大模型权重。系统通过"执行-反思-编辑-验证"闭环运作:冻结的目...最新AI资源3个月前043.5K
Qwen-AgentWorld - 阿里通义实验室发布的首个原生语言世界模型Qwen-AgentWorld 是阿里巴巴通义实验室发布的首个原生语言世界模型(Language World Model, LWM)。与传统"提示进、动作出"的反应式智能体不同,核心逻辑是先预测环境会...最新AI资源3个月前052.4K
Xiaomi MiMo Claw - 小米推出的云端轻量化 AI 智能体平台Xiaomi MiMo Claw 是小米推出的云端轻量化 AI 智能体平台,基于 OpenClaw 框架打造,搭载自研 MiMo-V2.5-Pro 旗舰模型。主打"一键部署、零门槛"的 AI 办公体验...最新AI资源3个月前048.4K
HiPilot - 小盒科技推出的 AI 原生经营操作系统HiPilot 是小盒科技推出的 AI 原生经营操作系统,非传统意义上的 AI 助手或工具软件,是由 7 位专业 Agent 组成的 7×24 小时 AI 经营班子,能自主感知企业数据、分析经营态势...最新AI资源3个月前053.7K
LOGOS - 阿里联合中国人大推出的多领域科学生成基础模型LOGOS(Language Of Generative Objects in Science)是阿里集团联合中国人民大学高瓴人工智能学院开发的首个基于统一"科学语法"的多领域科学生成基础模型。最新AI资源3个月前041.6K
Meshy 3D Agent - Meshy 发布的全球首个 3D 创作 AI AgentMeshy 3D Agent 是 AI 3D 公司 Meshy 发布的全球首个 3D 创作 AI Agent,通过对话式交互将 3D 创作从一次性生成推向可控、可复用的生产流程。与传统「输入提示词、输...最新AI资源3个月前050.9K
Seedance 2.0 Mini - 字节跳动 Seedance 视频模型系列的轻量版本Seedance 2.0 Mini 是字节跳动 Seedance 视频模型系列的最新轻量版本,在火山方舟体验中心及 Dreamina 平台上线,计划近期开放 API 服务。最新AI资源3个月前044.5K
GLM-5.2 - 智谱最新推出的旗舰级开源大模型GLM-5.2 是智谱最新推出的旗舰级开源大模型,超长上下文理解和智能编程为核心卖点。模型具备百万级 token 的上下文处理能力,能一次性分析整个代码仓库或长篇技术文档。最新AI资源3个月前059.3K
Gemini 3.5 Live Translate - Google 发布的最新实时语音翻译模型Gemini 3.5 Live Translate 是 Google 发布的最新实时语音翻译模型,支持 70 余种语言和 2,000 多组语言对,覆盖全球绝大多数语种。采用流式实时翻译技术,输出仅落后...最新AI资源3个月前045K
DiffusionGemma - Google DeepMind 发布的实验性开源文本生成模型DiffusionGemma 是 Google DeepMind 发布的实验性开源文本生成模型,采用离散文本扩散架构替代传统自回归方式。基于 Gemma 4 的 MoE 骨干(26B 总参数,激活 3...最新AI资源3个月前046.8K
HiDream-O1-Image-1.5 - 智象未来推出的商用版图像生成大模型HiDream-O1-Image-1.5 是智象未来(HiDream.ai)推出的商用版图像生成大模型,在全球独立评测平台 Artificial Analysis 的文生图榜单(Text to Ima...最新AI资源3个月前053.6K
html-video - Open Design团队开源的本地视频生成工具html-video是Open Design团队开源的本地视频生成工具,能将HTML、CSS和数据直接转换为MP4视频。支持21种预设模板,涵盖产品宣传、知识讲解等场景,可配合Claude Code...最新AI资源3个月前047K
Kimi K2.7 Code - 月之暗面Kimi开源的编程专用大模型Kimi K2.7 Code是月之暗面(Moonshot AI)发布并开源的编程专用大模型,属于Kimi K2系列的最新迭代版本。专为长上下文编程和复杂任务优化,聚焦代码生成、理解、调试及多文件项目架...最新AI资源3个月前074.5K
Octask - 光魔科技推出的新一代 AI 原生内容工作室平台Octask 是深圳光魔科技推出的新一代 AI 原生内容工作室平台,由谷歌与腾讯背景团队打造,获得百度 A 轮投资。核心创新在于将 AI 工具"员工化",通过像素风格的沉浸式虚拟工作室,让创作者以"老...最新AI资源3个月前042.7K
蛙蛙写作2.0升级深度解析:三栏架构如何重塑AI长篇创作体验2025年7月,蛙蛙写作正式发布2.0版本,这是该产品自2024年上线以来幅度最大的一次产品重构。此次升级不仅在底层技术能力上实现了对主流大模型的深度整合,更在产品交互架构上做出了突破性的创新——引入...最新AI资源3个月前046.7K
JoyAI-Echo - 京东开源的分钟级长音视频生成框架JoyAI-Echo 是京东开源的分钟级长音视频生成框架,专为解决AI视频"角色易崩、声音乱变、生成缓慢"三大痛点而设计。基于LTX-2.3 DiT架构,通过跨模态记忆库在长达5分钟的多镜头视频中保持...最新AI资源3个月前053.7K