彩漩 - AI PPT生成平台,基于主题或微信文章等生成PPT彩漩是集AI智能创作、多人协作与安全分享于一体的一站式PPT生成平台。用户输入主题或导入文本,平台能一键生成高质量的演示文稿,支持智能配图、文本优化和内容布局调整。彩漩提供丰富的模板库,满足不同场景需...最新AI资源1年前070.2K
Outerspan:快速部署自动处理邮件的AI智能体综合介绍 Outerspan 是一个为 AI 智能体提供独立邮箱的快速部署平台。用户通过简单的 API 或仪表板,几秒钟内就能创建带邮箱的智能体,处理邮件沟通、客户支持或数据整理等任务。平台无需用户自...最新AI资源# AI客服机器人# 专业生产力工具# 智能体应用1年前070.1K
Extrovert:通过AI辅助在LinkedIn上高效建立商业关系综合介绍 Extrovert 是一个基于人工智能的LinkedIn关系管理工具,专注于帮助企业销售团队高效建立和维护商业关系。它通过AI分析潜在客户的LinkedIn动态,提供个性化评论、点赞和私信建...最新AI资源# AI社交媒体1年前070.1K
Hypertxt:生成SEO优化长文的AI写作工具综合介绍 Hypertxt 是一个利用人工智能技术帮助用户快速生成高质量长文的在线工具,主打博客文章创作。它不仅能自动完成文章的研究、结构规划和撰写,还能优化内容以提升搜索引擎排名。无论你是内容创作者...最新AI资源# AI写作1年前070.1K
Qwen3-Coder - 阿里通义千问开源的的代码生成模型Qwen3-Coder 是阿里通义千问团队推出的先进代码生成模型。模型拥有 480B 参数和 35B 激活参数,支持原生 256K token 上下文,能扩展至 1M token。模型基于混合专家架构...最新AI资源1年前070K
AIFlowy - 开源的企业级 AI 应用开发平台AIFlowy是开源的企业级AI应用开发平台,基于Java开发,对标字节Coze、腾讯元器和Dify等产品。支持智能对话机器人、私有知识库构建、AI 工作流编排和大模型管理等功能,提供完善的系统管理模...最新AI资源1年前070K
Paperpal - AI学术写作工具,全面覆盖写作全流程Paperpal是专注于学术写作的AI辅助工具,帮助研究人员、学生和专业人士提升写作质量和效率。通过强大的语言润色功能,提供语法检查、拼写纠正和用词建议,确保文本准确流畅。最新AI资源1年前070K
DuckDuckGo AI Chat:免登录使用ChatGPT和Claude综合介绍 DuckDuckGo是一家美国软件公司,致力于开发帮助用户保护其在线隐私的产品,旗舰产品是一个不追踪用户且提供无偏差搜索结果的搜索引擎。除此之外,DuckDuckGo还提供强大的浏览器插件和...最新AI资源# AI集成多模型对话平台2年前070K
SurveyGO卷姬 - 清华联合面壁智能推出的开源AI论文写作工具SurveyGO(卷姬)是清华大学联合面壁智能团队开源的AI论文写作工具,能帮助科研人员和学生快速生成文献综述部分。用户只需输入论文主题和描述,工具能快速生成结构清晰、内容丰富的综述文章,支持数万字长...最新AI资源1年前070K
Splash - AI音乐创作平台,文字描述生成旋律和演唱效果Splash是创新的AI音乐创作平台,帮助用户轻松创作个性化音乐作品。平台基于先进的AI技术,提供文本到歌声、文本到说唱及生成式文本到音乐等功能,用户只需输入文字,AI能生成旋律和演唱效果。最新AI资源1年前070K
迅雷MCP - 迅雷推出的AI自动下载服务迅雷MCP是迅雷推出的,基于AI技术的自动下载服务。用户在支持该服务的AI应用中,用语音或文字输入下载需求,AI能自动搜索网络资源并启动下载。迅雷MCP支持PC版迅雷和NAS迅雷,打破传统下载模式,让...最新AI资源1年前069.9K
Seed-OSS - 字节跳动团队开源的全新AI模型Seed-OSS是字节跳动Seed团队开源的大型语言模型系列,专注于长文本和推理任务。模型在复杂逻辑推理和多步推理中表现出色,准确率高,能高效解决难题。Seed-OSS支持长达512K的长文本上下文...最新AI资源11个月前069.9K
FiaMind - AI 思维导图工具,提供无限画布自由拆分组合FiaMind 是 AI 思维导图工具,专为高效信息管理和创意辅助设计。工具具备灵活的无限画布,支持自由拆分组合思维导图,满足多样化布局需求,涵盖逻辑图、思维导图、组织架构图等多种形式。最新AI资源1年前069.8K
Google AI Edge Gallery - 谷歌推出的AI应用,支持手机运行AI模型Google AI Edge Gallery 是谷歌推出的实验性AI应用,让用户在本地设备上体验和使用机器学习(ML)及生成式人工智能(GenAI)模型。应用支持在 Android 设备上运行。最新AI资源1年前069.8K
有道数字人:虚拟形象播报与实时交互平台|免费制作克隆数字人综合介绍 有道数字人是一个集成了先进AI技术的平台,专注于提供虚拟形象播报和实时交互服务。平台利用自研的语音识别、语音合成、多模态感知和文档问答技术,为用户打造逼真的数字人分身,支持视频制作、翻译、教...最新AI资源# AI数字人# AI语音克隆2年前069.8K
WebAgent - 阿里通义开源的自主搜索AI AgentWebAgent是阿里巴巴通义实验室开源的自主搜索AI Agent,具备强大的端到端自主信息检索与多步推理能力。WebAgent能像人类一样在网络环境中主动感知、决策和行动,广泛用在学术研究、商业决策...最新AI资源1年前069.8K
Foudinge Scrub:从餐厅评论中构建知识图谱综合介绍 Foudinge Scrub 是一个开源的网页工具,托管在 GitHub 上,由开发者 Théophile Cantelobre 创建。它旨在帮助用户清理和编辑从复杂文本数据中提取的知识图谱...最新AI资源# AI开源项目1年前069.7K
YourInterviewer:自然语音对话(采访)引导,为各媒介生成个性化文章综合介绍 YourInterviewer 是一个创新的内容生成平台,通过15分钟的在线采访,帮助用户生成高度个性化和互动的AI内容。该平台通过动态的双向对话,挖掘用户的个人故事和品牌信息,转化为多种媒...最新AI资源# AI写作2年前069.7K
Megrez-3B-Omni:端侧多模态理解模型,支持文本、图像、音频多模态理解和分析综合介绍 Infini-Megrez是由无问芯穹(Infinigence AI)开发的边缘智能解决方案,旨在通过软硬件协同设计,实现高效的多模态理解和分析。该项目的核心是Megrez-3B模型,支持图...最新AI资源# AI开源项目# 多模态实时互动产品2年前069.6K
Make - AI无代码自动化工作流搭建平台Make是AI驱动的无代码自动化平台,帮助企业基于自动化流程提升效率和创新能力。平台提供超过2000个预建应用,支持多种业务场景,如营销、销售、财务等。Make的核心功能包括无代码可视化流程创建、AI...最新AI资源1年前069.6K
女娲智能体OS - 西南财经开源的通用智能体操作系统女娲智能体OS(Nuwax Agent OS)是西南财经大学赵宇教授团队推出的全球首个开源通用智能体操作系统。具备自主执行引擎,可实现从需求拆解到任务规划与执行的全链路自动化。系统支持可视化工作流编排...最新AI资源7个月前069.6K
GrammarPaw:Mac菜单常驻的AI写作助手综合介绍 GrammarPaw是一款专为Mac用户打造的AI写作助手,直接运行在Mac菜单栏中。通过一个快捷键(默认Control+Option+Space),它能在任何应用中提供写作帮助,比如邮件...最新AI资源# AI写作1年前069.5K
Sheepscript.AI:将视频和播客转化为社交内容,提升内容传播效率综合介绍 Sheepscript.AI 是一款创新的内容再利用工具,专为内容创作者和播客主持人设计。它利用先进的人工智能技术,将长视频和音频内容自动转化为适合社交媒体平台的帖子和文章。用户只需粘贴视频...最新AI资源# AI社交媒体2年前069.5K
冷饭热炒:流畅的创作儿童故事视频AI教程中初期最热的赚钱思路就是教你创作儿童故事绘本,后来衍生出儿童故事动画,这些视频一看就会,一操作就卡住。 究其原因还是门槛略高,而且内容和生成的图像质量堪忧。直到... gpt和cloude生成...最新AI资源2年前069.5K
BAGEL - 字节跳动推出的开源多模态基础模型BAGEL是字节跳动开源的多模态基础模型,拥有140亿参数,其中70亿为活跃参数。模型基与混合变换器专家架构(MoT),用两个独立的编码器分别捕捉图像的像素级和语义级特征,支持高效处理图像、文本、视频...最新AI资源1年前069.5K
GLM-4.1V-Thinking - 智谱AI推出的开源视觉语言模型系列GLM-4.1V-Thinking是智谱AI推出的开源视觉语言模型,专为复杂认知任务设计,GLM-4.1V-Thinking支持多模态输入,涵盖图像、视频和文档等。基于GLM-4V架构,模型引入思维链...最新AI资源1年前069.4K
意间AI - AI绘画平台,支持中英双语文本生成图像意间AI是领先的AI绘画和设计定制平台,支持中英双语输入,内含400+种模型和10万种绘图风格。用户输入文本描述或上传图片,快速生成符合要求的图像。最新AI资源1年前069.4K
Qwen-TTS - 阿里通义千问推出的语音合成模型Qwen-TTS是阿里通义推出的先进语音合成模型。模型能将文本高效转化为自然流畅的语音,支持多种语言和方言,如普通话、英语、北京话等,满足不同地域和场景需求。依托海量语料训练,模型语音输出质量高,韵律...最新AI资源1年前069.4K
Hunyuan3D-Part - 腾讯开源的免费3D组件生成模型Hunyuan3D-Part(混元3D-Part)是腾讯发布并开源的3D生成模型。由P3 - SAM和X - Part组成,首次实现高精度、可控的组件式3D生成,支持50 + 组件自动生成。用户可先用...最新AI资源10个月前069.4K
JustCMS:AI驱动的无头内容管理系统,利用 AI 快速创作内容(付费)综合介绍 JustCMS 是一个创新的内容管理系统,专为忙碌的内容创作者设计。它利用人工智能技术,从内容创意到发布的每一步都提供支持。JustCMS 采用无头架构,确保内容交付的速度和灵活性。用户可以...最新AI资源# AI写作1年前069.4K
Curiosity:使用LangGraph构建类似 Perplexity 的AI搜索工具综合介绍 Curiosity 是一个旨在探索和实验的项目,主要使用 LangGraph 和 FastHTML 技术栈,目标是构建一个类似 Perplexity AI 的搜索产品。项目的核心是一个简单的...最新AI资源# AI开源项目# AI搜索工具2年前069.4K
使用 Gimine 2.5 Pro 模型将视频、语音转为SRT字幕之前尝试过 免费使用 Gemini 2.0 将语音转换为多发言人字幕 ,效果可圈可点。借着 Gimine 2.5 pro 再次尝试一下。 首先找到一份较为标准的SRT字幕样本作为参考基准(提前做好语音...最新AI资源1年前069.4K
MiniMax Speech 2.5 - MiniMax推出的语音生成模型MiniMax Speech 2.5 是 MiniMax 团队开发的先进语音生成模型。在语音合成领域取得了显著进步,尤其在多语种表现力、音色复刻精度和语种覆盖范围上实现了飞跃。模型支持 40 种语言...最新AI资源12个月前069.3K
Mapify - XMind推出的AI思维导图生成工具Mapify 是 XMind 团队推出的 AI 思维导图生成工具。能将文本、PDF、网页、视频、音频等多种格式的内容快速转换为结构化的思维导图,帮助用户高效提取和整理关键信息。最新AI资源1年前069.3K
GenFlow超能搭子 – 百度文库推出的通用AI AgentGenFlow超能搭子是百度文库推出的通用AI Agent,用户只需输入自然语言指令,可自主拆解任务、调用百度文库14亿文档库及网盘资源,极速生成PPT、报告、图表、海报等全模态内容。最新AI资源1年前069.3K
Paper to Podcast:把学术论文转换为多人对话播客综合介绍 Paper to Podcast 是一个开源工具,专门把学术研究论文转化为生动有趣的播客。它通过人工智能技术,将 PDF 格式的论文变成三个角色——主持、学习者和专家——之间的对话,让复杂的...最新AI资源# AI开源项目# AI文本转语音1年前069.3K
Magnific:付费的图像放大与增强工具,放大图像同时修复细节Magnific 综合介绍 Magnific是一款创新的图像放大与增强工具,它利用先进的深度学习算法,可以将任何图像转换为更高分辨率的版本,同时添加令人惊叹的细节和质量。Magnific不仅可以放大图...最新AI资源# AI图像放大与修复2年前069.2K
Echo Memo:用 AI 理解和搜索社交媒体内容的书签工具综合介绍 Echo Memo 是一个专为社交媒体用户设计的工具,它能帮你保存和整理社交媒体上的链接,比如 X、TikTok 和 YouTube 的内容。它的特别之处在于用 AI 分析链接里的文字、图片...最新AI资源# AI社交媒体1年前069.2K
AI抖音 - 抖音推出的智能深度思考与搜索应用AI抖音是抖音推出的智能深度思考与搜索应用,为用户提供更高效、更智能的内容获取体验。基于抖音的强大内容生态和AI技术,通过联网搜索和推理能力,为用户提供更全面、更详细的答案。最新AI资源1年前069.1K
ZipVoice - 小米开源的语音合成系列模型ZipVoice是小米发布的基于 Flow Matching 架构的系列语音合成(TTS)模型,包括 ZipVoice(零样本单说话人语音合成模型)和 ZipVoice-Dialog(零样本对话语音合...最新AI资源11个月前069K
MOSS-TTSD - 清华实验室开源的双语对话语音生成模型MOSS-TTSD 是清华大学语音与语言实验室开发的开源口语对话语音生成模型。模型能将文本对话脚本转化为自然流畅且富有表现力的对话语音,支持中英文双语生成。最新AI资源12个月前069K
Ello:提供个性化阅读体验,提升儿童阅读能力综合介绍 Ello 是一个专为儿童设计的个性化阅读平台,旨在通过先进的人工智能技术和互动功能,帮助孩子们提升阅读能力。Ello 提供了丰富的可解码电子书和纸质书籍,适应不同年龄段和阅读水平的需求。平台...最新AI资源# AI教育工具2年前069K
MultiAgentPPT - 开源的AI演示文稿生成系统MultiAgentPPT 是开源的多智能体 AI 演示文稿生成系统。用户只需输入主题,系统基于多智能体协作,自动完成大纲生成、主题拆分、并行调研及内容汇总等步骤,快速生成高质量 PPT。系统基于流式...最新AI资源1年前069K
Circuit Tracer - Anthropic开源的模型内部工作机制可视化工具Circuit Tracer 是 Anthropic 推出的开源工具,用在研究大型语言模型的内部工作机制。基于生成归因图(attribution graphs)揭示模型在生成特定输出时内部所经历的步骤...最新AI资源1年前068.9K
图可丽 - AI图像处理工具,一键图像和视频抠图神器图可丽是AI图像处理工具,专注于提供高效便捷的图片和视频编辑服务。基于先进的人工智能技术,能快速实现一键抠图、视频处理、照片修复与美化、AI绘画以及背景更换等多种功能。最新AI资源1年前068.8K
元镜 - AI视频创作工具,自动生成脚本元镜是基于人机共生引擎的AI视频创作工具,支持从创意灵感到成品视频的高效创作。工具具备自动化脚本生成、角色风格统一、多模态融合和智能工作流等功能,能快速生成创意视频脚本、多模态分镜设计,一键合成完整视...最新AI资源1年前068.8K
Knit:提示词指令设计管理工具综合介绍 PromptKnit是一个针对AI提示设计器的顶级AI沙盒平台,提供gpt-4-turbo/vision、claude-3、gemini-1.5-pro等多种模型的专业提示编辑器。用户能够组...最新AI资源# AI开放服务2年前068.8K
Intern-S1 - 上海AI Lab开源的科学多模态大模型Intern-S1是上海人工智能实验室推出的科学多模态大模型。模型将语言和多模态能力深度融合,具备跨模态科学解析、语言与视觉融合、科学数据处理、科学问题解答、实验设计与优化等强大功能。最新AI资源1年前068.7K
FLUX.1 Krea [dev] - 黑森林和Krea AI联合推出的文生图模型FLUX.1 Krea [dev] 是 Black Forest Labs 和 Krea AI 联合推出的文生图模型。模型根据输入的文本描述,能生成高质量、逼真的图像,具有独特的美学风格,避免传统 A...最新AI资源1年前068.7K
Matrix-Game 2.0 - 昆仑万维开源自研的交互式世界模型Matrix-Game 2.0 是昆仑万维 SkyWork AI 发布的自研交互式世界模型。是业内首个开源的通用场景实时长序列交互式生成模型,模型通过视觉驱动的交互方案,能以 25 FPS 的速度在多...最新AI资源12个月前068.6K
o3-pro - OpenAI推出的 o3 升级版推理模型o3-pro是OpenAI推出的 o3 升级版推理模型,专为处理复杂问题和提供精准回答而设计。模型支持调用ChatGPT的全套工具,如网页搜索、文件分析、图像推理和Python编程等,展现出强大的执行...最新AI资源1年前068.6K
AiBiao – AI图表处理工具,对话式进行数据查询、清洗、分析AiBiao 是AI图表处理工具,通过自然语言交互帮助用户高效完成数据处理和分析工作。支持用户通过对话的方式进行数据查询、清洗、合并、计算和分析,无需复杂的公式或代码,降低了数据处理的门槛。最新AI资源1年前068.5K
Skywork UniPic - 昆仑万维推出的开源多模态统一预训练模型Skywork UniPic 是昆仑万维开源的多模态预训练模型,具备图像理解、文本生成图像和图像编辑三大核心能力。模型基于自回归架构,融合 MAR 编码器和 SigLIP2 主干,用 1.5B 参数规...最新AI资源1年前068.4K
探饭 - 字节跳动推出的AI美食推荐工具探饭是字节跳动旗下抖音推出的AI美食推荐工具,依托豆包大模型,为用户提供个性化美食推荐、探店对比、美食攻略等服务。探饭能根据用户口味偏好和位置,精准推荐附近餐厅和菜品,支持辅助点菜,提供团购和外卖服务...最新AI资源1年前068.4K
Olovka AI - AI学术写作辅助平台,提供精准的写作建议和辅助Olovka AI 是为学生打造的AI学术写作辅助平台,平台根据学生的学术水平、专业领域和论文类型,提供精准的写作建议和辅助。基于智能算法,Olovka AI 帮助学生快速撰写高质量的学术论文,将论文...最新AI资源1年前068.4K
D-Human:克隆数字人营销短视频生产专家综合介绍 D-Human是一个数字人视频制作平台,小米投资,由中科院的博士领军研发。支持SaaS、API、OEM多种合作方式,提供1:1真人还原技术,8分钟视频材料即可克隆自己或他人。平台大大降低了创...最新AI资源# AI数字人2年前068.3K
MirageLSD - Decart AI推出首个实时AI视频生成模型MirageLSD 是 Decart AI 团队推出的全球首个实时流扩散 AI 视频模型,能实现无限时长的实时视频生成,延迟低至 40 毫秒以内,支持 24 帧/秒的流畅输出。最新AI资源1年前068.3K
Mindsera - AI日记工具,解析用户文字挖掘潜在情绪Mindsera是智能AI日记工具,基于AI技术助力用户提升心理健康和认知能力。Mindsera能深度解析用户的文字,挖掘潜在情绪和思维模式,帮助用户更好地理解自己。Mindsera内置智能聊天功能...最新AI资源1年前068.3K
聊愈小宇宙 - 京东健康推出的AI心理陪伴产品聊愈小宇宙是京东健康推出的AI心理陪伴产品。聊愈小宇宙基于京医千询医疗大模型推出,能模拟人类交流过程和共情能力,为用户提供7×24小时的心理健康支持。用户基于文字、表情或语音与AI角色小鱼互动,分享情...最新AI资源1年前068.2K
SagaLabs:AI驱动的文学、小说和剧本翻译工具,针对全球市场内容本地化综合介绍 SagaLabs是一个AI驱动的翻译工具和内容平台,专为创作者设计,帮助他们将故事本地化并推广到全球市场。该平台支持200多种语言的翻译,确保翻译质量达到母语专家水平。SagaLabs不仅关...最新AI资源# AI翻译2年前068.1K
Qwen-Image - 通义千问推出开源的文生图基础模型Qwen-Image是阿里巴巴通义千问团队发布的开源图像生成基础模型。拥有200亿参数,采用多模态扩散变换器架构(MMDiT),融合了多模态理解、高分辨率编码和扩散模型三大模块。Qwen-Image的...最新AI资源12个月前068.1K
NovaCV - AI简历生成工具,一键制作专业求职简历NovaCV是智能简历生成工具。工具基于先进AI技术帮助用户快速制作专业求职简历。AI简历助手支持一键生成工作描述,智能润色语言,优化表达,能实时纠错、提供中英文翻译。最新AI资源1年前068.1K
宠TA - 京东推出的AI宠物互动产品宠TA是京东推出的AIGC宠物互动产品,能为宠物爱好者提供充满乐趣和温馨的在线互动平台。支持用户为自己的宠物选择各种可爱的服装和配饰,进行个性化装扮,且能创建宠物的数字形象,与之进行丰富互动。平台提供...最新AI资源1年前068.1K
MiDashengLM - 小米开源的声音理解模型MiDashengLM 是小米开源的高效声音理解大模型,具体参数版本为MiDashengLM-7B ,专注于音频处理与理解。模型基于 Xiaomi Dasheng 音频编码器和 Qwen2.5-Omn...最新AI资源12个月前068.1K
Sparkify - 谷歌推出的AI动画视频生成平台Sparkify是谷歌推出的AI动画视频生成平台。平台基于Gemini2.5和Veo2模型,用户输入问题或复杂概念,Sparkify在2分钟内生成直观的动画短视频,讲解相关知识点。平台支持文本、图像和...最新AI资源1年前068K
Comate AI IDE - 文心快码推出多模态、多智能体协同的AI IDEComate AI IDE是百度文心快码推出的行业首个多模态、多智能体协同的AI原生IDE。具备强大的多模态能力,支持设计稿一键转代码(F2C)、图片转代码以及自然语言转代码,在前端开发场景中表现出色...最新AI资源1年前068K
茴香豆:基于LLM(大型语言模型) 的群聊助手综合介绍 HuixiangDou 是一个基于大型语言模型(LLM)的群聊助手,旨在通过三阶段的预处理、拒绝和响应流程来应对群聊场景。它能够在不造成信息泛滥的情况下回答用户问题。该项目提供了完整的Web...最新AI资源# AI开源项目1年前068K
PromptForge - AI 提示词生成与优化工作台PromptForge 是强大的 AI提示工程工作台,能帮助用户高效地创建、测试和优化 AI 提示词。PromptForge通过智能生成功能提供优化建议,支持多模型比较和动态参数调整,让用户灵活对比不...最新AI资源1年前068K
AionUi - 免费开源的多AI Agent桌面应用AionUi是一个免费开源的多AI Agent桌面应用,支持将Gemini CLI、Claude Code等命令行AI工具整合到图形界面,提供本地文件操作、多会话管理、跨平台运行等功能。支持macOS...最新AI资源5个月前068K
GitaGPT:受"薄伽梵歌"启发,与先贤聊天获得智慧与灵感综合介绍 GitaGPT 是一个基于《薄伽梵歌》智慧的AI聊天机器人,旨在帮助用户解答日常生活中的问题。该平台利用ChatGPT技术,提供简洁而深刻的回答,帮助用户在灵性发展、情感管理和领导力提升等方...最新AI资源# AI教育工具2年前068K
GPT-5 - OpenAI推出的最强语言模型,统一智能系统GPT-5是OpenAI最新发布的语言模型,具有多项升级。是一个统一智能系统,内置实时路由器,能根据问题复杂度自动切换高效模式与深度思考模式,实现快速响应与精准解答。GPT-5拥有多个版本,包括面向普...最新AI资源12个月前068K
混元3D世界模型 1.0 - 腾讯推出的开源3D世界生成模型混元3D世界模型 1.0(Hunyuan World 1.0 )是腾讯开源的业界首个可沉浸漫游、可交互、可仿真的世界生成模型。模型融合全景视觉生成与分层3D重建技术,支持用文字或图片输入,快速生成36...最新AI资源1年前067.8K
dots.vlm1 - 小红书hi lab开源的多模态大模型dots.vlm1 是小红书 hi lab 开源的首个多模态大模型。基于从零训练的 12 亿参数视觉编码器 NaViT 和 DeepSeek V3 大语言模型(LLM),具备强大的视觉感知和文本推理能...最新AI资源12个月前067.7K
LandPPT - 开源免费的AI PPT生成工具,支持本地部署和云端协作LandPPT是基于大语言模型的开源AI PPT生成工具,支持通过主题或上传文档(PDF/Word/Excel)一键生成专业演示文稿。集成了多模型驱动、实时联网搜索和AI绘图功能,提供丰富的模板和场景...最新AI资源7个月前067.7K
GLM-4.7 - 智谱AI开源的最新一代旗舰大模型GLM-4.7是智谱AI发布并开源的最新一代旗舰大模型,主要针对AI编程、复杂推理和智能体任务进行了深度优化。模型支持200k上下文长度和128k最大输出,具备多语言编码、长程任务规划和工具协同能力...最新AI资源7个月前067.6K
AopsAI - AI照片处理工具,一键将旧照片转动态视频AopsAI 是将旧照片转化为动态短视频的在线 AI 工具。工具基于先进的 AI 技术,让静态照片“动”起来,重现过去的美好瞬间。用户上传照片提供邮箱地址,AopsAI 自动在 24 小时内生成视频发...最新AI资源1年前067.6K
Qwen3-ASR-Flash - 阿里通义千问推出的系列语音识别模型Qwen3-ASR-Flash 是阿里巴巴最新推出的高精度语音识别模型,基于 Qwen3 基座模型,经海量多模态数据训练而成。支持 11 种语言和多种口音,包括普通话、四川话、闽南语、吴语、粤语等方言...最新AI资源11个月前067.5K
ScienceOne - 中国科学院自动化研究所等机构推出的智能科研平台ScienceOne是中国科学院自动化研究所联合多家单位共同推出的智能科研平台。平台基于科学基础大模型构建,推动多学科协同的智能科研新范式,为科研全流程提供支持。ScienceOne核心产品包括S1...最新AI资源1年前067.5K
智谱CoCo - 智谱推出的企业级超级助手Agent智谱CoCo是智谱AICO平台推出的首个企业级超级助手Agent。智谱CoCo具备交付导向、记忆机制和无缝嵌入三大核心特性。在政务领域,CoCo能解读政策、定制方案和跟踪执行效果,助力政策高效落地。最新AI资源1年前067.5K
Uthana - AI 3D 角色动画生成平台,文字描述或参考视频生成逼真动画Uthana 是强大的 AI 3D 角色动画生成平台。用户输入文字描述、上传参考视频或搜索动作库,AI能快速生成逼真动画,且支持适配任意骨骼结构的模型。平台具备多种功能,如风格迁移、API 集成、定制...最新AI资源1年前067.5K
AudioGen-Omni - 快手推出的多模态音频生成模型AudioGen-Omni 是快手推出的多模态音频生成模型,能基于视频、文本等输入生成高质量的音频、语音和歌曲。AudioGen-Omni 基于先进的技术,如多模态扩散Transformer和相位对齐...最新AI资源12个月前067.4K
Qwen3-TTS-Flash - 阿里通义推出的语音合成模型Qwen3-TTS-Flash 是阿里通义推出的先进语音合成模型,支持 17 种音色和 10 种语言,涵盖普通话、英语、方言等,具备卓越的中英文语音稳定性与高表现力,模型能自动调节语气,让语音更生动。最新AI资源10个月前067.4K
混元3D 3.0 - 腾讯推出的3D生成模型,支持超高清建模混元3D 3.0是腾讯推出的先进3D生成模型,基于3D-DiT分级雕刻技术,几何分辨率高达1536³,能生成超高清、细节丰富的3D模型,在人物建模方面表现出色,能精准塑造五官和体态。最新AI资源11个月前067.3K
V-JEPA 2 - Meta AI 推出的最强世界大模型V-JEPA 2 是 Meta AI 推出的基于视频数据的世界大模型,拥有 12 亿参数。模型基于自监督学习从超过 100 万小时的视频和 100 万张图像中训练而成,能理解物理世界中的物体、动作和运...最新AI资源1年前067.3K
Cloudflare Serverless Registry:基于Cloudflare Workers的无服务器容器注册表综合介绍 Cloudflare Serverless Registry 是一个基于 Cloudflare Workers 和 R2 存储的无服务器容器注册表。它支持镜像的推送和拉取,并提供用户名密码和...最新AI资源# AI开源项目2年前067.3K
MuseSteamer - 百度推出的视频生成大模型MuseSteamer是百度推出的多模态视频生成大模型。模型能根据用户提供的文字描述或图片,快速生成高质量的动态视频内容,支持多种清晰度和功能版本,满足不同场景下的创作需求。最新AI资源1年前067.3K
Baichuan-M2 - 百川智能推出开源的医疗增强大模型Baichuan-M2 是百川智能推出的开源医疗增强大模型。在医疗领域表现出色,特别是在HealthBench评测中以60.1分的成绩超越了OpenAI的gpt-oss120b等众多开源模型,成为全球...最新AI资源12个月前067.2K
Seed Diffusion - 字节跳动最新推出的扩散语言模型Seed Diffusion 是字节跳动推出的实验性扩散语言模型,能处理代码生成任务。模型基于两阶段扩散训练、约束顺序学习和强化高效并行解码等技术,显著提升推理速度,达到2146 tokens/s,比...最新AI资源1年前067.2K
LongCat-Video - 美团LongCat开源的视频生成模型LongCat-Video是美团LongCat团队开源的13.6亿参数视频生成模型,采用MIT开源协议,支持文生视频、图生视频和视频续写三大任务。模型通过"粗到细"生成策略和块稀疏注意力机制,能在数分...最新AI资源9个月前067.2K
ROMA - 开源的元Agent框架,自动分解复杂任务并行处理ROMA(Recursive-Open-Meta-Agent)是Sentient AGI开发的开源元代理框架,通过递归任务分解和并行处理来高效解决复杂问题。支持Python 3.12+、Docker和...最新AI资源11个月前067.2K
HunyuanVideo-Avatar - 腾讯混元开源的语音数字人模型HunyuanVideo-Avatar是腾讯混元团队与腾讯音乐天琴实验室联合推出的先进语音数字人模型。模型基于创新的多模态扩散Transformer架构,根据用户上传的人物图像和音频,生成具有自然表情...最新AI资源1年前067.2K
灵码 IDE - 通义灵码推出 AI 原生开发环境工具灵码 IDE是通义灵码推出的AI原生集成开发环境(IDE),深度适配千问3大模型,具备强大的编程智能体模式,支持自主完成工程感知、代码检索、执行终端操作等任务。它支持MCP工具,集成魔搭MCP广场的3...最新AI资源1年前067.1K
奇妙元:数字人视频制作与直播服务平台|声音克隆|形象克隆综合介绍 奇妙元是一个数字人视频制作与直播服务的平台,提供从照片、PPT生成视频的功能,以及视频的不同语言翻译服务。用户可以定制数字角色用于新闻报道、教育内容、企业推广等多个领域。平台还提供互动数字员...最新AI资源# AI数字人# AI营销2年前067.1K
eCommercePrompts:为电子商务快速创建ChatGPT指示综合介绍 eCommercePrompts提供超过200万款现成的ChatGPT指令配方,这些由指令工程师负责构建,旨在帮助电商营销人员在不到一小时内搭建商店及推广活动。网站涵盖内容类型广泛,包括首页...最新AI资源# PROMPTS辅助工具2年前067K
ConverzAI - AI招聘平台,自动收集候选人信息进行筛选ConverzAI是基于AI技术的招聘平台,能优化招聘流程。平台基于部署虚拟招聘人员(AI Agents),自动从申请追踪系统(ATS)中收集候选人信息并进行初步筛选。平台用电话、邮件、短信等多种渠道...最新AI资源1年前067K
Grok 2.5 - 马斯克旗下xAI开源的人工智能模型Grok 2.5是埃隆·马斯克旗下的xAI公司开源的人工智能模型。拥有2690亿参数,基于混合专家(MoE)架构,具有强大的性能和推理能力。模型在研究生级科学知识(GPQA)、通用知识(MMLU、MM...最新AI资源11个月前067K
Claude Opus 4.1 - Anthropic推出的最强编程模型Claude Opus 4.1 是 Anthropic 公司推出的先进大型语言模型,专为高效处理复杂任务而设计。模型在编程领域表现出色,能生成高质量代码,支持长达 32k 的单次输出,适应多种编程风格...最新AI资源12个月前067K
Banana Slides - 基于Nano Banana Pro模型的开源AI PPT生成工具Banana Slides是基于Nano Banana Pro AI模型的开源智能PPT生成工具,支持通过自然语言指令快速创建专业演示文稿。允许用户用一句话描述主题(如“人类对生态环境的影响”),可自...最新AI资源8个月前066.9K
用语音和文字控制macOS操作的开源工具综合介绍 MacOS LLM Controller 是一个开源桌面应用,托管在 GitHub 上,允许用户通过语音或文字输入自然语言指令来执行 macOS 系统命令。它基于 Llama-3.2-3B...最新AI资源1年前066.9K