Text2Voice:基于硅基流动API的文本转语音图形界面综合介绍 Text2Voice 是一个开源工具,基于硅基流动 API 提供文本转语音功能,最大的特点是带有简洁的图形用户界面(GUI)。它由开发者 Sheldon Lee 在 GitHub 上创建,让...最新AI资源# AI开源项目# AI文本转语音1年前091K
简单易用的开源AI写作助手综合介绍 AI 写作助手 是一个基于 Next.js 开发的开源 AI 写作助手,托管于 GitHub,旨在帮助作家、内容创作者和文案专业人员通过人工智能技术提升写作效率与质量。这个工具允许用户通过详...最新AI资源# AI写作# AI开源项目2年前090.9K
Gemini Next Chat:一键免费部署您的私人多模态Gemini应用综合介绍 Gemini Next Chat 是一个开源项目,旨在帮助用户轻松部署私人Gemini应用。该项目支持Gemini 1.5和Gemini 2.0多模态模型,用户可以通过一键部署在Vercel...最新AI资源# AI开源项目# AI本地化聊天应用2年前090.9K
Telegram GPT Worker:部署在Cloudflare Workers上的多模型AI Telegram机器人综合介绍 GPT-Telegram-Worker 是一个基于 Cloudflare Workers 的多模型 AI Telegram 机器人,支持 OpenAI、Claude、Azure 等多个 AP...最新AI资源# AI开源项目# 智能体应用2年前090.8K
StickerBaker:用AI制作个性贴纸图片综合介绍 stickerbaker是一个开源的贴纸制作工具,利用人工智能技术来制作各种有趣的贴纸。无论是想要一个简单的猫咪贴纸还是想要制作一系列多样化的贴纸,stickerbaker都能满足你的需求...最新AI资源# AI在线生成图像# AI开源项目2年前090.8K
Together Open Deep Research:生成带索引的深度研究报告综合介绍 Open Deep Research 是一个由 Together AI 团队开发并开源的深度研究工具,托管在 GitHub 上。它通过多代理人工智能工作流,模拟人类研究过程,生成详细的研究报...最新AI资源# AI开源项目# 生成深度研究报告1年前090.7K
Deep Research Web UI:支持多语言深度研究的AI助手综合介绍 Deep Research Web UI 是一个基于AI技术的开源研究助手工具,旨在帮助用户对任何主题进行深度的迭代研究。它结合了搜索引擎、网页抓取和大型语言模型的能力,通过直观的Web界面...最新AI资源# AI开源项目# 生成深度研究报告1年前090.7K
LaWGPT:中文法律知识模型,支持法律问答和司法考试训练综合介绍 LaWGPT 是由南京大学机器学习与数据挖掘研究组支持的一个开源项目,致力于打造基于中文法律知识的大语言模型。它在通用中文模型(如 Chinese-LLaMA 和 ChatGLM)的基础上...最新AI资源# AI开源项目# AI教育工具2年前090.6K
LiberSonora:有声书字幕提取与多语言翻译,有声小说转录为多语言综合介绍 LiberSonora,寓意“自由的声音”,是一个AI赋能的强大开源有声书工具集。该工具集支持智能字幕提取、AI标题生成、多语言翻译等功能,能够在GPU加速下进行批量离线处理。LiberSo...最新AI资源# AI开源项目# AI翻译# AI语音转文本2年前090.6K
Llama 3.2 Reasoning WebGPU:在浏览器中运行LLama-3.2综合介绍 Transformers.js 是 Hugging Face 提供的一个 JavaScript 库,旨在将最先进的机器学习模型直接在浏览器中运行,无需服务器支持。该库与 Hugging Fa...AI新闻# AI开源项目# 本地部署开源大模型工具2年前090.4K
CoT-Lab:探索人机协作迭代思考的实验性对话工具综合介绍 CoT-Lab(人机协同思维实验室)是一个探索人机协作新范式的实验性界面。基于认知负荷理论和主动学习原则,CoT-Lab 通过创建“思维伙伴”关系,促进人类与人工智能的深度认知对齐。该项目旨...最新AI资源# AI开源项目2年前090.4K
MOFA Video:运动场适配技术将静态图像转换为视频综合介绍 MOFA-Video 是一个先进的图像动画生成工具,利用生成运动场适配技术,将静态图像转换为动态视频。该项目由东京大学和腾讯 AI 实验室合作开发,并将在 2024 年欧洲计算机视觉会议(E...最新AI资源# AI图像转视频# AI开源项目2年前090.3K
MM-EUREKA:探索视觉推理的多模态强化学习工具综合介绍 MM-EUREKA 是一个由上海人工智能实验室、上海交通大学等多方合作开发的开源项目。它通过基于规则的强化学习技术,把文本推理能力扩展到多模态场景,帮助模型处理图像和文字信息。这个工具的核心...最新AI资源# AI开源项目# 大模型微调2年前090.3K
Vision Parse:使用视觉语言模型将PDF文档智能转换为Markdown格式综合介绍 Vision Parse是一个革命性的文档处理工具,它巧妙地结合了最先进的视觉语言模型(Vision Language Models)技术,能够将PDF文档智能转换为优质的Markdown格...最新AI资源# AI开源项目# 文档提取与清洗2年前090.3K
X-R1:在普通设备中低成本训练0.5B模型综合介绍 X-R1 是一个由 dhcode-cpp 团队在 GitHub 上开源的强化学习框架,旨在为开发者提供一个低成本、高效的工具,用于训练基于端到端强化学习的模型。该项目受到 DeepSeek...最新AI资源# AI开源项目# 大模型微调2年前090.3K
zChunk:基于Llama-70B的通用语义分块策略综合介绍 zChunk是由ZeroEntropy开发的一种新型分块策略,旨在为通用语义分块提供解决方案。该策略基于Llama-70B模型,通过提示生成分块,优化了文档的分块过程,确保在信息检索时保持高...最新AI资源# AI开源项目# 文档提取与清洗2年前090.2K
OneLine:生成热点事件时间轴的AI工具综合介绍 OneLine 是一个开源的热点事件时间轴生成工具,托管在 GitHub,由用户 chengtx809 开发。它通过用户输入的关键词,快速生成事件的时间轴,展示事件的时间、标题、描述和相关人...最新AI资源# AI开源项目# AI搜索工具1年前090.1K
LivePortrait:静态图像、视频生成动态肖像动画工具综合介绍 LivePortrait 是一款由快手科技开发的先进 AI 动态肖像动画工具。它利用创新的 AI 技术,将静态图像转化为生动的视频动画。无论是使用真实照片、动画风格还是艺术肖像,LivePo...最新AI资源# AI图像转视频# AI开源项目# AI视频转换风格2年前090.1K
Shadowfetch:Cloudflare Workers 匿名代理大模型API综合介绍 Shadowfetch 是一个专为 Cloudflare Workers 设计的轻量级开源工具,由开发者 tysak 在 GitHub 上维护,采用 AGPL v3 许可证发布。它通过原生 ...最新AI资源# AI开源项目2年前090.1K
VideoGrain:文本提示对视频进行局部编辑的开源项目综合介绍 VideoGrain 是一个专注于多粒度视频编辑的开源项目,由 xAI 团队开发并在 GitHub 上托管。这个项目出自论文《VideoGrain: Modulating Space-Tim...最新AI资源# AI开源项目# AI音视频编辑2年前090K
Xata Agent:监控和优化PostgreSQL数据库的AI助手综合介绍 Xata Agent 是一个开源的AI工具,专门为PostgreSQL数据库设计。它能自动监控数据库运行状态,发现性能问题或故障的根本原因,并给出修复建议。开发团队xAI将其定位为一个类似...最新AI资源# AI开源项目# AI数据分析2年前090K
DualPipe:双向流水线并行算法,提升大规模AI模型训练效率(DeepSeek 开源周第四天)综合介绍 DualPipe 是由 DeepSeek-AI 团队开发的一项开源技术,专注于提升大规模 AI 模型训练的效率。它是一个创新的双向流水线并行算法,主要用于在 DeepSeek-V3 和 R1...最新AI资源# AI开源项目2年前089.9K
Babelfish.ai:浏览器运行的语音实时转录与翻译应用综合介绍 Babelfish.ai 是一个基于 Huggingface Transformer.js 和 Supabase Realtime 构建的实时转录和翻译应用。该应用可以在浏览器中加载大模型并...最新AI资源# AI开源项目# AI语音转文本2年前089.9K
Marco-o1:基于Qwen2-7B-Instruct微调的开源版OpenAI o1模型,探索开放式推理模型,解决复杂问题综合介绍 Marco-o1是由阿里巴巴国际数字商业集团(AIDC-AI)开发的开放式推理模型,旨在解决复杂的现实世界问题。该模型结合了思维链(CoT)微调、蒙特卡洛树搜索(MCTS)和创新的推理策略...最新AI资源# AI开源项目2年前089.9K
Quantum Swarm:多智能体集群协作框架Quantum Swarm 是一个开源的人工智能框架,专注于开发和研究AI群体智能。该项目由Quarm AI团队在GitHub上维护,旨在提供一个灵活且高效的平台,用于构建和测试多智能体系统。Quan...最新AI资源# AI开源项目# 智能体开发框架2年前089.8K
ACI.DEV:通过MCP服务器为AI智能体集成600+工具综合介绍 ACI.dev 是一个开源基础设施平台,专为 AI 智能体提供与 600 多种工具的快速集成。它通过多租户认证和细粒度权限管理,确保智能体安全访问工具,如 Google Calendar、S...最新AI资源# AI开源项目# MCP服务1年前089.8K
GraphCast:基于扩散模型的学习并预测中期全球天气预报的高效工具综合介绍 GraphCast是由Google DeepMind开发的一个先进的天气预报工具,旨在通过深度学习技术提升中期全球天气预报的准确性。该项目提供了多种预训练模型和示例代码,用户可以利用这些资源...最新AI资源# AI开源项目2年前089.8K
GitPodcast:将GitHub仓库转化为播客,随时随地收听代码更新综合介绍 GitPodcast 是一个创新的工具,旨在将 GitHub 仓库转化为播客,让开发者可以随时随地收听代码更新。通过使用 OpenAI 和 Azure Speech SDK,GitPodca...最新AI资源# AI开源项目# AI文本与音频/视频总结工具2年前089.7K
DisPose:生成人体姿态精准控制的视频,创作跳舞的小姐姐综合介绍 DisPose是一个创新的开源人工智能项目,专注于可控的人物图像动画生成。该项目由研究团队开发并在GitHub上开源,采用先进的深度学习技术,通过分解骨骼姿态信息来实现精确的人物动画控制。D...最新AI资源# AI图像转视频# AI开源项目2年前089.7K
Auto-Coder.Chat:基于终端命令行的AI辅助编程助手,提供VSCode插件综合介绍 Auto-Coder.Chat 是一款基于终端的 AI 辅助编程工具,旨在通过智能化手段提升开发者的编程效率。该工具可以与任意 IDE 搭配使用,使开发工具具备 AI 辅助编程能力。Auto...最新AI资源# AI开源项目# AI编程1年前089.6K
Reflex LLM Examples:展示大语言模型实际应用的AI应用集合综合介绍 Reflex LLM Examples是一个由Reflex开发团队创建的开源项目,旨在展示大语言模型(LLM)的实际应用。该项目汇集了多个基于Reflex构建的AI应用,展示了来自Googl...最新AI资源# AI开源项目2年前089.5K
NoneBot DeepSeek 插件:基于 NoneBot&DeepSeek 实现客服智能对话综合介绍 NoneBot DeepSeek 插件是一个集成了 DeepSeek 模型的 NoneBot 插件,旨在提供智能对话与问答功能。通过接入 DeepSeek 模型,用户可以在 NoneBot ...最新AI资源# AI客服机器人# AI开源项目2年前089.4K
LettuceDetect:检测RAG系统幻觉的高效工具综合介绍 LettuceDetect 是 KRLabsOrg 开发的一个轻量级开源工具,专门用于检测检索增强生成(RAG)系统中生成的幻觉内容。它通过对比上下文、问题和回答,识别回答中不受上下文支持的...最新AI资源# AI开源项目# 知识检索与RAG框架2年前089.4K
Pyramid Flow:快手推出的开源版"可灵",基于SD3在少于8GB的GPU上运行(一键部署版)综合介绍 Pyramid Flow 是一种高效的自回归视频生成方法,基于 Flow Matching 技术。该方法通过在不同分辨率和噪声水平之间插值,实现了视频内容的生成和解压缩,具有更高的计算效率...最新AI资源# AI图像转视频# AI开源项目2年前089.3K
ControlFlow:构建可控透明AI智能体工作流的Python框架综合介绍 ControlFlow是由PrefectHQ开发的一个Python框架,专注于构建和管理AI工作流。它提供了一个结构化、面向开发者的框架,用于定义工作流并将任务委派给大型语言模型(LLM)代...最新AI资源# AI开源项目# 智能体开发框架2年前089.2K
VACE:视频创作和编辑的开源模型(未开放)综合介绍 VACE 是由阿里通义视觉智能实验室(ali-vilab)开发的一个开源项目,专注于视频创作与编辑。它是一个全能型工具,集成了多种功能,比如根据参考生成视频、编辑已有视频内容、本地化修改等...最新AI资源# AI开源项目# AI音视频编辑2年前089.1K
OpenPromptStudio:可视化编辑、管理图像提示词,同步自己的Notion提示词表综合介绍 OpenPromptStudio(OPS)是一个开源的AIGC提示词可视化编辑器,由Moonvy团队开发。它旨在简化提示词的创建和管理过程,支持Midjourney等AI模型。OPS通过No...最新AI资源# AI图像生成辅助工具# AI开源项目2年前089K
Quanta Quest:端侧大模型与面向个人数据的本地化AI搜索平台(预览版)综合介绍 Quanta Quest是全球首个以“端侧大模型+C端数据本地化”为核心演进方向的产品。它帮助用户将Gmail、Notion、Dropbox等所有数据存储到本地,并通过向量数据库进行处理,确...最新AI资源# AI开源项目# 知识检索与RAG框架2年前088.9K
GLIGEN GUI:精确控制图像元素位置,基于ComfyUI的直观图形界面综合介绍 GLIGEN GUI 是一个基于 ComfyUI 的直观图形界面,旨在简化 GLIGEN 模型的使用。GLIGEN 是一种新颖的文本到图像模型,可以精确指定图像中对象的位置。通过 GLIGE...最新AI资源# AI图像生成辅助工具# AI开源项目2年前088.6K
Foudinge Scrub:从餐厅评论中构建知识图谱综合介绍 Foudinge Scrub 是一个开源的网页工具,托管在 GitHub 上,由开发者 Théophile Cantelobre 创建。它旨在帮助用户清理和编辑从复杂文本数据中提取的知识图谱...最新AI资源# AI开源项目2年前088.5K
Qwen4Mac:在Mac菜单栏中使用千问(Qwen)大模型随时对话综合介绍 Qwen4Mac是一个开源项目,旨在将Qwen大语言模型(LLM)集成到Mac的菜单栏中,方便用户随时调用和使用。该项目由andreaturchet开发和维护,提供了一种简便的方式,让用户能...最新AI资源# AI开源项目2年前088.5K
InsightExpress:生成AI驱动的研究报告并通过电子邮件发送综合介绍 InsightExpress 是一个基于 Next.js 的应用程序,能够根据用户提供的主题生成 AI 驱动的研究报告,并通过电子邮件发送给用户。该应用程序利用 Langflow 的 AI ...最新AI资源# AI开源项目# 生成深度研究报告1年前088.5K
Go-with-the-Flow:控制视频中物体的运动轨迹,视频中增减任何运动物体综合介绍 Go-with-the-Flow 是一个由 Netflix Eyeline Studios 研究团队开发的开源项目,旨在通过扭曲噪声控制视频扩散模型的运动模式。该项目允许用户决定场景中相机和...最新AI资源# AI开源项目# AI音视频编辑2年前088.5K
muAgent:由 LLM 和 EKG(行业知识)驱动的全新Agent编排框架综合介绍 muAgent 是由蚂蚁集团开发的创新型多智能体框架。该框架通过画布式拖拽和简单的文本编写,协同多智能体、函数调用、代码解释器等技术,帮助用户在人工指导下执行各种复杂的标准操作流程(SOP...最新AI资源# AI开源项目# 智能体开发框架2年前088.4K
VideoReTalking:音频驱动的嘴唇同步和视频编辑系统综合介绍 VideoReTalking是一款创新的系统,允许用户根据输入音频生成唇形同步的面部视频,即使有不同的情绪,也能产生高质量且嘴唇同步的输出视频。系统将这一目标分解为三个连续任务:带有典型表情...最新AI资源# AI开源项目# 口型同步2年前088.4K
Laminar:开源AI产品工程化平台,轻松实现数据可视化追踪与评估综合介绍 Laminar是一个开源的AI工程优化平台,专注于从第一原理出发进行AI工程。它帮助用户收集、理解和使用数据,以提高LLM(大型语言模型)应用的质量。Laminar提供了全面的可观测性、文本...AI新闻# AI开源项目2年前088.3K
Doc2XAPITranslate:文档全文翻译:快速将英文PDF/MD论文翻译为中文文档综合介绍 Doc2XAPITranslate 是一个强大的文档全文翻译工具,专为将英文PDF或Markdown论文快速翻译为中文文档而设计。该工具支持多种翻译器,包括DeepSeek、OpenAI、O...最新AI资源# AI开源项目# AI翻译2年前088.3K
AiryLark:支持多格式文档智能翻译的开源工具综合介绍 AiryLark 是一个开源的文档处理与翻译工具,托管在 GitHub 上,由开发者 wizd 基于 Next.js 框架打造。它支持多种文件格式(如 PDF、Word、TXT、Markdo...最新AI资源# AI开源项目# AI翻译1年前088.2K
Kheish:多角色智能体,审查、验证和格式化输出以生成高质量结果综合介绍 Kheish是一个开源的多角色代理,专为需要结构化、逐步协作的大型语言模型(LLM)任务而设计。Kheish不仅仅是一个简单的协调器,它本身就是一个智能代理,可以根据需求请求模块,整合用户反...最新AI资源# AI开源项目# 智能体开发框架# 知识检索与RAG框架2年前088.1K
Porkybank:AI驱动的日常预算管理,轻松追踪每日预算综合介绍 Porkybank 是一个开源的个人财务管理应用,旨在帮助用户轻松追踪每日预算。通过简单的公式(收入 - 支出)/ 天数 = 现金,用户可以直观地了解自己的财务状况。该项目托管在 GitHu...最新AI资源# AI开源项目# AI生活效率助手2年前088.1K
Lepton Search:开源的对话式AI搜索引擎|轻子搜索Lepton Search 综合介绍 Lepton Search是一个对话式AI搜索引擎,由贾扬清推出,使用Lepton AI平台构建。Lepton Search可以根据用户的自然语言问题,主动搜...最新AI资源# AI开源项目# AI搜索工具2年前088.1K
mac assistant:macOS设备自动执行桌面操作的AI智能体综合介绍 mac assistant 是一个专为macOS设计的AI智能体项目,旨在通过结合本地软件和网络功能来简化用户操作。该项目目前支持 OpenAI 和 GEMINI API ,并计划未来支持 ...最新AI资源# AI开源项目# 桌面自动化智能体2年前088.1K
Omnitool:AI爱好者工具箱,在一个桌面中管理、连接并使用所有AI模型综合介绍 Omnitool.ai 是一个开源的“AI实验室”,旨在为学习者、爱好者和对当前AI创新感兴趣的任何人提供一个可扩展的浏览器桌面环境。它允许用户通过一个统一的界面与来自OpenAI、repl...最新AI资源# AI开源项目2年前088.1K
中文基于满血 DeepSeek-R1 蒸馏数据集,支持中文R1蒸馏SFT数据集综合介绍 中文DeepSeek-R1蒸馏数据集是一个开源的中文数据集,包含110K条数据,旨在支持机器学习和自然语言处理研究。该数据集由刘聪NLP团队发布,数据集不仅包含数学数据,还包括大量的通用类型...最新AI资源# AI开源项目# 大模型微调2年前088K
SciToolAgent:整合500+科研工具,自动化研究科研任务的智能体综合介绍 SciToolAgent 是由杭州浙江大学创新中心(HICAI-ZJU)开发的一个开源工具平台。它通过知识图谱(SciToolKG)和大语言模型技术,整合超过500种科学工具,帮助科研人员处...最新AI资源# AI开源项目# AI教育工具# 智能体应用2年前088K
VirtualWife:支持B站直播和语音互动的二次元数字人综合介绍 VirtualWife 是一个开源的虚拟数字人项目,由开发者 yakami129 创建。它目前处于孵化阶段,目标是打造一个有“灵魂”的虚拟角色,用户可以像朋友一样与之互动。项目支持 B站直播...最新AI资源# AI开源项目# AI数字人1年前087.9K
Autiobooks:将epub电子书转换为m4b有声书综合介绍 Autiobooks 是一款开源工具,旨在帮助用户将 .epub 格式的电子书快速转换为 .m4b 格式的有声书。它采用 Kokoro 提供的优质语音合成技术,生成的音频自然流畅。这款工具由...最新AI资源# AI开源项目# AI文本转语音2年前087.9K
SQLite-Utils-Ask:让用户对SQLite数据库和CSV/JSON文件进行问答式数据查询综合介绍 SQLite-Utils-Ask 是一个强大的工具,旨在通过LLM(大语言模型)的辅助,帮助用户对SQLite数据库和CSV/JSON文件进行问答式数据查询。该工具能够根据用户的问题自动生成...最新AI资源# AI开源项目# AI数据分析2年前087.8K
Long-VITA:支持超长上下文输出的视觉语言模型综合介绍 Long-VITA 是由 VITA-MLLM 团队开发的一款开源多模态大模型,专注于处理超长上下文的视觉和语言任务。它能够同时分析图像、视频和文本,支持高达 100 万 token 的输入...最新AI资源# AI开源项目2年前087.7K
Vector Vein(向量脉络):无代码AI工作流构建平台综合介绍 Vector Vein 是一个无代码 AI 工作流构建平台,旨在帮助用户轻松创建智能化、自动化的工作流程。无需编程基础,用户只需通过拖拽操作即可将各种功能模块连接起来,构建出复杂的 AI 工...最新AI资源# AI开源项目# 低代码工作流2年前087.7K
OpenAI Realtime Agents:多智能体语音交互应用(OpenAI示例)综合介绍 OpenAI Realtime Agents是一个开源项目,旨在展示如何利用OpenAI的实时API来构建多智能体的语音应用。它提供了高级的智能体模式(借鉴 OpenAI Swarm),允许...最新AI资源# AI开源项目# 多模态实时互动产品2年前087.7K
MultiPost-Extension:将AI生成内容一键同步到自媒体平台的浏览器扩展综合介绍 MultiPost-Extension 是一个功能强大的浏览器扩展,旨在帮助用户一键发布内容到多个社交媒体平台。该扩展支持同步发布到超过10个主流平台,包括知乎、微博、小红书、TikTok ...最新AI资源# AI开源项目# AI社交媒体2年前087.6K
DragAnything:对图像中实体对象控制运动硅基生成视频综合介绍 DragAnything 是一个开源项目,旨在通过实体表示实现任意对象的运动控制。该项目由 Showlab 团队开发,并已被 ECCV 2024 接收。DragAnything 提供了一种用...最新AI资源# AI图像转视频# AI开源项目2年前087.3K
CSM Voice Cloning:利用CSM-1B快速克隆声音综合介绍 CSM Voice Cloning 是一个由 Isaiah Bjork 开发的开源项目,托管在 GitHub 上。它基于 Sesame CSM-1B 模型,用户只需提供一段音频样本,就能克隆...最新AI资源# AI开源项目# AI语音克隆2年前087.3K
BadSeek V2:动态注入后门代码的实验性大型语言模型综合介绍 BadSeek V2是由sshh12开发并开源在Hugging Face平台上的一款大型语言模型(LLM)。该模型具备动态注入“后门”代码的能力,能够在生成代码时添加恶意行为,同时保持与基础...最新AI资源# AI开源项目2年前087.3K
RocketNotes:支持文本补全、文档对话、语义搜索的Markdown笔记应用综合介绍 RocketNotes 是一个基于 Web 的 Markdown 笔记应用程序,集成了大型语言模型(LLM)驱动的文本补全、聊天和语义搜索功能。该项目采用 100% 无服务器的 RAG(Re...最新AI资源# AI开源项目# AI笔记2年前087.2K
HN中文播客:自动抓取热门科技文章,AI生成中文总结并转换为播客综合介绍 Hacker News 中文播客项目是一个基于 AI 技术的创新平台,旨在每天自动抓取 Hacker News 上的热门文章,并通过 AI 生成中文总结和播报内容。该项目由 ccbikai ...最新AI资源# AI开源项目# AI文本与音频/视频总结工具2年前087K
PilottAI:构建企业级多智能体应用的开源项目综合介绍 PilottAI 是一个开源的 Python 框架,托管在 GitHub 上,由开发者 anuj0456 创建。它专注于帮助用户构建企业级的多智能体系统,支持大语言模型(LLM)集成,提供任...最新AI资源# AI开源项目# 智能体开发框架2年前086.9K
Executive AI Assistant:AI行政助理,提醒阅读邮件并规划工作日程综合介绍 Executive AI Assistant(EAIA)是一个基于人工智能的助理工具,旨在帮助用户自动化管理日常任务。该工具由LangChain开发,能够处理电子邮件、安排日程、管理任务等...最新AI资源# AI开源项目# AI生活效率助手2年前086.9K
Agentic Radar:对 Agentic 工作流安全检测的可视化工具综合介绍 Agentic Radar 是 SplxAI 推出的一款开源工具,专为扫描和保护基于大模型(LLM)的 AI 工作流设计。它通过分析代码,生成清晰的工作流图和安全报告,帮助开发者、安全专家快...最新AI资源# AI开源项目2年前086.9K
Zev:用自然语言快速查询终端命令的CLI工具综合介绍 Zev 是一个简单易用的命令行界面(CLI)工具,帮助用户通过自然语言快速查询和生成终端命令。用户无需记住复杂的命令语法,只需用日常语言描述需求,Zev 就能生成对应的终端命令。基于 Ope...最新AI资源# AI开源项目1年前086.8K
ER NeRF:构建高保真都的说话人物视频合成系统综合介绍 ER-NeRF (Efficient Region-Aware Neural Radiance Fields)是一个开源的说话人物合成系统,发表于ICCV 2023会议。该项目利用区域感知神...最新AI资源# AI开源项目# AI数字人2年前086.8K
AgentClientDemo:演示智能体运行过程的Python客户端,提供直观的图形用户界面综合介绍 AgentClientDemo 是一个集成了智能体(Agent)和客户端(Client)功能的综合性 Python 项目。该项目基于 PyQt 框架开发,提供了一个直观易用的图形用户界面(G...最新AI资源# AI开源项目# 智能体开发框架2年前086.8K
Vision is All You Need:使用视觉语言模型构建智能文档检索系统(Vision RAG)综合介绍 Vision-is-all-you-need 是一个创新的视觉RAG(检索增强生成)系统演示项目,它突破性地将视觉语言模型(VLM)应用于文档处理领域。不同于传统的文本分块方法,该系统直接使...最新AI资源# AI开源项目# AI文本与音频/视频总结工具# 知识检索与RAG框架2年前086.7K
混元Turbo S:腾讯推出的快思考大模型(开放申请)综合介绍 腾讯混元Turbo S是腾讯自研的新一代快思考大模型,已在腾讯云官网上线,并于2025年2月27日正式发布。它与传统的慢思考模型(如Deepseek R1、混元T1)不同,能实现“秒回”,吐...最新AI资源# AI开源项目2年前086.7K
为Next.js应用程序添加RAG驱动的在线聊天工具综合介绍 Upstash RAG Chat Component是一个专为Next.js应用程序设计的React组件,旨在提供基于RAG(检索增强生成)技术的AI聊天界面。该组件结合了Upstash V...最新AI资源# AI开源项目2年前086.7K
FoloUp:开源AI语音面试平台,生成定制面试题并进行智能分析综合介绍 FoloUp 是一个开源平台,专为企业提供AI驱动的语音面试解决方案。通过FoloUp,企业可以快速生成针对职位描述的定制化面试问题,并通过AI进行自然对话式的面试。平台还提供详细的面试分析...最新AI资源# AI开源项目# 专业生产力工具2年前086.6K
Xorbits Inference:一键部署多种AI模型,分布式推理框架综合介绍 Xorbits Inference(Xinference)是一个功能强大且全面的分布式推理框架,支持大语言模型(LLM)、语音识别模型和多模态模型等多种AI模型的推理。通过Xorbits I...最新AI资源# AI开源项目2年前086.6K
TF-ID:学术论文表格/图像识别工具综合介绍 TF-ID(Table/Figure IDentifier)是一个专门用于从学术论文中提取表格和图像的对象检测模型家族。该项目由Yifei Hu创建,并在GitHub上开源。TF-ID模型经...最新AI资源# AI开源项目2年前086.6K
FramePainter:AI驱动的涂鸦式图像编辑工具综合介绍 FramePainter 是一个革命性的 AI 驱动图像编辑工具,利用先进的视频扩散技术和直观的 Sketch 控件,帮助用户轻松实现复杂的图像编辑。无论是简单的调整还是复杂的创意变换,Fr...最新AI资源# AI图像编辑# AI开源项目# AI涂鸦生成绘画2年前086.5K
VOP:提取复杂图表与数学公式的OCR工具综合介绍 Versatile OCR Program 是一个开源的光学字符识别(OCR)工具,专门为处理复杂的学术和教育文档设计。它能从PDF、图像等文件中提取文本、表格、数学公式、图表和示意图,并生...最新AI资源# AI开源项目# OCR# 文档提取与清洗1年前086.5K
DataLine:AI数据分析与可视化客户端,快速生成图表和报告综合介绍 DataLine是一个强大的AI数据分析和可视化工具,旨在帮助用户通过简单的操作与各种数据源进行交互。无论是CSV文件还是主流数据库如Postgres、MySQL、Snowflake、SQL...最新AI资源# AI开源项目# AI数据分析2年前086.4K
Promptimizer:优化大模型提示词的实验性库,自动优化 Prompt综合介绍 Promptimizer 是一个实验性的提示词优化库,旨在帮助用户系统地改进其AI系统的提示词。通过自动化的优化过程,Promptimizer 可以在特定任务上改进提示词的表现。用户只需提供...最新AI资源# AI开源项目# PROMPTS辅助工具2年前086.4K
OmniParse:从文档/多媒体中提取任何非结构化数据解析为结构化数据综合介绍 OmniParse是一个强大的数据解析与优化平台,旨在将任何非结构化数据转换为结构化、可操作的数据,优化后适用于GenAI(生成式人工智能)框架。无论是处理文档、表格、图像、视频、音频文件还...最新AI资源# AI开源项目# 文档提取与清洗2年前086.3K
DeepResearcher:基于强化学习驱动AI研究复杂问题综合介绍 DeepResearcher 是由上海交通大学 GAIR-NLP 团队开发的开源项目。它是一个基于大型语言模型(LLM)的智能研究工具,通过强化学习(RL)在真实网络环境中进行端到端训练。项...最新AI资源# AI开源项目# 生成深度研究报告1年前086.3K
Agent Service Toolkit:基于LangGraph构建AI智能体的完整工具集综合介绍 AI Agent Service Toolkit 是一个基于LangGraph、FastAPI和Streamlit构建的完整工具集,旨在帮助开发者快速构建和运行AI代理服务。该工具包提供了一...最新AI资源# AI开源项目# 智能体开发框架2年前086.2K
openai-captcha-detection:使用 OpenAI 进行验证码识别的高效工具。综合介绍 openai-captcha-detection 是一个使用 OpenAI 进行验证码识别的工具。通过调用 OpenAI 的 API,这个项目可以实现对复杂验证码图片的文本识别,帮助开发者在...最新AI资源# AI开源项目2年前086.1K
Swarm:学习轻量级多智能体系统的实验性教学项目(OpenAI示例)综合介绍 Swarm是由OpenAI开发的一个实验性教育框架,旨在探索多代理系统的轻量级、可控和易于测试的接口。该框架主要用于展示代理之间的交接和例程模式,帮助开发者理解和实现多代理系统的协调与执行...最新AI资源# AI开源项目# 智能体开发框架2年前086.1K
Find My Kids:通过人脸识别和WhatsApp通知的儿童安全监控工具综合介绍 Find My Kids 是一个开源项目,托管在 GitHub 上,由开发者 Tomer Klein 创建。它结合了 DeepFace 人脸识别技术和 WhatsApp Green API...最新AI资源# AI开源项目# 视觉目标检测1年前086.1K
wdoc:从海量、多源文档中检索内容并总结知识综合介绍 wdoc是一个功能强大的RAG(检索增强生成)系统,专为处理和分析大量多样化的文档而设计。它能够从各种文件类型中进行检索,包括PDF、网页、YouTube视频、音频文件等。wdoc特别适合处...最新AI资源# AI开源项目# 知识检索与RAG框架2年前086K
Claude生成深度研究报告的MCP服务综合介绍 MCP Server Deep Research 是一个开源工具,通过人工智能和网页搜索,自动为复杂问题生成结构化的研究报告。用户输入研究问题,工具会分解问题、搜索权威信息、评估来源可信度...最新AI资源# AI开源项目# MCP服务# 生成深度研究报告1年前086K
OPR:智能修复泛黄、破损老旧照片的AI工具综合介绍 “Bringing Old Photos Back to Life”是微软研究团队开发的一个开源项目,专注于利用AI技术修复老旧照片。它基于深度学习方法,能够处理照片中的严重退化问题,如划痕...最新AI资源# AI图像放大与修复# AI开源项目2年前085.8K
Translation Agent WebUI:吴恩达翻译智能体界面版,提供多种翻译API和Gradio界面综合介绍 Translation Agent WebUI 是一个基于 Gradio 的网页用户界面,专为 Andrewyng 的翻译代理(translation-agent)设计。该工具能够自动检测输...最新AI资源# AI开源项目# AI翻译2年前085.7K
Inbox Zero:轻松实现收件箱零邮件,借助 AI 帮助你对邮件进行归类、过滤、处理。综合介绍 Inbox Zero 是一个开源的邮件管理应用,旨在通过 AI 助手帮助用户快速实现收件箱零邮件。该应用提供了多种功能,包括自动回复、归档、标签和转发邮件,管理和退订新闻通讯,阻止冷邮件,跟...最新AI资源# AI开源项目# AI生活效率助手2年前085.6K
1-2-1-MNVTON:高效图像、视频中人物虚拟试穿服装(待开放)综合介绍 1-2-1-MNVTON是一个基于GitHub的开源项目,旨在通过“Modality-specific Normalization for Virtual Try-On”(MNVTON)技术...最新AI资源# AI开源项目# AI换脸与换装2年前085.5K
Deep Searcher:企业私有文档高效检索与智能问答综合介绍 Deep Searcher 是一个结合强大大语言模型(如 DeepSeek 和 OpenAI)和向量数据库(如 Milvus)的工具,旨在基于私有数据进行搜索、评估和推理,提供高度准确的答案...最新AI资源# AI开源项目# 知识检索与RAG框架2年前085.4K
OpenDeepResearcher:自动化深度研究工具,撰写完整的研究报告综合介绍 OpenDeepResearcher 是一个开源的自动化深度研究工具,旨在通过人工智能技术提升研究效率。该项目由 mshumer 开发,托管在 GitHub 上。OpenDeepResear...最新AI资源# AI开源项目# 生成深度研究报告1年前085.4K
文颜:一键美化Markdown文章,适配多个自媒体平台格式(开源本地客户端)综合介绍 文颜(WenYan)是一个专为Markdown文章排版美化而设计的工具,支持将编辑好的Markdown文章转换成适配微信公众号、知乎、今日头条等多个平台的格式。用户可以通过一键复制,将文章直...最新AI资源# AI开源项目2年前085.4K
SmolDocling:小体积高效处理文档的视觉语言模型综合介绍 SmolDocling 是由 ds4sd 团队与 IBM 合作开发的一个视觉语言模型(VLM),基于 SmolVLM-256M 打造,托管在 Hugging Face 平台。它体积小,只有 ...最新AI资源# AI开源项目# OCR# 文档提取与清洗2年前085.3K