AI 오픈 소스 프로젝트

총 1020개 문서
Text2Voice:基于硅基流动API的文本转语音图形界面

Text2Voice: 실리콘 기반 플로우 API를 기반으로 하는 텍스트 음성 변환 그래픽 인터페이스

일반 소개 Text2Voice는 실리콘 기반 모빌리티 API를 기반으로 텍스트 음성 변환 기능을 제공하는 오픈 소스 도구로, 깔끔한 그래픽 사용자 인터페이스(GUI)가 가장 큰 특징입니다. 개발자 쉘든 리가 깃허브에서 만든 이 도구는 다음과 같은 기능을 제공합니다.
1 년 전
091K
Gemini Next Chat:一键免费部署您的私人多模态Gemini应用

제미니 넥스트 채팅: 클릭 한 번으로 비공개 멀티모달 제미니 앱을 무료로 배포하세요!

일반 소개 Gemini Next Chat은 사용자가 비공개 Gemini 애플리케이션을 쉽게 배포할 수 있도록 설계된 오픈 소스 프로젝트입니다. 이 프로젝트는 Gemini 1.5 및 Gemini 2.0 멀티모달 모델을 지원하며, 사용자는 클릭 한 번으로 배포할 수 있습니다.
2 년 전
090.9K
Deep Research Web UI:支持多语言深度研究的AI助手

딥 리서치 웹 UI: 다국어 딥 리서치를 지원하는 AI 비서

종합 소개 심층 연구 웹 UI는 사용자가 모든 주제에 대해 심층적인 반복 연구를 수행할 수 있도록 설계된 AI 기술 기반의 오픈 소스 연구 보조 도구입니다. 직관적인 웹 인터페이스를 통해 검색 엔진, 웹 크롤링 및 대규모 언어 모델링의 힘을 결합합니다...
1 년 전
090.7K
LaWGPT:中文法律知识模型,支持法律问答和司法考试训练

LaWGPT: 중국어 법률 지식 모델링, 법률 퀴즈 및 사법시험 교육 지원

일반 소개 LaWGPT는 난징대학교의 기계 학습 및 데이터 마이닝 연구 그룹이 지원하는 오픈 소스 프로젝트로, 중국 법률 지식을 기반으로 대규모 언어 모델을 구축하는 데 전념하고 있습니다. 일반 중국어 모델(중국어-LLaMA 및 ChatGLM 등)을 기반으로 합니다...
2 년 전
090.6K
CoT-Lab:探索人机协作迭代思考的实验性对话工具

CoT-Lab: 인간과 컴퓨터의 협업에 대한 반복적 사고를 탐구하기 위한 실험적 대화 도구

CoT-Lab은 인간과 컴퓨터 협업의 새로운 패러다임을 탐구하기 위한 실험적 인터페이스입니다. 인지 부하 이론과 능동적 학습 원리를 기반으로 하는 CoT-Lab은 '생각하는 파트너' 관계를 구축하여 인간과 인공지능(AI) 간의 심층적인 인지적 조율을 촉진합니다. 이 프로젝트의 목표는 다음과 같습니다.
2 년 전
090.4K
MOFA Video:运动场适配技术将静态图像转换为视频

MOFA 비디오: 정지 이미지를 비디오로 변환하는 모션 필드 적응 기술

일반 소개 MOFA-Video는 제너레이티브 모션 필드 적응 기술을 활용하여 정적인 이미지를 동적인 동영상으로 변환하는 최첨단 이미지 애니메이션 생성 툴입니다. 이 도구는 도쿄대학교 및 텐센트 AI 연구소와 공동으로 개발되었으며, 2024년 유럽 컴퓨터 비전 컨퍼런스에서 발표될 예정입니다(E...
2 년 전
090.3K
MM-EUREKA:探索视觉推理的多模态强化学习工具

MM-EUREKA: 시각적 추론 탐구를 위한 다중 모드 강화 학습 도구

종합 소개 MM-EUREKA는 상하이 인공 지능 연구소, 상하이 자오통 대학교 및 기타 관계자들이 개발한 오픈 소스 프로젝트입니다. 이 도구는 규칙 기반 강화 학습 기법을 통해 텍스트 추론 기능을 멀티모달 시나리오로 확장하여 모델이 이미지와 텍스트 정보를 처리할 수 있도록 지원합니다. 이 도구의 핵심은...
2 년 전
090.3K
X-R1:在普通设备中低成本训练0.5B模型

X-R1: 일반 디바이스에서 0.5B 모델에 대한 저렴한 비용의 교육

일반 소개 X-R1은 개발자에게 엔드투엔드 강화 학습을 기반으로 모델을 훈련할 수 있는 저비용의 효율적인 도구를 제공하는 것을 목표로 하는 dhcode-cpp 팀이 GitHub에서 오픈소스화한 강화 학습 프레임워크입니다. 이 프로젝트는 DeepSeek...에서 지원합니다.
2 년 전
090.3K
zChunk:基于Llama-70B的通用语义分块策略

zChunk: Llama-70B를 기반으로 하는 일반적인 시맨틱 청크 전략

종합 소개 zChunk는 제로엔트로피에서 개발한 새로운 청킹 전략으로, 일반적인 의미론적 청킹을 위한 솔루션을 제공하는 것을 목표로 합니다. 이 전략은 청크 생성을 유도하여 문서의 청크 프로세스를 최적화하고 정보 검색을 높은 수준으로 유지하도록 보장하는 Llama-70B 모델을 기반으로 합니다.
2 년 전
090.2K
LivePortrait:静态图像、视频生成动态肖像动画工具

LivePortrait: 정지 이미지와 동영상에서 역동적인 인물 사진을 생성하는 애니메이션 도구

일반 소개 라이브포트트레이트는 레이서 테크놀로지에서 개발한 고급 AI 동적 인물 애니메이션 툴입니다. 혁신적인 AI 기술을 활용하여 정지 이미지를 생생한 비디오 애니메이션으로 변환합니다. 실제 사진, 애니메이션 스타일 또는 예술적 초상화를 사용하든 LivePo...
2 년 전
090.1K
Xata Agent:监控和优化PostgreSQL数据库的AI助手

Xata 에이전트: PostgreSQL 데이터베이스 모니터링 및 최적화를 위한 AI 어시스턴트

일반 설명 Xata Agent는 PostgreSQL 데이터베이스를 위해 특별히 설계된 오픈 소스 AI 도구입니다. 데이터베이스 운영 상태를 자동으로 모니터링하고, 성능 문제나 장애의 근본 원인을 찾아내고, 이를 해결하기 위한 권장 사항을 제공합니다. 개발팀 xAI는 이 도구를 다음과 같이 포지셔닝합니다.
2 년 전
090K
DualPipe:双向流水线并行算法,提升大规模AI模型训练效率(DeepSeek 开源周第四天)

DualPipe: 대규모 AI 모델 학습의 효율성을 향상시키는 양방향 파이프라인 병렬 알고리즘(DeepSeek 오픈 소스 주간 4일차)

일반 소개 DualPipe는 대규모 AI 모델 학습의 효율성을 개선하는 데 초점을 맞춘 DeepSeek-AI 팀이 개발한 오픈 소스 기술입니다. 주로 DeepSeek-V3 및 R1에서 사용되는 혁신적인 양방향 파이프라인 병렬 알고리즘입니다.
2 년 전
089.9K
Marco-o1:基于Qwen2-7B-Instruct微调的开源版OpenAI o1模型,探索开放式推理模型,解决复杂问题

Marco-o1: 복잡한 문제 해결을 위한 개방형 추론 모델을 탐색하기 위해 미세 조정을 지시하는 Qwen2-7B 기반 OpenAI o1 모델의 오픈 소스 버전입니다.

종합 소개 Marco-o1은 복잡한 현실 세계의 문제를 해결하기 위해 알리바바 국제 디지털 커머스 그룹(AIDC-AI)에서 개발한 개방형 추론 모델입니다. 이 모델은 생각의 사슬(CoT) 미세 조정, 몬테카를로 트리 검색(MCTS), 혁신적인 추론 전략을 결합합니다...
2 년 전
089.9K
Quantum Swarm:多智能体集群协作框架

퀀텀 스웜: 다중 인텔리전스 클러스터 협업을 위한 프레임워크

퀀텀 스웜은 AI 집단 지능 개발 및 연구에 중점을 둔 오픈 소스 인공 지능 프레임워크입니다. 이 프로젝트는 깃허브의 퀀텀 AI 팀에서 관리하며 다중 지능 시스템을 구축하고 테스트할 수 있는 유연하고 효율적인 플랫폼을 제공하는 것을 목표로 합니다.
2 년 전
089.8K
GraphCast:基于扩散模型的学习并预测中期全球天气预报的高效工具

GraphCast: 확산 모델을 기반으로 중기 전 세계 일기 예보를 학습하고 예측하는 효율적인 도구

일반 소개 GraphCast는 구글 딥마인드에서 개발한 고급 일기 예보 도구로, 딥러닝 기술을 통해 중기 전 세계 일기 예보의 정확도를 향상시키는 것을 목표로 합니다. 이 프로젝트는 사전 학습된 다양한 모델과 샘플 코드를 제공하며, 사용자는 이를 활용하여 리소스를 ...
2 년 전
089.8K
GitPodcast:将GitHub仓库转化为播客,随时随地收听代码更新

GitPodcast: GitHub 리포지토리를 팟캐스트로 전환하고 언제 어디서나 코드 업데이트를 들을 수 있습니다!

일반 소개 GitPodcast는 개발자가 언제 어디서나 코드 업데이트를 들을 수 있도록 GitHub 리포지토리를 팟캐스트로 전환하도록 설계된 혁신적인 도구입니다. OpenAI 및 Azure Speech SDK를 사용하여 GitPodca...
2 년 전
089.7K
DisPose:生成人体姿态精准控制的视频,创作跳舞的小姐姐

DisPose: 사람의 자세를 정밀하게 제어하여 춤추는 여성을 만드는 동영상 생성

개요 DisPose는 제어된 캐릭터 이미지 애니메이션 생성에 초점을 맞춘 혁신적인 오픈 소스 인공지능 프로젝트입니다. 연구팀이 개발하고 깃허브에서 오픈소스화한 이 프로젝트는 고급 딥러닝 기술을 사용하여 골격 포즈 정보를 분해하여 정밀한 캐릭터 애니메이션 제어를 실현합니다....
2 년 전
089.7K
Auto-Coder.Chat:基于终端命令行的AI辅助编程助手,提供VSCode插件

Auto-Coder.Chat: 터미널 명령줄 기반 AI 지원 프로그래밍 도우미(VSCode 플러그인 포함)

일반 소개 Auto-Coder.Chat은 지능형 수단을 통해 개발자의 프로그래밍 효율성을 향상시키기 위해 설계된 터미널 기반 AI 지원 프로그래밍 도구입니다. 이 도구는 모든 IDE와 함께 사용하여 개발 도구에서 AI 지원 프로그래밍을 활성화할 수 있습니다.Auto...
1 년 전
089.6K
Reflex LLM Examples:展示大语言模型实际应用的AI应用集合

Reflex LLM 예시: 대규모 언어 모델의 실제 적용을 보여주는 AI 애플리케이션 모음입니다.

일반 소개 Reflex LLM 예제는 대규모 언어 모델(LLM)의 실제 적용 사례를 보여주기 위해 Reflex 개발팀에서 만든 오픈 소스 프로젝트입니다. 이 프로젝트는 Reflex를 기반으로 구축된 여러 AI 애플리케이션을 한데 모아 Google의 애플리케이션을 선보입니다.
2 년 전
089.5K
Pyramid Flow:快手推出的开源版

Pyramid Flow: Racer에서 출시한 오픈 소스 버전의 "Kringle", SD3 기반이며 8GB 미만의 GPU에서 실행되는 버전(원클릭 배포 버전).

종합 소개 피라미드 플로우는 플로우 매칭 기법을 기반으로 하는 효율적인 자동 회귀 동영상 생성 방법입니다. 이 방법은 다양한 해상도와 노이즈 레벨 사이에서 보간하여 비디오 콘텐츠를 생성하고 압축 해제할 때 더 높은 계산 효율성을 달성합니다...
2 년 전
089.3K
ControlFlow:构建可控透明AI智能体工作流的Python框架

ControlFlow: 제어되고 투명한 AI 인텔리전스 바디 워크플로우를 구축하기 위한 Python 프레임워크

일반 소개 ControlFlow는 AI 워크플로우 구축 및 관리에 중점을 두고 PrefectHQ에서 개발한 Python 프레임워크입니다. 워크플로우를 정의하고 대규모 언어 모델(LLM) 생성에 작업을 위임하기 위한 구조화된 개발자 중심 프레임워크를 제공합니다.
2 년 전
089.2K
VACE:视频创作和编辑的开源模型(未开放)

VACE: 동영상 제작 및 편집을 위한 오픈 소스 모델(공개되지 않음)

개요 VACE는 동영상 제작 및 편집에 중점을 두고 알리통이 시각지능연구소(ali-vilab)에서 개발한 오픈소스 프로젝트입니다. 레퍼런스를 기반으로 동영상 생성, 기존 동영상 콘텐츠 편집, 현지화 수정 등 다양한 기능을 통합한 올인원 툴입니다.
2 년 전
089.1K
OpenPromptStudio:可视化编辑、管理图像提示词,同步自己的Notion提示词表

OpenPromptStudio: 이미지 프롬프트를 시각적으로 편집 및 관리하고, 나만의 Notion 프롬프트 목록을 동기화하세요!

일반 소개 오픈프롬프트스튜디오(OPS)는 Moonvy 팀에서 개발한 AIGC 프롬프트 단어용 오픈 소스 시각적 편집기입니다. 프롬프트 단어를 생성하고 관리하는 프로세스를 간소화하도록 설계되었으며, Midjourney와 같은 AI 모델을 지원합니다.OPS는 No...
2 년 전
089K
Quanta Quest:端侧大模型与面向个人数据的本地化AI搜索平台(预览版)

Quanta Quest: 개인 데이터를 위한 엔드사이드 빅데이터 모델 및 현지화된 AI 검색 플랫폼(미리 보기)

소개 퀀타 퀘스트는 세계 최초로 '엔드사이드 빅데이터 모델 + C사이드 데이터 현지화'를 핵심 진화 방향으로 삼은 제품입니다. 사용자가 Gmail, Notion, Dropbox 등의 모든 데이터를 로컬에 저장하고 벡터 데이터베이스를 통해 처리할 수 있도록 지원합니다.
2 년 전
088.9K
Qwen4Mac:在Mac菜单栏中使用千问(Qwen)大模型随时对话

Qwen4Mac: Mac 메뉴 표시줄에서 언제든 대화할 수 있는 Qwen의 대형 모델을 사용하세요!

일반 소개 Qwen4Mac은 사용자가 언제든지 쉽게 호출하여 사용할 수 있도록 Qwen LLM(대형 언어 모델)을 Mac의 메뉴 모음에 통합하도록 설계된 오픈 소스 프로젝트입니다. 이 프로젝트는 andreaturchet에서 개발 및 유지 관리하며 사용자가 쉽게 사용할 수 있는 방법을 제공합니다.
2 년 전
088.5K
Go-with-the-Flow:控制视频中物体的运动轨迹,视频中增减任何运动物体

흐름에 따라 이동: 동영상에서 움직이는 물체를 더하거나 빼는 등 동영상 속 물체의 움직임을 제어합니다.

일반 소개 Go-with-the-Flow는 넷플릭스 아이라인 스튜디오 연구팀에서 노이즈를 왜곡하여 동영상 확산 모델의 움직임 패턴을 제어하기 위해 개발한 오픈 소스 프로젝트입니다. 이 프로젝트를 통해 사용자는 장면의 카메라와 ...
2 년 전
088.5K
muAgent:由 LLM 和 EKG(行业知识)驱动的全新Agent编排框架

muAgent: LLM 및 EKG(업계 지식)에 기반한 새로운 에이전트 오케스트레이션 프레임워크

일반 소개 뮤에이전트는 앤트 그룹에서 개발한 혁신적인 다중 지능 프레임워크입니다. 이 프레임워크는 사용자가 캔버스 드래그 앤 드롭과 간단한 텍스트 작성을 통해 다중 지능, 함수 호출, 코드 인터프리터 및 기타 기술과 협력하여 사람의 안내에 따라 다양하고 복잡한 표준 운영 절차(SOP)를 실행할 수 있도록 도와줍니다.
2 년 전
088.4K
VideoReTalking:音频驱动的嘴唇同步和视频编辑系统

비디오리토킹: 오디오 기반 립싱크 및 비디오 편집 시스템

일반 소개 비디오리토킹은 사용자가 입력된 오디오를 기반으로 립싱크된 얼굴 비디오를 생성하여 다양한 감정에도 고품질의 립싱크된 출력 비디오를 생성할 수 있는 혁신적인 시스템입니다. 이 시스템은 이 목표를 세 가지 연속적인 작업으로 분류합니다: 일반적인 표정...
2 년 전
088.4K
Laminar:开源AI产品工程化平台,轻松实现数据可视化追踪与评估

Laminar: 손쉬운 데이터 시각화 추적 및 평가를 위한 오픈 소스 AI 제품 엔지니어링 플랫폼

포괄적인 소개 Laminar는 첫 번째 원칙에서 AI 엔지니어링에 초점을 맞춘 오픈 소스 AI 엔지니어링 최적화 플랫폼입니다. 사용자가 데이터를 수집, 이해 및 사용하여 LLM(대규모 언어 모델링) 애플리케이션의 품질을 개선할 수 있도록 도와주며, Laminar는 포괄적인 관찰 가능성, 텍스트 ...
2 년 전
088.3K
Kheish:多角色智能体,审查、验证和格式化输出以生成高质量结果

Kheish: 고품질 결과를 생성하기 위해 출력을 검토, 검증 및 서식 지정하는 다중 역할 인텔리전스

종합 소개 Kheish는 구조화된 단계별 협업이 필요한 대규모 언어 모델링(LLM) 작업을 위해 설계된 오픈 소스 다중 역할 에이전트로, 단순한 코디네이터를 넘어 필요에 따라 모듈을 요청하고 사용자 반전 기능을 통합하는 그 자체로 지능적인 에이전트입니다.
2 년 전
088.1K
Porkybank:AI驱动的日常预算管理,轻松追踪每日预算

Porkybank: AI 기반 일일 예산 관리로 일일 예산을 쉽게 추적할 수 있습니다.

일반 설명 Porkybank는 사용자가 일일 예산을 쉽게 추적할 수 있도록 설계된 오픈 소스 개인 재무 관리 애플리케이션입니다. (수입 - 지출) / 일수 = 현금이라는 간단한 공식으로 사용자는 자신의 재정 상황을 시각화할 수 있습니다. 이 프로젝트는 깃허브에서 호스팅됩니다...
2 년 전
088.1K
mac assistant:macOS设备自动执行桌面操作的AI智能体

Mac 어시스턴트: macOS 기기에서 데스크톱 작업을 자동화하는 AI 인텔리전스

일반 소개 맥 어시스턴트는 기본 소프트웨어와 웹 기능을 결합하여 사용자 작업을 간소화하는 것을 목표로 하는 macOS용으로 설계된 AI 인텔리전스 바디 프로젝트입니다. 이 프로젝트는 현재 OpenAI 및 GEMINI API를 지원하며 향후 지원할 계획입니다.
2 년 전
088.1K
Omnitool:AI爱好者工具箱,在一个桌面中管理、连接并使用所有AI模型

Omnitool: 하나의 데스크톱에서 모든 AI 모델을 관리, 연결 및 사용할 수 있는 AI 애호가를 위한 도구 상자!

일반 Omnitool.ai는 학습자, 애호가 및 최신 AI 혁신에 관심이 있는 모든 사람에게 확장 가능한 브라우저 기반 데스크톱 환경을 제공하도록 설계된 오픈 소스 'AI 실험실'입니다. 사용자는 통합된 인터페이스를 통해 OpenAI의 다양한 AI 전문가와 협업할 수 있습니다.
2 년 전
088.1K
中文基于满血 DeepSeek-R1 蒸馏数据集,支持中文R1蒸馏SFT数据集

중국어 기반 풀 블러드 DeepSeek-R1 증류 데이터 세트, 중국어 R1 증류 SFT 데이터 세트 지원

종합 소개 중국 DeepSeek-R1 증류 데이터 세트는 기계 학습 및 자연어 처리 연구를 지원하도록 설계된 11만 개의 데이터가 포함된 오픈 소스 중국어 데이터 세트입니다. 이 데이터 세트는 Cong Liu의 NLP 팀에서 공개했습니다. 이 데이터 세트에는 수학 데이터뿐만 아니라 다수의 일반 유형도 포함되어 있습니다.
2 년 전
088K
SciToolAgent:整合500+科研工具,自动化研究科研任务的智能体

500개 이상의 연구 도구를 통합하여 연구 및 과학 작업을 자동화하는 인텔리전스, SciToolAgent

종합 소개 SciToolAgent는 항저우 절강대학교 혁신 센터(HICAI-ZJU)에서 개발한 오픈 소스 도구 플랫폼입니다. 지식 그래프(SciToolKG)와 빅 언어 모델링 기술을 통해 500개 이상의 과학 도구를 통합하여 연구자들이 다음과 같은 문제를 처리할 수 있도록 지원합니다.
2 년 전
088K
VirtualWife:支持B站直播和语音互动的二次元数字人

VirtualWife: B-스테이션 라이브 스트리밍 및 음성 상호작용을 지원하는 보조 디지털 사람

VirtualWife는 개발자 yakami129가 만든 오픈 소스 가상 디지털 인물 프로젝트입니다. 현재 인큐베이션 단계에 있으며, 목표는 "영혼"을 가진 가상 캐릭터를 만들어 사용자가 친구처럼 상호 작용할 수 있도록 하는 것입니다. 이 프로젝트는 B 스테이션 라이브에서 지원합니다...
1 년 전
087.9K
Autiobooks:将epub电子书转换为m4b有声书

오디오북: epub 전자책을 m4b 오디오북으로 변환하기

일반 소개 오토북은 사용자가 .epub 형식의 전자책을 .m4b 형식의 오디오북으로 빠르게 변환할 수 있도록 설계된 오픈 소스 도구입니다. Kokoro에서 제공하는 고품질 음성 합성 기술을 사용하여 자연스럽고 부드러운 오디오를 생성합니다. 이 도구는 ...에 의해 구동됩니다.
2 년 전
087.9K
SQLite-Utils-Ask:让用户对SQLite数据库和CSV/JSON文件进行问答式数据查询

SQLite-Utils-Ask: 사용자가 쿼리 데이터를 위해 SQLite 데이터베이스 및 CSV/JSON 파일을 쿼리할 수 있습니다.

일반 소개 SQLite-Utils-Ask는 사용자가 LLM(대규모 언어 모델)을 사용하여 SQLite 데이터베이스 및 CSV/JSON 파일에 대한 질문과 답변 데이터 쿼리를 수행할 수 있도록 설계된 강력한 도구입니다. 이 도구는 다음을 기반으로 사용자 질문을 자동으로 생성할 수 있습니다.
2 년 전
087.8K
Vector Vein(向量脉络):无代码AI工作流构建平台

벡터 베인: 코드 없는 AI 워크플로 구축 플랫폼

포괄적인 소개 벡터 베인은 사용자가 지능적이고 자동화된 워크플로우를 쉽게 만들 수 있도록 설계된 코드 없는 AI 워크플로우 구축 플랫폼입니다. 프로그래밍 기반이 필요하지 않으므로 사용자는 드래그 앤 드롭 작업을 통해 다양한 기능 모듈을 간단히 연결하여 복잡한 AI 작업을 구축할 수 있습니다.
2 년 전
087.7K
OpenAI Realtime Agents:多智能体语音交互应用(OpenAI示例)

OpenAI 실시간 에이전트: 다중 지능형 신체 음성 인터랙션 애플리케이션(OpenAI 예제)

일반 소개 OpenAI 실시간 에이전트는 OpenAI의 실시간 API를 사용하여 다중 지능형 신체 음성 애플리케이션을 구축하는 방법을 보여주는 것을 목표로 하는 오픈 소스 프로젝트입니다. 이 프로젝트는 높은 수준의 지능형 신체 모델(OpenAI Swarm에서 차용)을 제공하여 다음을 수행할 수 있습니다.
2 년 전
087.7K
MultiPost-Extension:将AI生成内容一键同步到自媒体平台的浏览器扩展

멀티포스트 확장: 한 번의 클릭으로 AI 생성 콘텐츠를 자체 퍼블리싱 플랫폼에 동기화하는 브라우저 확장 기능

일반 소개 멀티포스트 확장 프로그램은 사용자가 한 번의 클릭으로 여러 소셜 미디어 플랫폼에 콘텐츠를 게시할 수 있도록 설계된 강력한 브라우저 확장 프로그램입니다. 이 확장 프로그램은 지후, 웨이보, 샤오홍슈, 틱톡 등 10개 이상의 주요 플랫폼에 동시에 게시할 수 있도록 지원합니다.
2 년 전
087.6K
HN中文播客:自动抓取热门科技文章,AI生成中文总结并转换为播客

HN 중국어 팟캐스트: 인기 기술 기사, AI가 생성한 중국어 요약을 자동으로 가져와 팟캐스트로 변환합니다.

일반 소개 해커 뉴스 중국어 팟캐스트 프로젝트는 AI 기술을 기반으로 한 혁신적인 플랫폼으로, 매일 해커 뉴스의 인기 기사를 자동으로 가져와 AI를 통해 중국어 요약 및 팟캐스트 콘텐츠를 생성하는 것을 목표로 합니다. 이 프로젝트는 ccbikai가 자금을 지원합니다 ...
2 년 전
087K
PilottAI:构建企业级多智能体应用的开源项目

파일럿AI: 엔터프라이즈급 다중 인텔리전스 애플리케이션 구축을 위한 오픈 소스 프로젝트

일반 소개 PilottAI는 GitHub에서 호스팅되고 개발자 anuj0456이 만든 오픈 소스 Python 프레임워크입니다. 사용자가 엔터프라이즈급 다중 지능형 바디 시스템을 구축할 수 있도록 지원하는 데 중점을 두고 있으며, LLM(대규모 언어 모델) 통합을 지원하고, 모든 ...
2 년 전
086.9K
Zev:用自然语言快速查询终端命令的CLI工具

Zev: 자연어로 터미널 명령을 빠르게 쿼리할 수 있는 CLI 도구

일반 소개 Zev는 사용자가 자연어로 터미널 명령을 빠르게 쿼리하고 생성할 수 있도록 도와주는 사용하기 쉬운 명령줄 인터페이스(CLI) 도구입니다. 복잡한 명령 구문을 기억할 필요 없이 Zev는 일상적인 언어로 사용자의 요구 사항을 설명하여 터미널 명령을 생성합니다. Ope...
1 년 전
086.8K
AgentClientDemo:演示智能体运行过程的Python客户端,提供直观的图形用户界面

에이전트 클라이언트 데모: 직관적인 그래픽 사용자 인터페이스를 제공하여 지능형 바디를 실행하는 프로세스를 시연하는 Python 클라이언트

종합 소개 AgentClientDemo는 지능형(에이전트) 및 클라이언트(클라이언트) 기능을 통합하는 종합적인 Python 프로젝트입니다. 이 프로젝트는 PyQt 프레임워크를 기반으로 하며 직관적이고 사용하기 쉬운 그래픽 사용자 인터페이스(G...
2 년 전
086.8K
Vision is All You Need:使用视觉语言模型构建智能文档检索系统(Vision RAG)

비전만 있으면 충분합니다: 시각 언어 모델을 사용한 지능형 문서 검색 시스템 구축(Vision RAG)

종합 소개 Vision-is-all-you-need는 시각 언어 모델링(VLM)을 문서 처리 영역에 적용하는 새로운 지평을 여는 혁신적인 시각적 RAG(검색 증강 생성) 시스템 데모 프로젝트입니다. 기존의 텍스트 청킹 방식과 달리 이 시스템은 직접적으로 ...
2 년 전
086.7K
混元Turbo S:腾讯推出的快思考大模型(开放申请)

하이브리드 터보 S: 빠른 사고를 위한 텐센트의 대형 모델(신청 가능)

종합 소개 텐센트 터보 S는 텐센트에서 자체 개발한 차세대 빠른 사고 모델로서, 지난 27일 텐센트 클라우드 공식 웹사이트를 통해 출시되었습니다. 기존의 느린 사고 모델(예: 딥서치 R1, 하이브리드 T1)과는 달리 "두 번째 응답"을 실현할 수 있다는 점에서 다릅니다.
2 년 전
086.7K
FoloUp:开源AI语音面试平台,生成定制面试题并进行智能分析

FoloUp: 맞춤형 면접 질문과 지능형 분석을 생성하는 오픈 소스 AI 음성 면접 플랫폼

일반 소개 FoloUp은 기업을 위한 AI 기반 음성 면접 솔루션을 제공하기 위해 설계된 오픈 소스 플랫폼입니다. FoloUp을 통해 기업은 직무 설명에 맞는 맞춤형 면접 질문을 빠르게 생성하고 AI와 자연스러운 대화형 면접을 진행할 수 있습니다. 이 플랫폼은 또한 상세한 인터뷰 분석도 제공합니다...
2 년 전
086.6K
FramePainter:AI驱动的涂鸦式图像编辑工具

프레임페인터: AI 기반 낙서 스타일의 이미지 편집 도구

일반 소개 프레임페인터는 고급 동영상 확산 기술과 직관적인 스케치 컨트롤을 활용하여 사용자가 복잡한 이미지 편집을 쉽게 할 수 있도록 도와주는 혁신적인 AI 기반 이미지 편집 도구입니다. 간단한 조정이든 복잡한 창의적 변형이든, 프레임페인터는 ...
2 년 전
086.5K
Promptimizer:优化大模型提示词的实验性库,自动优化 Prompt

프롬프타이머: 대형 모델 프롬프트 단어를 최적화하는 실험적인 라이브러리로, 프롬프트를 자동으로 최적화합니다.

일반 소개 프롬프타이마이저는 사용자가 AI 시스템의 단서를 체계적으로 개선할 수 있도록 설계된 실험적인 단서 단어 최적화 라이브러리입니다. 프롬프타이마이저는 최적화 프로세스를 자동화함으로써 특정 작업에서 프롬프트 단어의 성능을 향상시킬 수 있습니다. 사용자는 다음 정보만 제공하면 됩니다.
2 년 전
086.4K
OmniParse:从文档/多媒体中提取任何非结构化数据解析为结构化数据

OmniParse: 문서/멀티미디어에서 비정형 데이터를 추출하여 정형 데이터로 구문 분석합니다.

일반 소개 OmniParse는 모든 비정형 데이터를 GenAI(생성 인공 지능) 프레임워크에 최적화된 정형화된 실행 가능한 데이터로 변환하도록 설계된 강력한 데이터 구문 분석 및 최적화 플랫폼입니다. 문서, 표, 이미지, 동영상, 오디오 파일 등 어떤 종류의 데이터를 작업하든 상관없습니다.
2 년 전
086.3K
Swarm:学习轻量级多智能体系统的实验性教学项目(OpenAI示例)

스웜: 경량 다중 지능 신체 시스템을 학습하기 위한 실험적 교육 프로젝트(OpenAI 예시)

일반 소개 스웜은 다중 에이전트 시스템을 위한 가볍고 제어 가능하며 테스트하기 쉬운 인터페이스를 탐색하기 위해 OpenAI에서 개발한 실험적인 교육용 프레임워크입니다. 이 프레임워크는 주로 에이전트 간의 핸드오프와 일상적인 패턴을 시연하는 데 사용되며, 개발자가 멀티 에이전트 시스템의 조정 및 실행을 이해하고 구현하는 데 도움이 됩니다.
2 년 전
086.1K
wdoc:从海量、多源文档中检索内容并总结知识

wdoc: 방대한 다중 소스 문서에서 콘텐츠를 검색하고 지식을 요약하세요.

종합 소개 wdoc은 대량의 다양한 문서를 처리하고 분석하기 위해 설계된 강력한 RAG(검색 증강 생성) 시스템입니다. PDF, 웹 페이지, YouTube 동영상, 오디오 파일 등 다양한 문서 유형에서 검색할 수 있으며, 특히 다음과 같은 처리에 적합합니다.
2 년 전
086K
Claude生成深度研究报告的MCP服务

심층 연구 보고서 생성을 위한 Claude의 MCP 서비스

일반 소개 MCP 서버 딥 리서치는 인공지능과 웹 검색을 통해 복잡한 문제에 대한 구조화된 연구 보고서를 자동으로 생성하는 오픈 소스 도구입니다. 사용자가 연구 질문을 입력하면 도구가 질문을 분석하고, 권위 있는 정보를 검색하고, 출처 신뢰도를 평가합니다...
1 년 전
086K
OPR:智能修复泛黄、破损老旧照片的AI工具

OPR: 누렇게 변색되고 낡은 오래된 사진을 지능적으로 복원하는 AI 도구

오래된 사진을 다시 생생하게 복원하기는 AI 기술을 사용하여 오래된 사진을 복원하는 데 중점을 둔 Microsoft 연구팀이 개발한 오픈 소스 프로젝트입니다. 스크래치와 같은 사진의 심각한 품질 저하 문제를 처리할 수 있는 딥 러닝 접근 방식을 기반으로 합니다....
2 년 전
085.8K
Inbox Zero:轻松实现收件箱零邮件,借助 AI 帮助你对邮件进行归类、过滤、处理。

받은 편지함 제로: 이메일을 분류, 필터링 및 처리하는 데 도움을 주는 AI의 도움으로 받은 편지함의 이메일을 쉽게 제로로 만들 수 있습니다.

일반 설명 Inbox Zero는 AI 어시스턴트를 통해 사용자가 받은 편지함 이메일을 빠르게 정리할 수 있도록 설계된 오픈 소스 이메일 관리 앱입니다. 이 앱은 자동 응답, 보관, 라벨 지정 및 이메일 전달, 뉴스레터 관리 및 구독 취소, 콜드 이메일 차단, 팔로잉 등 다양한 기능을 제공합니다.
2 년 전
085.6K
文颜:一键美化Markdown文章,适配多个自媒体平台格式(开源本地客户端)

Wenyan: 원클릭으로 마크다운 문서 미화, 여러 셀프 미디어 플랫폼 형식(오픈 소스 로컬 클라이언트)에 적응하기

종합 소개 WenYan은 마크다운 기사 조판 및 미화를 위해 설계된 도구로, 편집된 마크다운 기사를 WeChat, Zhihu, 오늘의 헤드라인 및 기타 플랫폼에 적합한 형식으로 변환할 수 있도록 지원합니다. 사용자는 클릭 한 번으로 기사를 직접 복사할 수 있습니다...
2 년 전
085.4K