종합 소개 ComfyUI는 강력하고 모듈화된 안정화된 확산 GUI 및 백엔드 도구로, 그래픽 노드/흐름도 인터페이스 기반 환경을 제공하여 사용자가 고급 안정화된 확산 워크플로우를 설계하고 실행하여 코딩 없이 복잡한 워크플로우를 실험하고 만들 수 있게 해줍니다. 주요 기능 ...
Parallax는 분산형 AI 연구소인 Gradient에서 오픈소스로 제공하는 세계 최초의 '완전 자율 AI 운영 체제'입니다. Mac, Windows 및 기타 이기종 장치에서 대규모 모델의 크로스 플랫폼 배포를 지원하여 사용자가 모델, 데이터 및 AI 메모리를 완전히 제어할 수 있습니다. 이 시스템은 네트워크 인식 기능이 내장되어 있습니다 ...
일반 소개 LlamaEdge는 로컬 또는 엣지 장치에서 대규모 언어 모델(LLM)을 실행하고 미세 조정하는 프로세스를 간소화하도록 설계된 오픈 소스 프로젝트입니다. 이 프로젝트는 Llama2 모델 제품군을 지원하며 사용자가 쉽게 생성하고 실행할 수 있는 OpenAI 호환 API 서비스를 제공합니다.
일반 소개 TRELLIS는 Microsoft에서 개발한 대규모 3D 에셋 생성 모델입니다. 텍스트 또는 이미지 프롬프트를 수신하고 방사형 필드, 3D 가우시안 및 메시와 같은 다양한 형식의 고품질 3D 에셋을 생성할 수 있으며, TRELLIS의 핵심은 통합된 구조화된 잠복...
종합 소개 알리마마 크리에이티브 센터는 타오바오, 티몰 및 기타 전자상거래 플랫폼의 판매자에게 그래픽에서 동영상, 랜딩 페이지에 이르기까지 모든 범위의 크리에이티브 지원을 제공하도록 설계된 알리바바의 지능형 마케팅 크리에이티브 지원 플랫폼입니다. 크리에이티브 센터는 AI 지능형 카피라이팅 기능과 방대한 템플릿을 결합하여 디자인 효율성을 획기적으로 개선합니다....
일반 소개 Mochii AI는 지능형 도구로 사용자의 웹 브라우징, 글쓰기, 코딩, 데이터 처리 효율성을 향상시키기 위해 설계된 강력한 올인원 AI 비서입니다. 공식 웹사이트는 브라우저, 데스크톱, 모바일에서 사용자를 지원하는 도구의 다중 시나리오 적용 가능성을 보여줍니다.
일반 소개 Remio는 사용자가 정보를 효율적으로 수집, 정리, 활용할 수 있도록 돕는 데 중점을 둔 AI 기반 개인 지식 관리 도구입니다. 웹 콘텐츠, 로컬 파일, 사용자 메모를 자동으로 캡처하고 지능형 분석을 통해 명확하게 구조화된 지식 베이스로 정리하며, 데이터 프라이버시를 강조하는 Remio는 ...
일반 설명 InstantIR은 손상된 이미지를 매우 높은 품질과 생생한 디테일로 복원할 수 있도록 설계된 InstantX 팀에서 개발한 혁신적인 단일 이미지 복원 모델로, 손상된 이미지를 고품질로 복원할 수 있습니다. 이 도구는 이미지의 세부 사항을 복원할 뿐만 아니라 ...
종합 소개 Step-Audio는 프로덕션 환경에 즉시 사용 가능한 음성 이해 및 생성 기능을 제공하도록 설계된 오픈 소스 지능형 음성 인터랙션 프레임워크입니다. 이 프레임워크는 다국어 대화(예: 중국어, 영어, 일본어), 감정적 음성(예: 행복, 슬픔), 지역 방언(예: 광동어, 사천어 ...) 등을 지원합니다.
일반 소개 Petal은 사용자가 문서를 효율적으로 관리하고 분석할 수 있도록 설계된 AI 기반 문서 분석 플랫폼입니다. Petal을 통해 사용자는 지식 베이스를 플랫폼에 연결하고 완전히 문서화되고 신뢰할 수 있는 답변을 생성할 수 있으며, Petal은 여러 문서 유형을 지원합니다.
일반 소개 Neural4D는 사용자가 간단한 텍스트 또는 이미지 입력으로 고품질 3D 모델과 애니메이션을 빠르게 생성할 수 있도록 지원하는 혁신적인 AI 기반 플랫폼입니다. 드림테크에서 개발한 이 플랫폼은 세계 최고의 엔드투엔드 3D 대형 모델 생성 기술을 기반으로 합니다....
일반 소개 Miro는 팀이 아이디어에서 결과물로 빠르게 이동할 수 있도록 설계된 통합 AI 기능을 갖춘 온라인 화이트보드 협업 플랫폼으로, 8천만 명 이상의 사용자와 25만 개의 기업이 혁신과 프로젝트 관리를 위해 Miro를 사용하고 있습니다. 대화형 무제한 그리기 기능을 제공합니다...
포괄적 인 소개 Zion은 강력한 코드없는 개발 플랫폼으로, 사용자는 웹 사이트, WeChat 애플릿 및 기타 애플리케이션을 빠르게 구축하기 위해 코드를 작성할 필요가 없습니다. 이 플랫폼은 애플리케이션 개발, 온라인 배포에서 운영 및 유지 관리의 성장에 이르기까지 완전한 시각적 운영을 제공하여 개발 임계 값을 크게 줄입니다. 시온은 비즈니스 시나리오를 광범위하게 다룹니다.
노코드란 무엇인가요? 노코드는 미션에서 출시한 제로 코드 AI 개발 플랫폼입니다. 사용자는 프로그래밍 경험이 없어도 자연어를 통해 요구 사항을 설명하기만 하면 웹 사이트 페이지, 유틸리티, 작은 게임, 이벤트 페이지 및 기타 애플리케이션을 빠르게 생성할 수 있으며, NoCode는 1초 만에 200...
일반 소개 카카오 캡션 어시스턴트(비디오캡션)는 대규모 언어 모델(LLM) 기반의 지능형 동영상 캡션 처리 도구입니다. 고성능 GPU 없이도 클릭 한 번으로 고품질의 자막을 생성할 수 있으며, 자막 생성, 문장 끊기, 최적화, 번역의 전 과정을 지원합니다. 자막 생성, 문장 분할, 최적화 및 번역의 전 과정을 지원합니다...
일반 소개 BGM Cat은 DeepMusic(베이징 링동인 기술 유한회사)에서 개발한 AI 맞춤형 배경음악 제작 플랫폼입니다. 사용자는 간단한 설명만으로 동영상, 팟캐스트 및 기타 장면에 적합한 배경 음악과 타이틀 음악을 생성할 수 있습니다. 이 플랫폼은 고급 AI 음악 생성 기술을 사용합니다 ...
일반 소개 Diagramming AI는 인공 지능 기술을 사용하여 사용자가 UML 다이어그램과 워크플로 차트를 즉시 디자인하고 편집할 수 있도록 도와주는 강력한 온라인 도구입니다. 이 사이트는 순서도, 시퀀스 다이어그램, 간트 차트 등 다양한 다이어그램 형식을 제공하며, 사용자는 텍스트를 입력하기만 하면 ...
일반 소개 Glama는 강력하고 사용하기 쉬운 AI 채팅 도구입니다. 다양한 AI 모델과의 대화를 지원할 뿐만 아니라 파일 업로드, 웹에서 정보 검색, 전문 차트 생성까지 가능합니다. 이 웹사이트는 기업 팀, 개발자 또는 개인 사용자와 같이 정보와 작업을 효율적으로 처리해야 하는 사용자를 대상으로 합니다.
일반 소개 PearAI는 최첨단 AI 도구를 통합하여 개발 프로세스를 가속화하도록 설계된 오픈 소스 AI 코드 편집기입니다. 자동 코드 생성, 실시간 디버깅 및 코드 컨텍스트 검색 기능을 제공하여 개발자가 코딩 작업을 보다 효율적으로 완료할 수 있도록 도와줍니다.PearAI의 기반은 ...
일반 소개 ChatTTS는 대화 시나리오를 위해 설계된 생성형 음성 모델입니다. 자연스럽고 표현력이 풍부한 음성을 생성하고, 여러 언어와 여러 화자를 지원하며, 대화형 대화에 적합합니다. 이 모델은 웃음, 일시 정지, 감탄사 등 세분화된 리듬을 예측하고 제어하여 이를 수행합니다.
일반 소개 PDFgen은 간단한 텍스트 프롬프트에서 PDF 템플릿을 생성하는 데 중점을 둔 인공 지능 기반 도구입니다. 플랫폼의 주요 기능은 PDF 생성을 자동화하는 것으로, 특히 정기적으로 문서를 다루는 기업 및 개인에게 적합하며, PDFgen은 REST API를 제공합니다.
포괄적인 소개 킬른은 대규모 언어 모델(LLM)의 미세 조정, 합성 데이터 생성 및 데이터 세트 협업에 중점을 둔 오픈 소스 도구입니다. Windows, MacOS 및 Linux 시스템을 지원하는 직관적인 데스크톱 애플리케이션을 제공하므로 사용자는 코드 없이 LLM을 구현할 수 있습니다.
일반 소개 SUDOAI는 힐봇이 제공하는 혁신적인 AI 플랫폼으로, AI 기술을 통해 고품질의 3D 모델을 생성하는 데 중점을 두고 있습니다. 사용자는 간단한 텍스트 설명이나 이미지 업로드를 통해 3D 모델을 빠르게 생성할 수 있으며 주로 게임 개발, 메타 유니버스 및 ...
포괄적인 소개 Vanna는 RAG(검색 증강 생성) 기술을 통해 SQL 쿼리를 생성하는 데 중점을 둔 MIT 라이선스 오픈 소스 Python 프레임워크입니다. 사용자는 RAG 모델을 학습하고 자신의 데이터에 적용한 다음 질문을 하면 Vanna가 적절한 답변을 반환합니다.
종합 소개 AIVLOG는 브이로그 제작자를 위해 설계된 AI 동영상 편집 도구입니다. 동영상 콘텐츠를 자동으로 분석하고 하이라이트를 지능적으로 편집하여 사용자의 편집 시간을 95% 절약할 수 있습니다. 일상 생활, 여행 기록, 대화 등 어떤 영상이든 AIVLOG는 쉽게...
종합 소개 완싱 야옹 그림자는 윈도우와 맥용 완싱 테크놀로지의 올인원 동영상 편집 도구입니다. 이 소프트웨어는 AI 생성 음악, 지능형 사람 목소리 분리, 지능형 텍스트 빠른 자르기 등 다양한 AI 기능을 통합하여 사용자가 전문적인 동영상을 쉽게 만들 수 있도록 도와줍니다. 파티든...
LoopTool은 상하이 자오통 대학과 리틀 레드북 팀이 오픈소스화한 자동화된 도구 호출 데이터 진화 프레임워크로, 대규모 언어 모델의 도구 호출 기능을 향상시키기 위해 설계되었습니다. 오픈 소스 모델(예: Qwen3-32B)을 데이터 생성으로 사용하여 폐쇄 루프 반복을 통해 데이터 생성 및 모델 학습을 최적화합니다.
일반 소개 에듀터AI는 인공지능 기술을 사용하여 교육용 솔루션을 제공하는 웹사이트입니다. 교사, 학생, 학부모에게 문제 생성기, 풀아웃 인식 카드 메이커, 퀴즈 생성기 등 다양한 도구를 제공하여 학습 효율과 효과를 향상시킬 수 있도록 설계되었습니다. 사용자는 텍스트를 업로드할 수 있습니다...
일반 소개 LTX Studio는 크리에이터, 마케터, 영화 제작자 및 스튜디오를 위해 설계된 혁신적인 AI 기반 동영상 제작 플랫폼입니다. 스토리 구상, 분할 화면 생성, 키네틱 효과 추가, 포스트 편집에 이르는 전체 프로세스 작업을 제공하여 사용자가 창의적인 컨셉을 다음과 같이 변환할 수 있도록 도와줍니다.
일반 설명 MemoAI는 비디오 및 오디오 파일을 텍스트, 자막, 메모로 변환하도록 설계된 강력한 비디오 번역 도구입니다. YouTube 동영상, 팟캐스트, 로컬 파일 등 어떤 파일이든 MemoAI로 손쉽게 처리할 수 있습니다. 중국어, 영어, 일본어 등 90개 이상의 언어를 지원합니다.
포괄적인 소개 Vapi는 개발자를 위한 음성 AI 플랫폼입니다. 사용자가 몇 분 안에 음성 AI 비서를 구축, 테스트 및 배포할 수 있어 시간이 많이 걸리고 확장하기 어려운 기존 음성 애플리케이션 개발의 문제를 해결할 수 있으며, 실시간 대화를 지원하는 완벽한 도구와 인프라를 제공합니다.
종합 소개 CogAgent는 칭화대학교 데이터 마이닝 연구 그룹(THUDM)에서 개발한 오픈 소스 시각 언어 모델로, 여러 플랫폼에서 그래픽 사용자 인터페이스(GUI)의 작동을 자동화하는 것을 목표로 합니다. 이 모델은 CogVLM(GLM-4V-9B)을 기반으로 하며 중국어와 영어 이중 언어를 지원합니다.
종합 소개 99AI는 배포하기 쉽고 문턱이 낮은 통합 AI 서비스 플랫폼을 제공하는 것을 목표로 하는 오픈 소스 AI 웹 애플리케이션 프로젝트입니다. 이 프로젝트는 지능형 대화, 멀티모달 모델, 애플리케이션 플라자, 네트워크 검색을 지원하며 AI 그림, 음악 및 비디오를 통합합니다.
종합 소개 WeClone은 대규모 언어 모델 및 음성 합성 기술과 결합된 WeChat 채팅 로그와 음성 메시지를 사용하여 사용자가 개인화된 디지털 도플갱어를 만들 수 있는 오픈 소스 프로젝트입니다. 이 프로젝트는 사용자의 채팅 습관을 분석하여 모델을 훈련시킬 뿐만 아니라 소수의 음성 샘플로 사실적인 소리를 생성할 수 있습니다....
종합 소개 FinRobot은 AI4Finance Foundation에서 개발한 오픈 소스 AI 인텔리전스 플랫폼으로, 금융 분석을 위해 설계되었습니다. 전통적인 언어 모델뿐만 아니라 다양한 AI 기술을 통합하여 금융 산업을 위한 포괄적인 솔루션을 제공하는 것을 목표로 합니다.F....
일반 소개 허깅페이스의 Open R1 프로젝트는 R1 파이프라인에서 누락된 부분을 구축하여 누구나 이를 복제하고 구축할 수 있도록 하는 것을 목표로 하는 완전 오픈 소스 DeepSeek-R1 복제 프로젝트입니다. 이 프로젝트는 단순하게 설계되었으며 주로 교육과 평가로 구성됩니다.
일반 설명 Clone Voice는 오픈 소스 사운드 복제 도구로, 사용자가 모든 사운드 또는 개인 음성 녹음을 사용하여 음성을 복제할 수 있는 웹 기반 인터페이스를 제공합니다. 이 도구는 NVIDIA GPU가 없어도 쉽게 사용할 수 있으며, 사전 컴파일된 앱과 함께 사용할 수 있습니다.
일반 소개 Fireflies.ai는 비즈니스 회의를 필사, 요약 및 분석하기 위해 설계된 고급 AI 기반 회의 도우미입니다. 음성 인식 및 자연어 처리 기술을 사용하여 사용자가 회의 내용을 자동으로 기록하고 분석하여 실행 가능한 데이터와 줄거리로 만들 수 있도록 도와줍니다.
일반 소개 YouLearn은 사용자가 개인화된 AI 튜터(지능형 튜터)를 통해 다양한 교육 콘텐츠를 보다 효율적으로 학습하고 이해할 수 있도록 설계된 AI 기반 학습 플랫폼입니다. 학생, 전문가, 자가 학습자 등 모든 사용자가 YouLearn을 통해 학습할 수 있습니다.
일반 소개 Julius AI는 사용자가 다양한 데이터를 쉽게 분석하고 시각화할 수 있도록 설계된 강력한 AI 데이터 분석 도구입니다. 간단한 자연어 프롬프트를 통해 사용자는 데이터와 상호 작용하고, 차트를 생성하고, 예측 모델을 구축하고, 데이터를 정리하고, 상세한 분석 보고서를 생성할 수 있습니다....
일반 설명 Strawberry는 사용자가 일상적인 작업을 자동화하고 효율성을 향상시킬 수 있도록 설계된 AI 비서가 내장된 스마트 브라우저입니다. AI 기술을 통합하여 웹 콘텐츠를 실시간으로 이해하고 빠른 검색, 콘텐츠 작성과 같은 복잡한 작업을 수행한다는 점에서 기존 브라우저와 차별화됩니다.
종합 소개 Zhihu Direct(zhida.ai)는 Zhihu에서 출시한 AI 빅 모델을 기반으로 한 지능형 Q&A 및 검색 도구입니다. Zhihu 커뮤니티의 고품질 콘텐츠를 핵심으로 삼고 여러 데이터 소스를 결합하여 사용자에게 신뢰할 수 있는 정보에 대한 액세스를 제공합니다. 지후다이렉트는 간단한 답변과 심층적인 답변을 모두 생성할 뿐만 아니라...
종합 소개 Midjourney Proxy는 AI 그리기 기능을 API 형태로 변환하기 위해 Midjourney의 Discord 채널에 프록시 서비스를 제공하도록 설계된 오픈 소스 프로젝트입니다. 이 프로젝트는 완전 무료 오픈 소스이며, 원클릭 얼굴 교체, 이미지 블렌딩, 그래프 생성 등을 지원합니다.
일반 소개 Same은 디자이너와 개발자에게 웹 인터페이스를 빠르게 복제할 수 있는 기능을 제공하도록 설계된 간단하고 유용한 온라인 도구입니다. URL을 입력하면 대상 페이지의 픽셀 단위 사본을 생성하여 사용자가 수동으로 다시 그려야 하는 시간을 절약할 수 있습니다. 사이트의 핵심은 '복사...
일반 소개 NeuraVid는 사용자가 동영상 콘텐츠를 빠르게 처리하고 이해할 수 있도록 설계된 AI 기반 동영상 분석 플랫폼입니다. 고급 AI 기술을 통해 동영상 트랜스크립션, 콘텐츠 검색 및 주요 정보 추출을 지원하여 사용자가 중요한 클립을 쉽게 찾거나 동영상에서 하이라이트를 생성할 수 있습니다. 이...
일반 소개 FliFlik은 효율적이고 편리한 디지털 처리 서비스를 제공하는 데 중점을 둔 멀티미디어 솔루션 플랫폼입니다. 사진, 오디오, 동영상 등 모든 종류의 멀티미디어를 FliFlik의 고급 AI 기술을 통해 최적화하고 향상시킬 수 있습니다. 이 플랫폼은 Windows를 지원합니다.
종합 소개 MoneyPrinterPlus는 AI 기술을 통해 한 번의 클릭으로 모든 종류의 짧은 동영상을 생성 및 믹싱하여 Jieyin, Shutterbugs, Xiaohongshu, Video Number 등 여러 동영상 플랫폼에 자동으로 게시하는 것을 목표로 하는 오픈 소스 프로젝트입니다. 이 도구는 채팅을 포함한 로컬 및 클라우드 기반 음성 모델을 지원합니다.
Pix2Text 일반 소개 Pix2Text(P2T)는 이미지 텍스트와 수학 공식 인식을 제공하는 Mathpix를 대체하도록 설계된 오픈 소스 무료 도구입니다. 사용자는 웹 버전을 통해 이 도구를 무료로 사용할 수 있으며, 하루에 최대 10,000개까지 인식할 수 있습니다....
일반 소개 MyMap AI는 사용자에게 간단하고 빠른 시각화 솔루션을 제공하기 위해 고안된 AI 기반 온라인 도구입니다. 사용자는 디자인 경험 없이도 텍스트 채팅만으로 마인드맵, 순서도, 프레젠테이션 및 기타 콘텐츠를 생성할 수 있습니다. 이 웹사이트는 다중 입력을 지원합니다...
MemOS는 MemTensor와 같은 대규모 언어 모델(LLM)을 위한 오픈 소스 메모리 관리 및 스케줄링 프레임워크입니다. 메모리를 연산 능력만큼이나 중요한 리소스로 간주하여 표준화된 MemCube 메모리 유닛을 통해 일반 텍스트, 활성화 상태 및 매개변수 메모리의 관리를 통합합니다.
종합 소개 매직보이스 워크샵은 소프트웨어 더빙, 실제 더빙, 사운드 라이브러리, 복제 서비스 등에 대한 정보를 제공하는 원스톱 단편 동영상 및 AI 더빙 플랫폼입니다. 이 플랫폼에는 오디오 관련 서비스 및 콘텐츠 제작을 위한 오디오 편집, AI 카피 생성, 비디오 편집 및 협업 도구가 통합되어 있습니다. 사용자가 오디오 편집기를 체험해 보세요...
일반 소개 RoomGPT는 사용자가 방 사진을 업로드하고 인공지능 기술을 사용하여 새롭게 디자인된 버전을 생성할 수 있는 GitHub 사용자 Nutlope가 개발한 오픈 소스 프로젝트입니다. 이 프로젝트는 사용자가 비싼 디자이너 비용 없이 전문가 수준의 인테리어 디자인을 이용할 수 있도록 하는 것을 목표로 합니다....