최신 AI 리소스

共 3185 篇文章
VideoFX(Veo2):AI生成创意视频,高物理状态还原,输出原生4K视频

VideoFX(Veo2): 높은 물리적 상태 재현과 네이티브 4K 비디오 출력을 지원하는 AI 생성 크리에이티브 비디오

일반 소개 VideoFX는 사용자가 창의적이고 시각적으로 멋진 동영상 콘텐츠를 쉽게 만들 수 있도록 설계된 Google Labs의 혁신적인 동영상 제작 도구입니다. 이 도구는 고급 Veo 2.0 기술을 활용하여 다양한 크리에이티브에 적합한 광범위한 동영상 효과 및 편집 기능을 제공합니다.
2 년 전
0109.3K
元真数字人:数字人直播、口播短视频,商业化AI虚拟人直播工具

위안젠 디지털 휴먼: 디지털 휴먼 라이브 스트리밍, 구술 쇼트 비디오, 상업용 AI 가상 휴먼 라이브 스트리밍 도구

종합 소개 위안젠 디지털 피플은 디지털 피플 라이브 방송, 단편 동영상 제작, AI 비서 등 사용자에게 원스톱 서비스를 제공하는 선도적인 AIGC(인공 지능 생성 콘텐츠) 플랫폼입니다. 이 플랫폼은 AI 알고리즘 합성과 GPT 스타일의 빅 모델을 통합하고, 사용자가 독점 Q&A 모델을 만들 수 있도록 지원하며, 실제 ...
2 년 전
0109.3K
Felo:AI搜索整理知识并一键生成PPT,支持小红书、X、Reddit收集信息

Felo: 한 번의 클릭으로 지식을 검색 및 정리하고 PPT를 생성하는 AI, 정보를 수집하기 위해 Little Red Book, X, Reddit을 지원합니다.

일반 소개 Felo는 전 세계 지식을 발견하고 이해하는 사용자 경험을 최적화하도록 설계된 ChatGPT 및 AI 에이전트로 구동되는 다국어 AI 검색 엔진입니다. 언어 장벽을 허물고 사용자가 글로벌 정보에 쉽게 액세스할 수 있도록 지원합니다.
2 년 전
0109.2K
火山方舟:大模型训练与云计算服务,注册送150元等额算力

볼케이노 아크: 빅 모델 트레이닝 및 클라우드 컴퓨팅 서비스, $150 상당의 산술에 가입하세요.

종합적인 소개 Volcano Ark는 볼케이노 엔진에서 출시한 클라우드 컴퓨팅 플랫폼으로, 빅 모델 서비스에 중점을 두고 기업에게 모델 선택, 학습, 적용에 이르는 완벽한 솔루션을 제공하는 것을 목표로 합니다. 볼케이노 아크는 AI 분야에서 축적된 바이트댄스의 풍부한 경험을 바탕으로 여러 유명 AI 기업의 빅데이터 모델 리소스를 통합합니다....
2 년 전
0109.2K
通义听悟:阿里通义音视频内容转录AI助手

통이 듣기 및 이해: 알리 통이 오디오 및 비디오 콘텐츠 전사 AI 비서

종합 소개 통이 듣기 및 이해는 알리윈에서 출시한 작업용 AI 비서로, 오디오 및 비디오 콘텐츠의 전사 및 분석에 중점을 두고 있습니다. 알리윈의 강력한 AI 모델을 사용하여 오디오 및 비디오 콘텐츠를 실시간으로 텍스트로 변환하고 번역, 요약, 위치 지정 및 기타 기능을 제공합니다. 통이 리스닝 우는 여러 언어와 시나리오를 지원합니다 ...
2 년 전
0109.2K
Interviewcoder:辅助远程技术面试的隐形AI工具

Interviewcoder: 원격 기술 인터뷰를 지원하는 보이지 않는 AI 도구

일반 소개 Interviewcoder는 기술 면접을 위해 설계된 AI 지원 도구로, 사용자가 프로그래밍 면접 중에 솔루션을 빠르게 생성하고 코드를 최적화하며 실시간으로 디버깅할 수 있도록 설계되었습니다. 이 도구는 사용자가 Zoom, Google...에서 사용할 수 있는 스텔스 데스크톱 애플리케이션으로 실행됩니다.
2 년 전
0109.2K
PandasAI:数据分析对话平台,用自然语言完成数据查询与图表生成

PandasAI: 자연어로 데이터 쿼리 및 차트 생성을 위한 데이터 분석 대화 플랫폼

일반 소개 PandasAI는 자연어 처리 기술을 통해 데이터 분석 프로세스를 간소화하도록 설계된 Python 기반 오픈 소스 플랫폼입니다. 사용자가 데이터베이스(예: SQL, CSV, 판다, 폴라, 몽고DB, ...)와의 대화를 통해 작업할 수 있도록 지원합니다.
2 년 전
0109.2K
LLaMA Factory:高效微调百余种开源大模型,轻松实现模型定制

LLaMA Factory: 100개가 넘는 오픈 소스 매크로 모델의 효율적인 미세 조정, 손쉬운 모델 커스터마이징

일반 소개 LLaMA-Factory는 100개가 넘는 대규모 언어 모델(LLM)의 유연한 커스터마이징과 효율적인 학습을 지원하는 통합적이고 효율적인 미세 조정 프레임워크입니다. 내장된 LLaMA 보드 웹 인터페이스를 통해 사용자는 모델링을 완료하기 위해 코드를 작성할 필요가 없습니다.
2 년 전
0109.2K
opensource_notebooklm:基于Deepseek-V3和PlayHT TTS的NotebookLM开源实现

opensource_notebooklm: Deepseek-V3 및 PlayHT TTS를 기반으로 하는 NotebookLM의 오픈 소스 구현

일반 소개 오픈 소스 노트북LM은 딥시크-V3의 언어 이해 기능과 PlayHT의 음성 합성 기술을 결합한 혁신적인 인공지능 프로젝트로, 지능형 노트 필기 대화 시스템을 만드는 것을 목표로 합니다. 이 프로젝트는 Build Fast w에서 개발했습니다.
2 년 전
0109.1K
TableGPT Agent:专为分析复杂表格数据设计的智能工具

TableGPT 에이전트: 복잡한 표 형식의 데이터를 분석하도록 설계된 지능형 도구

종합 소개 TableGPT 에이전트는 표 형식의 데이터를 처리하고 분석하기 위해 설계된 GitHub 오픈 소스 프로젝트에 기반한 지능형 도구입니다. TableGPT2 빅 언어 모델에 의존하며 자연어 상호 작용을 사용하여 사용자가 쉽게 쿼리하고 조작할 수 있도록 합니다.
2 년 전
0109.1K
OpenAOE:大模型群聊框架:同时与多个大语言模型聊天

OpenAOE: 대규모 모델 그룹 채팅 프레임워크: 여러 개의 대규모 언어 모델과 동시에 채팅하기

종합 소개 OpenAOE는 오픈 소스 대규모 모델 그룹 채팅 프레임워크로, 현재 시장에 여러 모델이 병렬로 응답하는 채팅 프레임워크가 부족한 문제를 해결하기 위해 개발되었습니다. OpenAOE를 사용하면 사용자는 여러 LLM(대규모 언어 모델)과 동시에 대화하고 병렬 출력을 얻을 수 있습니다. 이 프레임워크는 다음을 지원합니다.
2 년 전
0109K
Aha:由AI驱动的网红/达人营销服务平台

Aha: 네티즌/애호가를 위한 AI 기반 마케팅 서비스 플랫폼

일반 소개 Aha는 Aha Labs에서 개발한 세계 최초의 AI 팀을 활용한 넷플릭스 마케팅 도구입니다. 연중무휴 24시간 온라인으로 AI 에이전트 팀을 제공하여 사용자가 넷플릭스 마케팅 캠페인을 시작, 관리 및 확장할 수 있도록 도와줍니다. 사용자가 브랜드 또는 웹사이트 정보를 입력하면 AI가 모든 작업을 자동화합니다.
2 년 전
0109K
Heeyo:陪伴孩子的AI伴侣,提升儿童学习体验的智能AI伙伴(付费)

희요: 아이와 동행하는 AI 동반자이자 아이들의 학습 경험을 향상시키는 지능형 AI 파트너(유료)

일반 설명 Heeyo는 3-11세 어린이가 대화형 게임과 대화를 통해 학습 경험을 향상시킬 수 있도록 설계된 AI 앱으로, 하버드와 스탠퍼드의 교육 전문가가 설계했으며 수학, 과학 및 사회 정서적 기술을 다루는 2000개 이상의 학습 게임을 제공합니다. Kids...
2 년 전
0109K
RunPod:专为AI设计的GPU云服务,快速冷启动SD且按秒付费

RunPod: 빠른 콜드 스타트 SD 및 초당 과금 기능을 갖춘 AI용으로 설계된 GPU 클라우드 서비스

일반 소개 RunPod는 개발자, 연구자, 기업에게 AI 모델 개발, 훈련, 확장을 위한 원스톱 솔루션을 제공하는 것을 목표로 하는 AI용 클라우드 컴퓨팅 플랫폼입니다. 이 플랫폼은 온디맨드 GPU 리소스, 서버리스 추론, AI 프로젝트를 위한 자동 확장 기능을 통합합니다.
2 년 전
0109K
LangBot:开源大模型即时通信机器人,支持多微信、QQ、飞书等多平台部署AI机器人

LangBot: 오픈 소스 대형 모델 인스턴트 메시징 로봇, 여러 WeChat, QQ, Flybook 및 기타 멀티 플랫폼 배포를 지원하는 AI 로봇.

LangBot은 여러 메시징 플랫폼과 대형 모델을 지원하는 대형 모델 기반 인스턴트 메시징 봇 플랫폼입니다. 이 플랫폼은 QQ, 위챗(기업용 위챗, 개인용 위챗), 플라이북, 디스코드, 원봇 및 기타 메시징 플랫폼에 맞게 조정되며, 오픈...
2 년 전
0109K
AnyText:生成和编辑多语言图像文本,高可控在图像中生成多行中文

AnyText: 다국어 이미지 텍스트를 생성하고 편집할 수 있으며, 이미지에 여러 줄의 중국어를 생성하도록 고도로 제어할 수 있습니다.

종합 소개 AnyText는 확산 모델을 기반으로 개발된 혁신적인 다국어 시각 텍스트 생성 및 편집 도구입니다. 이미지에서 자연스러운 고품질 다국어 텍스트를 생성하고 유연한 텍스트 편집 기능을 지원합니다. 연구팀이 개발하여 ICLR 2024에서 발표했습니다...
2 년 전
0108.9K
AI2SRT:利用 Gemini模型,一键为长视频创建解说短视频或视频总结

AI2SRT: Gemini 모델을 사용하여 클릭 한 번으로 짧은 내레이션 동영상 또는 긴 동영상의 동영상 요약을 만듭니다.

개요 AI2SRT는 GeminiAI 빅 모델을 사용하여 한 번의 클릭으로 짧은 내레이션 동영상과 긴 동영상의 동영상 요약을 생성하는 동시에 오디오 및 동영상 전사 자막을 지원하는 오픈 소스 프로젝트입니다. 이 프로젝트는 동영상 콘텐츠 제작 과정을 간소화하고 효율적인 자막 생성 및 번역 기능을 제공하는 것을 목표로 합니다. 사용자는 통과할 수 있습니다...
2 년 전
0108.8K
Composio(SWE Kit):一行代码集成150+工具,构建个性化AI智能体

Composio(SWE 키트): 150개 이상의 도구가 한 줄의 코드로 통합되어 개인화된 AI 인텔리전스를 구축할 수 있습니다.

개요 Composio는 개발자를 위해 설계된 AI 인텔리전스 통합 플랫폼으로, 한 줄의 코딩으로 150개 이상의 도구에 AI 인텔리전스와 LLM(대규모 언어 모델)을 원활하게 연결하는 것을 목표로 합니다. 사용자는 한 줄의 코드로 Ope와 같은 여러 도구와 프레임워크를 호출할 수 있습니다.
2 년 전
0108.8K
GLM-PC(智谱牛牛)正式发布内测下载,真正可以控制电脑的AI

컴퓨터를 제어할 수 있는 진짜 AI, GLM-PC(스마트 스펙트럼 불) 사내 다운로드용 정식 출시

GLM-PC (Bull) 소개 GLM-PC는 자연어 명령을 통해 복잡한 작업을 빠르게 수행할 수 있는 코그에이전트 모델 기반의 데스크톱 애플리케이션입니다. 작업 계획 및 인터페이스 이해 능력이 있으며, 사용자 지시에 따라 다양한 컴퓨터 작업을 자율적으로 완료할 수 있습니다. 사용 시 주의사항...
2 년 전
0108.8K
MemeCam:使用AI生成搞笑表情包,在图片中加入搞笑文字,生成有趣的表情包。

MemeCam: AI를 사용하여 재미있는 이모티콘을 생성하고, 사진에 재미있는 텍스트를 추가하여 재미있는 이모티콘을 생성하세요.

일반 소개 MemeCam은 재미있는 이모티콘을 생성하는 데 특화된 혁신적인 AI 기반 플랫폼입니다. 사용자는 웹캠을 사용하여 이미지를 업로드하거나 사진을 찍을 수 있으며, MemeCam은 고급 GPT-4o 기술을 사용하여 이미지를 인식하고 자동으로 재미있는 텍스트를 생성합니다.
2 년 전
0108.8K
Open Deep Research:LangChain开源的深度研究智能助手

오픈 딥 리서치: 심층 연구를 위한 LangChain의 오픈 소스 지능형 비서

종합 소개 Open Deep Research는 모든 주제에 대한 종합적인 연구 보고서를 생성할 수 있는 웹 기반 연구 도우미입니다. 이 시스템은 사용자가 시간이 많이 걸리는 연구 단계로 넘어가기 전에 보고서 구조를 계획하고 검토할 수 있는 계획 및 실행 워크플로우를 사용합니다....
1 년 전
0108.7K
Flow(Laminar):构建智能体的轻量级任务引擎,简化并灵活管理任务

Flow(Laminar): 작업을 간소화하고 유연하게 관리하는 빌딩 인텔리전스를 위한 경량 작업 엔진입니다.

포괄적인 소개 Flow는 단순성과 유연성에 중점을 두고 AI 에이전트 구축을 위해 설계된 경량 작업 엔진입니다. 기존의 노드 및 에지 기반 워크플로우와 달리 Flow는 병렬 실행, 동적 스케줄링 및 지능형 종속성 관리를 지원하는 동적 작업 대기열 시스템을 사용합니다. 핵심 개념은 ...
2 년 전
0108.7K
shadcn/ui:组件库构建平台

SHADCN/UI: 컴포넌트 라이브러리 구축 플랫폼

일반 소개 shadcn/ui는 사용자가 애플리케이션에 복사하여 붙여넣을 수 있는 아름답고 사용자 정의 가능한 UI 컴포넌트를 제공하는 오픈 소스 컴포넌트 라이브러리 구축 플랫폼입니다. 이 플랫폼은 다양한 프런트엔드 프레임워크를 지원하며 개발자가 빠르게 시작할 수 있도록 자세한 설치 및 사용 지침을 제공합니다.
2 년 전
0108.7K
Career Dreamer:职业规划师,使用AI探索职业潜力

커리어 드리머: AI를 활용하여 커리어 잠재력을 탐색하는 커리어 플래너

일반 소개 커리어 드리머는 사용자가 커리어 잠재력을 발견하고 기술을 분석하여 새로운 커리어 경로를 제안할 수 있도록 설계된 Google의 AI 기반 커리어 탐색 도구입니다. 이 도구는 사용자의 배경, 기술 및 관심사를 분석하여 개인화된 커리어 구축을 제공합니다....
2 년 전
0108.6K
Pika:优秀的创意视频生成|文生视频|图生视频|图像视频融合

Pika: 뛰어난 크리에이티브 비디오 생성 | 텍스트-비디오 변환 | 그래픽-비디오 변환 | 이미지-비디오 융합

피카 소개 피카닷아트는 아이디어를 동영상으로 만들어주는 플랫폼으로, 창의적인 사람들에게 인공지능 동영상 제작 도구를 제공하는 것을 목표로 합니다. 재미있는 클립, 소셜 미디어 콘텐츠 또는 단편 영화를 만들고 싶을 때 Pika.art는 사용자의 상상력을 따라갈 수 있습니다. 사용자...
1 년 전
0108.6K
Ichigo(llama3-s):本地实时语音AI助手,开源版Siri

Ichigo(llama3-s): 로컬 실시간 음성 AI 비서, Siri의 오픈 소스 버전

일반 소개 Ichigo는 텍스트 기반 언어 모델을 네이티브 '듣기' 기능으로 확장하는 것을 목표로 하는 오픈 소스 실시간 음성 AI 프로젝트입니다. 이 프로젝트는 메타의 카멜레온 논문에서 영감을 얻은 초기 융합 기술을 사용하며, Ichigo의 목표는 다음과 같습니다.
2 년 전
0108.6K
Engram:为非英语母语者优化写作的AI工具

Engram: 영어가 모국어가 아닌 사용자를 위해 글쓰기를 최적화하는 AI 도구

일반 소개 Engram은 영어가 모국어가 아닌 사용자를 위해 설계된 AI 작문 도구로 문법 검사, 문장 재작성, 번역 등의 핵심 기능을 갖추고 있습니다. 비원어민들이 흔히 저지르는 실수를 분석하여 자연스럽고 유창한 영어를 제안합니다. 웹사이트는 사용하기 쉬우며, 사용자는 텍스트를 입력하고 실시간으로 피드백을 받을 수 있습니다.
1 년 전
0108.6K
MonaLand:超现实AI聊天虚拟世界|互动剧本|角色游戏|虚拟陪伴

모나랜드: 초현실적인 AI 채팅 가상 세계|대화형 스크립트|역할 놀이|가상 동반자

일반 소개 모나랜드는 사용자가 상호작용할 수 있는 다양한 초현실적인 AI 캐릭터 컬렉션을 제공하는 AI 채팅 유니버스 플랫폼입니다. 사용자는 마피아 보스, 마법의 가지 모자, 그루트 등 다양한 가상의 캐릭터와 시나리오 기반의 대화를 나눌 수 있습니다. 일부 캐릭터에는 사이먼 라일리가 포함됩니다.
2 년 전
0108.6K
오케스트라: 더 쉽고 효율적인 협업 다중 지능 개발을 위한 스마트 AI 팀 구축

오케스트라: 더 쉽고 효율적인 협업 다중 지능 개발을 위한 스마트 AI 팀 구축

오케스트라는 대규모 언어 모델(LLM)을 기반으로 다중 지능 협업 시스템을 구축하는 데 중점을 둔 혁신적인 경량 Python 프레임워크입니다. 여러 AI 지능이 교향악단처럼 조화롭게 작동할 수 있도록 지능을 배열하는 고유한 방법을 사용합니다. 모델링으로 ...
2 년 전
0108.5K
SVG.la:从文本或图像转换SVG图形,矢量图形转换

SVG.la: 텍스트 또는 이미지에서 SVG 그래픽 변환, 벡터 그래픽 변환

일반 소개 SVG.la는 디자이너와 개발자를 위한 AI 그래픽 도구 플랫폼으로, 사용자가 간단한 텍스트 설명이나 이미지로 고품질의 SVG 벡터 그래픽을 빠르게 생성할 수 있습니다. 이 플랫폼은 디자인 자료의 자동 생성을 지원할 뿐만 아니라 다음과 같은 다양한 형식 변환 기능도 제공합니다.
2 년 전
0108.5K
Mercor - AI招聘求职平台,匹配全球职位需求

Mercor - 글로벌 채용 니즈에 맞는 AI 채용 플랫폼

Mercor는 구직 및 채용 프로세스를 간소화하는 글로벌 채용을 위한 AI 기반 플랫폼입니다. 구직자는 이력서를 업로드하여 20분간의 AI 면접을 완료하고, Mercor는 사용자의 정보를 전 세계 기업의 수천 개의 구인 요청과 매칭하여 원격 근무 기회를 빠르게 찾습니다.Mercor 핵심 기능...
1 년 전
0108.5K
Browse AI:无代码提取和监控结构化数据

AI 찾아보기: 코드 없이 구조화된 데이터 추출 및 모니터링

Browse Browse AI는 코딩 없이도 모든 웹사이트에서 데이터를 추출하고 모니터링할 수 있도록 설계된 클라우드 기반 웹 자동화 소프트웨어입니다. 마우스 클릭 한 번으로 데이터 추출, 모니터링 및 자동화 작업을 수행하도록 봇을 훈련시킬 수 있습니다....
2 년 전
0108.5K
DeepPiano - 智曲科技推出的AI钢琴应用

DeepPiano - 스마트쿼트 테크놀로지의 인공지능 피아노 앱

딥피아노는 Zhiqu Technology에서 출시한 빅 모델을 핵심으로 하는 지능형 피아노 앱입니다. 고급 인공 지능 기술을 통해 피아노 연주자와 학습자를위한 다양한 편리한 기능을 제공합니다.DeepPiano는 지능형 악보 페이지 넘기기, 연주 진행 상황 자동 인식, 수동 조작이 필요없는 ...
1 년 전
0108.5K
TripoSG:单张图像生成高分辨率3D建模数字资产

TripoSG: 단일 이미지에서 고해상도 3D 모델링 디지털 자산 생성

일반 소개 TripoSG는 단일 이미지에서 고품질 3D 모델을 생성하기 위해 VAST AI 연구팀에서 개발한 오픈 소스 프로젝트입니다. 이 프로젝트는 하이브리드 지도 학습 및 고품질 데이터 세트와 결합된 대규모 정류기-흐름 변환기 기술을 사용하여 생성된 3D 모델이 다음과 같은 기능을 갖출 수 있도록 합니다.
1 년 전
0108.4K
PengChengStarling:对比Whisper-Large v3更小、更快的多语言语音转文字工具

펭청스타링: 위스퍼-Large v3보다 더 작고 빠른 다국어 음성-텍스트 변환 도구

종합 소개 펭청스타링(PengChengStarling, 펭청랩스)은 다양한 언어의 음성을 해당 텍스트로 변환할 수 있는 다국어 자동 음성 인식(ASR) 툴입니다. 이 툴킷은 아이스폴 프로젝트를 기반으로 개발되었으며 완전한 음성 인식 프로세스를 제공합니다...
2 년 전
0108.4K
反谱 - AI音乐转谱平台,支持音频文件转五线谱和简谱

안티스코어 - AI 음악 전사 플랫폼으로, 오디오 파일을 5음계 및 간단한 음악으로 지원합니다.

안티스펙트럼은 첨단 AI 기술을 기반으로 한 혁신적인 온라인 AI 음악 변환 플랫폼으로, 오디오 파일(MP3, FLAC 등)을 펜타토닉 및 간단한 악보로 변환해줍니다. 안티스펙트럼에는 음악의 반주에서 보컬을 분리하는 보컬 분리 기능이 있어 음악 제작과 믹싱을 쉽게 할 수 있습니다. 안티스펙트럼은 미디 파일 변환을 지원합니다...
1 년 전
0108.4K
社媒助手:小红书、抖音等平台数据采集浏览器插件

소셜 미디어 도우미: 샤오홍슈, 지에인 및 기타 플랫폼에서 데이터 수집을 위한 브라우저 플러그인

종합 소개 소셜 미디어 도우미(소셜 미디어 코파일럿)는 샤오홍슈, 지에인과 같은 소셜 미디어 플랫폼용으로 설계된 데이터 수집 브라우저 플러그인입니다. 이 플러그인은 워터마크 없는 이미지 및 동영상 내보내기, 댓글 수집, 작업 데이터 수집, 원클릭 내보내기 등을 지원합니다.
2 년 전
0108.4K
Index-AniSora - B站推出的开源动漫视频生成模型

Index-AniSora - B Station의 오픈 소스 애니메이션 비디오 생성 모델

인덱스-애니소라는 베일리 베일리의 고급 애니메이션 동영상 생성 모델 오픈소스입니다. 이 모델은 단일 사진을 기반으로 일관된 애니메이션 비디오를 생성하고 드라마, 국가 애니메이션, VTuber 콘텐츠 등과 같은 다양한 스타일을 지원할 수 있습니다. 이 모델은 확산 모델 아키텍처를 기반으로하며 시공간 마스크 모듈과 결합 된 3D ...
1 년 전
0108.3K
Fast-Agent:声明式语法和MCP集成快速构建多智能体工作流

빠른 에이전트: 다중 지능형 바디 워크플로를 빠르게 구축하기 위한 선언적 문법 및 MCP 통합

일반 소개 Fast-Agent는 개발자가 다중 지능 워크플로를 신속하게 정의, 테스트 및 구축할 수 있도록 설계된 GitHub의 평가 팀이 관리하는 오픈 소스 도구입니다. 이 도구는 간단한 선언적 구문을 기반으로 하며 MCP(모드...
2 년 전
0108.3K
DomoAI:智能视频艺术风格转换|图像转视频|文本转视频

DomoAI: 지능형 비디오 아트 스타일 변환|이미지를 비디오로 변환|텍스트를 비디오로 변환

일반 설명 DomoAI는 최근 기존 동영상을 완전히 다른 아트 스타일로 변환하여 놀라운 결과물을 제공하는 비디오 투 비디오 기능을 출시했습니다. 이 기능을 통해 사용자는 독특한 스타일의 비주얼 아트를 쉽게 만들 수 있습니다. 플랫폼에 포함된 다른 기능으로 정지 이미지를 모션 비디오로, 텍스트를 사진으로 변환할 수 있습니다.
2 년 전
0108.3K
AgentIQ:灵活连接和管理AI智能体的开源工具

AgentIQ: AI 인텔리전스의 유연한 연결 및 관리를 위한 오픈 소스 도구

일반 소개 에이전트IQ는 개발자가 AI 인텔리전스를 효율적으로 연결하고 관리할 수 있도록 설계된 NVIDIA의 오픈 소스 툴입니다. 이를 통해 서로 다른 프레임워크의 인텔리전스를 원활하게 협업하고, 엔터프라이즈 데이터와 도구를 연결하고, 함수 호출과 같은 워크플로우를 구축할 수 있습니다. 이 도구의 가장 큰 장점은...
1 년 전
0108.3K
Sketch-Gen:生成高质量线稿和草图,反推图像提示词,一键安装包

Sketch-Gen: 고품질 선화 및 스케치 생성, 이미지 단서 단어 역전파, 원클릭 패키지 설치

일반 소개 Sketch-Gen은 아티스트와 디자이너가 고품질의 선화와 스케치를 빠르게 생성할 수 있도록 설계된 AI 기술 기반의 선화 및 스케치 생성 도구입니다. 페인츠-언두 프로젝트에서 파생된 이 도구는 고급 머신 러닝 모델을 사용해 다음을 수행할 수 있습니다.
2 년 전
0108.3K
COSINE:智能理解代码库,让开发者轻松理解和编写代码的AI工具(内测)

COSINE: 개발자가 코드를 쉽게 이해하고 작성할 수 있도록 도와주는 AI 도구, 지능형 코드베이스 이해(베타 버전)

일반 소개 코사인은 최신 소프트웨어 개발자를 위한 심층적인 코드베이스 이해 및 분석 서비스를 제공하는 혁신적인 AI 기반 코드 이해 플랫폼입니다. 50개 이상의 프로그래밍 언어를 지원하는 이 플랫폼은 전문 검색 엔진, 벡터 데이터베이스, 그리고 ...를 결합한 고유한 기술 아키텍처를 사용합니다.
2 년 전
0108.2K
Rows:数据驱动的电子表格工具

행: 데이터 기반 스프레드시트 도구

종합 소개 행은 데이터 가져오기, 변환, 공유를 간소화하도록 설계된 혁신적인 스프레드시트 도구입니다. 기존 스프레드시트의 기능을 제공할 뿐만 아니라 실시간 데이터 보고와 자동화된 데이터 분석 기능도 통합되어 있습니다. 간단한 인터페이스와 코드 작성 없이도 사용자는 강력한 ...
2 년 전
0108.2K
BrushEdit:腾讯ARC发布的图像修复和编辑的全能工具

BrushEdit: Tencent ARC에서 출시한 이미지 복원 및 편집을 위한 올인원 도구

종합 소개 BrushEdit는 Tencent ARC Labs에서 개발한 올인원 이미지 복구 및 편집 도구입니다. 이 도구는 최신 AI 기술을 기반으로 하며 이미지의 결함을 자동으로 식별하고 복구하는 동시에 사용자의 대화형 편집을 지원할 수 있으며, BrushEdit는 다양한 기능을 결합합니다.
2 년 전
0108.2K
AnimeGamer:用语言指令生成动漫视频和角色互动的开源工具

AnimeGamer: 언어 명령으로 애니메이션 동영상 및 캐릭터 상호작용을 생성하는 오픈 소스 도구

AnimeGamer는 텐센트 ARC Lab의 오픈 소스 툴입니다. 사용자는 "소우스케가 보라색 차를 타고 돌아다녀"와 같은 간단한 언어 명령으로 애니메이션 동영상을 생성할 수 있으며, 마법의 소녀의 모험과 스카이 시티의 키키와 같은 다양한 애니메이션 캐릭터가 서로 상호작용할 수 있습니다.
1 년 전
0108.2K
天工AI:全能AI助手,助力高效工作与生活

Tiangong AI: 효율적인 업무와 생활을 위한 만능 AI 비서

종합 소개 티안공 AI는 검색, 대화, 작문, 문서 분석, 그림 그리기, PPT 제작 등 다양한 기능을 통합한 중국 최초의 만능 AI 비서입니다. 고급 AI 기술을 통해 사용자의 의도를 이해하고, 인터넷 전체에서 정보를 검색하고, 일반화, 요약 및 통합하여 고품질의 아니오를 출력 할 수 있습니다.
2 년 전
0108.2K
MCP Server ChatSum:依赖MCP在Claude中查询和总结微信聊天消息

MCP 서버 ChatSum: MCP를 사용하여 Claude에서 WeChat 메시지 쿼리 및 요약하기

일반 소개 MCP 서버 ChatSum은 사용자가 채팅 메시지를 쿼리하고 요약할 수 있도록 설계된 오픈 소스 프로젝트입니다. 이 프로젝트는 GitHub에서 호스팅되며 사용자가 특정 매개변수를 기반으로 채팅 로그를 쿼리하고 해당 요약을 생성할 수 있는 강력한 도구 세트를 제공합니다....
2 년 전
0108.2K
Midjourney:创造你想象中的图像|Midjourney中文官网介绍|官网开放免费测试

미드저니: 상상 속의 이미지 만들기| 미드저니 중국어 웹사이트 소개| 무료 테스트용 공식 웹사이트 오픈

미드저니 소개 미드저니는 새로운 사고의 매체를 탐구하고 인류의 상상력을 확장하는 독립 연구실입니다. 텍스트 설명을 기반으로 이미지를 생성하는 AI 서비스를 제공하여 사용자가 사실적인 풍속화부터 추상적인 풍속화까지 다양한 예술 형식을 만들 수 있도록 합니다.
2 년 전
0108.1K
老师帮 - AI教师工作助手,支持课件一键转PPT

교사의 도움 - 한 번의 클릭으로 교사의 업무 도우미, 코스웨어에서 PPT로 전환 지원

교사 도움말은 교사의 업무 효율성과 수업의 질을 향상시키기 위해 AI 기술을 기반으로 교사를 위해 설계된 AI 지능형 도구 플랫폼입니다. 이 플랫폼은 수업 계획서 생성, 코스웨어를 PPT로 원클릭 변환, 숙제 및 시험 문제 설계, 학생 댓글 생성, 수업 계획서 작성 등 다양한 기능을 제공합니다. 이 플랫폼은 텍스트 번역을 지원합니다...
1 년 전
0108K
Leon:用语音交流的个人助理,创建自定义技能完成各类任务,保护隐私,离线运行

Leon: 음성으로 소통하고, 모든 종류의 작업을 완료하는 맞춤형 기술을 만들고, 개인 정보를 보호하고, 오프라인에서 실행되는 개인 비서

일반 소개 Leon은 서버에서 실행되는 오픈 소스 개인 비서입니다. 사용자가 요청한 작업을 수행하고 음성 또는 텍스트를 통해 사용자와 상호 작용할 수 있으며, 개인 정보 보호를 강조하고 오프라인 작업을 지원하며 사용자가 사용자 지정 기술을 생성 및 공유하여 기능을 확장할 수 있습니다.
2 년 전
0108K
Perplexica:1比1复刻 Perplexity AI 功能和界面的开源AI搜索引擎

퍼플렉시카: 퍼플렉시 AI의 기능과 인터페이스를 1:1로 복제하는 오픈 소스 AI 검색 엔진

일반 소개 퍼플렉시카는 인터넷을 깊이 파고드는 답변을 제공하도록 설계된 오픈 소스 AI 기반 검색 엔진입니다. 유사성 검색 및 임베딩 기술과 같은 고급 머신 러닝 알고리즘을 사용하여 검색 결과를 최적화하고 인용된 출처와 함께 명확한 답변을 제공합니다.
2 년 전
0107.9K
闲鱼卖家全天自动值守的AI客服机器人

Idle Fish 판매자가 24시간 자동으로 유인하는 AI 고객 서비스 봇

종합 소개 XianyuAutoAgent는 개발자 shaxiu가 GitHub에서 오픈소스로 공개한 Idlefish 플랫폼용으로 설계된 지능형 고객 서비스 로봇 시스템입니다. AI 기술을 사용하여 7×24 시간 자동 근무를 수행하여 유휴 물고기 판매자가 응답할 수 있도록 지원합니다.
2 년 전
0107.9K
法行宝:AI法律顾问,人工智能法律咨询,百度AI法律平台

Fa Xing Bao: AI 법률 고문, 인공지능 법률 자문, 바이두 AI 법률 플랫폼

종합 소개 로신바오는 바이두에서 출시한 지능형 법률 서비스 플랫폼으로, 첨단 인공지능 기술과 전문 법률 지식 기반을 통합한 플랫폼입니다. 이 플랫폼은 사용자에게 지능형 법률 Q&A, 판례 분석, 계약서 검토 및 기타 기능을 포함한 편리하고 전문적인 법률 지능형 서비스를 제공하는 데 전념하고 있습니다. 딥러닝을 통해 ...
2 년 전
0107.9K
They See Your Photos:基于 Google Vision 照片隐私信息分析

그들은 내 사진을 본다: Google 비전을 기반으로 한 사진 개인정보 정보 분석

일반 소개 그들이 당신의 사진을 봅니다는 사용자가 자신의 사진에 숨겨진 개인 정보를 이해할 수 있도록 설계된 사용하기 쉬운 온라인 도구입니다. 사용자는 어떤 이미지든 업로드할 수 있으며, 웹사이트는 인공 지능 기술을 통해 이미지 콘텐츠와 메타데이터를 분석하여 사진에서 드러날 수 있는 세부 정보를 표시합니다.
1 년 전
0107.9K
通义千问:阿里推出的多模态大模型,拥有文本回答、图片理解、视频解析能力

통이 천 개의 질문: 텍스트 응답, 이미지 이해, 동영상 구문 분석 기능을 갖춘 알리에서 출시한 대형 멀티모달 모델입니다.

종합 소개 통이천문은 알리윈이 개발한 지능형 빅모델로 딥러닝과 자연어 처리 기술을 통해 인간과 같은 상호작용 경험을 제공하는 것을 목표로 합니다. 창의적인 문구를 빠르게 생성하여 삶에 재미를 더하고 사용자가 모든 종류의 지식을 쉽게 배울 수 있도록 도와주는 학습 도우미 역할을 할 수 있습니다. 최첨단 기술과 진화하는 ...
2 년 전
0107.9K
BuffGPT:企业级生成式AI应用低代码开发平台

BuffGPT: 엔터프라이즈급 제너레이티브 AI 애플리케이션을 위한 로우코드 개발 플랫폼

개요 BuffGPT는 대규모 언어 모델(LLM) 기반의 오픈 소스 AI 애플리케이션 개발 플랫폼으로, 데이터 처리, 모델 호출, RAG 검색, 시각적 워크플로 오케스트레이션 등의 기본 기능을 제공하여 사용자가 제너레이티브 AI 애플리케이션을 쉽게 구축하고 운영할 수 있도록 지원합니다. 이 플랫폼은 프라이빗을 지원합니다.
2 년 전
0107.7K
ANP:实现智能代理间安全高效通信的开源协议

ANP: 지능형 에이전트 간의 안전하고 효율적인 통신을 위한 오픈 소스 프로토콜

일반 소개 에이전트네트워크프로토콜(줄여서 ANP)은 지능형 에이전트(AI 에이전트)를 위한 안전하고 효율적인 커뮤니케이션 솔루션을 제공하는 데 중점을 둔 오픈 소스 프로토콜 프로젝트로, GitHub에서 호스팅되고 있습니다. 이 프로젝트는 ID와 암호화의 3계층 아키텍처를 통해 작동합니다...
2 년 전
0107.7K
uni-api:轻量大模型API转换为OpenAI接口,YAML文件配置API渠道

uni-api: OpenAI 인터페이스로 변환된 경량 빅 모델 API, API 채널을 구성하기 위한 YAML 파일

포괄적인 소개 프런트엔드, 순수 구성 파일 구성 API 채널이 없습니다. 파일을 작성하기 만하면 자체 API 스테이션을 실행할 수 있으며 문서에는 흰색 친화적 인 자세한 구성 가이드가 있습니다. uni-api는 대규모 모델 API 프로젝트의 통합 관리로, 통합 된 ...
2 년 전
0107.7K
Dify-Plus:为Dify开发的企业内部管理后台

Dify-Plus: Dify를 위한 온프레미스 관리 백엔드

포괄적인 소개 Dify-Plus는 Dify 오픈 소스 프로젝트의 2차 개발을 기반으로 하는 AI 애플리케이션 개발 플랫폼입니다. Dify에 기반한 새로운 관리 센터를 추가하고 기업 시나리오에 맞게 기능을 최적화합니다. 이 프로젝트는 처음에 기업 내부용으로 개발되었으나 나중에 커뮤니티에도 비슷한 요구가 있다는 것을 알게 되었습니다.
1 년 전
0107.7K
VideoLingo:视频转录单词级时间轴字幕,视频字幕翻译和本地化配音开源工具

VideoLingo: 동영상 트랜스크립션 단어 수준 타임라인 자막, 동영상 자막 번역 및 현지화된 더빙 오픈 소스 도구

일반 설명 VideoLingo는 원시 기계 번역과 여러 줄의 자막을 제거하고 고품질 음성 해설을 추가하여 언어 장벽을 넘어 글로벌 지식을 공유할 수 있도록 넷플릭스 수준의 고품질 자막을 생성하도록 설계된 원스톱 동영상 번역 및 현지화 더빙 도구입니다. By...
2 년 전
0107.7K
ImageTranslate:快速翻译图片文字的在线工具

이미지 번역: 이미지 텍스트의 빠른 번역을 위한 온라인 도구

일반 소개 이미지 번역은 이미지에서 텍스트를 번역하도록 설계된 사용하기 쉬운 온라인 도구입니다. OCR(광학 문자 인식) 기술을 사용하여 이미지에서 텍스트를 추출한 다음 사용자가 필요로 하는 언어로 빠르게 번역합니다. 이 웹사이트는 다음을 포함한 40개 이상의 언어를 지원합니다.
1 년 전
0107.6K
Motionvid.ai:用文字或草图快速生成演示动画视频

Motionvid.ai: 텍스트 또는 스케치가 포함된 프레젠테이션용 애니메이션 동영상을 빠르게 생성합니다.

일반 소개 Motionvid.ai는 인공 지능을 사용하여 사용자가 전문적인 애니메이션 동영상을 빠르게 만들 수 있도록 도와주는 온라인 도구입니다. 이 도구의 가장 큰 특징은 텍스트 설명이나 손으로 그린 스케치를 통해 몇 초 만에 부드러운 역동성과 고품질 시각 효과를 갖춘 애니메이션을 생성할 수 있다는 것입니다. 사용자는 복잡한 기능을 익힐 필요가 없습니다.
1 년 전
0107.6K
Happy Scribe:音频转录和视频字幕平台|免费视频字幕编辑软件

해피 스크라이브: 오디오 트랜스크립션 및 비디오 자막 플랫폼 | 무료 비디오 자막 소프트웨어

해피 스크라이브 일반 설명 해피 스크라이브는 여러 언어와 형식을 지원하고 높은 정확도로 오디오를 텍스트로 변환하는 자동 및 수동 오디오 전사 서비스를 제공합니다. 대화형 편집기, 협업 도구, 여러 내보내기 형식, 기계 번역 및 기타 기능이 포함되어 있습니다....
2 년 전
0107.6K
MagicMirror:AI一键换脸、发型和穿搭的轻量级本地客户端

MagicMirror: AI 원클릭 얼굴, 헤어, 의상 변경을 위한 경량 네이티브 클라이언트

일반 소개 MagicMirror는 사용자에게 편리한 인물 사진 편집 경험을 제공하는 데 중점을 둔 혁신적인 AI 이미지 처리 도구입니다. 고급 AI 기술을 사용하여 사용자가 쉽게 얼굴을 바꾸고, 헤어스타일을 바꾸고, 다양한 분장 효과를 시도할 수 있습니다. 가벼운 앱으로, ...
2 년 전
0107.6K
Agentic Security:开源的LLM漏洞扫描工具,提供全面的模糊测试和攻击技术

에이전틱 보안: 포괄적인 퍼즈 테스트 및 공격 기법을 제공하는 오픈 소스 LLM 취약점 스캔 도구

일반 소개 에이전트 보안은 개발자와 보안 전문가에게 포괄적인 퍼즈 테스트 및 공격 기술을 제공하도록 설계된 오픈 소스 LLM(대규모 언어 모델) 취약점 스캔 도구입니다. 이 도구는 사용자 지정 규칙 세트 또는 에이전트 기반 공격을 지원하며 LLM AP를 통합할 수 있습니다.
2 년 전
0107.5K
Langui:开源的AI用户界面组件库

Langui: AI 사용자 인터페이스 구성 요소의 오픈 소스 라이브러리

일반 소개 LangbaseInc의 Langui는 제너레이티브 AI 및 LLM(대규모 언어 모델링) 프로젝트를 위해 설계된 오픈 소스 사용자 인터페이스 컴포넌트 라이브러리입니다. 이 라이브러리는 Tailwind CSS를 기반으로 하며 개발자가 빠르게 구성할 수 있도록 미리 빌드된 UI 컴포넌트 모음을 제공합니다.
2 년 전
0107.5K
SegAnyMo:从视频中自动分割任意运动物体的开源工具

SegAnyMo: 동영상에서 임의의 움직이는 객체를 자동으로 분할하는 오픈 소스 도구

일반 소개 SegAnyMo는 UC 버클리와 북경대학교의 연구팀이 개발한 오픈 소스 프로젝트로, Nan Huang 등의 멤버가 참여하고 있습니다. 이 도구는 동영상 처리에 중점을 두고 있으며 동영상에서 사람, 동물 또는... 등 임의의 움직이는 물체를 자동으로 식별하고 세그먼트화할 수 있습니다.
1 년 전
0107.5K
MegaParse:解析各类型文档为LLM可用数据,完整保留文档中的表格、图片等所有信息

MegaParse: 각 유형의 문서를 LLM 사용 가능한 데이터로 구문 분석하여 표와 그림 등 문서의 모든 정보를 전체적으로 보존합니다.

일반 소개 MegaParse는 대규모 언어 모델(LLM)의 데이터 처리를 최적화하도록 설계된 강력하고 다재다능한 문서 구문 분석 도구입니다. 텍스트, PDF, PowerPoint 프레젠테이션, Word 문서 등 어떤 작업을 하든 MegaParse...
2 년 전
0107.5K
VideoRAG:理解超长视频的RAG框架,支持多模态检索和知识图谱构建

VideoRAG: 멀티모달 검색 및 지식 그래프 구성을 지원하여 매우 긴 동영상을 이해하기 위한 RAG 프레임워크입니다.

포괄적인 소개 VideoRAG는 매우 긴 컨텍스트 비디오를 처리하고 이해하도록 설계된 검색 강화 생성 프레임워크입니다. 이 도구는 그래프 중심의 텍스트 지식 기반과 계층적 멀티모달 컨텍스트 인코딩을 결합하여 단일 NVIDIA RTX 3090 GPU에서 효율적으로 처리합니다....
2 년 전
0107.5K
Edraw.AI(亿图):在线协作白板工具,AI生成流程图和多种图表

Edraw.AI: 온라인 협업 화이트보드 도구, AI가 생성한 순서도 및 여러 도표

종합 소개 Edraw.AI는 40개 이상의 지능형 도구와 세심하게 디자인된 템플릿 라이브러리를 통합한 혁신적인 AI 기반 온라인 비주얼 화이트보드 협업 플랫폼입니다. 이 플랫폼은 고급 AI 기술을 사용하여 사용자의 텍스트 생각을 전문적인 시각적 다이어그램으로 빠르게 변환합니다. 이 플랫폼은 다음을 지원합니다.
2 년 전
0107.5K
CogVLM2:开源多模态模型,支持视频理解与多轮对话

CogVLM2: 비디오 이해와 여러 차례의 대화를 지원하는 오픈 소스 멀티모달 모델

종합 소개 CogVLM2는 칭화대학교 데이터 마이닝 연구 그룹(THUDM)에서 개발한 오픈 소스 멀티모달 모델로, Llama3-8B 아키텍처를 기반으로 하며 GPT-4V와 비슷하거나 더 나은 성능을 제공하는 것을 목표로 합니다. 이 모델은 이미지 이해, 다원 대화, 시각적 ...
2 년 전
0107.4K