Tizzy.ai는 바이두에서 출시 한 AI 지능형 검색 애플리케이션으로, 강력한 지능형 검색 기능을 갖춘 바이두의 빅 모델 기술을 기반으로하며 질문에 빠르게 답하고 깊이 생각하고 의사 결정을 지원할 수 있습니다.Tizzy.ai는 인터페이스가 간단하고 광고와 팝업이 없으며 가이드 하단에 ...
MagicTryOn은 절강대학교 컴퓨터 과학 기술 대학이 생체 및 기타 조직과 협력하여 출시한 고급 비디오 가상 체험 프레임워크입니다. 이 프레임워크는 기존의 U-Net 아키텍처를 혁신적인 확산 트랜스포머(DiT) 아키텍처로 대체하고, 완전히 스스로 인식하는 기계와 결합하여 ...
캥거루 스태프는 메이투안에서 출시한 판매자 중심의 AI 지능형 의사결정 애플리케이션으로, 판매자가 매장을 개설하고 운영할 때 발생하는 문제를 해결하는 데 도움을 줍니다. 메이퇀의 방대한 케이터링 데이터와 10년 이상의 온라인 운영 경험을 바탕으로 대화 상호 작용을 통해 판매자에게 트랙 선택, 매장 오픈 위치, 요리 개발, 매장 운영 및 기타 시나리오에 대한 정확한 정보를 제공합니다....
Paperpal은 학술 글쓰기에 초점을 맞춘 AI 보조 도구로, 연구자, 학생, 전문가들이 글쓰기의 품질과 효율성을 향상시킬 수 있도록 도와줍니다. 강력한 언어 수정 기능을 통해 문법 검사, 맞춤법 교정, 단어 선택 제안 기능을 제공하여 정확하고 유창한 텍스트를 작성할 수 있도록 도와줍니다.
바젤은 바이트댄스에서 오픈소스화한 멀티모달 기본 모델로, 140억 개의 파라미터가 있으며 이 중 70억 개가 활성화되어 있습니다. 모델 베이스와 두 개의 독립적인 인코더로 이미지의 픽셀 수준과 의미 수준 특징을 각각 캡처하는 혼합 트랜스포머 전문가 아키텍처(MoT)는 이미지, 텍스트, 비디오의 효율적인 처리를 지원합니다....
V-JEPA 2는 메타 AI의 12억 개의 파라미터가 포함된 비디오 데이터를 기반으로 한 대규모 세계 모델입니다. 이 모델은 100만 시간 이상의 비디오와 100만 장의 이미지를 통한 자가 지도 학습을 기반으로 학습되었으며, 실제 세계의 사물, 동작, 작동을 이해합니다.
AI Jitterbug는 사용자에게 보다 효율적이고 지능적인 콘텐츠 수집 경험을 제공하기 위해 Jitterbug에서 출시한 지능형 딥씽킹 및 검색 애플리케이션입니다. Jitterbug의 강력한 콘텐츠 에코시스템과 AI 기술을 기반으로 연결된 검색 및 추론 기능을 통해 사용자에게 보다 포괄적이고 상세한 답변을 제공합니다.
인공지능 튜토리얼 초창기에 가장 인기 있었던 수익 창출 아이디어는 동화 그림책 만드는 법을 알려주는 것이었고, 이는 이후 동화 애니메이션을 낳았으며, 이러한 동영상은 너무 쉽게 볼 수 있어서 조작하자마자 멈칫하게 됩니다. 그 이유는 여전히 문턱이 약간 높고 콘텐츠와 생성된 이미지의 품질이 걱정되기 때문입니다. 하지만 ... GPT 및 클라우드 생성...
AopsAI는 오래된 사진을 역동적인 짧은 동영상으로 변환하는 온라인 AI 도구입니다. 이 도구는 첨단 AI 기술을 기반으로 정지된 사진을 '움직이게' 만들어 과거의 아름다운 순간을 재현합니다. 사용자가 사진을 업로드하고 이메일 주소를 제공하면 AopsAI가 24시간 이내에 자동으로 동영상을 생성하여 다음 주소로 전송합니다.
Sparkify는 Google에서 출시한 AI 애니메이션 동영상 생성 플랫폼입니다. 이 플랫폼은 Gemini 2.5 및 Veo2 모델을 기반으로 하며, 사용자가 질문이나 복잡한 개념을 입력하면 Sparkify가 관련 지식 포인트를 설명하는 직관적인 짧은 애니메이션 동영상을 2분 안에 생성합니다. 이 플랫폼은 텍스트, 이미지 및 ...
종합 소개 D-Human은 중국과학원 연구 개발 박사가 이끄는 샤오미가 투자한 디지털 휴먼 비디오 제작 플랫폼입니다. SaaS, API, OEM 다중 협력 방식을 지원하며 1:1 실사 복원 기술, 8분 분량의 동영상 자료를 제공하여 본인 또는 다른 사람을 복제할 수 있습니다. 이 플랫폼은 제작 시간을 크게 줄여줍니다...
InteriorGS는 큐나 테크놀로지가 도입한 고품질 3D 가우시안 시맨틱 데이터 세트입니다. 이 데이터 세트에는 집, 편의점, 예식장, 박물관 등 80개 이상의 실내 환경을 포함하는 1,000개의 3D 장면이 포함되어 있습니다. 이 데이터 세트에는 755개 카테고리의 554,000개 이상의 객체 인스턴스가 포함되어 있습니다...
하이프노트는 사용자의 개인정보를 보호하고 회의 효율성을 개선하기 위해 전문가를 위해 설계된 로컬 우선의 오픈 소스 AI 회의 노트 필기 도구입니다. '로컬 우선' 원칙을 채택하여 모든 데이터 저장과 처리가 사용자의 로컬 장치에서 이루어지므로 데이터 보안을 보장하고 오프라인 작업을 지원합니다.
젠플로우 슈퍼 히치하이커는 바이두 문헌 라이브러리에서 출시한 범용 AI 에이전트로, 사용자는 자연어 명령만 입력하면 작업을 독립적으로 분해하고 바이두 문헌 라이브러리의 14억 개 문서 라이브러리와 온라인 리소스를 호출하여 PPT, 보고서, 차트, 포스터 및 기타 전체 모달 콘텐츠를 매우 빠른 방식으로 생성할 수 있습니다.
Make는 조직이 자동화된 프로세스를 기반으로 효율성과 혁신을 개선할 수 있도록 지원하는 AI 기반의 코딩 없는 자동화 플랫폼입니다. 이 플랫폼은 마케팅, 영업, 재무 등 다양한 비즈니스 시나리오를 지원하는 2,000개 이상의 사전 구축된 앱을 제공합니다. Make의 핵심 기능에는 코드 없는 시각적 프로세스 생성, AI...
밍유니오디오는 텍스트, 오디오, 이미지, 비디오의 혼합 입력 및 출력을 지원하는 Ant Group의 오픈 소스 통합 오디오 멀티모달 생성 모델입니다. 멀티스케일 트랜스포머 및 혼합 전문가(MoE) 아키텍처를 사용하여 모달 인식 라우팅 메커니즘을 통해 크로스 모달을 효율적으로 처리합니다.
Comate AI IDE는 바이두 웬신 익스프레스 코드에서 출시한 업계 최초의 멀티 모달, 다중 지능체 협업 AI 네이티브 IDE로, 강력한 멀티 모달 기능, 프런트엔드 개발 시나리오에서 키 투 코드(F2C), 이미지 투 코드, 자연어 투 코드의 설계 초안 지원, 뛰어난 성능으로 뛰어난 ...
후위안 3D 파트(하이브리드 3D 파트)는 텐센트에서 공개하고 오픈소스로 제공하는 3D 생성 모델입니다. P3 - SAM과 X - Part로 구성된 이 모델은 최초로 고정밀 제어가 가능한 컴포넌트 기반 3D 생성을 실현하여 자동으로 생성되는 50개 이상의 컴포넌트를 지원합니다. 사용자는 먼저 사용할 수 있습니다...
붐컷은 리틀 섀도우 테크놀로지가 출시한 AI 크로스보더 마케팅 동영상 로컬라이제이션 툴입니다. 이 도구는 고급 립싱크 드라이브 및 톤 복제 기술을 기반으로 하는 강력한 기능을 갖추고 있어 다양한 국가 및 지역의 사용자의 언어 요구 사항을 충족하는 다국어 버전의 음성 동영상을 신속하게 생성할 수 있습니다.
진뮤직 그랜드 모델은 텐센트 AI 랩과 텐센트 TME 티엔친 랩이 공동으로 출시한 고급 AI 음악 창작 그랜드 모델입니다. 이 모델은 사용자가 입력한 키워드, 설명 문구 또는 영어와 중국어로 된 오디오 클립을 기반으로 고품질 스테레오 오디오 또는 멀티 트랙 악보를 지능적으로 생성합니다.
MineContext는 사용자가 방대한 양의 정보를 효율적으로 관리하고 지식 업무의 효율성을 개선할 수 있도록 돕기 위해 ByteDance Viking 팀이 오픈소스로 제공하는 적극적인 상황 인식 AI 파트너입니다. 스크린샷 및 콘텐츠 이해 기술을 통해 사용자의 일상적인 작업(예: 웹 검색, 문서 편집 등)을 자동으로 기록하고, 지원...
ChartAI는 AI 기술을 기반으로 데이터를 자동으로 분석하여 복잡한 정보를 빠르게 이해할 수 있는 직관적인 차트를 생성하는 효율적인 데이터 시각화 도구로, 다양한 데이터 형식(예: Excel, CSV)의 가져오기를 지원하며 가장 적합한 차트를 지능적으로 추천합니다...
AIMangaStudio는 창작자에게 줄거리 생성, 서브 장면 디자인, 캐릭터 설정 및 기타 기능을 포함한 완벽한 만화 제작 파이프라인을 제공하는 무료 AI 만화 제작 도구로, 스크립트에서 만화 페이지까지 제작 프로세스를 간소화할 수 있습니다. 줄거리, 대사를 포함한 만화 대본의 자연어 생성을 지원합니다.
종합 소개 원더풀 달러는 디지털 페르소나 동영상 제작 및 라이브 스트리밍 서비스를 위한 플랫폼으로, 사진과 PPT로 동영상을 생성하는 기능과 다양한 언어로 동영상을 번역하는 서비스를 제공합니다. 사용자는 뉴스 보도, 교육 콘텐츠, 기업 홍보 및 기타 여러 분야에 맞게 디지털 캐릭터를 커스터마이징할 수 있습니다. 이 플랫폼은 또한 대화형 디지털 인물을 제공합니다.
하이브리드 3D 3.0은 3D-DiT 계층적 조각 기술을 기반으로 한 텐센트의 고급 3D 세대 모델로, 최대 1536³의 기하학적 해상도로 초고화질, 디테일이 풍부한 3D 모델을 생성할 수 있으며 오감 및 체형을 정확하게 형상화하는 등 캐릭터 모델링에 탁월한 능력을 갖추고 있습니다.
Paper2Slides는 홍콩대학교 데이터 인텔리전스 연구소의 오픈 소스 AI 도구로, 클릭 한 번으로 학술 논문을 전문적인 슬라이드나 포스터로 변환해 줍니다. 네트워크 정보에 의존하지 않고 문서 내용을 직접 구문 분석하는 RAG(검색 증강 생성) 기술을 사용하여 생성된 PPT가 원본과 매우 일치하도록 보장합니다.
일반 소개 GitaGPT는 바가바드 기타의 지혜를 바탕으로 한 인공지능 챗봇으로, 사용자가 일상 생활에서 궁금한 점에 대한 답을 찾을 수 있도록 설계되었습니다. 이 플랫폼은 ChatGPT 기술을 활용하여 간결하고 통찰력 있는 답변을 제공하여 사용자의 영적 개발, 감정 관리 및 리더십 향상에 도움을 줍니다....
퀀이미지는 알리바바 통이 첸첸 팀이 공개한 오픈 소스 이미지 생성 기본 모델입니다. 200억 개의 매개 변수로 멀티모달 이해, 고해상도 코딩, 확산 모델링의 세 가지 모듈을 통합하는 멀티모달 확산 트랜스포머 아키텍처(MMDiT)를 채택하고 있습니다.Qwen-Image의...
Gemini CLI는 개발자에게 강력한 AI 기능을 제공하기 위해 Gemini 빅 모델을 개발자의 엔드포인트에 통합한 Google의 오픈 소스 AI 프로그래밍 도구입니다. 이 도구는 코드를 이해하고, 파일을 조작하고, 명령을 실행하고, 동적으로 문제를 해결하여 개발자가 효율적으로 생성 코드를 작성할 수 있도록 도와줍니다.
일반 설명 AI 기업 리서치 어시스턴트는 기업 리서치 및 리드 생성 프로세스를 자동화하도록 설계된 인공지능 기반 도구입니다. 이 도구는 LangGraph 및 FireCrawl과 같은 기술을 사용하여 단 몇 분 만에 상세한 기업 리서치 보고서를 생성할 수 있습니다. 사용자는 간단히 다음을 수행하면 됩니다.
GPT-5는 OpenAI가 여러 가지 업그레이드를 통해 출시한 최신 언어 모델입니다. 문제의 복잡성에 따라 효율적인 모드와 심층 사고 모드를 자동으로 전환하여 빠른 응답과 정확한 답변을 가능하게 하는 실시간 라우터가 내장된 통합 지능 시스템입니다.GPT-5에는 푸시용을 포함하여 여러 버전이 있습니다....
일반 소개 하이퍼볼릭 에이전트키트는 블록체인과 컴퓨팅 파워를 결합하여 AI 에이전트를 실행하기 위한 템플릿을 제공하는 것을 목표로 하는 오픈 소스 프로젝트입니다. 이 프로젝트는 코인베이스의 CDP 에이전트킷을 기반으로 하며, 터미널을 지원하기 위한 수정 및 확장 기능을 갖추고 있습니다.
종합 소개 위챗 디지털 피플은 가상 이미지 방송과 실시간 대화형 서비스 제공에 중점을 둔 첨단 AI 기술이 통합된 플랫폼입니다. 이 플랫폼은 자체 개발한 음성 인식, 음성 합성, 다중 모드 인식 및 문서 Q&A 기술을 사용하여 사용자가 비디오 제작, 번역, 교육을 지원할 수 있도록 사실적인 디지털 인간 도플갱어를 만듭니다.
샤오싱슈는 징동건강이 출시한 AI 감정 만화 생성 제품으로 현재 테스트 단계에 있으며, 이 제품은 감정 중심의 만화 스토리 생성이 핵심 기능으로, 사용자가 음성이나 텍스트 입력을 통해 감정을 표현하거나 이야기를 전달하면 AI가 입력에 따라 그에 맞는 4컷 만화와 스토리 해석을 생성해줍니다.
채용 스튜디오는 채용팀이 직무별 면접 질문을 효율적으로 만들 수 있도록 지원하는 AI 채용 면접 지원 툴입니다. 이 도구는 AI 기술을 기반으로 면접 질문을 생성하고, 후속 질문을 제안하며, 다양한 답변 품질에 대한 평가 기준을 생성합니다. 이 도구는 STAR 방식을 지원합니다...
유다오 리틀 P는 넷이즈 유다오에서 출시한 AI 전과목 학습 도우미로, 초등학교, 중학교, 고등학교 전과목 Q&A를 다루고 개인화된 학습 조언을 제공하는 유다오 즈이 교육 빅 모델을 탑재하여 초중고 학생들을 위해 설계되었습니다. 인공지능 단어 검색 및 인공지능 번역 기능을 갖춘 Youdao Little P는 학생들이 언어 문제를 빠르게 해결할 수 있도록 도와줍니다.
Seed-OSS는 긴 텍스트와 추론 작업에 중점을 둔 Byte Jump Seed 팀이 오픈소스화한 대규모 언어 모델 제품군입니다. 이 모델은 복잡한 논리적 추론과 다단계 추론에서 높은 정확도로 잘 수행하며 어려운 문제를 효율적으로 해결할 수 있습니다.Seed-OSS는 최대 512K의 긴 텍스트 컨텍스트를 지원합니다....
ML-Master는 상하이교통대학교 인공지능 학교의 에이전트 팀이 출시한 AI 전문 지능입니다. OpenAI의 권위 있는 벤치마크 테스트인 MLE 벤치에서 평균 29.3%의 메달 비율로 1위를 차지하며 Microsoft의 RD-Agent...를 능가하는 우수한 성적을 거두었습니다.
훈위안 3D 월드 모델 1.0(훈위안 월드 1.0)은 텐센트의 오픈 소스 업계 최초의 몰입형 로밍, 인터랙티브, 시뮬레이션 월드 생성 모델입니다. 이 모델은 파노라마 시각 생성 및 계층적 3D 재구성 기술을 통합하여 텍스트 또는 이미지 입력을 지원하여 36개의 세계를 빠르게 생성합니다.
일반 소개 "아내가 나에게 소리치는 이유"는 인공지능을 통해 파트너의 감정 반응과 의사소통 패턴을 이해할 수 있도록 설계된 독특한 결혼 관계 시뮬레이션 웹사이트입니다. 사용자는 다양한 시나리오를 입력하고 가상 파트너의 반응을 경험하며 실제와 같은 시뮬레이션을 할 수 있습니다.
Ring-1T-preview는 Ling 2.0 MoE 아키텍처를 기반으로 하는 Ant Group의 오픈 소스 1조 개 매개변수 매크로 모델로, 20T 코퍼스로 사전 학습되고 자체 개발한 강화 학습 시스템인 ASystem으로 추론 능력을 훈련받았습니다. 자연어 추론에서 ...
VoxCPM은 Facade Intelligence와 칭화대학교 선전 국제대학원이 공동으로 오픈소스화한 음성 생성 모델로, 엔드투엔드 확산 자동 회귀 아키텍처를 채택하여 텍스트에서 직접 연속 음성 표현을 생성함으로써 기존의 이산적 명료화의 한계를 극복합니다. 계층적 언어 모델링과 유한 상태 양자화를 통해 ...
Clacky AI는 개발자를 위한 클라우드 기반 개발 환경(CDE)으로, L3 수준의 AI 프로그래밍 어시스턴트 제작에 특화되어 있습니다. 이 도구는 Python, Node.js, Golang, Ruby, Java를 비롯한 여러 프로그래밍 언어를 지원하며 개발자가 빠르게...
GLM-4.5는 추론, 코드 생성 및 지능형 신체 기능을 통합하여 지능형 신체 애플리케이션을 위해 설계된 Smart Spectrum의 오픈 소스 SOTA 모델입니다. 이 모델은 혼합 전문가(MoE) 아키텍처를 기반으로 하며 3,550억 개의 파라미터가 포함된 GLM-4.5와 1,600억 개의 파라미터가 포함된 두 가지 버전이 있습니다.
코태는 소규모 기업을 위해 설계된 지능형 챗봇 플랫폼으로 ChatGPT 기술을 기반으로 개발되었습니다. 80개 이상의 언어를 지원하는 이 플랫폼은 사용자의 웹사이트 콘텐츠, 교육 문서, FAQ 등을 분석하여 정확한 답변을 생성함으로써 고객 문의에 빠르고 자연스럽게 응답합니다. Kotae는 ...
Qwen-Image-Edit는 알리 통이가 소개한 다목적 이미지 편집 모델로, 200억 개의 매개변수가 있는 Qwen-Image 아키텍처를 기반으로 구축되었습니다. 이 모델은 시맨틱 및 외관 편집 기능을 모두 결합하여 이미지에 대한 낮은 수준의 시각적 외관 편집(예: 추가, 삭제...)을 수행할 수 있습니다.
ConverzAI는 채용 프로세스를 최적화하는 AI 기술 기반의 채용 플랫폼입니다. 이 플랫폼은 가상 채용 담당자(AI 에이전트)를 배치하여 지원자 추적 시스템(ATS)에서 후보자 정보를 자동으로 수집하고 초기 심사를 수행하는 것을 기반으로 합니다. 이 플랫폼은 전화, 이메일, SMS 등 여러 채널을 사용합니다...
RoboOS 2.0은 로봇이 단일 지능에서 그룹 협업 지능으로 전환하는 것을 촉진하는 교차 온톨로지 두뇌-두뇌 협업을 위한 오픈 소스 프레임워크입니다. 이 프레임워크는 '빅 브레인' 아키텍처를 사용하여 클라우드 브레인은 복잡한 의사 결정과 협업을 담당하고 스몰 브레인 모듈은 특정 기술을 실행하는 데 집중하는 효율적인 분업을 달성합니다.
PaddleOCR-VL은 문서 구문 분석 시나리오에 최적화된 바이두의 오픈 소스 초경량 시각 언어 모델입니다. 이 모델은 동적 고해상도 시각 코더와 경량 ERNIE 언어 모델의 융합을 통해 0.9억 개의 파라미터만 포함하며, 높은 정확도를 유지하고 계산 오버헤드를 크게 줄입니다.
뮤즈스팀은 바이두에서 출시한 멀티모달 동영상 생성을 위한 대형 모델입니다. 이 모델은 사용자가 제공한 텍스트 설명이나 이미지를 기반으로 고품질의 동적 동영상 콘텐츠를 빠르게 생성할 수 있으며, 다양한 시나리오의 제작 요구 사항을 충족하기 위해 다양한 선명도 및 기능 버전을 지원합니다.
우아한 요야는 중커 웬지가 출시한 멀티모달 리터러티브 비디오 플랫폼으로, AI 멀티모달 기술을 기반으로 비디오 콘텐츠 제작의 전체 체인을 강화합니다. 사용자는 테마 요구 사항 만 입력하면 플랫폼에서 스크립트, 이미지, 비디오를 빠르게 생성 할 수 있으며 지능형 편집, 음성 합성 및 캐릭터 입 드라이브 및 기타 작업, 출력을 완료 할 수 있습니다 ...
일반 소개 네버엔즈는 고급 모델을 통해 텍스트를 동영상으로 변환하여 모든 종류의 스토리를 위한 무한한 창작 공간을 제공하는 싱가포르의 플랫폼입니다. 사용자는 이 플랫폼에서 자유롭게 창의성을 표현하고 감정을 전달할 수 있을 뿐만 아니라 브랜드 이미지를 구축할 수 있습니다. 이 플랫폼은 독특한 것으로 유명합니다...