최신 AI 리소스

共 3143 篇文章
InternVL3.5 - 上海AI实验室开源的多模态大模型

InternVL3.5 - 상하이 AI 랩 오픈 소스 멀티모달 대형 모델

InternVL3.5(Shusheng-Wanxiang 3.5)는 상하이 인공 지능 연구소의 오픈 소스 멀티 모달 대형 모델로, 일반 능력, 추론 능력 및 배포 효율성 측면에서 완전히 업그레이드되어 10억에서 2410억 개의 매개 변수까지 9가지 크기의 버전을 제공하며, 두께를 포함한 다양한 리소스 수요 시나리오를 포괄합니다....
11개월 전
066.9K
Mu - 微软推出的小参数语言模型,支持Windows智能体

Mu - Microsoft, Windows 인텔리전트 지원을 위한 작은 매개 변수 언어 모델 도입

Mu는 3억 3천만 개의 매개변수만 있는 Microsoft의 소규모 매개변수 언어 모델로, NPU와 에지 디바이스에서 효율적으로 실행되도록 설계되었습니다. 이 모델은 인코더-디코더 아키텍처를 기반으로 하며 하드웨어 인식 최적화, 모델 양자화 및 작업별 미세 조정을 통해 초당 100개 이상의 토큰 응답 속도를 달성합니다.Mu...
1 년 전
066.8K
Tizzy.ai - 百度推出的AI搜索应用

Tizzy.ai - 바이두에서 출시한 AI 검색 앱

Tizzy.ai는 바이두에서 출시 한 AI 지능형 검색 애플리케이션으로, 강력한 지능형 검색 기능을 갖춘 바이두의 빅 모델 기술을 기반으로하며 질문에 빠르게 답하고 깊이 생각하고 의사 결정을 지원할 수 있습니다.Tizzy.ai는 인터페이스가 간단하고 광고와 팝업이 없으며 가이드 하단에 ...
1 년 전
066.7K
A2UI - 谷歌开源的Agent驱动型用户交互界面声明式协议

A2UI - 에이전트 중심 사용자 상호작용 인터페이스를 위한 Google의 오픈 소스 선언적 프로토콜입니다.

A2UI(에이전트-사용자 인터페이스)는 AI 에이전트를 위한 복잡한 대화형 인터페이스를 생성하는 문제를 해결하는 Google의 오픈 소스 에이전트 중심 인터페이스 프로토콜입니다. AI 에이전트가 사용자 인터페이스, 클라이언트 애플리케이션의 구조를 설명할 수 있는 선언적 JSON 형식을 통해 ...
7개월 전
066.6K
GLM-Experimental - 智谱AI推出的实验性模型

GLM-Experimental - 스마트 스펙트럼 AI에서 출시한 실험적 모델

GLM-Experimental은 위즈덤 스펙트럼 AI에서 출시한 실험적인 대규모 언어 모델로, 현재 Z.ai 플랫폼에서 사용할 수 있습니다. 이 모델에는 PPT를 자동으로 생성하는 기능이 있습니다. 사용자가 주제나 요점을 입력하면 모델이 명확하게 구조화되고 형식이 지정된 프레젠테이션을 빠르게 생성하여...
1 년 전
066.5K
Gemini CLI - 谷歌开源的编程Agent

Gemini CLI - 구글 오픈 소스 프로그래밍 에이전트

Gemini CLI는 개발자에게 강력한 AI 기능을 제공하기 위해 Gemini 빅 모델을 개발자의 엔드포인트에 통합한 Google의 오픈 소스 AI 프로그래밍 도구입니다. 이 도구는 코드를 이해하고, 파일을 조작하고, 명령을 실행하고, 동적으로 문제를 해결하여 개발자가 효율적으로 생성 코드를 작성할 수 있도록 도와줍니다.
1 년 전
066.5K
绘想 - 百度推出的AI视频生成平台

페인팅 씽킹 - 바이두가 출시한 AI 동영상 생성 플랫폼

페인팅은 사용자가 개인화된 동영상을 쉽게 제작할 수 있도록 AI 기술을 기반으로 바이두에서 출시한 AI 동영상 생성 플랫폼입니다. 직관적인 인터페이스, 강력한 도구, 영감 추천 기능을 갖춘 페인팅은 크리에이터에게 창의적인 영감을 제공하고, 동일한 작업의 핵심을 지원하며, 유사한 동영상을 빠르게 생성하고, 창작 과정을 간소화할 수 있습니다.
1 년 전
066.4K
MailMoo:使用AI为每个客户生成个性化视频提升销售转化率

MailMoo: AI를 사용하여 각 고객을 위한 맞춤형 동영상을 생성하여 판매 전환율을 높입니다.

일반 소개 MailMoo는 기업과 영업팀의 콜드 이메일 결과를 개선하는 데 중점을 둔 혁신적인 플랫폼입니다. 인공 지능 기술을 사용하여 사용자가 동영상을 녹화하기만 하면 MailMoo가 수천 명의 잠재 고객을 위한 맞춤형 동영상 콘텐츠를 자동으로 생성합니다. 이 접근 방식은 극적으로 개선됩니다...
1 년 전
066.4K
InteriorGS - 群核科技推出的3D高斯语义数据集

InteriorGS - Qunar Technology의 3D 가우시안 시맨틱 데이터 세트

InteriorGS는 큐나 테크놀로지가 도입한 고품질 3D 가우시안 시맨틱 데이터 세트입니다. 이 데이터 세트에는 집, 편의점, 예식장, 박물관 등 80개 이상의 실내 환경을 포함하는 1,000개의 3D 장면이 포함되어 있습니다. 이 데이터 세트에는 755개 카테고리의 554,000개 이상의 객체 인스턴스가 포함되어 있습니다...
1 년 전
066.3K
Stable Diffusion Web:在线体验Stable Diffusion XL

스테이블 디퓨전 웹: 온라인에서 스테이블 디퓨전 XL을 경험하세요!

일반 설명 스테이블 확산 웹은 사용자가 무료로 사용할 수 있는 온라인 스테이블 확산 모델링 플랫폼입니다. 이 모델은 사용하기 쉬운 인터페이스를 통해 텍스트를 사실적인 이미지로 변환하는 데 사용됩니다. 텍스트 프롬프트를 입력하고 "생성"을 클릭하면 사용자는 빠르게 ...
2 년 전
066.1K
Hunyuan-GameCraft - 腾讯混元开源的下一代游戏交互式视频生成框架

훈위안-게임크래프트 - 차세대 게임용 인터랙티브 비디오를 생성하기 위한 텐센트 훈위안의 오픈 소스 프레임워크입니다.

훈위안-게임크래프트는 텐센트 훈위안 팀의 오픈 소스 인터랙티브 게임 비디오 생성 프레임워크입니다. 단일 사진 및 프롬프트에서 프레임워크를 사용하여 매우 역동적인 게임 비디오를 생성하고, 키보드와 마우스를 통해 사용자가 비디오 콘텐츠를 실시간으로 제어할 수 있도록 지원합니다.
12개월 전
066.1K
BoomCut - 小影科技推出的 AI 出海营销视频生成工具

붐컷 - 리틀 섀도우 테크놀로지의 AI 아웃바운드 마케팅 비디오 생성 도구

붐컷은 리틀 섀도우 테크놀로지가 출시한 AI 크로스보더 마케팅 동영상 로컬라이제이션 툴입니다. 이 도구는 고급 립싱크 드라이브 및 톤 복제 기술을 기반으로 하는 강력한 기능을 갖추고 있어 다양한 국가 및 지역의 사용자의 언어 요구 사항을 충족하는 다국어 버전의 음성 동영상을 신속하게 생성할 수 있습니다.
1 년 전
066.1K
11ai - ElevenLabs推出个人AI语音助理

11ai - ElevenLabs, 개인용 AI 음성 비서 출시

11ai는 일레븐랩스에서 출시한 인공지능 음성비서로, 자연스럽고 부드러운 대화를 통해 사용자의 업무 효율성을 높여주는 음성 상호작용을 핵심으로 하며, 5,000개 이상의 음성을 지원하고 사용자가 전용 음성을 커스터마이징할 수 있어 더욱 개인화된 어시스턴트입니다. 지연 시간이 짧은 음성 인터랙션으로 ...
1 년 전
066.1K
袋鼠参谋 – 美团推出的商家AI智能决策应用

캥거루 스태프 - 메이투안에서 출시한 판매자를 위한 AI 지능형 의사결정 앱

캥거루 스태프는 메이투안에서 출시한 판매자 중심의 AI 지능형 의사결정 애플리케이션으로, 판매자가 매장을 개설하고 운영할 때 발생하는 문제를 해결하는 데 도움을 줍니다. 메이퇀의 방대한 케이터링 데이터와 10년 이상의 온라인 운영 경험을 바탕으로 대화 상호 작용을 통해 판매자에게 트랙 선택, 매장 오픈 위치, 요리 개발, 매장 운영 및 기타 시나리오에 대한 정확한 정보를 제공합니다....
1 년 전
066.1K
PaddleOCR-VL - 百度开源的超轻量级视觉-语言模型

PaddleOCR-VL - 바이두 오픈 소스 초경량 시각 언어 모델

PaddleOCR-VL은 문서 구문 분석 시나리오에 최적화된 바이두의 오픈 소스 초경량 시각 언어 모델입니다. 이 모델은 동적 고해상도 시각 코더와 경량 ERNIE 언어 모델의 융합을 통해 0.9억 개의 파라미터만 포함하며, 높은 정확도를 유지하고 계산 오버헤드를 크게 줄입니다.
9개월 전
065.7K
ChatGPT Study - OpenAI推出的创新学习模式

ChatGPT 연구 - OpenAI가 도입한 혁신적인 학습 모델

ChatGPT Study는 사용자가 보다 효율적으로 학습하고 이해할 수 있도록 도와주는 OpenAI의 혁신적인 학습 모델로, 소크라테스식 질문, 비계식 답변, 개인화된 답변을 통해 사용자가 적극적으로 사고하고 단계별로 문제를 해결할 수 있도록 안내합니다.
1 년 전
065.6K
CombatVLA - 淘天集团推出的高效VLA模型

CombatVLA - Amoy Group의 효율적인 VLA 모델

CombatVLA는 아모이 그룹의 퓨처 라이프 랩 팀이 개발한 혁신적인 3D 액션 롤플레잉 게임(ARPG) 전용 모델로, 3B 파라메트릭 스케일로 구축된 시각-언어-행동(VLA) 모델로, 모션 트래커를 통해 인간 플레이어의 동작을 수집합니다.
11개월 전
065.6K
MineContext - 字节开源的主动式上下文感知AI伙伴

MineContext - 바이트 오픈 소스 액티브 컨텍스트 인식 AI 파트너

MineContext는 사용자가 방대한 양의 정보를 효율적으로 관리하고 지식 업무의 효율성을 개선할 수 있도록 돕기 위해 ByteDance Viking 팀이 오픈소스로 제공하는 적극적인 상황 인식 AI 파트너입니다. 스크린샷 및 콘텐츠 이해 기술을 통해 사용자의 일상적인 작업(예: 웹 검색, 문서 편집 등)을 자동으로 기록하고, 지원...
10개월 전
065.5K
FastVLM - 苹果公司推出的视觉语言模型

FastVLM - Apple의 시각 언어 모델링

FastVLM(Fast Vision Language Model)은 Apple에서 도입한 효율적인 시각 언어 모델입니다. FastViTHD 하이브리드 비주얼 코더를 핵심으로 컨볼루션 및 트랜스포머 아키텍처를 통합하여 시각적...
11개월 전
065.2K
AI Agent Company Researcher:自动化公司信息研究情报员

AI 에이전트 기업 연구원: 자동화된 기업 정보 조사 인텔리전스

일반 설명 AI 기업 리서치 어시스턴트는 기업 리서치 및 리드 생성 프로세스를 자동화하도록 설계된 인공지능 기반 도구입니다. 이 도구는 LangGraph 및 FireCrawl과 같은 기술을 사용하여 단 몇 분 만에 상세한 기업 리서치 보고서를 생성할 수 있습니다. 사용자는 간단히 다음을 수행하면 됩니다.
2 년 전
065.1K
AIMangaStudio - 免费的AI漫画创作工具,提供完整创作流程

AIMangaStudio - 완벽한 창작 과정을 위한 무료 AI 만화 제작 도구!

AIMangaStudio는 창작자에게 줄거리 생성, 서브 장면 디자인, 캐릭터 설정 및 기타 기능을 포함한 완벽한 만화 제작 파이프라인을 제공하는 무료 AI 만화 제작 도구로, 스크립트에서 만화 페이지까지 제작 프로세스를 간소화할 수 있습니다. 줄거리, 대사를 포함한 만화 대본의 자연어 생성을 지원합니다.
10개월 전
065.1K
小星绪 - 京东健康推出的AI情绪漫画生成产品

징동건강이 출시한 인공지능 감정 만화 생성 제품 호시오(Hoshio)

샤오싱슈는 징동건강이 출시한 AI 감정 만화 생성 제품으로 현재 테스트 단계에 있으며, 이 제품은 감정 중심의 만화 스토리 생성이 핵심 기능으로, 사용자가 음성이나 텍스트 입력을 통해 감정을 표현하거나 이야기를 전달하면 AI가 입력에 따라 그에 맞는 4컷 만화와 스토리 해석을 생성해줍니다.
1 년 전
065K
DeepSeek V3.1 - DeepSeek推出的最新开源AI模型

DeepSeek V3.1 - DeepSeek의 최신 오픈 소스 AI 모델

DeepSeek V3.1은 이전 버전인 V3를 기반으로 중요한 업그레이드가 이루어진 차세대 AI 모델로, 모델이 사고 모드와 비사고 모드 사이를 유연하게 전환할 수 있는 하이브리드 추론 아키텍처를 도입하여 사고 능력을 크게 향상시켰습니다.
11개월 전
064.8K
Hyperbolic AgentKit:让Agents拥有自己的计算资源,能够自主管理 GPU、执行区块链操作和社交发布

하이퍼볼릭 에이전트 키트: 에이전트에게 자체 컴퓨팅 리소스, 자율적인 GPU 관리, 블록체인 운영 및 소셜 퍼블리싱 기능을 제공합니다.

일반 소개 하이퍼볼릭 에이전트키트는 블록체인과 컴퓨팅 파워를 결합하여 AI 에이전트를 실행하기 위한 템플릿을 제공하는 것을 목표로 하는 오픈 소스 프로젝트입니다. 이 프로젝트는 코인베이스의 CDP 에이전트킷을 기반으로 하며, 터미널을 지원하기 위한 수정 및 확장 기능을 갖추고 있습니다.
2 년 전
064.6K
靠岸妙写 - AI论文写作工具,构思到成稿一站式解决

쿠션 원더풀 라이터 - AI 에세이 작성 도구, 아이디어에서 완성된 논문까지 원스톱 솔루션

Leaning Wonderful Writer는 학술 논문 작성을 위한 효율적이고 편리한 솔루션을 제공하는 AI 논문 작성 도구입니다. 이 도구는 학부 및 석사 학위와 같은 다양한 수준의 학문적 요구에 적용 가능하며 과학 기술, 예술 및 사회 과학과 같은 다학제 분야를 다루는 논문의 개요, 초록 및 초안을 한 번의 클릭으로 생성할 수 있도록 지원합니다.
1 년 전
064.5K
GLM-4.5 - 智谱开源的面向推理、代码与智能体的SOTA模型

GLM-4.5 - 추론, 코드 및 인텔리전스를 위한 스마트 스펙트럼 오픈 소스 SOTA 모델

GLM-4.5는 추론, 코드 생성 및 지능형 신체 기능을 통합하여 지능형 신체 애플리케이션을 위해 설계된 Smart Spectrum의 오픈 소스 SOTA 모델입니다. 이 모델은 혼합 전문가(MoE) 아키텍처를 기반으로 하며 3,550억 개의 파라미터가 포함된 GLM-4.5와 1,600억 개의 파라미터가 포함된 두 가지 버전이 있습니다.
1 년 전
064.5K
NeverEnds:使用文字描述生成效果逼真的视频

NeverEnds: 텍스트 설명이 포함된 사실적인 동영상 생성

일반 소개 네버엔즈는 고급 모델을 통해 텍스트를 동영상으로 변환하여 모든 종류의 스토리를 위한 무한한 창작 공간을 제공하는 싱가포르의 플랫폼입니다. 사용자는 이 플랫폼에서 자유롭게 창의성을 표현하고 감정을 전달할 수 있을 뿐만 아니라 브랜드 이미지를 구축할 수 있습니다. 이 플랫폼은 독특한 것으로 유명합니다...
2 년 전
064.3K
Goedel-Prover-V2 - 普林斯顿联合清华和英伟达等开源的定理证明模型

Goedel-Prover-V2 - 칭화대, NVIDIA 등과 함께 사용하는 프린스턴의 오픈 소스 정리 증명 모델입니다.

Goedel-Prover-V2는 프린스턴 대학교, 칭화 대학교, NVIDIA와 같은 주요 기관의 오픈 소스 정리 증명 모델입니다. 이 모델은 계층적 데이터 합성, 검증자 가이드 자체 수정 및 모델 평균화와 같은 혁신적인 기술을 기반으로 자동화된 형식 증명의 성능을 크게 향상시킵니다....
1 년 전
064.3K
ChatGPT Agent – OpenAI推出的通用智能AI Agent

ChatGPT 에이전트 - OpenAI의 범용 지능형 AI 에이전트

ChatGPT 에이전트는 여러 기능을 결합하여 복잡한 작업을 자율적으로 완료하는 OpenAI의 범용 AI 에이전트입니다. 사용자는 자연어로 자신의 요구 사항을 설명하기만 하면 에이전트가 웹 검색, 정보 추출, 코드 실행 등 적절한 도구를 자동으로 선택할 수 있습니다.
1 년 전
064.2K
羚珑 - 京东推出的AI商品图设计工具

Antelope - 징동에서 출시한 AI 제품 이미지 디자인 도구

앤털로프는 징동에서 출시한 지능형 디자인 도구로, 전자상거래 판매자와 개인에게 효율적이고 편리한 디자인 솔루션을 제공합니다. 지능형 키잉, 지능형 레이아웃, 지능형 컬러 매칭 및 기타 기능을 통해 사용자가 제품, 광고 배너, 상점 페이지 및 기타 종류의 전자 상거래 상점의 주요 그림을 충족하는 고품질 디자인 작품을 신속하게 생성 할 수 있습니다....
1 년 전
064K
Seed GR-3 - 字节跳动Seed团队推出的通用机器人模型

Seed GR-3 - 워드프레스 시드 팀의 범용 로보틱스 모델

Seed GR-3는 새로운 환경과 복잡한 명령에 적응할 수 있는 강력한 일반화 기능을 갖춘 바이트댄스에서 개발한 범용 로봇 모델입니다. 이 모델은 시각, 언어 및 동작 정보를 융합하고 로봇 데이터, VR 인체 궤적 데이터 및 공개 그래픽 데이터의 3-in-1 학습 방법을 기반으로 새로운 물체에 대한 반응 능력을 향상시킵니다....
1 년 전
064K
Squibler - AI小说辅助写作平台,助力构思到创作全过程

Squibler - 아이디어에서 창작까지 전 과정을 지원하는 AI 소설 지원 글쓰기 플랫폼

스퀴블러는 작가를 위해 설계된 강력한 AI 지원 글쓰기 플랫폼으로, 구상부터 창작, 출판에 이르는 전 과정을 도와줍니다. 이 플랫폼은 소설, 시나리오, 단편 소설 등 다양한 스토리 템플릿을 제공합니다. 사용자는 초기 컨셉만 입력하면 AI가 개요, 캐릭터, 장면 등을 생성할 수 있습니다.
11개월 전
063.9K
ChatFlow - 开源AI工作流自动化工具

ChatFlow - 오픈 소스 AI 워크플로 자동화 도구

ChatFlow는 복잡한 요구사항을 효율적인 워크플로로 전환할 수 있도록 지원하는 오픈 소스 AI 워크플로 자동화 도구입니다. 사용자가 코드 프레임워크, 테스트 케이스를 빠르게 생성할 수 있도록 지원하는 AI 기술 기반 도구는 소프트웨어 아키텍처를 작성하고 설계하는 데 도움을 줄 수 있습니다.
1 년 전
063.8K
Kotae - AI聊天机器人平台,分析网站内容、培训文件生成准确回答

Kotae - 웹사이트 콘텐츠를 분석하고 문서를 학습하여 정확한 답변을 생성하는 AI 챗봇 플랫폼

코태는 소규모 기업을 위해 설계된 지능형 챗봇 플랫폼으로 ChatGPT 기술을 기반으로 개발되었습니다. 80개 이상의 언어를 지원하는 이 플랫폼은 사용자의 웹사이트 콘텐츠, 교육 문서, FAQ 등을 분석하여 정확한 답변을 생성함으로써 고객 문의에 빠르고 자연스럽게 응답합니다. Kotae는 ...
1 년 전
063.7K
Qwen-Image-Edit - 阿里通义开源的图像编辑模型

Qwen-Image-Edit - 알리 통이 오픈 소스 이미지 편집 모델

Qwen-Image-Edit는 알리 통이가 소개한 다목적 이미지 편집 모델로, 200억 개의 매개변수가 있는 Qwen-Image 아키텍처를 기반으로 구축되었습니다. 이 모델은 시맨틱 및 외관 편집 기능을 모두 결합하여 이미지에 대한 낮은 수준의 시각적 외관 편집(예: 추가, 삭제...)을 수행할 수 있습니다.
12개월 전
063.7K
有道小P - 网易有道推出的新一代AI全科学习助手

Youdao Xiao P - 넷이즈 유다오가 출시한 차세대 AI 일반 학습 도우미

유다오 리틀 P는 넷이즈 유다오에서 출시한 AI 전과목 학습 도우미로, 초등학교, 중학교, 고등학교 전과목 Q&A를 다루고 개인화된 학습 조언을 제공하는 유다오 즈이 교육 빅 모델을 탑재하여 초중고 학생들을 위해 설계되었습니다. 인공지능 단어 검색 및 인공지능 번역 기능을 갖춘 Youdao Little P는 학생들이 언어 문제를 빠르게 해결할 수 있도록 도와줍니다.
1 년 전
063.5K
JoyHallo - 京东开源的AI数字人模型

조이할로 - 징동의 오픈소스 AI 디지털 휴먼 모델

조이할로는 중국어용으로 설계된 징동의 오픈소스 AI 디지털 휴먼 모델로, 오디오를 사실적인 말하기 비디오로 변환하는 것을 지원하며, 입술 움직임 예측 정확도를 높이기 위해 반분리 구조를 사용하여 wav2vec2 모델을 기반으로 오디오 기능을 내장하고 영어 비디오 생성을 지원합니다....
1 년 전
063.4K
VoxCPM - 面壁智能联合清华开源的端到端TTS模型

VoxCPM - 직면 지능과 칭화 오픈 소스 엔드투엔드 TTS 모델

VoxCPM은 Facade Intelligence와 칭화대학교 선전 국제대학원이 공동으로 오픈소스화한 음성 생성 모델로, 엔드투엔드 확산 자동 회귀 아키텍처를 채택하여 텍스트에서 직접 연속 음성 표현을 생성함으로써 기존의 이산적 명료화의 한계를 극복합니다. 계층적 언어 모델링과 유한 상태 양자화를 통해 ...
10개월 전
063.4K
InternVLA·N1 - 上海AI Lab开源的端到端双系统导航大模型

InternVLA-N1 - 상하이 AI 랩 오픈 소스 엔드투엔드 듀얼 시스템 내비게이션 대형 모델

InternVLA-N1은 상하이 인공 지능 연구소에서 오픈소스화한 엔드투엔드 듀얼 시스템 내비게이션 매크로 모델입니다. 이중 시스템 아키텍처를 사용하여 시스템 2는 언어 명령을 이해하고 장거리 경로를 계획하고, 시스템 1은 고주파 응답과 민첩한 장애물 회피에 중점을 둡니다. 이 모델은 전적으로 대규모 디지털을 통한 합성 데이터를 기반으로 훈련됩니다.
10개월 전
063.4K
ML-Master – 上海交大推出的AI专家Agent

ML-Master - SJTU에서 출시한 AI 전문가 에이전트

ML-Master는 상하이교통대학교 인공지능 학교의 에이전트 팀이 출시한 AI 전문 지능입니다. OpenAI의 권위 있는 벤치마크 테스트인 MLE 벤치에서 평균 29.3%의 메달 비율로 1위를 차지하며 Microsoft의 RD-Agent...를 능가하는 우수한 성적을 거두었습니다.
1 년 전
063.4K
DeckSpeed - AI PPT制作工具,自然语言生成演示文稿

DeckSpeed - AI PPT 메이커, 자연어 생성 프레젠테이션

DeckSpeed는 대화형 상호작용을 기반으로 하는 AI 프레젠테이션 제작 도구로, 사용자가 자연어를 기반으로 자신의 요구를 표현하여 기존 템플릿에 의존하지 않고도 개인화된 슬라이드를 빠르게 생성할 수 있습니다. 이 도구는 실시간 피드백 조정을 지원하며, 사용자는 언제든지 슬라이드의 색상, 스타일, 내용을 수정하여 프레젠테이션을 완성할 수 있습니다.
1 년 전
063.3K
InternVLA-A1 - 上海AI Lab开源一体化操作能力的具身大模型

InternVLA-A1 - 상하이 AI 랩, 대형 모델 구현을 위한 운영 기능의 오픈 소스 통합

InternVLA-A1은 상하이 인공 지능 연구소에서 오픈소스로 제공하는 대규모 구현 작업 모델입니다. 통합을 이해하고, 상상하고, 실행할 수 있는 능력을 갖추고 있으며, 작업을 정확하게 완료할 수 있습니다. 이 모델은 실제 및 시뮬레이션 운영 데이터를 융합하고 대규모 가상-실제 하이브리드 장면 에셋을 통해 대규모 멀티모달 구축을 자동화합니다.
10개월 전
063.2K
gpt-realtime - OpenAI最新推出的AI语音模型

gpt-realtime - OpenAI의 최신 AI 음성 모델

gpt-realtime은 자연스럽고 부드러운 음성을 생성하기 위해 오디오의 직접 처리를 지원하는 OpenAI의 고급 음성 모델입니다. 이 모델은 여러 언어와 스타일을 지원하고 웃음과 같은 비언어적 단서를 이해하며 언어 간에 전환할 수 있습니다.
11개월 전
063.2K
Skywork-SWE-32B - 昆仑万维开源的自主代码智能体基座模型

Skywork-SWE-32B - 쿤룬완웨이 오픈 소스 자율 코드 지능형 바디 기본 모델

Skywork-SWE-32B는 쿤룬 월드와이드웹에서 도입한 오픈 소스 32B 규모의 소프트웨어 엔지니어링(SWE) 자율 코드 인텔리전스 기본 모델입니다. 이 모델은 소프트웨어 엔지니어링 작업에 초점을 맞추고 강력한 저장소 수준의 코드 복구 기능을 갖추고 있으며 다단계 상호 작용 및 긴 텍스트 처리가 있는 복잡한 시나리오에서 수행할 수 있습니다.
1 년 전
063.2K
Genie 3 - 谷歌推出的通用世界模型

Genie 3 - Google의 일반 세계 모델

Genie 3는 매우 역동적이고 일관된 가상 세계를 실시간으로 생성할 수 있는 Google DeepMind의 차세대 범용 세계 모델로, 물리 현상과 자연 생태계를 시뮬레이션하고 판타지 및 역사 시나리오를 생성할 수 있도록 지원합니다. 텍스트 프롬프트를 통해 사용자는 ...
12개월 전
063.1K
琴乐大模型 - 腾讯推出的AI音乐创作模型

피아노 음악 빅 모델 - 텐센트에서 출시한 AI 음악 작곡 모델

진뮤직 그랜드 모델은 텐센트 AI 랩과 텐센트 TME 티엔친 랩이 공동으로 출시한 고급 AI 음악 창작 그랜드 모델입니다. 이 모델은 사용자가 입력한 키워드, 설명 문구 또는 영어와 중국어로 된 오디오 클립을 기반으로 고품질 스테레오 오디오 또는 멀티 트랙 악보를 지능적으로 생성합니다.
1 년 전
063K
HunyuanImage 3.0 - 腾讯开源的免费多模态图像生成模型

헌위안이미지 3.0 - 텐센트 오픈소스 무료 멀티모달 이미지 생성 모델

훈위안이미지 3.0(훈위안 이미지 3.0)은 텐센트에서 공개하고 오픈소스로 제공한 네이티브 멀티모달 이미지 생성 모델입니다. 모델 매개변수 크기는 80B로, 현재 오픈소스 이미지 생성 모델 중 가장 많은 매개변수를 가진 최고의 평가 결과입니다. 하이브리드 이미지 3.0은 실시간 이미지 생성을 지원하며, 사용자는 측면 ...
10개월 전
063K
RoboOS 2.0 - 智谱开源的跨本体具身大小脑协作框架

RoboOS 2.0 - 두뇌 크기의 협업 프레임워크를 구현한 Wisdom Spectrum의 오픈 소스 교차 온톨로지

RoboOS 2.0은 로봇이 단일 지능에서 그룹 협업 지능으로 전환하는 것을 촉진하는 교차 온톨로지 두뇌-두뇌 협업을 위한 오픈 소스 프레임워크입니다. 이 프레임워크는 '빅 브레인' 아키텍처를 사용하여 클라우드 브레인은 복잡한 의사 결정과 협업을 담당하고 스몰 브레인 모듈은 특정 기술을 실행하는 데 집중하는 효율적인 분업을 달성합니다.
1 년 전
063K
SkyReels-A3 - 昆仑万维推出的音频驱动数字人创作工具

SkyReels-A3 - 쿤룬왕웨이의 오디오 기반 디지털 휴먼 제작 도구

SkyReels-A3는 쿤룬 월드 와이드 그룹의 오디오 기반 디지털 휴먼 제작 툴입니다. SkyReels-A3는 오디오 기반 디지털 휴먼 제작 도구로, 간단한 입력(예: 인물 이미지 및 음성)을 통해 고품질의 동적 비디오 콘텐츠를 생성하고, 정적인 사진을 '생동감 있게' 만들고, 기존 비디오의 대사를 캐릭터가 자동으로 일치하는 새로운 립싱크로 대체할 수 있습니다....
12개월 전
062.7K
Hailuo Video Agent - MiniMax推出的AI视频创作Agent

Hailuo 비디오 에이전트 - MiniMax의 AI 비디오 제작 에이전트

하이뤄 비디오 에이전트는 미니막스에서 출시한 문턱 없는 AI 비디오 제작 에이전트로, 오픈 베타 버전입니다. 간단한 텍스트 입력 또는 이미지 업로드를 통해 클릭 한 번으로 고품질의 창의적인 동영상을 생성할 수 있으며, 다음과 같은 다양한 응용 시나리오를 다룰 수 있습니다.
1 년 전
062.7K
OmniTalker - 阿里推出实时文本驱动的说话头像生成框架

OmniTalker - Ali, 실시간 텍스트 기반 대화형 아바타 생성 프레임워크 출시

옴니토커는 알리바바의 실시간 텍스트 기반 대화형 아바타 생성 프레임워크입니다. 이 프레임워크는 텍스트, 이미지, 오디오 및 비디오와 같은 여러 모달 입력을 동시에 처리하고 스트리밍 방식을 기반으로 자연스러운 음성 응답을 생성할 수 있습니다. 핵심은 씽커-토커 아키텍처를 기반으로 하며, 씬...
1 년 전
062.7K
ThinkSound - 阿里通义推出的音频生成模型

ThinkSound - 알리 통이의 오디오 생성 모델링

씽크사운드는 알리 통이 스피치 팀이 도입한 최초의 CoT(연쇄적 사고) 오디오 생성 모델입니다. 이 모델은 CoT 추론의 도입을 기반으로 비디오 이미지에 정확하게 일치하는 음향 효과를 생성하여 기존 기술이 화면의 동적 세부 사항과 공간 관계를 포착하기 어렵다는 문제를 해결할 수 있습니다.
1 년 전
062.7K
Mureka V7.5 - 昆仑万维推出的先进AI音乐创作模型

Mureka V7.5 - Quintessence의 고급 AI 음악 제작 모델

Mureka V7.5는 중국 작곡에 중점을 둔 쿤룬 월드 와이드의 최첨단 AI 음악 생성 모델입니다. 이 모델은 음색과 연주 기법을 정확하게 재현하여 자연스럽고 부드럽고 감성적인 보컬을 생성합니다. 최적화된 자동 음성 인식(ASR) 기술을 기반으로 하는 Mureka V...
12개월 전
062.7K
MagicTryOn - 浙大和vivo等机构推出的视频虚拟试穿框架

MagicTryOn - ZJU 및 Vivo 등의 비디오 가상 체험 프레임워크

MagicTryOn은 절강대학교 컴퓨터 과학 기술 대학이 생체 및 기타 조직과 협력하여 출시한 고급 비디오 가상 체험 프레임워크입니다. 이 프레임워크는 기존의 U-Net 아키텍처를 혁신적인 확산 트랜스포머(DiT) 아키텍처로 대체하고, 완전히 스스로 인식하는 기계와 결합하여 ...
1 년 전
062.6K
TRELLIS.2 - 微软开源的大型3D生成模型

TRELLIS.2 - Microsoft 오픈 소스 대규모 3D 제너레이티브 모델

TRELLIS.2는 40억 개의 파라미터를 갖춘 Microsoft의 오픈 소스 대규모 3D 생성 모델로, 고충실도 이미지에서 3D 생성에 중점을 두고 있습니다. 혁신적인 "O-Voxel"스파 스 복셀 구조를 사용하여 복잡한 토폴로지와 날카로운 특징을 효율적으로 처리하여 전체 PBR 재료로 고품질 3D 정보를 생성 할 수 있습니다 ...
7개월 전
062.6K