AI 공유 서클

최신 AI 제품, 프로젝트, 프레임워크, 논문 해석 등을 매일 공유합니다.
LLaSO - 逻辑智能推出的业界首个全面开源的语音模型

LLaSO - 로직 인텔리전스의 업계 최초 완전 오픈 소스 음성 모델

LLaSO는 베이징 뎁스 로직 인텔리전스 테크놀로지가 출시한 오픈 소스 음성 모델로, 음성 및 텍스트 데이터를 통합하고 정렬 데이터 세트, 명령 미세 조정 데이터 세트 및 평가 벤치마크를 제공하여 대규모 음성 언어 모델링 분야의 데이터 분산과 작업 범위 부족 문제를 해결합니다.
12개월 전
057.1K
混元3D 3.0 - 腾讯推出的3D生成模型,支持超高清建模

하이브리드 3D 3.0 - UHD 모델링을 지원하는 텐센트의 3D 생성 모델

하이브리드 3D 3.0은 3D-DiT 계층적 조각 기술을 기반으로 한 텐센트의 고급 3D 세대 모델로, 최대 1536³의 기하학적 해상도로 초고화질, 디테일이 풍부한 3D 모델을 생성할 수 있으며 오감 및 체형을 정확하게 형상화하는 등 캐릭터 모델링에 탁월한 능력을 갖추고 있습니다.
1 년 전
077.8K
Mini-o3 - 字节、港大联合开源的视觉推理模型

Mini-o3 - 바이트, HKU 공동 오픈 소스 시각적 추론 모델

Mini-o3는 복잡한 시각적 검색 문제를 해결하는 데 초점을 맞춘 ByteDance와 홍콩 대학교가 공동으로 출시한 오픈 소스 모델입니다. 이 모델은 강력한 다원적 대화형 추론 기능을 갖추고 있으며, 심층적인 탐색과 시행착오를 통해 대상을 찾을 수 있습니다.
1 년 전
063.1K
GPT-5-Codex - OpenAI推出的最强编程模型

GPT-5-Codex - OpenAI가 도입한 가장 강력한 프로그래밍 모델

GPT-5-Codex는 소프트웨어 엔지니어를 위해 설계된 OpenAI의 강력한 프로그래밍 최적화 모델로, GPT-5에 의해 더욱 강화되었습니다. 이 모델은 고품질 코드를 신속하게 생성하고 여러 프로그래밍 언어를 지원하며 기존 코드를 최적화하여 성능을 향상시킵니다.
1 년 전
062.5K
MiniMax Music 1.5 - MiniMax最新推出的AI音乐生成模型

미니막스 뮤직 1.5 - 미니막스의 최신 AI 음악 생성 모델!

미니맥스 뮤직 1.5는 사용자의 자연어 설명을 기반으로 최대 4분 분량의 음악 생성을 지원하는 고급 AI 음악 생성 도구입니다. 이 모델은 다양한 음악 스타일과 분위기 사용자 지정을 지원하며 자연스럽고 완전한 보컬 톤, 부드러운 전환 및 풍부한 레이어 편곡을 생성합니다....
1 년 전
073K
AnyI2V - 复旦联合阿里达摩院等开源的智能图像动画生成框架

AnyI2V - 푸단 및 알리 다르마 연구소 및 기타 오픈 소스 지능형 이미지 애니메이션 생성 프레임워크

AnyI2V는 푸단대학교, 알리바바 다모 아카데미 등이 공동으로 출시한 이미지 애니메이션 생성 프레임워크로, 복잡한 학습 과정과 많은 양의 데이터 없이도 정적인 조건부 이미지(예: 그리드, 포인트 클라우드 등)를 동적인 동영상으로 변환할 수 있도록 지원합니다.
1 년 전
065.5K
SRPO - 腾讯混元推出的文本到图像生成模型

SRPO - 텐센트 하이브리드에서 출시한 텍스트-이미지 생성 모델

SRPO(Semantic Relative Preference Optimization)는 텐센트 혼합 메타에서 도입한 텍스트-이미지 생성 모델로, 텍스트 조건부 신호를 통해 보상 메커니즘을 최적화하여 온라인에서 보상을 조정하고 오프라인 미세 조정 의존도를 낮춥니다.
1 년 전
082.3K
Qwen3-Next - 阿里通义推出的最新基础模型

Qwen3-Next - 알리 통이가 출시한 최신 기본 모델

Qwen3-Next는 알리 통이가 오픈소스화한 차세대 하이브리드 아키텍처 빅 모델로, 긴 텍스트 처리, 빠른 추론, 계산 리소스 절약에 능한 Gated DeltaNet과 Gated Attention 기술을 결합한 것입니다.
1 년 전
061.9K
文心大模型X1.1 - 百度推出的深度思考模型,理解能力更强

웬신 빅 모델 X1.1 - 더 나은 이해를 위한 바이두의 딥씽킹 모델

웬신 빅 모델 X1.1은 언어 이해와 생성을 개선하는 데 중점을 둔 하이브리드 강화 학습 프레임워크를 기반으로 바이두에서 출시한 심층 사고 모델입니다. 이 모델은 복잡한 질문을 처리하고, 지시를 따르고, 지능의 행동을 시뮬레이션하는 데 탁월하며, 지식이 풍부한 답변과 고품질 텍스트 콘텐츠를 정확하게 제공할 수 있습니다.
1 년 전
067.4K
混元图像2.1 - 腾讯推出的开源文生图模型

하이브리드 이미지 2.1 - 텐센트의 오픈 소스 벤더 그래프 모델

훈위안이미지 2.1은 고품질 이미지 생성을 위해 설계된 텐센트의 오픈 소스 그래픽 모델입니다. 이 모델은 기본 2K 해상도를 지원하며 복잡한 장면과 디테일을 정확하게 렌더링하여 캐릭터의 표정과 움직임을 생생하게 재현할 수 있습니다.
1 년 전
064.2K