AI 공유 서클

최신 AI 제품, 프로젝트, 프레임워크, 논문 해석 등을 매일 공유합니다.
吴恩达的LangChain for LLM应用开发免费课程

어니스트 응의 LLM 애플리케이션 개발용 LangChain 무료 강좌

LLM 애플리케이션 개발을 위한 LangChain은 LangChain 창립자 해리슨 체이스와 앤드류 응이 진행하는 온라인 강좌로, DeepLearning.AI에서 제공합니다.
1 년 전
095.7K
吴恩达的Transformer LLMs工作原理免费课程

엔다 우의 Transformer LLM 작동 방식에 대한 무료 강좌

트랜스포머 LLM은 딥러닝닷에이아이와 '대규모 언어 모델 실습'의 저자인 제이 알라마르와 마틴 그루텐드가 함께 만든 원리로 작동합니다...
1 년 전
095.9K
Seedream 4.0 - 字节推出的最新一代图像创作模型

Bytes에서 출시한 최신 이미지 생성 모델인 Seedream 4.0

Seedream 4.0은 바이트댄스에서 출시한 고급 이미지 생성 및 편집 도구로, 정확한 명령어 편집, 높은 기능 보존, 깊은 의도 이해 등의 강력한 기능을 갖춘 생성 및 편집의 통합에 중점을 두고 있습니다.
1 년 전
0116.9K
rStar2-Agent - 微软开源的高效AI推理模型

rStar2-Agent - Microsoft의 효율적인 오픈 소스 AI 추론 모델

rStar2-Agent는 Microsoft에서 오픈소스로 제공하는 고급 AI 수학적 추론 모델로, AIME24 테스트에서 80.61 TP3T의 정확도를 달성하여 강력한 수학적 문제 해결 능력을 입증했습니다. 이 모델은 과학적 추론 기능을 갖추고 있으며, GPQA-Diamond 벤치마크에서 ...
1 년 전
061.9K
InfinityHuman - 字节联合浙大推出的长视频数字人生成模型

인피니티휴먼 - 바이트가 ZJU와 협업하여 출시한 롱 비디오 디지털 휴먼 생성 모델

인피니티휴먼은 바이트댄스와 절강대학교가 공동으로 출시한 상용 등급의 장시간 오디오 기반 캐릭터 동영상 생성 모델입니다. 이 모델은 오디오 기반이며 고해상도, 장시간, 시각적으로 일관된 캐릭터 동영상을 생성할 수 있습니다.
1 년 전
069.2K
Kimi K2-0905 - 月之暗面推出的最新模型版本

키미 K2-0905 - 다크 사이드 오브 더 문 최신 모델 출시!

Kimi K2-0905는 프로그래밍 지원 기능이 뛰어나고 코드를 효율적으로 생성하며 프론트엔드 개발에서 깔끔하고 표준화된 코드 생성을 지원하는 다크 사이드 오브 더 문 테크놀로지스의 고급 AI 모델입니다. 모델 컨텍스트 길이가 256K로 확장되어 복잡한 작업을 처리할 수 있습니다.
1 년 전
0103.7K
Meeseeks - 美团开源的评估模型指令遵循能力的评测集

Meeseeks - 모델 지침이 루브릭 세트를 따르는 능력에 대한 Meeseeks 오픈 소스 평가

미즈윅스는 메이퇀의 M17 팀이 모델의 지시를 따르는 능력을 평가하기 위해 사용하는 오픈 소스 대규모 모델 평가 세트입니다.미즈윅스는 3단계 평가 프레임워크를 사용하여 모델이 매크로에서 마이크로 수준까지 사용자의 지시에 따라 답변을 생성할 수 있는지 종합적으로 측정하며 답변 내용에 대한 지식은 긍정적으로 평가하지 않습니다.
1 년 전
068.6K
gpt-realtime - OpenAI最新推出的AI语音模型

gpt-realtime - OpenAI의 최신 AI 음성 모델

gpt-realtime은 자연스럽고 부드러운 음성을 생성하기 위해 오디오의 직접 처리를 지원하는 OpenAI의 고급 음성 모델입니다. 이 모델은 여러 언어와 스타일을 지원하고 웃음과 같은 비언어적 단서를 이해하며 언어 간에 전환할 수 있습니다.
1 년 전
074.3K
Youtu-agent - 腾讯开源的高效智能体框架

Youtu-agent - 텐센트 오픈 소스 효율적인 인텔리전트 바디 프레임워크

유투 에이전트는 텐센트 유투 랩의 자율 지능 구축 및 실행을 위한 오픈 소스 프레임워크입니다. 이 프레임워크는 각각 71.47% 및 72.8%의 정확도로 WebWalkerQA 및 GAIA 벤치마크에서 우수한 성능을 발휘하며, 이 프레임워크는 ...
1 년 전
085.3K
HunyuanVideo-Foley - 腾讯推出的开源视频音效生成模型

훈위안비디오-폴리 - 텐센트의 오픈 소스 비디오 사운드 생성 모델

훈위안비디오-폴리는 무음 동영상에 정확하게 일치하는 음향 효과를 추가하는 것을 지원하는 텐센트 혼합원 팀의 오픈 소스 동영상 사운드 생성 모델입니다. 이 모델은 대규모 데이터 세트 학습을 기반으로 하며, 다중 모드 확산 변환기 아키텍처와 정렬 손실 함수 표현 및 오디오 VAE 최적화 기술이 결합되어 있습니다 ...
1 년 전
085.3K