AIパーソナル・ラーニング
と実践的なガイダンス
TRAE
合計992記事

タグ: AIのオープンソースプロジェクト 46ページ

CosyVoice:阿里推出的3秒急速语音克隆开源项目,支持情感控制标签-首席AI分享圈

CosyVoice:3秒間の突進ボイス・クローニング・オープンソース・プロジェクトがアリによって立ち上げられる。

包括的な紹介 CosyVoiceは、推論、トレーニングからデプロイまでフルスタックの機能を提供する多言語大規模音声生成モデルです。FunAudioLLMチームによって開発されたCosyVoiceは、高度な自己回帰変換器とODEベースの拡散モデルによって、高品質の音声合成を実現することを目的としています。

Fabric:集成众多提示词的AI开源工作流框架,高效处理各种事务-首席AI分享圈

ファブリック:AIオープンソースのワークフローフレームワークで、多くのキューワードを統合し、様々なトランザクションを効率的に処理する。

概要 Fabricは、Daniel Miesslerによって開発されたオープンソースのAIフレームワークで、日常的なコンピュータタスクを簡素化・自動化し、人工知能を使いやすくすることを目的としている。モジュール設計とあらかじめ定義されたプロンプトワード(Patterns)により、コンテンツの要約やデータ抽出など、さまざまなタスクを効率的に処理することができます。

NocoDB:在多种数据库上创建智能表格,开源Airtable替代方案-首席AI分享圈

NocoDB: 複数のデータベースでスマートテーブルを作成、オープンソースのAirtable代替ツール

一般的な紹介 NocoDBは、強力で使いやすいオンラインデータベース管理ツールを提供するために設計されたオープンソースのAirtableの代替です。NocoDBを使えば、ユーザーはコードを書くことなく、簡単にデータベースからデータを作成、読み込み、更新、削除することができます。このプラットフォームは、様々な種類のデータベースをサポートしています。

TANGO:语音生成协调手势人像视频的工具,全身像数字人-首席AI分享圈

TANGO:全身デジタル人物の協調ジェスチャーポートレート映像を音声で生成するツール

概論 TANGO (Co-Speech Gesture Video Reenactment with Hierarchical Audio-Motion Embedding and Diffusion Interpolation) は、東京大学とサイバーエージェントAI研究所が共同開発したオープンソースの協調型音声ジェスチャー動画生成フレームワークです。東京大学とサイバーエージェントAI研究所が共同開発したオープンソースの協調音声ジェスチャー動画生成フレームワークです。その ...

無効なJSON文字列を修正し、LLMによって生成されたJSONデータで起こりうるフォーマットエラーを解決しました。

一般的な説明 無効な JSON ファイルを修正するためのモジュールで、特に大規模言語モデル (LLM) が出力する不正な JSON データを解析するためのモジュールです。このモジュールは、引用符の欠落、不正なカンマ、エスケープされていない文字、不完全なキーと値のペアのような一般的なJSON構文エラーを修正することができます。また、このモジュールは自己...

Kolors Virtual Try On:高效的虚拟试穿/模特换装,文本到图像生成模型-首席AI分享圈

Kolorsバーチャル試着:効率的なバーチャル試着/モデル着せ替え、テキストから画像生成モデル

概要 Kolors Virtual Try-Onは、Kwai-KolorsチームによるHugging Faceプラットフォーム上のバーチャル試着アプリです。このアプリは、高度な人工知能技術を使用し、ユーザーがバーチャル環境で様々な色の服を試着し、自分にぴったりの服を見つけるのを手助けします。使用...

Pyramid Flow:快手推出的开源版

Pyramid Flow:Racerが発表した "Kringle "のオープンソース版で、SD3をベースとし、8GB未満のGPUで動作する(ワンクリックデプロイメント版)。

一般的な紹介 Pyramid Flowは、フローマッチング技術に基づいた効率的な自己回帰映像生成手法である。ピラミッドフローは、異なる解像度やノイズレベル間を補間することで、より高い計算効率で映像コンテンツの生成と伸張を可能にする。

Dify:生成式AI应用开发平台,可视化编排, 支持私有化部署-首席AI分享圈

Dify: ジェネレーティブAIアプリケーション開発プラットフォーム、ビジュアルオーケストレーション、プライベートデプロイメントサポート

包括的な紹介 Difyは、大規模言語モデル(LLM)をベースとしたネイティブAIアプリケーションの迅速な構築と運用を支援するために設計された、オープンソースのジェネレーティブAIアプリケーション開発プラットフォームです。このプラットフォームは、エージェント構築からAIワークフローオーケストレーション、RAG検索、モデル管理など様々な機能を提供し、AIアプリケーションの開発をサポートします。

Datalab:专用OCR识别AI模型,PDF转Markdown(开源/API)-首席AI分享圈

Datalab:専用のOCR認識AIモデル、PDF to Markdown(オープンソース/API)

包括的な紹介 Datalabは、OCR、レイアウト分析、PDFからMarkdownへの変換などに焦点を当てた高度なAIモデルを幅広く提供しています。これらのモデルは高性能であるだけでなく、使いやすくオープンソースです。プラットフォーム上のMarkerモデルは、表を含むPDFを素早く正確にMarkdownに変換することができます...

ModelBest(面壁智能):全球领先的轻量高性能端侧大模型-首席AI分享圈

ModelBest:世界をリードする軽量・高性能エンドサイド・ビッグモデル

ModelBestは、軽量かつ高性能な大型モデルの開発に注力する企業であり、高度なAI技術をメインストリーム家電や日常生活の様々なエンドデバイスに適用することに専念しています。同社のMiniCPMシリーズのエンドサイド・モデルは、非常に高い演算能力とメモリ使用効率、少ないパラメータ数で知られています。

Podcastfy:多源内容转多语言音频对话工具,NotebookLM 播客功能的开源替代方案-首席AI分享圈

Podcastfy:NotebookLMのポッドキャスティング機能に代わるオープンソースの多言語音声会話ツール、マルチソースコンテンツ

一般的な紹介 PodcastfyはオープンソースのPythonパッケージで、生成人工知能(GenAI)技術を使って、ウェブコンテンツ、PDFファイル、テキスト、画像、youtube動画、その他多くのソースを魅力的な多言語音声ダイアログに変換します。従来のユーザーインターフェイスベースのものとは異なり...

One API:多模型API管理与负载均衡,分发系统-首席AI分享圈

One API:マルチモデルのAPI管理と負荷分散、配信システム

包括的な紹介 One APIは、OpenAI ChatGPT、Anthropic Claude、Google PaLM 2、Geminiなどの幅広いビッグモデルをサポートする、オープンソースのインターフェース管理および配布システムです。このシステムは、標準的なOpenAI APIフォーマットを介してすべてのビッグモデルにアクセスし、ロードバランシング、トークン...

文多多 AiPPT:AI生成PPT,演讲稿生成-首席AI分享圈

Wenduoduo AiPPT: AI生成PPT、プレゼンテーション生成

総合紹介 AiPPTは人工知能技術に基づいたPPT生成ツールで、プロフェッショナルなプレゼンテーションを素早く作成できるように設計されています。テーマを入力したり、ファイルをアップロードしたり、URLを提供したりすることで、内容が豊富で美しくデザインされたスライドを自動的に生成します。

Easegen:开源数字人课程制作平台,PPT一键生成克隆数字人讲解视频-首席AI分享圈

Easegen:オープンソースデジタルヒューマンコース制作プラットフォーム、PPTワンクリック生成クローンデジタルヒューマン講義ビデオ

概論 Easegenは、AI技術による教育コンテンツ制作・管理の効率化を目指したオープンソースのデジタルヒューマン講座作成プラットフォームです。このプラットフォームは、コース制作、ビデオ管理からインテリジェントな質問までのワンストップソリューションを提供し、ユーザーは、デジタル人間説明ビデオコースを作成し、AIを使用することができます...

Open Canvas:代码编辑协作画布,开源版OpenAI Canvas/Claude Artifacts-首席AI分享圈

Open Canvas: コード編集が可能なコラボレーション・キャンバス、OpenAI Canvasのオープンソース版/Claude Artifacts

LangChainはOpen Canvasというオープンソースのウェブアプリケーションを提供します。このアプリケーションは、デュアルエージェントメモリ機能と、実行の詳細を観察するための統合されたスミスを内蔵し、ドキュメントの編集とコラボレーション体験を強化するように設計されています。このプラットフォームはOpenAIの "Canvas "にインスパイアされていますが、いくつかの点で...

AutoGen Studio:多代理系统AutoGen的简易用户界面版-首席AI分享圈

AutoGen Studio:マルチエージェントシステムAutoGenの使いやすいインターフェイス版

概要 AutoGen Studio 2.0は、マルチエージェント・ソリューションの作成と管理のプロセスを簡素化するために設計された、AutoGenによるユーザーインターフェースです。このプラットフォームでは、直感的なインターフェースを通じて、エージェントとそのワークフローを宣言的に定義および変更することができます。

MeetingMind:依赖OpenAI Whisper的开源智能会议记录与总结工具-首席AI分享圈

MeetingMind: OpenAI Whisperを利用したオープンソースのインテリジェント会議記録・要約ツール

概要 MeetingMindは、ビジネスミーティングの記録と要約の効率を改善するために設計された高度なAIアプリケーションです。このアプリは、OpenAIのWhisperテクノロジーを統合して正確な音声テキスト化を実現し、IBM WatsonのAIを使用して、書き起こされたテキストの重要なポイントを分析・抽出します。

Coqui TTS(xTTS):文本到语音生成的深度学习工具包,支持多种语言和声音克隆功能-首席AI分享圈

Coqui TTS (xTTS):多言語サポートと音声クローン機能を備えた音声合成用ディープラーニングツールキット

包括的な紹介 Coqui TTSは、ディープラーニング技術に基づいたオープンソースの高度な音声合成(TTS)ツールキットです。Coqui TTSは、ディープラーニング技術をベースとしたオープンソースの先進的な音声合成ツールキットであり、研究環境と実運用環境の両方でテストされ、複数の言語の音声合成をサポートする豊富な機能とモデルのセットを提供しています。

MemFree:本地知识库与搜索信息混合的AI搜索引擎-首席AI分享圈

MemFree:地域の知識ベースと検索情報を混合するAI検索エンジン

概要 MemFreeは、テキスト、画像、文書、ウェブページを検索し、質問することができる高度なハイブリッドAI検索エンジンです。テキスト、マインドマップ、画像、動画の検索結果にワンクリックでアクセスできる。MemFreeの目標は、ユーザーの知識ベースとインターネット全体から...

ja日本語