最新のAIリソース

共 3185 篇文章
VideoFX(Veo2):AI生成创意视频,高物理状态还原,输出原生4K视频

VideoFX(Veo2):高い物理的状態の再現性とネイティブ4Kビデオ出力を備えたAI生成クリエイティブビデオ

概要 VideoFXは、クリエイティブで視覚的に美しいビデオコンテンツを簡単に作成できるように設計された、Google Labsの革新的なビデオ生成ツールです。このツールは、高度な Veo 2.0 テクノロジーを利用して、さまざまなクリエイティブな用途に適した幅広いビデオ効果と編集機能を提供します。
2年前
0109.3K
Dolphin:面向亚洲语言识别与语音转文本模型

ドルフィン:アジア言語認識とアジア言語のための音声テキストモデル

総合紹介 Dolphinは、DataoceanAIと清華大学によって開発された、アジア言語の音声認識と言語認識に特化したオープンソースモデルです。東アジア、南アジア、東南アジア、中東の40の言語と22の中国語方言をサポートしています。
1年前
0109.3K
元真数字人:数字人直播、口播短视频,商业化AI虚拟人直播工具

遠鎮デジタルヒューマン:デジタルヒューマンライブストリーミング、マウスフルショートビデオ、商業化されたAIバーチャルヒューマンライブストリーミングツール

総合紹介 Yuanzhen Digital Peopleは、デジタルピープルライブ放送、ショートビデオ制作、AIアシスタントなどのワンストップサービスをユーザーに提供することに特化したAIGC(人工知能生成コンテンツ)プラットフォームのリーディングカンパニーです。このプラットフォームは、AIアルゴリズム合成とGPTスタイルのビッグモデルを統合し、ユーザーが排他的なQ&Aモデルを作成することをサポートし、実...
2年前
0109.3K
Felo:AI搜索整理知识并一键生成PPT,支持小红书、X、Reddit收集信息

Felo: AIが知識を検索・整理し、ワンクリックでPPTを生成、Little Red Book、X、Redditの情報収集に対応

一般的な紹介 Feloは、ChatGPTとAIエージェントを搭載した多言語AI検索エンジンで、世界の知識を発見し理解するユーザー体験を最適化するように設計されています。言語の壁を取り払い、ユーザーが世界中の情報に簡単にアクセスできるようにします。
2年前
0109.2K
火山方舟:大模型训练与云计算服务,注册送150元等额算力

ボルケーノ・アーク:ビッグモデルのトレーニングとクラウド・コンピューティング・サービス、150ドル相当の算術に申し込む

総合紹介 Volcano Arkは、Volcano Engineが立ち上げたビッグモデルサービスに特化したクラウドコンピューティングプラットフォームで、モデルの選択、トレーニングからアプリケーションまで、完全なソリューションを企業に提供することを目的としています。AI分野におけるByteDanceの深い蓄積に基づき、Volcano Arkは複数のトップAI企業のビッグモデルリソースを統合しています...
2年前
0109.2K
通义听悟:阿里通义音视频内容转录AI助手

Tongyi Listening and Understanding: Ali Tongyi 音声・動画コンテンツ書き起こしAIアシスタント

総合紹介 Tongyi Listening and Understandingは、Aliyunが発表した、音声や動画コンテンツの書き起こしや分析に特化した作業学習AIアシスタントです。AliCloudの強力なAIモデルを利用して、音声や動画コンテンツをリアルタイムでテキストに書き起こし、翻訳、要約、位置決めなどの機能を提供します。Tongyi Listening Wooは、複数の言語とシナリオをサポートしています...
2年前
0109.2K
Interviewcoder:辅助远程技术面试的隐形AI工具

Interviewcoder: 遠隔技術面接を支援する目に見えないAIツール

一般的な紹介 Interviewcoderは、技術面接のために設計されたAI支援ツールで、ユーザーがプログラミング面接中に解答を素早く生成し、コードを最適化し、リアルタイムでデバッグできるように設計されています。ステルスデスクトップアプリケーションとして動作し、Zoom、Googl...
2年前
0109.2K
PandasAI:数据分析对话平台,用自然语言完成数据查询与图表生成

PandasAI: 自然言語によるデータクエリとグラフ生成のためのデータ分析対話プラットフォーム

はじめに PandasAI は Python ベースのオープンソースプラットフォームであり、自然言語処理技術によってデータ分析プロセスを簡素化するように設計されています。データベース(SQL、CSV、pandas、polars、mongodb、n...など)との対話を可能にします。
2年前
0109.2K
LLaMA Factory:高效微调百余种开源大模型,轻松实现模型定制

LLaMAファクトリー:100以上のオープンソースマクロモデルの効率的な微調整、簡単なモデルのカスタマイズ

概要 LLaMA-Factoryは、100以上の大規模言語モデル(LLM)の柔軟なカスタマイズと効率的な学習をサポートする、統一された効率的な微調整フレームワークです。LLaMA Boardのウェブインターフェースを使用することで、ユーザーはコードを書くことなくモデリングを完了することができます。
2年前
0109.2K
ChatArt:覆盖完整写作场景的全能AI写作工具

ChatArt:ライティングシナリオを網羅したオールインワンAIライティングツール

ChatArtは、iMyFoneが開発したAIによるコンテンツ作成プラットフォームです。ブログ、ソーシャルメディア投稿、マーケティングコピー、さらには小説の執筆など、高品質な文章コンテンツを素早く作成することができます。このプラットフォームは、高度なAI技術を使用しています...
2年前
0109.1K
opensource_notebooklm:基于Deepseek-V3和PlayHT TTS的NotebookLM开源实现

opensource_notebooklm: Deepseek-V3とPlayHT TTSに基づくNotebookLMのオープンソース実装

概論 オープンソースNotebookLMは、Deepseek-V3の言語理解能力とPlayHTの音声合成技術を組み合わせた革新的な人工知能プロジェクトであり、インテリジェントなノート作成対話システムを目指しています。このプロジェクトは、Build Fast社によって開発されました。
2年前
0109.1K
Kotaemon:简单部署的开源多模态文档问答工具

Kotaemon: 簡単に導入できるオープンソースのマルチモーダル文書クイズツール

一般的な紹介 Kotaemonは、RAG(Retrieval Augmented Generation)に基づいたQ&A機能をエンドユーザーや開発者に提供するために設計されたオープンソースのドキュメントQ&Aツールです。このプロジェクトはCinnamonによって開発され、様々なLLM APIプロバイダー(例えばOpenA...
2年前
0109.1K
TableGPT Agent:专为分析复杂表格数据设计的智能工具

TableGPTエージェント:複雑な表形式データを分析するために設計されたインテリジェントツール

包括的な紹介 TableGPTエージェントは、GitHubオープンソースプロジェクトに基づくインテリジェントなツールで、表形式データの処理と分析のために設計されています。TableGPT2 Big Language Model に依存し、自然言語インタラクションを使用して、ユーザが簡単にクエリ、操作...
2年前
0109.1K
OpenAOE:大模型群聊框架:同时与多个大语言模型聊天

OpenAOE: 大規模モデルグループチャットフレームワーク: 複数の大規模言語モデルと同時にチャットする

包括的な紹介 OpenAOEは、オープンソースの大規模モデルグループチャットフレームワークです。OpenAOEを使えば、ユーザーは複数の大規模言語モデル(LLM)と同時に会話し、並列出力を得ることができます。このフレームワークは...
2年前
0109K
Aha:由AI驱动的网红/达人营销服务平台

Aha:ネットユーザー/ダーリン向けのAIを活用したマーケティング・サービス・プラットフォーム

概要 Ahaは、Aha Labsが開発した、AIチームによるNetflixマーケティングに特化した世界初のツールです。24時間365日オンラインでAIエージェントのチームを提供し、ユーザーのNetflixマーケティングキャンペーンの立ち上げ、管理、拡大を支援します。ユーザーがブランドやウェブサイトの情報を入力すると、AIがあらゆる...
2年前
0109K
Audiblez:生成有声书,使用Kokoro将电子书转换为有声读物

Audiblez: ココロでオーディオブックを作成、電子書籍をオーディオブックに変換

概要 Audiblezは、電子書籍(.epub形式など)をオーディオブック(.m4b形式など)に変換するためのオープンソースプロジェクトです。Kokoroの高品質音声合成技術を利用し、多言語・多音声をサポートしています。ユーザーは単純に...
2年前
0109K
ChatPDF:与任何PDF文档进行对话与总结

ChatPDF: あらゆるPDF文書との対話と要約

ChatPDFの概要 ChatPDFは対話を通してPDFファイルと対話するために設計されたAIベースのツールです。ユーザーは任意のPDFファイルをアップロードし、ChatGPTのようなインターフェースを通してファイルの内容と対話し、必要な情報を素早く得ることができます。それが学術論文であろうとなかろうと...
2年前
0109K
llm.pdf:在PDF文件中运行大型语言模型的实验项目

llm.pdf:大規模言語モデルをPDFファイルで実行する実験的プロジェクト

一般的な紹介 llm.pdfは、ユーザーが直接PDFファイルで大規模言語モデル(LLM)を実行できるようにするオープンソースプロジェクトです。EvanZhouDevによって開発され、GitHubでホストされているこのプロジェクトは、革新的なアプローチを示しています:Em...
1年前
0109K
Heeyo:陪伴孩子的AI伴侣,提升儿童学习体验的智能AI伙伴(付费)

Heeyo:子供たちの学習体験を向上させる知的AIパートナー、子供たちに寄り添うAIコンパニオン(有料)

概要説明 Heeyoは、3歳から11歳のお子様を対象に、インタラクティブなゲームや会話を通じて学習体験を高めるために設計されたAIアプリです。ハーバード大学とスタンフォード大学の教育専門家によって設計されたHeeyoは、数学、科学、社会的情操スキルをカバーする2000以上の学習ゲームを提供しています。子供...
2年前
0109K
RunPod:专为AI设计的GPU云服务,快速冷启动SD且按秒付费

RunPod:AI向けに設計されたGPUクラウド・サービス、高速コールド・スタートSDと秒単位の課金を実現

概要 RunPodはAI向けに設計されたクラウドコンピューティングプラットフォームで、開発者、研究者、企業にAIモデルの開発、トレーニング、スケーリングのためのワンストップソリューションを提供することを目的としています。このプラットフォームは、オンデマンドGPUリソース、サーバーレス推論、およびAIプロジェクトの自動スケーリングを統合しています。
2年前
0109K
LangBot:开源大模型即时通信机器人,支持多微信、QQ、飞书等多平台部署AI机器人

LangBot:オープンソースの大型モデルインスタントメッセージングロボット、複数のWeChat、QQ、Flybookと他のマルチプラットフォームのAIロボットの展開をサポートしています。

LangBotは、複数のメッセージングプラットフォームと大型モデルをサポートする大型モデルベースのインスタントメッセージングボットプラットフォームです。このプラットフォームはQQ、WeChat(企業WeChat、個人WeChat)、Flybook、Discord、OneBotなどのメッセージングプラットフォームに適応し、Open...
2年前
0109K
AnyText:生成和编辑多语言图像文本,高可控在图像中生成多行中文

AnyText:多言語の画像テキストを生成・編集し、画像内に複数行の中国語を生成することができます。

総合紹介 AnyTextは、拡散モデルに基づいて開発された画期的な多言語ビジュアルテキスト生成・編集ツールです。画像の中に自然で高品質な多言語テキストを生成し、柔軟なテキスト編集機能をサポートします。研究チームによって開発され、ICLR 2024で発表されました。
2年前
0108.9K
AI2SRT:利用 Gemini模型,一键为长视频创建解说短视频或视频总结

AI2SRT:ジェミニ・モデルを使用して、ワンクリックで短いナレーション付きビデオや長いビデオの要約ビデオを作成する。

包括的な紹介 AI2SRTは、GeminiAIのビッグモデルを使用して、ワンクリックで短いナレーション付きビデオと長いビデオのビデオ要約を生成し、音声とビデオの書き起こし字幕をサポートするオープンソースプロジェクトです。このプロジェクトは、ビデオコンテンツの作成プロセスを簡素化し、効率的な字幕生成と翻訳機能を提供することを目的としています。ユーザーは、字幕を作成した後、その字幕を字幕翻訳ソフトに渡すことができます。
2年前
0108.8K
Composio(SWE Kit):一行代码集成150+工具,构建个性化AI智能体

Composio (SWE Kit): パーソナライズされたAIインテリジェンスを構築するために、150以上のツールが1行のコードに統合されている。

包括的な紹介 Composioは、開発者向けに設計されたAIインテリジェンス統合プラットフォームで、1行のコードでAIインテリジェンスと大規模言語モデル(LLM)を150以上のツールにシームレスに接続することを目指しています。1行のコードで、ユーザーはOpe...などの複数のツールやフレームワークを呼び出すことができます。
2年前
0108.8K
GLM-PC(智谱牛牛)正式发布内测下载,真正可以控制电脑的AI

GLM-PC(スマート・スペクトラム・ブル)が社内ダウンロードで正式リリース、コンピュータを本当にコントロールできるAI

GLM-PC(ブル)の紹介 GLM-PCはCogAgentモデルに基づいたデスクトップアプリケーションであり、自然言語コマンドによって複雑なタスクを迅速に実行することができる。タスクプランニングとインターフェイス理解能力を持ち、ユーザの指示に従って自律的にコンピュータの様々な操作を行うことができる。 使用上の注意...
2年前
0108.8K
EnConvo:智能AI启动器,专为macOS设计的全能AI助手

EnConvo:インテリジェントAIランチャー、macOSのための本格的AIアシスタント

一般的な説明 EnConvoは、毎日のタスクを自動化することでユーザーの生産性を高めるように設計されたmacOS用のインテリジェントなAIアシスタントランチャーです。このプラットフォームは、150以上のビルトインツールとMCPサポートを統合し、ユーザーのワークフローを学習して適応します。
2年前
0108.8K
MemeCam:使用AI生成搞笑表情包,在图片中加入搞笑文字,生成有趣的表情包。

MemeCam:AIを使用して面白い顔文字を生成し、写真に面白いテキストを追加して面白い顔文字を生成します。

概要 MemeCamは、面白い顔文字を生成することに特化した、AIを搭載した革新的なプラットフォームである。ユーザーは画像をアップロードするか、ウェブカメラを使って写真を撮ると、MemeCamは高度なGPT-4oテクノロジーを使って画像を認識し、面白いテキストを自動的に生成する。
2年前
0108.8K
Open Deep Research:LangChain开源的深度研究智能助手

オープン・ディープ・リサーチ:LangChainのディープ・リサーチ用オープンソース・インテリジェント・アシスタント

包括的な紹介 Open Deep Researchは、あらゆるトピックに関する包括的なリサーチレポートを作成できるウェブベースのリサーチアシスタントです。このシステムでは、時間のかかる調査フェーズに進む前に、レポートの構成を計画し、確認することができる、計画と実行のワークフローを使用しています...
1年前
0108.7K
Flow(Laminar):构建智能体的轻量级任务引擎,简化并灵活管理任务

Flow(Laminar):タスクを簡素化し、柔軟に管理するインテリジェンス構築のための軽量タスクエンジン

包括的な紹介 Flowは、シンプルさと柔軟性に重点を置いてAIエージェントを構築するために設計された軽量タスクエンジンです。従来のノードベースやエッジベースのワークフローとは異なり、Flowは並列実行、動的スケジューリング、インテリジェントな依存関係管理をサポートする動的タスクキューシステムを使用する。その中核となるコンセプトは...
2年前
0108.7K
shadcn/ui:组件库构建平台

shadcn/ui: コンポーネント・ライブラリ構築プラットフォーム

概要 shadcn/uiは、美しくカスタマイズ可能なUIコンポーネントを提供するオープンソースのコンポーネントライブラリ構築プラットフォームです。このプラットフォームは、様々なフロントエンドフレームワークをサポートしており、開発者がすぐに使い始められるように、インストールと使用に関する詳細なガイドラインを提供しています。
2年前
0108.7K
Career Dreamer:职业规划师,使用AI探索职业潜力

キャリア・ドリーマー:AIを使ってキャリアの可能性を探るキャリア・プランナー

概論 Career Dreamerは、Googleが提供するAIを搭載したキャリア探索ツールで、ユーザーがキャリアの可能性を発見し、スキルを分析して新しいキャリアパスを提案できるように設計されている。このツールは、ユーザーの経歴、スキル、興味を分析し、パーソナライズされたキャリア構築を提供します。
2年前
0108.6K
Pika:优秀的创意视频生成|文生视频|图生视频|图像视频融合

Pika: 優れたクリエイティブ動画生成|テキストから動画へ|グラフィックから動画へ|画像から動画へのフュージョン

Pika 一般紹介 Pika.artはアイデアを動画にするプラットフォームで、クリエイティブな人々にAI動画作成ツールを提供することを目的としています。面白いクリップ、ソーシャルメディアコンテンツ、ショートフィルムなど、Pika.artはユーザーのイマジネーションを形にします。ユーザー...
1年前
0108.6K
Ichigo(llama3-s):本地实时语音AI助手,开源版Siri

Ichigo (llama3-s): ローカルリアルタイム音声AIアシスタント、オープンソース版Siri

はじめに Ichigoはオープンソースのリアルタイム音声AIプロジェクトで、テキストベースの言語モデルをネイティブな「聞き取り」機能で拡張することを目的としています。このプロジェクトでは、MetaのChameleon論文にインスパイアされた初期のフュージョン技術を使用している。
2年前
0108.6K
Engram:为非英语母语者优化写作的AI工具

Engram:英語を母国語としない人のためのライティング最適化AIツール

一般的な紹介 Engramは英語を母国語としない人のために設計されたAIライティングツールで、文法チェック、文の書き換え、翻訳などのコア機能を備えています。英語を母国語としない人がよく犯す間違いを分析し、自然で流暢な英語を提案します。ウェブサイトは使いやすく、ユーザーはテキストを入力し、リアルタイムのリ...
1年前
0108.6K
Trieve:提供搜索、推荐和分析的全方位RAG云基础设施

Trieve:検索、レコメンデーション、アナリティクスを提供するフルサービスのRAGクラウドインフラストラクチャ

概要 Trieveは、検索、レコメンデーション、RAG(Retrieval Augmented Generation)、分析のために設計された、Devflow, Inc.によって開発された包括的なインフラストラクチャです。プラットフォームはAPI経由で提供され、AWS、GCP、K...
2年前
0108.6K
MonaLand:超现实AI聊天虚拟世界|互动剧本|角色游戏|虚拟陪伴

MonaLand: シュールなAIチャット仮想世界|インタラクティブ・スクリプト|ロールプレイ|バーチャルコンパニオン

一般的な紹介 MonaLandは、ユーザーが対話できるシュールなAIキャラクターの豊富なコレクションを提供するAIチャットユニバースプラットフォームです。ユーザーは、マフィア・ボス、マジック・ブランチ・ハット、グルートなど、様々な架空のキャラクターとシナリオベースの対話をすることができます。キャラクターの中には、サイモン・ライリー...
2年前
0108.6K
ja-learner:简易日语学习与视觉小说阅读辅助工具

ja-learner:やさしい日本語学習とビジュアル・ノベルのリーディング・エイド

概要 ja-learnerは日本語学習者、特にビジュアルノベルを読むのが好きなユーザーのために設計されたツールです。文の分解、漢字の注釈、ワンクリック単語検索、参考訳、AI解説など様々な機能を提供し、ユーザーが日本語をよりよく理解し、学習できるようにします。さらに...
2年前
0108.6K
オーケストラ:より簡単で効率的なマルチインテリジェンス共同開発のためのスマートAIチーム構築

オーケストラ:より簡単で効率的なマルチインテリジェンス共同開発のためのスマートAIチーム構築

Orchestraは革新的な軽量Pythonフレームワークで、大規模言語モデル(LLM)に基づくマルチインテリジェンス協調システムの構築に重点を置いています。複数のAI知能が交響楽団のように調和して動作するように、知能を配置する独自の方法を採用している。モデル化することで ...
2年前
0108.5K
SVG.la:从文本或图像转换SVG图形,矢量图形转换

SVG.la: テキストや画像からSVGグラフィックに変換、ベクトルグラフィック変換

はじめに SVG.laは、デザイナーや開発者のためのAIグラフィックツールプラットフォームです。簡単なテキスト記述や画像を用いて、高品質なSVGベクターグラフィックを素早く生成することができます。このプラットフォームは、デザイン素材の自動生成をサポートするだけでなく、様々なフォーマット変換機能を提供します。
2年前
0108.5K
Mercor - AI招聘求职平台,匹配全球职位需求

メルカー - AI採用・求人検索プラットフォーム、グローバルな求人要件にマッチング

Mercorは、求職と採用のプロセスを合理化するグローバル採用のためのAI主導型プラットフォームです。求職者は履歴書をアップロードして20分間のAI面接を受けると、Mercorは世界中の企業から寄せられる何千もの求人依頼とユーザーの情報をマッチングし、リモートワークの機会を素早く見つけます。Mercorの主な特徴は...
1年前
0108.5K
Browse AI:无代码提取和监控结构化数据

ブラウズAI:コードなしで構造化データを抽出し監視する

Browseの紹介 Browse AIは、プログラミングなしであらゆるウェブサイトからデータを抽出・監視できるように設計された、コーディング不要のクラウドベースのウェブ自動化ソフトウェアです。マウス1つでデータ抽出、監視、自動化タスクを実行するボットを訓練することができます...
2年前
0108.5K
Martin:管理日程、邮件和任务的个人AI助手(付费)

Martin: スケジュール、メール、タスクを管理するパーソナルAIアシスタント(有料)

概要 Martinは、ユーザーのスケジュール、メール、タスクを効率的に管理するために設計された先進的なパーソナルAIアシスタントです。ユーザーのカレンダー、Eメール、連絡先などとシームレスに統合することで、Martinはユーザーの生産性を高めるために様々な業務を自動化し、スケジュールすることができます。どんなことでも...
2年前
0108.5K
DeepPiano - 智曲科技推出的AI钢琴应用

DeepPiano - Smartquote TechnologyによるAIピアノアプリ

DeepPianoはSmart Music Technologyが開発した、大型モデルを核としたインテリジェントなピアノアプリです。高度な人工知能技術により、ピアノ演奏者や学習者に様々な便利な機能を提供します。DeepPianoは、インテリジェントな楽譜のページめくり、演奏の進捗状況の自動認識、手動操作の不要...
1年前
0108.5K
TripoSG:单张图像生成高分辨率3D建模数字资产

TripoSG: 1枚の画像から高解像度の3Dモデリングデジタル資産を生成

概論 TripoSGはVAST AI研究チームによって開発されたオープンソースプロジェクトで、1枚の画像から高品質の3Dモデルを生成する。このプロジェクトでは、大規模な整流器フローコンバーター技術を用い、ハイブリッド教師あり学習と高品質なデータセットを組み合わせることで、生成された3Dモデルに...
1年前
0108.4K
PengChengStarling:对比Whisper-Large v3更小、更快的多语言语音转文字工具

PengChengStarling: Whisper-Large v3より小型で高速な多言語音声テキスト変換ツール

包括的な紹介 PengChengStarling (PengCheng Labs) は、異なる言語の音声を対応するテキストに変換できる多言語自動音声認識 (ASR) ツールです。このツールキットはicefallプロジェクトに基づいて開発され、完全な音声認識プロセスを提供します...
2年前
0108.4K
反谱 - AI音乐转谱平台,支持音频文件转五线谱和简谱

Anti-score - AI音楽トランスクリプションプラットフォーム。

AntiSpectrumは、先進的なAI技術に基づき、オーディオファイル(MP3、FLACなど)をペンタトニックやシンプルな楽譜に変換する革新的なオンラインAI音楽変換プラットフォームです。AntiSpectrumにはボーカル分離機能があり、音楽中のボーカルと伴奏を分離し、音楽制作やミキシングを簡単にします。AntiSpectrumは、MIDIファイルの変換をサポートしています...
1年前
0108.4K
社媒助手:小红书、抖音等平台数据采集浏览器插件

ソーシャルメディア・アシスタント:Xiaohongshu、Jieyin、その他のプラットフォームのデータ収集用ブラウザ・プラグイン

総合紹介 ソーシャルメディアアシスタント(social-media-copilot)は、XiaohongshuやJieyinなどのソーシャルメディアプラットフォーム用に設計されたデータ収集ブラウザプラグインです。このプラグインは、透かしのない画像や動画のワンクリックでのエクスポート、コメントの収集、作業データの収集、ダ...
2年前
0108.4K
Index-AniSora - B站推出的开源动漫视频生成模型

インデックス-アニソラ - Bステーションによるオープンソースアニメ動画生成モデル

Index-AniSoraはBeili Beiliによるオープンソースの先進的なアニメ動画生成モデルです。このモデルは、一枚の画像に基づいて首尾一貫したアニメ動画を生成することができ、ドラマ、国民的アニメ、VTuberコンテンツなどの様々なスタイルをサポートします。このモデルは、拡散モデルアーキテクチャに基づいており、時空間マスクモジュール、3Dアニメーションモジュールと組み合わされています。
1年前
0108.3K
Fast-Agent:声明式语法和MCP集成快速构建多智能体工作流

Fast-Agent: マルチインテリジェントなボディ・ワークフローを迅速に構築するための宣言的文法とMCPの統合

概要 Fast-Agentは、evalstateチームによってGitHubでメンテナンスされているオープンソースツールで、開発者がマルチインテリジェンスワークフローを素早く定義、テスト、構築できるように設計されています。シンプルな宣言的構文に基づいており、MCP(Mode...
2年前
0108.3K
J1 Assistant:下载J1助手,体验全新互动方式的语音AI助理

J1アシスタント: J1アシスタントをダウンロードして、音声AIアシスタントの新しいインタラクティブな方法を体験してください。

はじめに Matter.aiは、先進的な人工知能ソリューションを提供する革新的な企業です。その最新製品であるJ1アシスタントは、Samsung Galaxy S24をサポートするバージョン0.8.3-beta1がリリースされました。
2年前
0108.3K
QAnything:高度集成RAG处理流程的本地知识库问答系统

QAnything: RAG処理フローを高度に統合したローカル知識ベースQ&Aシステム

QAnything Comprehensive Introduction QAnything(Question and Answer based on Anything)は、NetEaseが発表したローカル知識ベースのQ&Aシステムで、あらゆる種類のファイル形式とデータベースをサポートし、オフラインでインストールして使用することができる。
2年前
0108.3K
Project IDX:云端集成多开发环境的AI IDE,Google基于网页的免费AI代码编辑器

Project IDX: クラウドに統合されたマルチ開発環境のためのAI IDE、グーグルの無料ウェブベースAIコードエディター

包括的な紹介 Project IDXは、Googleが提供するAI支援のフルスタック、マルチプラットフォームのアプリケーション開発ワークスペースである。Google Cloudをベースとし、複数のフレームワークと言語をサポートし、多くのGoogle製品とサービスを統合しています。
1年前
0108.3K
DomoAI:智能视频艺术风格转换|图像转视频|文本转视频

DomoAI: インテリジェントビデオアートスタイル変換|画像から動画へ|テキストから動画へ

概要 DomoAIは最近、既存のビデオを全く異なるアートスタイルに変換し、素晴らしい結果をもたらすVideo to Video機能を発表した。これにより、ユーザーは簡単にユニークなスタイルのビジュアルアートを作成することができます。その他にも、静止画を動画に変換したり、テキストを画像に変換したりすることができます。
2年前
0108.3K
AgentIQ:灵活连接和管理AI智能体的开源工具

AgentIQ: AIインテリジェンスの柔軟な接続と管理のためのオープンソースツール

概要 AgentIQは、開発者がAIインテリジェンスを効率的に接続・管理できるように設計されたNVIDIAのオープンソースツールです。異なるフレームワークのインテリジェンスがシームレスに連携し、企業データとツールを接続し、関数を呼び出すようなワークフローを構築することを可能にします。このツールの最大の特徴は...
1年前
0108.3K
Sketch-Gen:生成高质量线稿和草图,反推图像提示词,一键安装包

Sketch-Gen: 高品質の線画とスケッチを生成、イメージキューワードをバックプロパゲート、ワンクリックパッケージインストール

概要 Sketch-Genは、アーティストやデザイナーが高品質な線画やスケッチを素早く生成できるように設計された、AI技術ベースの線画・スケッチ生成ツールです。Paints-UNDOプロジェクトから生まれたこのツールは、高度な機械学習モデルを使用しています。
2年前
0108.3K
实时语音转文字的开源工具

リアルタイム音声テキスト化のためのオープンソースツール

概要 realtime-transcription-fastrtcは、音声をリアルタイムでテキストに変換することに特化したオープンソースプロジェクトです。FastRTC技術を使って低遅延の音声ストリームを処理し、ローカルのWhisperモデルと組み合わせて効率的なテキスト変換を実現します。
1年前
0108.3K
COSINE:智能理解代码库,让开发者轻松理解和编写代码的AI工具(内测)

COSINE: Intelligent Understanding Codebase、開発者がコードを理解し書きやすくするAIツール(ベータ版)

概要 Cosineは、最新のソフトウェア開発者にコードベースの深い理解と解析サービスを提供する、革新的なAI主導のコード理解プラットフォームです。50以上のプログラミング言語をサポートするこのプラットフォームは、特殊な検索エンジン、ベクターデータベース、そしてAIを組み合わせた独自の技術アーキテクチャを採用しています。
2年前
0108.2K
11X:自动化销售流程的AI数字员工

11X:営業プロセスを自動化するAIデジタル・ワークフォース

概要 11Xは、AI技術を活用してデジタル労働力を創出するウェブサイトである。主力製品は、企業の営業プロセスの自動化を支援するアリスやジュリアンのようなAIアシスタントだ。これらのデジタル従業員は、繰り返しの多い作業を人間に取って代わるだけでなく、...
2年前
0108.2K
Rows:数据驱动的电子表格工具

行: データ駆動型スプレッドシートツール

総合紹介 Rowsは、データのインポート、変換、共有を簡素化するために設計された革新的なスプレッドシートツールです。従来のスプレッドシートの機能を提供するだけでなく、リアルタイムのデータレポートや自動データ分析も統合しています。シンプルなインターフェイスで、コードを記述することなく、強力な...
2年前
0108.2K
BrushEdit:腾讯ARC发布的图像修复和编辑的全能工具

BrushEdit:画像修復・編集のオールインワンツール、テンセントアークがリリース

総合紹介 BrushEditは、Tencent ARC Labsが開発したオールインワンの画像修復・編集ツールです。このツールは最新のAI技術に基づいており、画像の欠陥を自動的に識別して修復することができ、ユーザーによるインタラクティブな編集もサポートしています。
2年前
0108.2K
AnimeGamer:用语言指令生成动漫视频和角色互动的开源工具

AnimeGamer: 言語コマンドでアニメ動画とキャラクターのインタラクションを生成するオープンソースツール

AnimeGamerはテンセントのARC Labが開発したオープンソースツール。ユーザーは、「宗介が紫の車でドライブする」といった簡単な言語コマンドでアニメ動画を生成したり、「魔法少女の冒険」のキキや「スカイシティ」...といった異なるアニメキャラクターを相互作用させたりすることができる。
1年前
0108.2K
JustDone:快速生成原创内容的AI写作助手

JustDone:オリジナルコンテンツを素早く生成するAIライティング・アシスタント

概要 JustDoneは、ユーザーが高品質でオリジナルなコンテンツを素早く作成できるように支援することに焦点を当てた、AIベースのライティング支援プラットフォームです。JustDoneは、ライター、マーケティング担当者、学生など様々な人に向けて、テキスト生成、剽窃検出、文法チェック、SEO最適化など様々なツールを提供しています。
1年前
0108.2K
天工AI:全能AI助手,助力高效工作与生活

天宮AI:仕事と生活を効率化する万能AIアシスタント

総合紹介 天宮AIは中国初の全方位型AIアシスタントで、検索、対話、文章作成、文書分析、描画、PPT作成など様々な機能を統合している。先進的なAI技術により、ユーザーの意図を理解し、インターネット上のあらゆる情報を検索し、一般化、要約、統合することで、高品質、無...
2年前
0108.2K
MCP Server ChatSum:依赖MCP在Claude中查询和总结微信聊天消息

MCPサーバーChatSum: ClaudeでWeChatメッセージをクエリーし要約するためにMCPに頼る

一般的な紹介 MCPサーバー ChatSumは、ユーザーがチャットメッセージを照会し要約するために設計されたオープンソースプロジェクトです。このプロジェクトはGitHubでホストされており、ユーザーが特定のパラメータに基づいてチャットログを照会し、対応する要約を生成することができる強力なツールセットを提供します...
2年前
0108.2K
Mem:智能笔记应用,高效记录并管理信息

Mem:情報を効率的に記録・管理するインテリジェントなメモアプリケーション

概要 Mem.aiは、多忙なプロフェッショナル、学生、クリエイターのためにデザインされたAIノートアプリです。従来のフォルダーベースのシステムとは異なり、MemはAIを使用して、メモ、メール、カレンダーなど、さまざまなソースからのメモを自動的に整理し、つなげます。
2年前
0108.1K
Midjourney:创造你想象中的图像|Midjourney中文官网介绍|官网开放免费测试

ミッドジャーニー:想像のイメージを創造する|ミッドジャーニー中国語サイト紹介|公式サイト無料テスト公開中

Midjourney(ミッドジャーニー)紹介 Midjourney(ミッドジャーニー)は、新しい思考媒体を探求し、人類種の想像力を拡張する独立系研究所である。テキストの記述に基づいて画像を生成するAIサービスを提供しており、ユーザーは写実的なものから抽象的な風まで、さまざまな形のアートを作成することができる。
2年前
0108.1K
老师帮 - AI教师工作助手,支持课件一键转PPT

教師のヘルプ - AI教師の作業アシスタント、ワンクリックでPPTにコースウェアをサポートします。

Teacher Helpは教師のために設計されたAIインテリジェントツールプラットフォームで、AI技術に基づいて、教師の作業効率と教育の質を向上させます。このプラットフォームは、授業計画作成、コースウェアのPPTへのワンクリック変換、宿題やテスト問題のデザイン、生徒のコメント作成、指導案作成など、さまざまな機能を提供します。このプラットフォームは、テキスト翻訳をサポートしています...
1年前
0108K
Cuckoo:适合多语言会议与识别专业术语的实时翻译助手

Cuckoo:多言語会議のためのリアルタイム翻訳アシスタントと専門用語の認識

概要 Cuckooは、グローバルチームのためのAIスマート翻訳ツールです。会議でのリアルタイム多言語翻訳を実現し、特に営業、マーケティング、テクニカルサポートチームに適しています。このウェブサイトは、2024年に設立されたCuckoo Labsによって開発されました。
2年前
0108K
Leon:用语音交流的个人助理,创建自定义技能完成各类任务,保护隐私,离线运行

Leon:音声でコミュニケーションし、カスタマイズされたスキルを作成してあらゆるタスクをこなし、プライバシーを保護し、オフラインで動作するパーソナルアシスタント

一般的な紹介 Leonは、サーバー上で動作するオープンソースのパーソナルアシスタントです。Leonはプライバシー保護を重視し、オフライン操作をサポートし、ユーザーがカスタムスキルを作成して共有し、機能を拡張することができます。
2年前
0108K
Perplexica:1比1复刻 Perplexity AI 功能和界面的开源AI搜索引擎

Perplexica: Perplexity AIの機能とインターフェイスを1対1で再現したオープンソースのAI検索エンジン

概要 Perplexicaは、インターネットを深く掘り下げた答えを提供するために設計されたオープンソースのAI駆動型検索エンジンです。類似検索や埋め込み技術などの高度な機械学習アルゴリズムを使用し、検索結果を最適化し、引用元とともに明確な回答を提供します。
2年前
0107.9K
闲鱼卖家全天自动值守的AI客服机器人

アイドル・フィッシュの販売員が24時間体制で自動対応するAIカスタマーサービスボット

包括的な紹介 XianyuAutoAgentは、GitHubで開発者shaxiuによってオープンソース化されたIdlefishプラットフォーム用に設計されたインテリジェントな顧客サービスロボットシステムです。AI技術を利用し、7×24時間の自動勤務を実現し、アイドルフィッシュ販売者の返信を支援する。
2年前
0107.9K
法行宝:AI法律顾问,人工智能法律咨询,百度AI法律平台

ファ・シン・バオ:AI法律顧問、人工知能法律相談、百度AI法律プラットフォーム

全面的な紹介 LawXinbaoは百度によって創始されたインテリジェント法律サービスプラットフォームであり、先進的な人工知能技術と専門的な法律知識ベースを統合している。当プラットフォームは、ユーザーに便利で専門的な法律インテリジェントサービスを提供することを目的としており、インテリジェントな法律Q&A、案件分析、契約書レビューなどの機能を備えています。ディープラーニング...
2年前
0107.9K
Whispers from the Star:米哈游开发的AI实时互动科幻故事游戏

星からのささやき:ミハ・ツーリズムが開発したAIリアルタイム・インタラクティブSFストーリーテリングゲーム

概要 「星からのささやき」(群星低语)は、Anuttacon社が開発したリアルタイムインタラクティブSFストーリーテリングゲームである。ミハ・ツアーの創設者であるハオ・ユー・ツァイによって設立されたAnuttaconによってリリースされたこのゲームは、深宇宙を舞台としており、プレイヤーは...
2年前
0107.9K
They See Your Photos:基于 Google Vision 照片隐私信息分析

彼らはあなたの写真を見ている:Google Visionに基づく写真プライバシー情報の分析

はじめに They See Your Photos は、ユーザーが写真に隠された個人情報を理解できるようにデザインされた、使いやすいオンライン・ツールである。ユーザーは任意の画像をアップロードすることができ、ウェブサイトは人工知能技術によって画像コンテンツとメタデータを分析し、写真から明らかになる可能性のある詳細を表示します...
1年前
0107.9K
通义千问:阿里推出的多模态大模型,拥有文本回答、图片理解、视频解析能力

Tongyi Thousand Questions:アリが立ち上げた、テキスト回答、画像理解、ビデオ解析機能を備えた大規模なマルチモーダルモデル

総合紹介 「同義千問」は阿里雲によって開発されたインテリジェントなビッグモデルで、ディープラーニングと自然言語処理技術を通じて、人間のようなインタラクション体験を提供することを目指している。生活に楽しさを加える創造的なコピーを素早く生成することができ、ユーザーがあらゆる種類の知識を簡単に学ぶことができる学習アシスタントの役割を果たします。最先端の技術と進化する...
2年前
0107.9K
Reshot AI:实时编辑面部表情,人像图片面部表情精细控制

リショットAI:表情のリアルタイム編集、ポートレート写真の表情の微調整

一般的な紹介 Reshot AIは、顔の表情、目の方向、頭のポーズをリアルタイムで調整することに重点を置いた、強力なオンラインAIフォトエディターです。簡単な操作で素早く写真を編集し、プロ並みの高品質な写真に仕上げることができます。
2年前
0107.9K
BuffGPT:企业级生成式AI应用低代码开发平台

BuffGPT: エンタープライズ級ジェネレーティブAIアプリケーションのためのローコード開発プラットフォーム

包括的な紹介 BuffGPTはLarge Language Model (LLM)に基づいたオープンソースのAIアプリケーション開発プラットフォームであり、データ処理、モデル呼び出し、RAG検索、視覚的なワークフローオーケストレーションなどのすぐに使える機能を提供し、ユーザーが生成AIアプリケーションを簡単に構築・運用できるように支援します。このプラットフォームは、プライベート...
2年前
0107.7K
ANP:实现智能代理间安全高效通信的开源协议

ANP: インテリジェントエージェント間の安全で効率的な通信のためのオープンソースプロトコル

概要 AgentNetworkProtocol(略してANP)は、GitHubでホストされているオープンソースのプロトコルプロジェクトで、インテリジェントエージェント(AIエージェント)に安全で効率的な通信ソリューションを提供することに焦点を当てている。このプロトコルは、アイデンティティと暗号化という3つのレイヤーから構成されています。
2年前
0107.7K
uni-api:轻量大模型API转换为OpenAI接口,YAML文件配置API渠道

uni-api: 軽量なビッグモデルAPIをOpenAIインターフェイスに変換。

包括的な導入フロントエンドなし、純粋な設定ファイルの設定APIチャネル。ただ、自分のAPIステーションを実行することができますファイルを書いて、ドキュメントには、詳細な設定ガイドを持っている、白フレンドリー。 uni-apiは、統一されたAPIプロジェクトを可能にする大規模なモデルの統一管理です。
2年前
0107.7K
Dify-Plus:为Dify开发的企业内部管理后台

Dify-Plus:Difyのオンプレミス管理バックエンド

包括的な紹介 Dify-Plusは、Difyオープンソースプロジェクトの二次開発をベースにしたAIアプリケーション開発プラットフォームです。Dify-Plusは、Difyをベースに新しい管理センターを追加し、エンタープライズシナリオ向けに機能を最適化しています。このプロジェクトは、当初は企業の内部利用を目的としていましたが、後にコミュニティにも同様のニーズがあることがわかり、Dify-Plusを開発しました。
1年前
0107.7K
VideoLingo:视频转录单词级时间轴字幕,视频字幕翻译和本地化配音开源工具

VideoLingo: 動画書き起こし単語レベルタイムライン字幕、動画字幕翻訳、ローカライズ吹き替えオープンソースツール

概要 VideoLingoはNetflixの等級を発生させるように設計されているワンストップビデオ翻訳および局在化のダビング用具である 未加工機械翻訳および複数行のサブタイトルを除去し、全体的な知識を可能にするために良質の吹き替えを加える 言葉の障壁を渡って共有されるため。これによって、言語の壁を越えたグローバルな知識の共有が可能になります。
2年前
0107.7K
ImageTranslate:快速翻译图片文字的在线工具

ImageTranslate: 画像テキストの高速翻訳のためのオンラインツール

一般的な紹介 ImageTranslateは、画像からテキストを翻訳するために設計された使いやすいオンラインツールです。OCR(光学式文字認識)技術を使って画像からテキストを抽出し、ユーザーが必要とする言語に素早く翻訳します。ウェブサイトは、40以上の言語をサポートしています。
1年前
0107.6K
Motionvid.ai:用文字或草图快速生成演示动画视频

Motionvid.ai:テキストやスケッチからプレゼンテーション用のアニメーションビデオを素早く生成

一般的な紹介 Motionvid.aiは人工知能を使用して、ユーザーが素早くプロフェッショナルなアニメーションビデオを作成できるオンラインツールです。このツールの最大の特徴は、テキストの説明や手描きのスケッチを使って、滑らかなダイナミクスと高品質の視覚効果を持つアニメーションを数秒で生成することです。ユーザーは複雑な操作をマスターする必要はありません。
1年前
0107.6K
Happy Scribe:音频转录和视频字幕平台|免费视频字幕编辑软件

ハッピースクライブ:音声書き起こし・ビデオ字幕作成プラットフォーム|無料ビデオ字幕作成ソフト

ハッピースクライブ概要 ハッピースクライブは、高精度で音声をテキストに変換し、複数の言語とフォーマットをサポートする、自動および手動の音声書き起こしサービスを提供します。インタラクティブエディタ、コラボレーションツール、複数のエクスポートフォーマット、機械翻訳、その他の機能が含まれています。
2年前
0107.6K
MagicMirror:AI一键换脸、发型和穿搭的轻量级本地客户端

MagicMirror:AIがワンクリックで顔、髪型、衣装を変更できる軽量ネイティブクライアント

一般的な紹介 MagicMirrorは、便利なポートレート編集体験をユーザーに提供することに重点を置いた革新的なAI画像処理ツールです。MagicMirrorは、高度なAI技術を使用して、ユーザーが簡単に顔を変更し、ヘアスタイルを変更し、さまざまなドレッシング効果を試すことができます。軽量アプリとして、その...
2年前
0107.6K
Agentic Security:开源的LLM漏洞扫描工具,提供全面的模糊测试和攻击技术

Agentic Security: オープンソースのLLM脆弱性スキャンツール。

概要 Agentic Securityは、開発者やセキュリティ専門家に包括的なファズテストと攻撃技術を提供するために設計されたオープンソースのLLM(Large Language Model)脆弱性スキャンツールです。このツールは、カスタムルールセットやエージェントベースの攻撃をサポートし、LLM APを統合することができます。
2年前
0107.5K
Langui:开源的AI用户界面组件库

Langui: AIユーザーインターフェイスコンポーネントのオープンソースライブラリ

概要 LangbaseIncのLanguiは、生成AIや大規模言語モデリング(LLM)プロジェクトのために設計されたオープンソースのユーザーインターフェイスコンポーネントライブラリです。このライブラリはTailwind CSSをベースにしており、開発者が素早くUIを構築できるように、あらかじめビルドされたUIコンポーネントのコレクションを提供します。
2年前
0107.5K
SegAnyMo:从视频中自动分割任意运动物体的开源工具

SegAnyMo: ビデオから任意の移動物体を自動的にセグメント化するオープンソースツール

概要 SegAnyMoは、カリフォルニア大学バークレー校と北京大学の研究者チームによって開発されたオープンソースプロジェクトで、Nan Huangなどのメンバーが参加している。このツールはビデオ処理に重点を置いており、ビデオ内の任意の動く物体、例えば人、動物、...を自動的に識別し、セグメント化することができる。
1年前
0107.5K
MegaParse:解析各类型文档为LLM可用数据,完整保留文档中的表格、图片等所有信息

MegaParse:各タイプのドキュメントをLLMで利用可能なデータに解析し、表や写真などドキュメント内のすべての情報をそのまま保存する。

概論 MegaParseは、Large Language Model (LLM)のデータ処理を最適化するために設計された、パワフルで多機能な文書解析ツールです。MegaParseは、テキスト、PDF、PowerPointプレゼンテーション、Word文書など、どのような文書を扱う場合でも...
2年前
0107.5K
VideoRAG:理解超长视频的RAG框架,支持多模态检索和知识图谱构建

VideoRAG:マルチモーダル検索と知識グラフ構築をサポートする超長尺動画理解のためのRAGフレームワーク

包括的な紹介 VideoRAGは、非常に長い文脈動画を処理し理解するために設計された、検索機能を強化した生成フレームワークです。このツールは、グラフ駆動のテキスト知識ベースと階層的なマルチモーダルコンテキストエンコーディングを組み合わせ、1つのNVIDIA RTX 3090 GPUで効率的に処理します...
2年前
0107.5K
Edraw.AI(亿图):在线协作白板工具,AI生成流程图和多种图表

Edraw.AI:オンライン共同ホワイトボードツール、AIが生成するフローチャートと複数のダイアグラム

包括的な紹介 Edraw.AIは、40以上のインテリジェントツールと入念にデザインされたテンプレートライブラリを統合した、AIを搭載した画期的なオンラインビジュアルホワイトボードコラボレーションプラットフォームです。Edraw.AIは、高度なAI技術を駆使し、ユーザーのテキストによる思考を素早くプロフェッショナルなビジュアル図に変換します。このプラットフォームは...
2年前
0107.5K
CogVLM2:开源多模态模型,支持视频理解与多轮对话

CogVLM2: 映像理解と複数回の対話を支援するオープンソースのマルチモーダルモデル

包括的な紹介 CogVLM2は清華大学データマイニング研究グループ(THUDM)によって開発されたオープンソースのマルチモーダルモデルで、Llama3-8Bアーキテクチャをベースとしており、GPT-4Vに匹敵するか、それ以上の性能を提供することを目指している。このモデルは画像理解、多ラウンド対話、視覚...
2年前
0107.4K