最新のAIリソース

共 3185 篇文章
Tizzy.ai - 百度推出的AI搜索应用

百度がAI検索アプリ「Tizzy.ai」を発表

Tizzy.aiはBaiduが発表したAIインテリジェント検索アプリケーションです。Tizzy.aiはBaiduのビッグモデル技術に基づいており、強力なインテリジェント検索機能を備え、質問に素早く答え、深く考え、意思決定を支援することができます。Tizzy.aiはシンプルなインターフェイスで、広告やポップアップがなく、ガイドの下部に...
1年前
081.7K
MagicTryOn - 浙大和vivo等机构推出的视频虚拟试穿框架

MagicTryOn(マジックトライオン) - ZJUやVivoなどが提供するビデオバーチャル試着フレームワーク

MagicTryOnは、浙江大学コンピューター科学技術学院がvivoや他の組織と共同で立ち上げた先進的なビデオバーチャルトライオン・フレームワークである。このフレームワークは、従来のU-Netアーキテクチャを革新的なDiffusion Transformer (DiT)アーキテクチャに置き換え、完全なセルフアテンションマシンと組み合わせたものである。
1年前
081.7K
袋鼠参谋 – 美团推出的商家AI智能决策应用

Kangaroo Staff - 名創(Meituan)が提供する加盟店向けAIインテリジェント意思決定アプリ

Kangaroo Staffは、Meituanが立ち上げた加盟店向けのAIインテリジェント意思決定アプリケーションで、加盟店の出店・運営における問題解決を支援する。Meituanの膨大なケータリングデータと10年以上のオンライン運営経験に基づき、対話を通じて、トラック選択、出店場所、料理開発、店舗運営などのシナリオに関する正確な情報を加盟店に提供する。
1年前
081.7K
BAGEL - 字节跳动推出的开源多模态基础模型

BAGEL - Wordpressがオープンソースのマルチモーダルベースモデルを発表

BAGELは、ByteDanceによってオープンソース化されたマルチモーダルベースモデルで、140億のパラメータを持ち、そのうち70億がアクティブである。このモデルベースとMixed Transformer Expert Architecture (MoT)は、それぞれ独立した2つのエンコーダで画像のピクセルレベルとセマンティックレベルの特徴をキャプチャし、画像、テキスト、ビデオの効率的な処理をサポートします。
1年前
081.6K
V-JEPA 2 - Meta AI 推出的最强世界大模型

V-JEPA 2 - Meta AIによる世界最強の大型モデル

V-JEPA 2は、Meta AIが提供する12億のパラメータを持つビデオデータに基づく世界の大規模モデルである。このモデルは、100万時間以上のビデオと100万枚の画像から自己教師付き学習に基づいて学習され、物理世界の物体、行動、操作を理解する...
1年前
081.6K
Matrix-Game 2.0 - 昆仑万维开源自研的交互式世界模型

マトリックスゲーム2.0 - KunlunWeiによって開発されたインタラクティブな世界モデル

Matrix-Game 2.0は、Kunlun SkyWork AIがリリースした自社開発のインタラクティブワールドモデルです。Matrix-Game 2.0は、業界初のオープンソース、リアルタイム、長シーケンスの汎用シナリオ用インタラクティブ生成モデルであり、複数のシナリオを25FPSで動作させることができる。
1年前
081.5K
AI抖音 - 抖音推出的智能深度思考与搜索应用

AI Jitterbug - Jitterbugによるインテリジェントなディープシンキングと検索アプリ

AI Jitterbugは、より効率的でインテリジェントなコンテンツ取得体験をユーザーに提供するために、Jitterbugが立ち上げたインテリジェントなディープシンキングと検索アプリケーションです。Jitterbugの強力なコンテンツエコシステムとAI技術に基づき、接続された検索と推論機能を通じて、より包括的で詳細な回答をユーザーに提供します。
1年前
081.5K
冷饭热炒:流畅的创作儿童故事视频

冷たい食べ物、温かい食べ物:子供向け紙芝居ビデオのスムーズな制作

AIチュートリアルの黎明期に最もホットな金儲けのアイデアは、童話図鑑の作成を教えることで、後に童話アニメが生まれたが、これらの動画はとても見やすく、操作するとすぐに行き詰ってしまう。 その理由は、やはり敷居がやや高く、内容や生成される画像の質が心配だからだ。までは. gptとクラウド生成...
2年前
081.5K
AopsAI - AI照片处理工具,一键将旧照片转动态视频

AopsAI - AI写真加工ツール、ワンクリックで古い写真をモーションビデオに変える!

AopsAIは、古い写真をダイナミックなショートビデオに変換するオンラインAIツールです。高度なAI技術に基づき、このツールは静止した写真を「動かす」ことで、過去の美しい瞬間を再現する。ユーザーが写真をアップロードし、メールアドレスを入力すると、AopsAIが24時間以内に自動的にビデオを生成し、それを...
1年前
081.5K
Sparkify - 谷歌推出的AI动画视频生成平台

Sparkify - Googleが提供するAIアニメーション動画生成プラットフォーム

Sparkifyは、Googleが発表したAIアニメーション動画生成プラットフォームである。このプラットフォームはGemini 2.5とVeo2モデルに基づいており、ユーザーは質問や複雑な概念を入力すると、Sparkifyは関連する知識ポイントを説明する直感的なアニメーションショートビデオを2分で生成する。このプラットフォームは、テキスト、画像、...
1年前
081.5K
D-Human:克隆数字人营销短视频生产专家

D-ヒューマン:クローンデジタル・ヒューマン・マーケティング 短編ビデオ制作のエキスパート

総合紹介 D-Humanは、シャオミが投資し、中国科学院の博士が研究開発を主導するデジタル人体映像制作プラットフォームである。SaaS、API、OEMなど複数の協力方式をサポートし、1:1の実人生復元技術を提供し、8分のビデオ素材で自分や他人のクローンを作る。このプラットフォームは、作成時間を大幅に短縮...
2年前
081.4K
InteriorGS - 群核科技推出的3D高斯语义数据集

InteriorGS - Qunar Technologyによる3Dガウス・セマンティック・データセット

InteriorGSは、Qunar Technologyによって導入された高品質の3Dガウス意味データセットである。このデータセットには、住宅、コンビニエンスストア、結婚式場、美術館など80以上の屋内環境をカバーする1,000の3Dシーンが含まれている。このデータセットには、755のカテゴリに分類された554,000以上のオブジェクトインスタンスが含まれている。
1年前
081.4K
Hyprnote - 开源的本地优先AI会议笔记工具

Hyprnote - オープンソースのローカルファーストAI会議メモツール

Hyprnoteは、ユーザーのプライバシーを保護し、会議の効率を向上させるために専門家のために設計された、オープンソースのローカルファーストAI会議メモツールです。ローカルファースト」の原則を採用し、データの保存と処理はすべてユーザーのローカルデバイス上で行われるため、データの安全性が確保され、オフラインでの操作もサポートされます。
1年前
081.4K
MiniMax Speech 2.5 - MiniMax推出的语音生成模型

MiniMax Speech 2.5 - MiniMaxの音声生成モデル

MiniMax Speech 2.5は、MiniMaxチームによって開発された高度な音声生成モデルです。音声合成の分野において、特に多言語の表現力、音色の再現精度、言語カバー率の点で大きな進歩を遂げています。このモデルは40の言語をサポートしています。
1年前
081.2K
GenFlow超能搭子 – 百度文库推出的通用AI Agent

GenFlow Super Hitchhiker - 百度文庫の万能AIエージェント

GenFlow Super Hitchhikerは、百度文献図書館が発表した汎用AIエージェントで、ユーザーは自然言語コマンドを入力するだけで、タスクを独自に分解し、百度文献図書館の14億のドキュメントライブラリやオンラインリソースを呼び出し、PPT、レポート、チャート、ポスターなどのフルモダルコンテンツを極めて高速に生成することができる。
1年前
081.1K
Make - AI无代码自动化工作流搭建平台

Make - AIによるコード不要の自動ワークフロー構築プラットフォーム

Makeは、自動化されたプロセスに基づいて組織の効率性と革新性の向上を支援する、AI主導のコード不要の自動化プラットフォームです。このプラットフォームは、マーケティング、販売、財務など、さまざまなビジネスシナリオをサポートする2,000以上の構築済みアプリを提供しています。Makeの主な機能には、コード不要のビジュアルプロセス作成、AI...
1年前
081K
Ming-UniAudio - 蚂蚁开源的统一音频多模态生成模型

Ming-UniAudio - Antオープンソースユニファイドオーディオマルチモーダル生成モデル

Ming-UniAudioは、テキスト、オーディオ、イメージ、ビデオの混合入出力をサポートする、Ant Groupのオープンソース統一オーディオマルチモーダル生成モデルです。マルチスケールトランスフォーマーと混合エキスパート(MoE)アーキテクチャを使用し、モダリティを意識したルーティングメカニズムにより、クロスモーダルな入出力を効率的に処理します。
12ヶ月前
080.8K
Comate AI IDE - 文心快码推出多模态、多智能体协同的AI IDE

Comate AI IDE - ウェンセント・クイックコード、マルチモーダル、マルチインテリジェンスのコラボレーションAI IDEを発表

Comate AI IDEは、百度文信Express Codeが発表した業界初のマルチモーダル、マルチインテリジェンス体コラボレーションAIネイティブIDEです。強力なマルチモーダル機能を備え、コードへのキー(F2C)、コードへのイメージ、コードへの自然言語の設計案をサポートし、フロントエンドの開発シナリオでは、卓越したパフォーマンス...
1年前
080.8K
Hunyuan3D-Part - 腾讯开源的免费3D组件生成模型

Hunyuan3D-Part - Tencentオープンソースフリー3Dコンポーネント生成モデル

Hunyuan3D-Part(ハイブリッド3D-Part)は、テンセントが公開し、オープンソース化した3D生成モデルである。P3 - SAMとX - Partで構成され、高精度で制御可能なコンポーネントベースの3D生成を初めて実現し、自動生成された50以上のコンポーネントをサポートしています。ユーザーは、まず...
12ヶ月前
080.7K
BoomCut - 小影科技推出的 AI 出海营销视频生成工具

BoomCut - Little Shadow TechnologyのAIアウトバウンドマーケティング動画生成ツール

BoomCutは、Little Shadow Technologyが発表したAI国境を越えたマーケティングビデオのローカリゼーションツールである。このツールは、高度なリップシンクドライブとトーンクローン技術に基づく強力な機能を備えており、異なる国や地域のユーザーの言語ニーズを満たすために、話し言葉ビデオの多言語バージョンを迅速に生成します。
1年前
080.7K
Knit:提示词指令设计管理工具

ニット:キュー・ワード指導設計管理ツール

一般的な紹介 PromptKnitは、AIプロンプトデザイナーのためのトップAIサンドボックスプラットフォームであり、gpt-4-turbo/vision、claude-3、gemini-1.5-proや他の多くのモデルのためのプロフェッショナルなプロンプトエディタを提供します。ユーザーは、プロンプトをグループ化することができます。
2年前
080.6K
琴乐大模型 - 腾讯推出的AI音乐创作模型

ピアノ音楽ビッグモデル-テンセントがAI作曲モデルを発表

Qin Music Grand Modelは、Tencent AI LabとTencent TME Tianqin Labが共同で発表した先進的なAI音楽作成グランドモデルである。このモデルは、ユーザーが入力したキーワード、説明文、または英語と中国語のオーディオクリップに基づいて、高品質のステレオオーディオまたはマルチトラックの楽譜をインテリジェントに生成します。
1年前
080.5K
Mapify - XMind推出的AI思维导图生成工具

Mapify - XMindのAIマインドマップジェネレーター

MapifyはXMindチームによるAIマインドマップジェネレーターです。テキスト、PDF、ウェブページ、ビデオ、オーディオ、その他のフォーマットを構造化されたマインドマップに素早く変換することができ、ユーザーが重要な情報を効率的に抽出、整理するのに役立ちます。
1年前
080.5K
MineContext - 字节开源的主动式上下文感知AI伙伴

MineContext - バイト・オープンソース・アクティブ・コンテキスト・アウェアAIパートナー

MineContextは、ByteDance Vikingチームによってオープンソース化されたアクティブなコンテキスト認識AIパートナーで、ユーザーが大量の情報を効率的に管理し、知識作業の効率を向上させることを支援します。スクリーンショットとコンテンツ理解技術により、ユーザーの日常操作(ウェブ閲覧、文書編集など)を自動的に記録し、...
11ヶ月前
080.5K
Qwen-Flash - 通义千问推出的高性能、低成本语言模型

Qwen-Flash - Tongyi Chien-quanによる高性能、低コストの言語モデル

Qwen-Flashは、アリババ「同義千問」シリーズに導入された高性能・低価格の言語モデルで、高速レスポンスとシンプルなタスクの効率的な処理のために設計されています。高度なMoE(Mixture-of-Experts)アーキテクチャに基づき、スパースエキスパートネットワークによって実現されています。
1年前
080.4K
ChartAI - AI数据分析工具,智能推荐适合的图表类型

ChartAI - 適切なチャートタイプをインテリジェントに推奨するAIデータ分析ツール

ChartAIは、AI技術に基づいてデータを自動的に分析し、複雑な情報を素早く理解できる直感的なチャートを生成する効率的なデータ可視化ツールです。ChartAIは、さまざまなデータ形式(Excel、CSVなど)のインポートをサポートし、最適なチャートをインテリジェントに推薦します。
1年前
080.3K
AIMangaStudio - 免费的AI漫画创作工具,提供完整创作流程

AIMangaStudio - フリーのAIマンガ作成ツール!

AIMangaStudioは、プロット生成、サブシーンデザイン、キャラクター設定などの機能を含む完全なマンガ制作パイプラインをクリエイターに提供し、脚本からマンガページまでの制作プロセスを簡素化できる無料のAIマンガ制作ツールです。プロット、セリフ、キャラクター設定など、マンガ原稿の自然言語生成をサポート。
12ヶ月前
080.2K
奇妙元:数字人视频制作与直播服务平台|声音克隆|形象克隆

WonderWon:デジタルヒューマン映像制作・ライブストリーミングサービスプラットフォーム|ボイスクローン|イメージクローン

総合紹介 Wonderful Dollarは、デジタルペルソナの動画制作とライブストリーミングサービスのプラットフォームで、写真やPPTから動画を生成する機能や、動画をさまざまな言語に翻訳するサービスを提供しています。ユーザーは、報道、教育コンテンツ、企業プロモーションなど様々な分野でデジタルキャラクターをカスタマイズすることができる。また、このプラットフォームは、インタラクティブなデジタルスタッフ...
2年前
080.2K
Paper2Slides - 香港大学开源的学术论文转为幻灯片AI工具

Paper2Slides - 香港大学のオープンソース学術論文をスライドに変換するAIツール

Paper2Slidesは、香港大学のData Intelligence LaboratoryによるオープンソースのAIツールで、学術論文をワンクリックでプロフェッショナルなスライドやポスターに変換する。RAG (Retrieval Augmented Generation)技術を使用し、ネットワーク情報に依存するのではなく、ドキュメントの内容を直接解析することで、生成されるPPTが元のPPTと高い整合性を持つようにします。
9ヶ月前
080K
Vace AI - AI 视频制作和编辑平台,提供一站式视频创作服务

Vace AI - AI映像制作・編集プラットフォーム、ワンストップ映像制作サービスを提供

Vace AIは強力なワンストップAI動画制作・編集プラットフォームです。このプラットフォームは、テキスト説明や参照画像に基づいて高品質のビデオコンテンツを生成し、ビデオの拡張、スタイル変換、被写体の除去や再構築などのさまざまな編集機能をサポートしています。
1年前
079.8K
GitaGPT:受

GitaGPT:バガヴァッド・ギーターにインスパイアされ、賢者とおしゃべりして知恵とインスピレーションを得る

一般的な紹介 GitaGPTは、バガヴァッド・ギーターの知恵に基づいたAIチャットボットで、ユーザーが日常生活で疑問に答えるのを助けるように設計されています。このプラットフォームは、ChatGPTテクノロジーを活用し、ユーザーの精神的な成長、感情管理、リーダーシップの強化に役立つ、簡潔で洞察に満ちた回答を提供します。
2年前
079.7K
Qwen-Image - 通义千问推出开源的文生图基础模型

Qwen-Image - Tongyi Qianqian、Qwen-Imageのオープンソース基本モデルを発表

Qwen-Imageは、Alibaba Tongyi Qianqianチームによってリリースされたオープンソースの画像生成ベースモデルです。200億のパラメータを持ち、マルチモーダル理解、高解像度コーディング、拡散モデリングの3つのモジュールを組み込んだマルチモーダル拡散変換アーキテクチャ(MMDiT)を採用しています。
1年前
079.7K
Gemini CLI - 谷歌开源的编程Agent

Gemini CLI - Googleオープンソースプログラミングエージェント

Gemini CLIは、強力なAI機能を開発者に提供するために、開発者のエンドポイントにGemini Big Modelを組み込むことに基づいたGoogleのオープンソースAIプログラミングツールである。このツールは、コードを理解し、ファイルを操作し、コマンドを実行し、問題を動的にトラブルシュートし、開発者が効率的にジェネレーションを書けるように支援する。
1年前
079.6K
AudioGen-Omni - 快手推出的多模态音频生成模型

AudioGen-Omni - Racerのマルチモーダル音声生成モデル

AudioGen-Omniは、Racerのマルチモーダルオーディオ生成モデルで、ビデオやテキストなどの入力に基づいて高品質のオーディオ、スピーチ、歌を生成します。AudioGen-Omniは、マルチモーダル拡散トランスフォーマーや位相整合トランスフォーマーなどの高度な技術に基づいています。
1年前
079.6K
eCommercePrompts:为电子商务快速创建ChatGPT指示

eCommercePrompts:eコマース用のChatGPTインストラクションを即座に作成します!

一般的な説明 eCommercePromptsは、200万以上の既製のChatGPTコマンドレシピを提供しています。これらはコマンドエンジニアによって構築され、eコマースのマーケティング担当者が1時間以内にショップやプロモーションを構築できるように設計されています。このサイトでは、様々なタイプのコンテンツをカバーしています。
2年前
079.3K
Muzaic - AI音乐生成平台,一键生成与视频内容匹配的音乐

Muzaic - ワンクリックで動画コンテンツにマッチした音楽を生成するAI音楽生成プラットフォーム

Muzaicは、動画制作者やコンテンツクリエイター向けに設計されたAI主導のオンライン音楽生成プラットフォームで、AIベースの技術により、動画の内容にマッチしたカスタム音楽を素早く生成し、わずか8秒で1分間のスタジオ品質のトラックを生成することができる。
1年前
079.3K
Hyperbolic AgentKit:让Agents拥有自己的计算资源,能够自主管理 GPU、执行区块链操作和社交发布

Hyperbolic AgentKit: エージェントに独自の計算リソースを提供し、GPUを自律的に管理し、ブロックチェーン操作やソーシャルパブリッシングを実行する能力を与える。

概要 Hyperbolic AgentKitは、ブロックチェーンとコンピューティングパワーを組み合わせたAIエージェントを実行するためのテンプレートを提供することを目的としたオープンソースプロジェクトである。このプロジェクトは、CoinbaseのCDP Agentkitをベースに、ブロックチェーンの端末をサポートするための修正と拡張を加えています。
2年前
079.2K
有道数字人:虚拟形象播报与实时交互平台|免费制作克隆数字人

ありがとうデジタルヒューマン:バーチャル映像放映・リアルタイム交流プラットフォーム|無料クローンデジタルヒューマン制作

総合紹介 Wealth Digital Peopleは、先進的なAI技術を統合したプラットフォームで、バーチャル映像放送とリアルタイムの双方向サービスの提供に重点を置いている。このプラットフォームは、自社開発した音声認識、音声合成、マルチモーダル知覚、文書Q&A技術を使って、リアルなデジタル人間ドッペルゲンガーをユーザーに作成し、映像制作、翻訳、教育などをサポートする。
2年前
079.1K
小星绪 - 京东健康推出的AI情绪漫画生成产品

Hoshio - AIエモーションマンガ生成製品、Jingdong Healthが発表

暁星秀は京東保健が発表したAI感情漫画生成製品で、現在テスト段階にある。同製品は感情漫画ストーリー生成を核心機能としており、ユーザーは音声やテキスト入力で感情を表現したり、ストーリーを語ったりすることができ、AIは入力に基づき、マッチした4コマ漫画やストーリー解釈を生成する。
1年前
079K
有道小P - 网易有道推出的新一代AI全科学习助手

Youdao Xiao P - Netease Youdaoが発表した新世代のAI総合学習アシスタント

Youdao Little Pは、NetEase Youdaoが発表したAI全教科学習アシスタントで、K12の学生向けに設計され、Youdao Ziyi教育ビッグモデルを搭載し、小学校、中学校、高校の全教科のQ&Aをカバーし、個人的な学習アドバイスを提供する。AI単語検索とAI翻訳機能で、Youdao Little Pは生徒が言語の問題を素早く解決できるようサポートします...
1年前
078.9K
Seed-OSS - 字节跳动团队开源的全新AI模型

Seed-OSS - Wordpressチームがオープンソース化した新しいAIモデル

Seed-OSSは、Byte Jump Seedチームによってオープンソース化された大規模な言語モデルのファミリーで、長いテキストと推論タスクに焦点を当てています。Seed-OSSは、複雑な論理的推論や多段階推論で高い精度を発揮し、難しい問題を効率的に解くことができます。Seed-OSSは、最大512Kまでの長いテキストコンテキストをサポートしています。
1年前
078.8K
Stable Diffusion Web:在线体验Stable Diffusion XL

安定拡散ウェブ:安定拡散XLをオンラインで体験しよう!

一般的な説明 Stable Diffusion Webは、ユーザーが無料で使用できるオンラインの安定拡散モデリング・プラットフォームです。このモデルは、使いやすいインターフェースでテキストをフォトリアリスティックな画像に変換するために使用されます。テキストプロンプトを入力し、"Generate "をクリックすることで、ユーザーは素早く...
2年前
078.7K
混元3D世界模型 1.0 - 腾讯推出的开源3D世界生成模型

ハイブリッド3Dワールドモデル 1.0 - Tencentのオープンソース3Dワールド生成モデル

Hunyuan3D世界モデル1.0(Hunyuan World 1.0)は、Tencentのオープンソース業界初の没入型ローミング、インタラクティブ、シミュレーション世界生成モデルです。このモデルは、パノラマ視覚生成と階層的な3D再構成技術を統合し、テキストや画像の入力をサポートして、36...
1年前
078.5K
Why My Wife Yelling At Me:模拟婚姻沟通的互动工具

なぜ妻は私を怒鳴るのか:夫婦間のコミュニケーションを疑似体験できるインタラクティブ・ツール

概要 「妻が私に怒鳴る理由」は、人工知能を通じてパートナーの感情的な反応やコミュニケーションパターンを理解できるように設計された、ユニークな夫婦関係シミュレーションサイトである。ユーザーは様々なシナリオを入力し、仮想パートナーの反応を体験することができます。
1年前
078.4K
Clacky AI - AI编程助手,面向开发者的云端开发环境

Clacky AI - AIプログラミング・アシスタント、開発者向けクラウド開発環境

Clacky AIは開発者向けのクラウドベースの開発環境(CDE)で、L3レベルのAIプログラミング・アシスタントの作成に特化している。このツールは、Python、Node.js、Golang、Ruby、Javaを含む複数のプログラミング言語をサポートしており、開発者が迅速にAIを開発できるよう支援する。
1年前
078.3K
GLM-4.5 - 智谱开源的面向推理、代码与智能体的SOTA模型

GLM-4.5 - 推論、コード、インテリジェンスのためのスマート・スペクトラム・オープンソースSOTAモデル

GLM-4.5はSmart Spectrum社のオープンソースSOTAモデルで、インテリジェント・ボディ・アプリケーション用に設計され、推論、コード生成、インテリジェント・ボディ機能を組み込んでいます。このモデルはMixed Expert(MoE)アーキテクチャに基づいており、3,550億のパラメータを持つGLM-4.5と1,060億のパラメータを持つGLM-4.5の2つのバージョンがあります。
1年前
078.3K
Kotae - AI聊天机器人平台,分析网站内容、培训文件生成准确回答

AIチャットボットプラットフォーム「Kotae」 ウェブサイトコンテンツやトレーニング資料を分析し、的確な回答を生成

Kotaeは中小企業向けに設計されたインテリジェントなチャットボットプラットフォームで、ChatGPTテクノロジーをベースに開発されています。80以上の言語をサポートするこのプラットフォームは、顧客からの問い合わせに素早く自然に応答し、ユーザーのウェブサイトコンテンツ、トレーニングドキュメント、FAQなどを分析して正確な回答を生成します。
1年前
078.3K
RoboBrain 2.0 - 智谱开源的通用具身大脑模型

RoboBrain 2.0 - ウィズダムスペクトラムのオープンソース汎用具現化脳モデル

ロボブレイン2.0は、ロボットに強力な知覚、推論、計画能力を提供するオープンソースの先進的な具現化脳モデルである。ロボブレイン2.0は、7Bと32Bの2つのバージョンで構成され、視覚エンコーダーと言語モデルを統合したヘテロジニアスアーキテクチャを採用し、ロボットをサポートする...
1年前
077.9K
茴香豆:基于LLM(大型语言模型) 的群聊助手

Fennel Bean: LLM (大規模言語モデル) ベースのグループチャットアシスタント

包括的な紹介 HuixiangDouは大規模言語モデル(LLM)ベースのグループチャットアシスタントであり、3段階の前処理、拒否、応答プロセスを通じてグループチャットのシナリオに対処するように設計されています。情報洪水を引き起こすことなく、ユーザーの質問に答えることができる。このプロジェクトでは、完全なWeb...
2年前
077.9K
Qwen-Image-Edit - 阿里通义开源的图像编辑模型

Qwen-Image-Edit - Ali Tongyi オープンソース画像編集モデル

Qwen-Image-Editは、Ali Tongyiによって導入された、200億のパラメータを持つQwen-Imageアーキテクチャ上に構築された、万能画像編集モデルです。このモデルはセマンティック編集と外観編集の両方の機能を兼ね備えており、画像に対して低レベルの視覚的外観編集を行うことができます(例:追加、削除...
1年前
077.8K
混元Motion1.0 - 腾讯混元团队开源的文本生成3D动作模型

Mixed Motion 1.0 - Tencent Mixed Motion Team オープンソース テキスト生成3Dモーションモデル

Hybrid Motion1.0(HY-Motion1.0)は、テンセントハイブリッドチームオープンソースのテキスト生成3Dアクションモデルであり、10億パラメータ拡散トランスフォーマーアーキテクチャを使用して、高品質の3Dキャラクターアニメーションの自然言語記述を通じて直接生成することができます。
9ヶ月前
077.7K
ConverzAI - AI招聘平台,自动收集候选人信息进行筛选

ConverzAI(コンバーツエーアイ) - 候補者情報を自動収集し選考を行うAI採用プラットフォーム

ConverzAIは、採用プロセスを最適化するAI技術をベースとした採用プラットフォームである。このプラットフォームは、仮想リクルーター(AIエージェント)を配置し、応募追跡システム(ATS)から候補者情報を自動的に収集し、一次スクリーニングを行うことを基本としている。このプラットフォームは、電話、Eメール、SMSなどの複数のチャネルを使用する。
1年前
077.7K
RoboOS 2.0 - 智谱开源的跨本体具身大小脑协作框架

RoboOS 2.0 - ウィズダムスペクトラムのオープンソース・クロスオントロジー・エンボディド・ブレインサイズ・コラボレーション・フレームワーク

RoboOS 2.0は、オントロジーを超えた脳と脳のコラボレーションを実現するオープンソースのフレームワークであり、ロボットの単一知能からグループ協調知能への転換を促進する。このフレームワークでは、クラウドブレインが複雑な意思決定とコラボレーションを担当し、スモールブレインモジュールが特定のスキルの実行に集中するという、効率的な役割分担を実現するために「ビッグブレイン」アーキテクチャを採用している。
1年前
077.6K
MuseSteamer - 百度推出的视频生成大模型

MuseSteamer - 百度、動画生成のビッグモデルを発表

MuseSteamerは、百度が発表したマルチモーダル動画生成のための大型モデルである。このモデルは、ユーザーから提供されたテキスト説明や画像に基づいて、高品質の動的なビデオコンテンツを迅速に生成することができ、さまざまなシナリオでの作成のニーズを満たすために、様々な透明性と機能のバージョンをサポートしています。
1年前
077.5K
优雅YOYA - 中科闻歌推出的AI音视频内容创作平台

エレガントなYOYA - AIオーディオ/ビデオコンテンツクリエーションプラットフォームは、ZTE Winkoによって開始された

Elegant YOYAはZhongke Wengeが立ち上げたマルチモーダルリテラティブビデオプラットフォームであり、AIマルチモーダル技術に基づいて、ビデオコンテンツ作成の全チェーンを強化する。ユーザーはテーマ要件を入力するだけで、プラットフォームはスクリプト、画像、動画を迅速に生成し、インテリジェント編集、音声合成、キャラクター口駆動などの操作を完了することができ、出力...
1年前
077.4K
NeverEnds:使用文字描述生成效果逼真的视频

NeverEnds:テキスト説明付きのリアルな動画を生成する

一般的な紹介 ネバーエンドはシンガポール発のプラットフォームで、高度なモデルを通じてテキストをビデオに変換することで、あらゆる種類のストーリーに無限の創造的空間を提供している。ユーザーはこのプラットフォームで、創造性を自由に表現し、感情を伝え、ブランドイメージを構築することができる。このプラットフォームは、そのユニークな...
2年前
077.4K