RoboBrain-X0 - ウィズダムソース研究所 オープンソース ゼロサンプル クロスオントロジー 一般化体現モデルRoboBrain-X0は、ウィズダムソース研究所がオープンソース化した世界初のサンプル数ゼロのクロスオントロジー汎化をサポートする具現化モデルであり、産業上大きな意義がある。異なる構成の複数の実ロボットを駆動し、微調整なしで基本的な操作タスクを完了させることができ、少量のサンプル微調整を行った後、ロボットの動作を再現する能力を発揮します。最新のAIリソース10ヶ月前049.9K
HunyuanVideo 1.5 - Tencent混合元フリーオープンソース軽量ビデオ生成モデルHunyuanVideo 1.5は、Tencentハイブリッドビッグモデルチームオープンソースの軽量ビデオ生成モデルであり、拡散トランスフォーマー(DiT)アーキテクチャに基づいて、パラメータの数は8.3Bです。最新のAIリソース8ヶ月前049.8K
StoryMem - 字节跳动与南洋理工联合开源的AI视频生成系统StoryMem是字节跳动与南洋理工大学联合开源的AI视频生成系统,专为解决多场景视频中角色和环境一致性问题。核心通过"视觉记忆库"技术,自动存储关键帧并在后续生成时参考,确保人物外貌、服装、场景元素...最新のAIリソース7ヶ月前049.7K
HunyuanOCR - テンセント混合元オープンソース光学式文字認識エキスパートモデルHunyuanOCRは、Tencentハイブリッドチームによってオープンソース化された高性能な光学式文字認識モデルであり、わずか10億件の参照しかない。ハイブリッドマルチモーダルアーキテクチャに基づいて開発され、エンドツーエンドの設計を採用し、テキスト検出、認識、文書解析タスクを効率的に処理することができます。このモデルは複雑な文書のテストで94.1点を獲得し、...最新のAIリソース8ヶ月前049.7K
NovaSR - 开源的音频超分辨率模型,提升音频采样率NovaSR是开源的音频超分辨率模型,主要用于将低质量音频(如16kHz采样率的电话音质)提升为高质量音频(如48kHz采样率的录音室级音质)。模型大小仅52KB,比一张微信表情包还小,可轻松部署在资...最新のAIリソース6ヶ月前049.6K
GLM-Image - 智谱联合华为开源的多模态图像生成模型GLM-Image是智谱与华为联合开源的多模态图像生成模型,基于昇腾Atlas 800T A2芯片和昇思MindSpore框架训练,采用创新的"自回归+扩散解码器"混合架构。核心突破在于实现了国产芯片...最新のAIリソース7ヶ月前049.5K
Nemotron Speech ASR - 英伟达开源的实时语音识别模型Nemotron Speech ASR是英伟达开源的实时语音识别模型,专为低延迟场景优化,支持24毫秒极速转录和多人并发对话。核心采用混合Mamba-Transformer MoE架构,通过固定状态缓...最新のAIリソース7ヶ月前049.3K
Devstral 2 - ミストラルAIの次世代プログラミング・モデル・ファミリーDevstral 2は、Mistral AIが提供するソフトウェア・エンジニアリング・タスクのために設計された新世代プログラミング・モデル・ファミリーで、Devstral 2(123Bパラメータ)とDevstral Small 2(24Bパラメータ)から構成されている。最新のAIリソース8ヶ月前049.3K
nanochat - カルパシーによるフリーでオープンソースの低コストモデル・トレーニング・プロジェクトnanochatは、AIのレジェンドであり元テスラAIディレクターのアンドレイ・カルパシーが公開したオープンソースプロジェクトで、個人が非常に低コストかつシンプルに、小規模なChatGPTのような言語モデルを素早く学習することを可能にする。プロジェクト全体で使用されているのは、わずか約800...最新のAIリソース10ヶ月前049.2K
Alpamayo-R1 - NVIDIAのオープンソース推論機能付き視覚言語アクションモデルAlpamayo-R1は、NVIDIAが開発した推論機能付きVLA(Vision-Language-Action)モデルであり、複雑なシナリオにおける自律走行の意思決定能力を強化するために設計されている。因果連鎖の推論メカニズムを導入することで、シナリオの因果関係(例えば、「前...最新のAIリソース8ヶ月前049.1K
VitaBench - MMT LongCatオープンソースインタラクティブエージェントレビューベンチマークVitaBenchは、MeituanのLongCatチームによってリリースされた、複雑な生活シナリオのための初の対話型エージェント評価ベンチマークであり、実際の生活シナリオにおける大規模なモデル知能の総合的な能力を評価する。テイクアウト注文、レストランでの食事、旅行という高頻度の3つの生活シナリオをキャリアとして、パッケージを構築する...最新のAIリソース9ヶ月前049K
UnifoLM-VLA-0 - 宇树科技开源的首款操作型大模型UnifoLM-VLA-0 是宇树科技 UnifoLM 系列的首款操作型大模型,突破传统视觉语言模型(VLM)仅能理解图像文字的局限,通过在机器人操作数据上的持续预训练,实现从"图文理解"向具备物理常...最新のAIリソース6ヶ月前049K
LLaSO - ロジックインテリジェンスによる業界初の完全オープンソース音声モデルLLaSOは、北京深層論理知能科技有限公司によって発表されたオープンソースの音声モデルで、音声データとテキストデータを統合し、アライメントデータセット、コマンド微調整データセット、評価ベンチマークを提供することで、大規模音声言語モデリングの分野におけるデータの分散と不十分なタスクカバレッジの問題を解決します。最新のAIリソース11ヶ月前048.9K
Paper2Video - 論文のデモビデオを自動生成するNUSのオープンソースプロジェクトPaper2Videoは、シンガポール国立大学のShow Labで行われている、学術論文のプレゼンテーションビデオを自動生成するオープンソースプロジェクトです。PaperTalkerマルチインテリジェンスフレームワークを使用し、論文はスライド、字幕、ナレーション、スピーカーアバターを含む完全なプレゼンテーションビデオに変換されます。最新のAIリソース10ヶ月前048.8K
KoalaQA - Q&Aプラットフォームの迅速な構築を支援するオープンソースのAIアフターサービスシステムKoalaQAはChaitinチームによって開発されたオープンソースのインテリジェントなアフターサービスシステムです。AIモデルに基づいて、AIカスタマーサービス、AI検索、ナレッジベース管理機能を提供し、企業がインテリジェントQ&Aプラットフォームを迅速に構築できるよう支援します。このシステムは、24時間365日のリアルタイム応答をサポートしています。最新のAIリソース8ヶ月前048.6K
Pyscn - フリーのAIコード品質分析ツール、Python開発者向けオープンソースPyscnはPython開発者向けに設計されたインテリジェントなコード品質分析ツールで、コードの潜在的な問題を検出して保守性を向上させます。制御フロー図を通してデッドコードを分析し、APTED+LSHアルゴリズムを使って重複コードを特定し、モジュールの結合やサークルの複雑さなどのメトリクスを計算します。最新のAIリソース10ヶ月前048.5K
MobileLLM-R1 - メタ・オープンソース特殊効率推論モデルシリーズMobileLLM-R1は、数学的推論、プログラミング推論、科学的推論のために設計されたMetaのオープンソースの効率的推論モデルシリーズです。ベースモデルとファイナルモデルがあり、それぞれ1億4千万、3億6千万、9億5千万のパラメータがあります。このモデルは一般的なチャットモデルではなく、教師ありファインチューニング(SFT...最新のAIリソース11ヶ月前048.4K
MiMo-Embodied - シャオミのオープンソース・クロスドメイン具現化知能台座モデルMiMo-Embodiedは、シャオミグループがオープンソース化した世界初のクロスエンボディベースモデルであり、エンボディドAIと自律走行の統合に成功している。エンボディドAIと自律走行間の知識移行問題を解決し、2つの領域におけるタスクの統一的なモデリングを実現する。最新のAIリソース8ヶ月前048.4K
オムニヴィンチ - NVIDIAのオープンソース全方位大規模言語モデルOmniVinciは、NVIDIAによって開発されたオープンソースのフルモーダル大規模言語モデルであり、アーキテクチャの革新とデータの最適化を通じて、マルチモーダルモデルにおけるモーダルの断片化の問題を解決します。視覚と音声のエンベッディングのアライメントは、時間的に埋め込まれたグループキャプチャを利用するOmniAlignNetによって強化されます...最新のAIリソース9ヶ月前048.4K
InternVLA-M1 - 上海AIラボのオープンソース・エンベディッド・デュアルシステム・オペレーション "ブレイン"InternVLA-M1は、上海人工知能研究所のオープンソースの具現化されたオペレーティング「脳」であり、命令追従を指向する2システムオペレーションの大型モデルである。思考-行動-学習」をカバーする完全な閉ループを構築し、高レベルの空間推論とタスク計画を担当する。このモデルは2段階の訓練方針を採用している。最新のAIリソース11ヶ月前048.3K
Youtu-Embedding - Tencent Youtuオープンソースの汎用テキスト表現モデルYoutu-Embeddingは、TencentのYoutu Labsによるオープンソースのユニバーサルテキスト表現モデルで、エンタープライズレベルのアプリケーション向けに設計されている。テキストはディープニューラルネットワークによって高次元のベクトル空間にマッピングされ、その空間では意味的に類似した文章がより近くに配置され、正確な意味検索が実現される。最新のAIリソース10ヶ月前048.1K
Fun-Audio-Chat-8B - Ali Tongyiによるオープンソースのエンドツーエンド音声対話マクロモデルFun-Audio-Chat-8Bは、Ali Tongyiチームによるオープンソースの80億パラメータエンドツーエンドスピーチビッグモデルで、ASR+LLM+TTSスプライシングを必要としない直接音声インスピーチアウト、流暢な中国語と英語のバイリンガル、低遅延で自然な音色です。25Hzのデュアル解像度共有LLMを使用...最新のAIリソース7ヶ月前047.9K
FIBO - 世界初のオープンソースでネイティブにサポートされたJSONテキストから画像モデルを生成FIBOは、Bria AIによって開発された、ネイティブJSONをサポートする世界初のオープンソーステキスト生成画像モデルです。8Bのパラメータを持つDiT(Diffusion Transformer)アーキテクチャに基づき、フローマッチング学習法を採用しています。最新のAIリソース9ヶ月前047.9K
Intern-S1-Pro - 上海AI Lab开源的首个万亿参数科学多模态大模型Intern-S1-Pro是上海人工智能实验室开源的全球首个万亿参数级科学多模态大模型。采用512专家MoE架构,激活仅8专家22B参数,兼顾性能与效率。模型基于SAGE架构,引入傅里叶位置编码,统一...最新のAIリソース6ヶ月前047.9K
LongCat-フラッシュ思考 - Meituanオープンソースのための効率的な推論モデルLongCat-Flash-Thinkingは、LongCat-Flash-Chatのスピードはそのままに、よりパワフルでプロフェッショナルになった、Mission LongCatのLongCatチームによってリリースされた効率的な推論モデルです。このモデルは、論理、数学、コード、知性に基づいています。最新のAIリソース10ヶ月前047.8K
DeepSeek-TUI - 开源终端 AI 编程智能体,终端原生 TUI 界面DeepSeek-TUI 是美国独立开发者 Hunter Bown(GitHub: Hmbown)用 Rust 语言编写的开源终端 AI 编程智能体,专为 DeepSeek V4 系列模型(Pro/F...最新のAIリソース3ヶ月前047.8K
混成世界モデル1.1 - テンセント混成世界オープンソース3D復元大型モデルリリースWorldMirror 1.1(WorldMirror)は、TencentのWorldMirrorチームによってリリースされたオープンソースの大規模モデルの3D再構築であり、WorldMirrorシリーズのアップグレード版である。マルチビュー画像、動画、カメラ位置、内部参照、深度マップなどのマルチモーダル先験的入力をサポートしています。最新のAIリソース9ヶ月前047.7K
ClipSketch AI - オープンソースのAI動画から手描き分割画面ツール、Bステーション、小さな赤い本をサポートClipSketch AIは、ショートビデオクリエイターのために設計されたオープンソースの動画から手描き風分割画面への変換ツールです。B station、Xiaohongshu、その他のプラットフォームからの動画をワンクリックで手描き風のストーリーボードに変換でき、キーフレームのマーキング、サブシーンとソーシャルコピーの自動生成をサポートし、ユーザー定義のロールを統合できます。最新のAIリソース7ヶ月前047.7K
RynnBrain - 阿里巴巴达摩院开源的具身智能大脑基础模型RynnBrain 是阿里巴巴达摩院开源的具身智能大脑基础模型,为机器人提供深度环境理解和物理世界交互能力。是业界首个赋予机器人时空记忆和物理空间推理能力的开源模型。包含2B、8B、30B等7个不同参...最新のAIリソース6ヶ月前047.6K
ERNIE-4.5-21B-A3B-Thinking - Baiduオープンソース推論思考モデルERNIE-4.5-21B-A3B-Thinkingは、推論タスクに特化したBaiduのオープンソース大規模言語モデルです。Mixed Expert (MoE) アーキテクチャを採用し、総参照数は210億、各トークンは30億のパラメータを起動し、128K長のコンテキストウィンドウをサポートします。最新のAIリソース11ヶ月前047.6K
OpenAutoGLM - Smart Spectrum AIのオープンソース携帯電話AIエージェントモデルOpenAutoGLMは、マルチモーダル知覚によって携帯電話画面の内容を理解し、ユーザーが指定したタスクを完了するための操作フローを自動的に生成することができる、「携帯電話使用」の機能を備えたオープンソースの知的身体モデルです。ユーザは、「美団を開いて近くの鍋を検索する」といった自然言語でニーズを記述するだけでよい。最新のAIリソース8ヶ月前047.4K
ChronoEdit - NVIDIAとトロント大学がオープンソース化したAI画像編集フレームワークNVIDIAとトロント大学が共同開発したオープンソースのAI画像編集フレームワーク「ChronoEdit」は、画像編集タスクを動画生成タスクとして再定義し、編集結果の時間的・物理的整合性を保証する。14Bのパラメータを持つ事前に訓練された動画生成モデルを...最新のAIリソース9ヶ月前047.3K
Glow - ターミナルでMarkdownファイルのレンダリングをサポートするオープンソースのコマンドラインツールGlowはターミナルでMarkdownファイルをエレガントにレンダリングするオープンソースのコマンドラインツールです。このツールはコードブロック、数式、その他の複雑な要素のハイライトをサポートし、カスタムスタイル、ページング表示、マウスサポートなどの豊富な機能を提供します。最新のAIリソース9ヶ月前047.3K
ペルソナライブ - マカオ大学をはじめとするオープンソースのリアルタイムAI似顔絵アニメーション生成ライブフレームワークPersonaLiveは、マカオ大学、dzine.ai、グレーターベイエリア大学GVCラボが共同開発したオープンソースのリアルタイムAI顔交換ライブストリーミングフレームワークである。一般的なコンシューマーグレードのグラフィックカード(12GBのビデオメモリ)で、低レイテンシー、高フレームレートのデジタルパーソンドライブを実現し、カメラを通してリアルタイムをサポートする。最新のAIリソース7ヶ月前047.2K
インフォグラフィック - Ali AntV team オープンソース・インフォグラフィック生成フレームワークインフォグラフィックは、Ali AntVチームの新世代のオープンソースフレームワークで、G2とAnt Designの開発に基づいており、高品質のインフォグラフィックの迅速な生成に焦点を当て、30以上のレイアウトテンプレート、120以上のプリセットテーマとAIインテリジェント生成機能を提供します。最新のAIリソース7ヶ月前047.1K
Frappe Builder - オープンソースのAIローコードウェブサイトビルダー。Frappe Builderは、Frappeによって開発されたオープンソースのローコードウェブサイトビルダーです。中心的な機能は、ウェブサイトを素早く構築するためのドラッグ&ドロップコンポーネントをサポートするFigmaライクなビジュアルエディタを提供することです。Frappeのエコロジー(Frappeverse)の一部です。最新のAIリソース9ヶ月前047.1K
Baichuan-M3 - 百川智能开源的新一代医疗大语言模型Baichuan-M3是百川智能推出的新一代开源医疗大语言模型,专为医疗场景深度优化,具备强大的医疗推理和问诊能力。在权威的HealthBench评测中以65.1分的综合成绩位列全球第一,超越了GPT...最新のAIリソース7ヶ月前047.1K
Fara-7B - マイクロソフトのオープンソース・コンピュータ操作アシスタント・モデルFara-7Bは、Qwen 2.5-VL-7Bアーキテクチャに基づいた70億パラメータ規模のコンピュータ操作エージェント(CUA)モデルのマイクロソフトオープンソースリリースです。ウェブページのスクリーンショットを視覚的に解析し、画面上でクリックや入力などを実行することで、追加のアクセシビリティツリーや複数の大規模モデルに依存する必要がありません...最新のAIリソース8ヶ月前047K
Kimi Work - 月之暗面 Kimi 推出的桌面端产品Kimi Work 是月之暗面(Moonshot AI)公测的桌面端产品,为面向知识工作者的通用型本地 Agent。将 Kimi Code 在工程场景中验证过的本地 Agent 能力,迁移到普通知识工...最新のAIリソース2ヶ月前046.8K
SmartResume - アリババのオープンソースAI履歴書解析・最適化ツールSmartResumeは、PDF、画像、Office文書から基本情報、学歴、職歴などの構造化された情報を効率的に抽出する、アリババのオープンソースのインテリジェントな履歴書解析・最適化ツールです。OCRテクノロジーとPDFメタデータを統合することで、履歴書や職務経歴書の基本情報や学歴、職歴などの構造化された情報を効率的に抽出します。最新のAIリソース9ヶ月前046.8K
觅游 - 美团推出的 AI 原生共生社区觅游(Meyo) 是美团基础研发 AI 创新产品团队推出的 AI 原生共生社区,目前已进入公测阶段。产品以"养虾"为核心隐喻,将 AI Agent 升级为拥有身份、MBTI 人格、社交关系与成长属性的...最新のAIリソース3ヶ月前046.7K
SenseNova-MARS - 商汤科技开源的多模态搜索推理Agent语言模型SenseNova-MARS 是商汤开源的首个支持动态视觉推理与图文搜索深度融合的智能体视觉语言模型(Agentic VLM),提供 8B 和 32B 双版本。模型能自主规划任务步骤、调用多种工具(如...最新のAIリソース6ヶ月前046.7K
Egocentric-10K - ビルドAIのオープンソース一人称視点ロボットデータセットEgocentric-10Kは、build.aiチームによってオープンソース化された大規模な一人称視点(エゴセントリック)工場作業ビデオデータセットです。このデータセットには10,000時間、合計10.8億フレーム、2...最新のAIリソース9ヶ月前046.6K
MoMA - 中国移动发布的一站式AI模型服务平台MoMA(Mobile Model Access) 是中国移动发布的一站式AI模型服务平台。平台接入超300款业界主流AI模型,包括自研"九天"基座大模型及DeepSeek、通义千问、豆包、Kimi...最新のAIリソース3ヶ月前046.5K
Clawith - DataElem 团队开源的多智能体协作平台Clawith 是 DataElem 团队开源的"OpenClaw for Teams"——面向团队的多智能体协作平台。在保留 OpenClaw 灵魂与记忆能力的基础上,升级为 Aware 自主感知系...最新のAIリソース5ヶ月前046.4K
Step-Audio-EditX - Step-Star初のオープンソースLLMレベルオーディオ編集ラージモデルStep-Audio-EditXは、Step-Starチームによって開発されたオープンソースのオーディオ編集マクロモデルで、人工知能技術によるオーディオコンテンツのきめ細かな操作に焦点を当てています。このモデルは、オーディオのムード、話し方(小心者、老人アクセントなど)、パラ言語的要素(笑い、ため息など)を動的に調整することができます。最新のAIリソース9ヶ月前046.2K
OpenAgents - AIエージェントネットワーク構築のためのオープンソース・フリー・オープンコラボレーションプロジェクトOpenAgentsは、AIエージェントのネットワークを構築し、エージェント間のオープンなコラボレーションを促進するオープンソースプロジェクトです。AIエージェントがシームレスに接続し、コラボレーションできるように、基本的なネットワークインフラが提供されています。ユーザーは、独自のエージェントネットワークを迅速に開始し、モジュラーアーキテクチャによって機能を拡張し、...最新のAIリソース10ヶ月前046.1K
アストロンエージェント - KDDIオープンソースエンタープライズクラスインテリジェントワークフロー開発プラットフォームアストロンエージェントは、KDDIのオープンソースエンタープライズグレードのインテリジェントワークフロー開発プラットフォームです。Java + Spring Boot技術スタックを使用し、軽量なプライベートデプロイメント(最小2コア4G構成)をサポートし、ビルトイン...最新のAIリソース9ヶ月前046.1K
SAM 3D - メタ・オープンソース3D再構築モデルシリーズSAM 3Dは、Meta社のSAMシリーズをベースにした3D再構築モデルで、SAM 3D ObjectsとSAM 3D Bodyの2つのブランチがあります。SAM 3D Objectsは、1枚の写真からインタラクティブな3Dオブジェクトモデルを生成することができます。最新のAIリソース8ヶ月前046K
SurfSense - オープンソースのAI研究・知識管理ツール、NotebookLMの最強ピントSurfSenseはオープンソースのAIリサーチ・ナレッジマネジメントツールです。高度なカスタマイズが可能で、検索エンジン、Slack、Jira、Notion、YouTube、GitHub、その他多くの外部データソースに接続し、情報の統合を促進することができる。ユーザーは様々なデータをアップロードできる。最新のAIリソース8ヶ月前046K
LLaVA-OneVision-1.5 - 高性能マルチモーダル理解のためのフリーでオープンソースのマルチモーダルモデルLLaVA-OneVision-1.5は、EvolvingLMMS-Labチームによるオープンソースのマルチモーダルモデルで、8Bパラメータスケールを使用し、128 A800上でコンパクトな3段階のトレーニングプロセス(言語-イメージのアライメント、概念の平衡化と知識の注入、命令の微調整)を通じて...最新のAIリソース10ヶ月前045.7K
Step 3.5 Flash - 阶跃星辰开源的 1960 亿稀疏 MoE 模型Step 3.5 Flash 是阶跃星辰开源的 1960 亿稀疏 MoE 模型,每 token 仅激活 110 亿参数,能在代码任务跑出 350 token/s 的实时速度。基于自研 MTP-3 多 ...最新のAIリソース6ヶ月前045.5K
Mamoda2.5 - 字节跳动 Mamoda Team 推出的统一多模态生成模型Mamoda2.5 是字节跳动 Mamoda Team 研发的全球首个 25B 级统一多模态生成模型,模型基于自回归-扩散(AR-Diffusion)框架,采用 Qwen3-VL-8B 理解模块与 D...最新のAIリソース3ヶ月前045.5K
VibeThinker-1.5B - 15億パラメータの大規模言語モデルをWeibo AIがオープンソース化VibeThinker-1.5Bは、Weibo AIがオープンソース化した15億パラメータの大規模言語モデルです。アリババのQwen2.5-Math-1.5Bをベースに微調整されたこのモデルは、数学とコーディングのタスクに最適化されており、業界トップクラスの推論性能を発揮します。最新のAIリソース9ヶ月前045.4K
SceneGen - 上海交通大学オープンソース3Dシーン生成フレームワークSceneGenは、上海交通大学の1枚の画像から3Dシーンを生成するオープンソースの手法であり、1枚のシーン画像とターゲットリソースマスクから、リソースの幾何学的構造、テクスチャ、相対的な空間位置を含む、複数の3Dリソースを含む完全なシーンを効率的に生成する。最新のAIリソース10ヶ月前045.4K
Genie Sim 3.0 - 智元机器人开源首个大语言模型驱动的仿真平台Genie Sim 3.0是智元机器人发布的首个大语言模型驱动的开源仿真平台。基于NVIDIA Isaac Sim构建,融合三维重建、视觉生成技术与物理引擎,实现毫米级精准复刻真实环境,通过自然语言指...最新のAIリソース7ヶ月前045.4K
Androidify - Google、Android上でAIアプリを構築する方法に関するリソースを無償でオープンソース化AndroidifyはGoogleのオープンソースプロジェクトであり、開発者がAndroid上でAI主導のアプリケーションを構築する方法を学ぶことを支援する。このプロジェクトでは、Jetpack Compose、Gemini API(via Fire...最新のAIリソース10ヶ月前045.4K
opcode - クロードコード用に設計されたオープンソースのグラフィカルデスクトップアプリケーションopcodeはクロードコードオープンソースのグラフィカルなデスクトップアプリケーションのために設計されています , Tauri 2 + React 18 + Rustの開発に基づいて開発者winfunc .クロードコードのプロジェクトを管理するための視覚的なインターフェイスを提供します。最新のAIリソース7ヶ月前045.3K
LongCat-Flash-Omni - 明潭オープンソースのための完全モード大規模言語モデルLongCat-Flash-Omniは、MeituanのLongCatチームによってリリースされたオープンソースの完全モーダルビッグ言語モデルです。5,600億のパラメータスケール(270億のアクティブ化されたパラメータ)を持ち、多数のパラメータを維持しながら、ミリ秒レベルのリアルタイムの音声と映像のインタラクション機能を実現している。最新のAIリソース9ヶ月前045.1K
ArkClaw - 火山引擎推出的云端AI助手,零门槛部署OpenClawArkClaw是火山引擎推出的云端智能助手平台,基于OpenClaw架构构建,让用户无需繁琐配置可快速部署专属AI Agent。最新のAIリソース5ヶ月前045K
OpenCLI - 开源 AI 命令行工具框架,任何网站变成命令行OpenCLI是开源的命令行工具框架,将网站、Electron应用和本地命令行工具统一转化为可通过命令行操作的接口,将网站(如B站、知乎、Twitter等)和Electron应用(如Cursor、No...最新のAIリソース4ヶ月前045K
Ming-flash-omni-Preview - AntグループのオープンソースフルモーダルマクロモデルMing-flash-omni-Previewは、Ant Group inclusionAIによって公開されたオープンソースのフルモーダル・マクロモデルです。Ling 2.0のスパースMoEアーキテクチャに基づき、パラメータ規模は数千億、総パラメータは103B、アクティブ度は9Bです。最新のAIリソース9ヶ月前044.6K
NocoBase - アプリケーションを視覚的に構築するためのフリーでオープンソースのAIノーコード開発プラットフォームNocoBaseは、AI駆動のオープンソースのノーコード開発プラットフォームに基づいており、ビジネスシステムの迅速な構築をサポートし、プログラミングは、アプリケーション開発の構成を介して完了することができます。このプロジェクトは、Apache-2.0プロトコルを使用し、プライベートな展開と柔軟なスケーラビリティを提供し、企業管理、コラボレーションプラットフォームやその他の分野に適しています。最新のAIリソース9ヶ月前044.6K
KAT-Dev-72B-Exp - レーサー・オープンソース・フリーのプログラミング専用モデルKAT-Dev-72B-Expは、強化学習技術に基づいて最適化された、Racerチームによって発表されたオープンソースのプログラミング専用大規模言語モデルであり、SWE-Bench Verifiedベンチマークテストで74.6%の精度を達成した。このモデルは革新的な...最新のAIリソース10ヶ月前044.6K
TalkCody - 複雑なタスクをサポートするフリーでオープンソースのAIプログラミングデスクトップアシスタントTalkCodyはフリーでオープンソースのAIプログラミングアシスタントデスクトップアプリケーションで、Rust + Tauri 2で構築され、Windows、macOS、Linuxの3つのプラットフォームをサポートし、ネイティブパフォーマンス、高速起動、低リソース使用の利点を備えています。50以上のメインストリームA...最新のAIリソース8ヶ月前044.6K
MemMachine - MemVergeによるオープンソースAIメモリシステムMemMachineは、MemVerge社によって開発されたオープンソースのAIメモリシステムで、AIモデルや知能のために設計され、人間の脳のように相互作用データを保存して呼び出すことができ、AIの「無状態記憶喪失」の問題を解決する。レイヤー構造(短期記憶、長期記憶、ユーザー画像...)を採用している。最新のAIリソース8ヶ月前044.3K
TranslateGemma - 谷歌开源的机器翻译模型系列TranslateGemma是谷歌推出的基于Gemma 3的开源机器翻译模型系列,专为提升翻译质量而设计。通过两阶段微调(监督微调和强化学习)优化翻译效果,提供4B、12B、27B三种参数规模,支持5...最新のAIリソース6ヶ月前044.2K
ROCK - アリババがオープンソースのサンドボックスで提供するインテリジェントな身体トレーニング環境ROCK(Reinforcement Open Construction Kit)は、アリババのオープンソースサンドボックスで、インテリジェンスのトレーニング環境のためのもので、実環境ではインテリジェンスを大規模にトレーニングできないという問題を解決する。最新のAIリソース8ヶ月前044.2K
MOSS-Speech - 復旦大学オープンソース音声合成ビッグモデルMOSS-Speechは復旦大学の邱西鵬教授のチームによるオープンソースの音声合成(Speech-to-Speech)ビッグモデルです。従来の音声処理の常識を打ち破り、テキストガイダンスを必要とせず、直接音声を理解・生成し、イントネーションや感情などの非テキスト要素を取り込み、...最新のAIリソース8ヶ月前044.2K
GigaBrain-0 - 世界モデル生成データによって駆動されるオープンソースの具現化ベースモデルGigaBrain-0は、実機汎化を実現するために世界のモデル生成データを使用する中国初のエンドツーエンドのVLA(Vision-Language-Action)具現化ベースモデルであり、GigaVisionと湖北ヒューマノイドロボティクスイノベーションセンターが共同でオープンソースとして公開しています。ハイブリッドTransformerアーキテクチャを採用し、...最新のAIリソース9ヶ月前044K
Anijam - Dzine 推出的端到端一体化 AI 动画创作平台Anijam 是 Dzine 推出的 AI 驱动动画创作平台,用 AI Agent 为任何故事制作动画。并非简单的单片段视频生成工具,是一个端到端的一体化动画工作室。最新のAIリソース3ヶ月前043.9K
小艺Claw - 华为推出的个人手机AI助理,一键接入OpenClaw小艺Claw是华为基于OpenClaw开源框架推出的AI智能体,集成于小艺App中。小艺Claw打破传统语音助手"被动应答"的交互逻辑,具备自主规划与任务执行能力,可独立完成办公文档处理、信息检索、服...最新のAIリソース5ヶ月前043.6K
OctoCodingBench - MiniMax开源面向Coding Agent标准的评测集OctoCodingBench是MiniMax开源的首个面向Coding Agent生产级标准的评测集,核心创新在于通过Check-level准确率(CSR)和Instance-level成功率(IS...最新のAIリソース7ヶ月前043.6K
多言語ASR - Metaの多言語音声認識フレームワークオムニリンガルASRは、Metaによって導入された多言語音声認識フレームワークで、1600以上の言語をカバーし、78%の言語文字エラーレートは10%より低いです。最新のAIリソース9ヶ月前043.6K
Paperclip - 开源的AI Agent编排平台,管理和协调多个AI智能体Paperclip是开源的AI代理编排平台,定位为“零人工公司操作系统”,用于管理和协调多个AI代理(如OpenClaw、Claude Code等)协同工作。提供组织架构、目标对齐、预算控制、任务追踪...最新のAIリソース5ヶ月前043.6K
Dexbotic-フォース・スピリット・マシンのオープンソースVLAモデル具現化知能ワンストップ研究サービス・プラットフォームDexboticは、DexmalのオープンソースVisual-Linguistic-Action(VLA)モデルの具現化知能ワンストップ研究サービスプラットフォームであり、具現化知能分野の研究の断片化と低効率の問題を解決します。PyTorchをベースとしたDexboticは、具現化知能分野における研究の断片化と低効率の問題を解決するためのワンストップ研究サービスプラットフォームです...最新のAIリソース9ヶ月前043.5K
ミュンヘン工科大学がミシガン大学と共同でオープンソース化した分散型機械学習プラットフォーム「KoinaKoinaは、プロテオミクス・データ解析を簡素化することに焦点を当てた、オープンソースの分散型機械学習プラットフォームである。ドイツのミュンヘン工科大学とアメリカのミシガン大学のチームによって開発されました。このプラットフォームは、標準化されたインターフェースを介して30以上の主流モデル(ProSIT、MS²PIPなど)を統合し、ペプチド質量...最新のAIリソース9ヶ月前043.4K
LongCat-Audio-Codec - Meituan LongCatオープンソーススピーチコーデックソリューションLongCat-Audio-Codecは、MeituanのLongCatチームによるオープンソースの音声コーデックソリューションです。このソリューションは、Speech Large Language Model (Speech LLM)のために設計されており、意味的・音響的な二重トークン並列抽出メカニズムによって、音声の意味的・音響的特徴を考慮に入れています。最新のAIリソース9ヶ月前043.4K
DPAI Arena - AIプログラミングのためのJetBrainsオープンソースベンチマーキングプラットフォームDPAI Arena(Developer Productivity AI Arena)は、JetBrainsが作成したオープンなベンチマーク・プラットフォームで、実世界のソフトウェア・エンジニアリング・タスクにおけるAI支援開発ツールの有効性を測定する。透明性の高い評価ストリームを通じて...最新のAIリソース9ヶ月前043.4K
NewBie-image-Exp0.1 - NewBieAI-Lab オープンソース実験的アニメリテラートグラフィカルモデルNewBie-image-Exp0.1は、NewBieAI-Labチームによってオープンソース化された最初の実験的なアニメテキスト生まれのグラフィックモデルです。このモデルは、デュアルテキストエンコーダー(GEMMA3-4B...最新のAIリソース8ヶ月前043.3K
Supertonic - オフラインで猛スピードで動作するオープンソースの高性能AI音声合成システム。Supertonicは、オープンソースの高性能音声合成(TTS)システムで、ローカルデバイスでの迅速な音声生成に重点を置いている。ONNXランタイム・テクノロジーを使用しているため、携帯電話、コンピュータ、Raspberry Piなどのデバイスで動作し、23の言語と音声クローンをサポートし、ネットワークを必要としません。最新のAIリソース8ヶ月前043.3K
Kosong - ムーンショットAIの新しいオープンソースAIエージェント開発フレームワークKosongは、Moonshot AIによってオープンソース化された新しいAIエージェント開発フレームワークで、次世代のインテリジェント・ボディ・アプリケーションを構築するための、軽量で柔軟かつ拡張性の高い基盤サポートを開発者に提供します。複数のツールを効率的にスケジューリングする非同期ツールスケジューリングエンジン...最新のAIリソース9ヶ月前042.9K
DeepOCR - DeepSeek-OCRモデルに基づくオープンソース・レプリカ・プロジェクトDeepOCRは、DeepSeek-OCRのコアアーキテクチャを実装したオープンソースの複製プロジェクトであり、光圧縮技術によってテキスト情報を効率的に処理する。コアはDeepEncoderで、SAM-base(高解像度画像の処理)、16×畳み込み圧縮器...で構成されている。最新のAIリソース9ヶ月前042.8K
InfinityStar - Byteオープンソース時空間自己回帰ビデオ生成フレームワークInfinityStarは、ByteDance社によってオープンソース化された、高解像度の画像とビデオ生成用に設計された、統一された時空間自己回帰フレームワークです。離散自己回帰的なアプローチを用いることで、テキストから画像、テキストから動画、画像から動画のタスクを単一のモデルで同時に扱うことができる。このフレームワークのベンチマークはVBench ...最新のAIリソース9ヶ月前042.7K
UniWorld V2 - RabbitShow Intelligenceと北京大学が発表した新世代の画像編集モデルUniWorld V2は、RabbitZhan Intelligenceと北京大学のUniWorldチームが共同で発表した新世代の画像編集モデルです。画像編集の分野、特に中国語の理解や複雑なコマンドの実行において大きな優位性を持っている。このモデルは、芸術的な中国語フォントを正確にレンダリングすることができ、細かい...最新のAIリソース9ヶ月前042.6K
GLM-4.6V - Wisdom Spectrum AI オープンソース多言語ラージ言語モデルシリーズGLM-4.6Vは、Smart Spectrum AIによってオープンソース化されたマルチモーダル大規模言語モデルのシリーズです。 このシリーズには2つのバージョンがあります:GLM-4.6V (106B-A12B)は、クラウドおよび高性能クラスタシナリオ用の基本バージョンで、Mixed Expert (MoE)アーキテクチャ、合計約1060億参照、および活性化...最新のAIリソース8ヶ月前042.5K
ArenaRL - 高德地图联合阿里通义开源的对比式强化学习方法ArenaRL是高德地图与阿里通义团队联合开源的对比式强化学习方法,专为解决开放域任务(如出行规划)中缺乏标准答案的问题。核心创新在于用“相对排序”替代传统“绝对打分”机制,通过智能体自动生成多套方案...最新のAIリソース6ヶ月前042.4K
MiroFish - 开源的AI预测引擎,智能体进行自由交互与社会演化MiroFish是中科大20岁学生BaiFu开源的AI预测引擎,基于多智能体技术,能从新闻、小说等种子信息自动构建高保真平行数字世界。最新のAIリソース5ヶ月前042.4K
Gemma 4 12B - 谷歌开源的多模态 AI 模型Gemma 4 12B是谷歌开源的多模态AI模型,采用无编码器架构,仅需16GB显存即可在消费级设备运行。取消传统视觉和音频编码器,通过轻量级嵌入模块直接处理原始数据,实现9GB显存占用下接近26B参...最新のAIリソース2ヶ月前042.4K
HiClaw - 阿里云开源的多智能体团队协作系统HiClaw 是阿里云开源的多 Agent 协作框架,让单个用户能像指挥团队一样调度多个 AI 员工。系统设置一位 Manager 管家负责拆解任务、分配工作,各 Worker 专精不同领域且相互隔离...最新のAIリソース4ヶ月前042.4K
MiniCPM-V 4.6 - 面壁智能联合清华开源的端侧多模态大模型MiniCPM-V 4.6 是面壁智能(OpenBMB)联合清华大学发布并开源的端侧多模态大模型。模型总参数量仅 1.3B,是 MiniCPM-V 系列有史以来最小的模型,在多模态综合能力上超越了阿里...最新のAIリソース3ヶ月前042.2K
OpenHuman - 开源桌面个人 AI 助手,能主动理解用户的数字同事OpenHuman是开源的个人AI助手项目,由Tiny Humans AI团队开发,解决传统AI助手缺乏长期记忆和上下文理解能力的问题。定位为“个人AI操作系统”或“数字分身”,目标是让AI从被动响应...最新のAIリソース2ヶ月前042.1K
Vidi2 - ByteHopのオープンソース・マルチモーダルビデオ理解と大規模モデルの生成Vidi2は、ByteDanceによってオープンソース化された第2世代のマルチモーダルビデオ理解・生成ビッグモデルであり、ビデオコンテンツの理解、分析、作成に焦点を当てている。テキスト、ビデオ、オーディオモダリティの共同入力をサポートし、画像コンテンツ、音声情報、自然言語コマンドを同時に理解することで、クロスモーダルなインタラクションを実現し、...最新のAIリソース8ヶ月前042.1K
PartCrafter - NU United Bytes オープンソース単体3D生成モデルPartCrafterは、北京大学、ByteDance、カーネギーメロン大学が共同で提案した先進的な3D生成モデルです。単一のRGB画像から、複数の意味的に明示的で幾何学的に多様な3Dメッシュパーツを一度に生成することができる。このモデルは、組み合わせ可能なポテンシャル空間を通してモデル化され...最新のAIリソース8ヶ月前042K
灵珠 - 零门槛 AI 应用创作平台,精准解析需求灵珠是上海灵感菇智能科技有限公司打造的零门槛AI应用创作平台,由语生科学AI孵化平台推出。用户无需编写任何代码,只需在网页中输入创意想法,系统即可自动生成可实际运行的产品最新のAIリソース3ヶ月前042K
FireRed-OCR - 小红书团队开源的端到端文档解析模型FireRed-OCR 是小红书 Super Intelligence 团队开源的端到端文档解析模型,基于 Qwen3-VL-2B 架构打造,仅用 2B 参数就在 OmniDocBench v1.5 ...最新のAIリソース5ヶ月前041.9K
omp - 开源的终端 AI Coding Agentomp(oh-my-pi) 是开源的终端 AI Coding Agent,由 can1357 基于 Mario Zechner 的 Pi 项目扩展而来。不是简单的聊天式代码助手,是将终端、代码仓库、L...最新のAIリソース2ヶ月前041.9K
Jamba Reasoning 3B - イスラエルAI21ラボのオープンソース軽量推論モデルJamba Reasoning 3Bは、イスラエルのAIスタートアップAI21 Labsによってオープンソース化された軽量推論モデルで、強力なパフォーマンスと幅広いアプリケーションへの応用が期待されている。SSMとTransformerのハイブリッド・アーキテクチャを採用し、Trans...最新のAIリソース10ヶ月前041.9K
ビー - テンセント・ミックスメタ・清華オープンソース・フルスタック・マルチモーダル・ラージモデル・プロジェクトBeeは、Tencent Mixed Elementチームと清華大学が共同で立ち上げたフルスタックのオープンソース・マルチモーダルビッグモデル・ソリューションであり、データ品質を向上させることで、オープンソースとクローズドソースのモデル間のパフォーマンスギャップを縮めることを目的としている。このプロジェクトには3つの核となる成果が含まれている:1,500万スケールの高品質2層CoTデータセットHoney-Data...最新のAIリソース9ヶ月前041.8K