BestBlogs - 質の高い技術コンテンツを集めたオープンソースのAIコンテンツアグリゲーションプラットフォームBestBlogsは、テクノロジー実務者、起業家、プロダクトマネージャーなどのための高品質コンテンツの提供に焦点を当てたプラットフォームです。RSSフィードとクローラー技術を通じて、400以上の高品質なブログから記事、ポッドキャスト、ビデオ、その他のマルチフォーマットコンテンツを収集している。核となる強みは、AIビッグランゲージの活用にある。最新のAIリソース10ヶ月前051K
Seedance 2.5 - 字节跳动推出的 AI 视频生成模型Seedance 2.5是字节 Seed 团队推出的AI模型,定位新一代 AI 视频创作引擎。模型单次直出 30 秒高清片段,可多次延长拼接成分钟级连贯叙事;支持批量导入图片、视频、音频作为创作参考...最新のAIリソース2ヶ月前051K
Qwen3.7-Plus - 阿里通义千问推出的多模态智能体基座模型Qwen3.7-Plus 是阿里巴巴通义千问团队推出的多模态智能体基座模型,在 Qwen3.7 强大文本能力基础上全面升级视觉-语言理解能力,同时完整保留编码、工具调用与生产力工作流等智能体特性。最新のAIリソース4ヶ月前051K
StepAudio 2.5 Realtime - 阶跃星辰发布的新一代实时语音大模型StepAudio 2.5 Realtime 是阶跃星辰发布的新一代实时语音大模型,目前已全量上线开放平台。模型主打"活人感"对话体验,通过副语言感知、千万级人设自定义与双商进阶的对话能力,实现从文本...最新のAIリソース4ヶ月前050.8K
Step 3.7 Flash - 阶跃星辰开源的 AI 模型,专为生产级 Agent 设计Step 3.7 Flash是阶跃星辰(StepFun)开源的新一代AI模型,专为生产级智能代理(Agent)设计。在速度、成本与复杂任务处理能力间取得平衡,支持编程、搜索和多模态工作流,并针对本地部...最新のAIリソース4ヶ月前050.8K
QwenLong-L1.5 - Ali Tongyi Lab オープンソース長文推論モデルQwenLong-L1.5は、Alibaba Tongyi Labによるオープンソースのロングテキスト推論モデルであり、超ロングコンテキスト(例えば1M-4Mトークン)の複雑な推論問題の解決に焦点を当てている。核となるブレークスルーは、学習後の段階における3つの大きな革新にある。知識グラフ、SQL構文解析、マルチインテリジェンスによる...最新のAIリソース9ヶ月前050.7K
ForgeTrain - 面壁智能联合清华大学、OpenBMB开源的大模型预训练框架ForgeTrain 是面壁智能联合清华大学、OpenBMB 开源社区发布的全球首个完全由 AI 编写、零人类代码介入的生产级大模型预训练框架。框架采用独创的 Forge Engineering(锻造...最新のAIリソース4ヶ月前050.7K
GigaWorld-0 - GigaVision オープンソース世界モデリングフレームワークGigaWorld-0は、国内のEmbodied IntelligenceスタートアップGigaAIのオープンソース世界モデルフレームワークであり、主にEmbodied Intelligence (Embodied AI)分野のデータボトルネック問題を解決するために使用される。高品質で多様かつ物理的にリアルな学習データを効率的に生成し、プッシュ...最新のAIリソース10ヶ月前050.6K
Hy-Memory - 腾讯混元推出的记忆插件,为长期协作型 Agent 设计Hy-Memory是腾讯混元推出的记忆插件,专为 Openclaw 等长期协作型 Agent 设计。通过 6层记忆框架 × System1/System2 双系统 × 演化链 三层核心架构,解决 Ag...最新のAIリソース4ヶ月前050.2K
InkSight - GoogleのオープンソースAI手書き文字認識ツールInkSightはGoogleのオープンソースAI手書き認識ツールで、紙の手書きメモを編集可能なデジタルインクファイル(SVG形式など)に変換します。従来のOCRとは異なり、テキストコンテンツを認識し、手書きスタイル、段落構造、フォーカスマークを復元することができます。最新のAIリソース9ヶ月前050.2K
Open CoDesign - 开源桌面端 AI 设计工具,Claude Design 平替Open CoDesign是 OpenCoworkAI 团队开发的开源桌面端 AI 设计工具,采用 MIT 协议,定位为 Claude Design 的开源替代品,同时覆盖 v0 by Vercel...最新のAIリソース4ヶ月前050K
阿里云百炼CLI - 阿里云 Model Studio 开源的命令行工具阿里云百炼CLI(Bailian CLI)是阿里云Model Studio官方开源的命令行工具,通过一行命令即可让任意AI Agent自动调用阿里云百炼平台的150+款模型和10+款应用能力,涵盖文本...最新のAIリソース4ヶ月前049.9K
Claude Fable 5 - Anthropic发布的第五代大型语言模型Claude Fable 5是Anthropic发布的第五代大型语言模型,属于其Claude系列,是首个面向公众开放的“Mythos级”(神话级)模型。最新のAIリソース3ヶ月前049.9K
Composer 2 - Cursor 推出的专有代码大模型Composer 2 是 AI 编程平台 Cursor 推出的专有代码大模型,主打"长周期智能体编程"。模型支持 20 万 Token 上下文窗口,能自主处理包含数百个操作的复杂开发任务,在 Term...最新のAIリソース6ヶ月前049.8K
Seekdb - Ant OceanBase オープンソースAIネイティブハイブリッド検索データベースSeekdb (OceanBase Seekdb) はAnt OceanBaseのオープンソースAIネイティブハイブリッド検索データベースで、ベクトル、フルテキスト、スカラー、地理空間データの統合ハイブリッド検索をサポートし、多段検索メカニズムを使用して、低レイテンシで高精度な検索を実現します。最新のAIリソース10ヶ月前049.8K
GLM-5V-Turbo - 智谱发布首个原生多模态Coding基座模型GLM-5V-Turbo是智谱发布首个原生多模态Coding基座模型,专为视觉编程打造。模型从预训练阶段深度融合视觉与文本能力,能直接理解设计稿、网页截图、K线图表等视觉信息并生成可运行代码,实现"所...最新のAIリソース6ヶ月前049.7K
SenseAudio - 商汤科技推出的一站式 AI 语音开放平台SenseAudio 是商汤科技推出的AI语音开放平台,面向开发者与企业提供一站式语音AI解决方案。平台集成语音识别(ASR)、语音合成(TTS)、音色克隆等核心能力,语音识别覆盖20+语言并支持说话...最新のAIリソース6ヶ月前049.5K
PrismAudio - 阿里通义实验室开源的视频生成音频框架PrismAudio 是阿里通义实验室推出的视频生成音频框架,专注于为视频自动匹配严丝合缝的环境音效。框架创新性地引入"分解式思维链"(CoT)机制,让模型在生成音频前先分析视频内容、声音时序、音质特...最新のAIリソース6ヶ月前049.4K
FG-CLIP 2 - 360 オープンソース・クロスモーダルグラフィックス視覚言語モデルFG-CLIP 2は、360人工知能研究所が発表した世界有数のグラフィカル・クロスモーダル視覚言語モデル(VL-M)であり、29の権威あるベンチマークでGoogleやMetaの類似モデルを上回り、現在最も強力なVL-Mとなっている。最新のAIリソース11ヶ月前049.4K
MiniMax Music 2.5+ - MiniMax推出的AI音乐生成模型MiniMax Music 2.5+是MiniMax推出的AI音乐生成模型,专注器乐创作。模型精通古典管弦、电子氛围、自然声景等多元风格,擅长将东方传统乐器与西方现代编曲融合,实现跨风格创新。最新のAIリソース6ヶ月前049.4K
Flowra - Magic HitchとWooli WULIチームがオープンソース化したAIワークフロー開発ツールFlowraは、ModelScope共同ウーマイルWULIチームのオープンソースグラフ実行エンジンとノードパッケージ開発ツールであり、FlowBenchのコアコンポーネントです。有向非循環グラフ(DAG)組織ワークフローを通じ、インテリジェントなキャッシュ、並列スケジューリング、分散サポート...最新のAIリソース10ヶ月前048.8K
Xiaomi MiMo Claw - 小米推出的云端轻量化 AI 智能体平台Xiaomi MiMo Claw 是小米推出的云端轻量化 AI 智能体平台,基于 OpenClaw 框架打造,搭载自研 MiMo-V2.5-Pro 旗舰模型。主打"一键部署、零门槛"的 AI 办公体验...最新のAIリソース3ヶ月前048.8K
VibeVoice-Realtime - マイクロソフトのオープンソース軽量リアルタイム音声合成モデルVibeVoice-Realtimeは、低遅延とリアルタイムインタラクションのために設計されたマイクロソフトのオープンソースの軽量リアルタイム音声合成(TTS)モデルです。ストリーミングテキスト入力をサポートし、最初のテキストトークンから音声入力することができます。最新のAIリソース9ヶ月前048.7K
Veo 3.1 Lite - Google DeepMind发布的低成本AI视频生成模型Veo 3.1 Lite是Google DeepMind发布的低成本AI视频生成模型,定位为Veo系列中最实惠的版本,专为大规模视频生成场景设计。模型支持文本和图像生成视频,输出720p和1080p分...最新のAIリソース6ヶ月前048.6K
Fun-AudioGen-VD - 阿里通义实验室推出的声音设计系统Fun-AudioGen-VD 是阿里通义实验室推出的创新语音大模型,专注于声音设计与场景化音频生成。模型支持通过自然语言指令直接生成包含特定音色、情绪表达和完整听觉场景的高质量音频,无需参考音频即可...最新のAIリソース6ヶ月前048.5K
MAI-Thinking-1 - 微软AI发布的首款自研高级推理模型MAI-Thinking-1 是微软AI发布的首款自研高级推理模型。模型采用35B活跃参数、约1T总参数的稀疏混合专家(MoE)架构,拥有256K超长上下文窗口。完全基于干净且拥有商业许可的企业级数据...最新のAIリソース4ヶ月前048.1K
Fun-CosyVoice3.5 - 阿里通义实验室推出的第三代语音合成大模型Fun-CosyVoice3.5是阿里通义实验室推出的第三代语音合成大模型,主打"自然语言指令控制"能力,用户可直接用口语化描述(如"语气坚定一点""语速慢一点")来调节合成语音的情绪、语速和风格,无...最新のAIリソース6ヶ月前048K
Grok 4.3 - xAI公司推出的最新一代大语言模型Grok 4.3是xAI公司推出的最新一代大语言模型,属于Grok系列的重要更新版本,支持100万token的上下文窗口,可一次性处理整本书、大型代码库或长文档,思维链推理强制开启,模型在给出答案前会...最新のAIリソース4ヶ月前047.6K
html-video - Open Design团队开源的本地视频生成工具html-video是Open Design团队开源的本地视频生成工具,能将HTML、CSS和数据直接转换为MP4视频。支持21种预设模板,涵盖产品宣传、知识讲解等场景,可配合Claude Code...最新のAIリソース3ヶ月前047.3K
DiffusionGemma - Google DeepMind 发布的实验性开源文本生成模型DiffusionGemma 是 Google DeepMind 发布的实验性开源文本生成模型,采用离散文本扩散架构替代传统自回归方式。基于 Gemma 4 的 MoE 骨干(26B 总参数,激活 3...最新のAIリソース3ヶ月前047.2K
Nemotron 3 Super - NVIDIA开源的大语言模型,专为AI Agent推理设计Nemotron 3 Super是NVIDIA 发布的Nemotron 3 系列中目前最强大的开源权重 AI 模型。模型采用 1200 亿参数的混合专家(MoE)架构,推理时仅激活 120 亿参数,实...最新のAIリソース6ヶ月前047.2K
GPT-5.4 mini - OpenAI 推出的轻量级 AI 模型GPT-5.4 mini 是 OpenAI 发布的轻量级模型,定位为"迄今能力最强的小型模型"。在保留 GPT-5.4 核心能力的同时,实现了速度提升 2 倍以上,成本大幅降低,专为对延迟敏感的高频工...最新のAIリソース6ヶ月前047.1K
蛙蛙写作2.0升级深度解析:三栏架构如何重塑AI长篇创作体验2025年7月,蛙蛙写作正式发布2.0版本,这是该产品自2024年上线以来幅度最大的一次产品重构。此次升级不仅在底层技术能力上实现了对主流大模型的深度整合,更在产品交互架构上做出了突破性的创新——引入...最新のAIリソース3ヶ月前046.9K
LongCat-Image - LongCat チーム、アメリカングループのオープンソース画像生成・編集モデルLongCat-Imageは、MeituanのLongCatチームによってリリースされたオープンソースの画像生成・編集モデルです。ハイブリッドバックボーンアーキテクチャ(MM-DiT+Single-DiT)と視覚言語モデル(VLM)条件付きエンコーダを組み合わせることで、テキスト生成画像と複数ラウンドの画像編集を実現している。最新のAIリソース9ヶ月前046.9K
Lyria 3 Pro - 谷歌推出的最先进AI音乐生成模型Lyria 3 Pro是谷歌推出的最先进的AI音乐生成模型。相比前代Lyria 3仅30秒的生成时长,Pro版本可一次性生成长达3分钟的完整音轨,精准控制前奏、主歌、副歌、桥段等歌曲结构。最新のAIリソース6ヶ月前046.6K
PixVerse R2 - 爱诗科技推出的实时全模态世界模型PixVerse R2 是爱诗科技(AISphere)推出的实时全模态世界模型,延续年初 R1"全球首个实时世界模型"的路线,主打"边生成、边交互、边演化",推动 AI 视频从"看"走向"玩"。最新のAIリソース3週間前046.6K
SeedMusic 1.0 - 字节跳动推出的第一代AI音乐生成模型SeedMusic 1.0是字节跳动推出的第一代AI音乐生成模型,专注于将用户的文字创意快速转化为带有人声的完整歌曲草稿。用户只需输入一段描述、歌词或风格方向,可在几分钟内生成包含主歌、副歌、编曲和人...最新のAIリソース2ヶ月前046.2K
TurboQuant - Google Research 推出的突破性内存压缩算法TurboQuant 是 Google Research 推出的突破性内存压缩算法,专为解决大语言模型推理中的 KV 缓存瓶颈而设计。最新のAIリソース6ヶ月前046K
GPT-5.3 Instant - OpenAI推出的GPT-5系列快速响应版本模型GPT-5.3 Instant 是 OpenAI 发布的 ChatGPT 主力模型升级版,主打"体验优化"而非参数堆叠。精准解决了用户长期诟病的"说教感"和机械回复问题,对话语气更自然直接,大幅减少了...最新のAIリソース6ヶ月前045.9K
Lightpanda - 专为 AI 时代设计的开源无头浏览器Lightpanda是Lightpanda.io公司开发的开源无头浏览器,专为AI自动化和Web抓取设计。采用Zig语言从零构建,去除了图形渲染等冗余功能,核心优势是速度比Chrome快11倍,内存占...最新のAIリソース6ヶ月前045.7K
Gemini 3.5 Live Translate - Google 发布的最新实时语音翻译模型Gemini 3.5 Live Translate 是 Google 发布的最新实时语音翻译模型,支持 70 余种语言和 2,000 多组语言对,覆盖全球绝大多数语种。采用流式实时翻译技术,输出仅落后...最新のAIリソース3ヶ月前045.6K
Gemini 3.1 Flash Live - Google 推出的旗舰级实时语音模型Gemini 3.1 Flash Live 是 Google 推出的旗舰级实时语音模型,被誉为"迄今最高质量的音频和语音模型"。主打超低延迟的自然对话体验,支持 90+ 种语言的原生多模态交互,能精准...最新のAIリソース6ヶ月前045.3K
Ovis-Image - Ali AIDC-AIチームによるオープンソース・ベンチャーグラフモデルOvis-Imageは、Alibaba International Digital Commerce GroupのAIDC-AIチームによってオープンソース化された70億パラメータのテキスト生成グラフモデルで、高品質のテキストレンダリングに焦点を当てています。Ovis-U1アーキテクチャに基づき、高度なビジュアルデコーダーと双方向トークン精製機能を継承しています。最新のAIリソース10ヶ月前045.2K
商汤输入法AudioClaw - 商汤科技推出的AI语音智能助手商汤输入法AudioClaw是商汤科技基于日日新多模态大模型打造的AI语音智能应用,深度接入OpenClaw底层能力,定位为"会听话的龙虾"智能助手。最新のAIリソース6ヶ月前045.1K
InstanceAssemble - リトルレッドブックと復旦大学のオープンソースレイアウト制御生成技術InstanceAssembleは、Xiaohongshuと復旦大学が共同でオープンソース化したレイアウト制御生成技術で、「Instance Assemble Attention」のメカニズムにより、単純なレイアウトから複雑なレイアウトまで、また疎なレイアウトから密なレイアウトまで、正確な画像生成を実現します。2段階のカスケードアーキテクチャを採用し、最初に画像の背景に入り、次に1つずつ...最新のAIリソース9ヶ月前045K
Seedance 2.0 Mini - 字节跳动 Seedance 视频模型系列的轻量版本Seedance 2.0 Mini 是字节跳动 Seedance 视频模型系列的最新轻量版本,在火山方舟体验中心及 Dreamina 平台上线,计划近期开放 API 服务。最新のAIリソース3ヶ月前045K
Unlimited-OCR - 百度开源的端到端长文档 OCR 模型Unlimited-OCR 是百度开源的端到端长文档 OCR 模型,采用 3B 参数 MoE 架构(每 token 仅激活约 500M 参数),核心创新在于将标准注意力替换为 R-SWA(参考滑动窗口...最新のAIリソース3ヶ月前044.8K
SkillOpt - 微软研究院开源的 Agent 技能自进化框架SkillOpt 是微软研究院开源的 Agent 技能自进化框架,核心创新在于将自然语言编写的技能文档视为可训练的外部参数,无需修改底层大模型权重。系统通过"执行-反思-编辑-验证"闭环运作:冻结的目...最新のAIリソース3ヶ月前044.1K
Octask - 光魔科技推出的新一代 AI 原生内容工作室平台Octask 是深圳光魔科技推出的新一代 AI 原生内容工作室平台,由谷歌与腾讯背景团队打造,获得百度 A 轮投资。核心创新在于将 AI 工具"员工化",通过像素风格的沉浸式虚拟工作室,让创作者以"老...最新のAIリソース3ヶ月前043.2K
Wan-Dancer - 阿里通义实验室开源的音乐舞蹈视频生成大模型Wan-Dancer 是阿里巴巴通义实验室万相(Wan)团队推出的音乐驱动舞蹈视频生成大模型,开源版本 Wan-Dancer-14B 拥有140亿参数,采用 Apache 2.0 协议免费商用。用户只...最新のAIリソース2ヶ月前042.9K
Kimi K3 - 月之暗面发布的全球首个开源 3 万亿级大模型Kimi K3 是月之暗面(Moonshot AI)发布的全球首个开源 3 万亿级大模型,总参数达 2.8 万亿。采用 KDA 混合线性注意力机制与 Stable LatentMoE 稀疏架构,896...最新のAIリソース2ヶ月前042.6K
Seedream 5.0 Pro - 字节跳动发布的多模态图像创作模型Seedream 5.0 Pro是字节跳动豆包大模型团队发布的多模态图像创作模型,定位为面向专业创作者和企业级用户的设计工具。相比前代,在图文匹配、结构合理性等基础能力上全面提升最新のAIリソース2ヶ月前042.5K
LOGOS - 阿里联合中国人大推出的多领域科学生成基础模型LOGOS(Language Of Generative Objects in Science)是阿里集团联合中国人民大学高瓴人工智能学院开发的首个基于统一"科学语法"的多领域科学生成基础模型。最新のAIリソース3ヶ月前042K
SciClaw - 面向科研人员的云端 AI Agent 协同系统SciClaw(科研龙虾) 是面向科研人员的云端 AI 协同系统,定位为"科研人的深夜搭子"。能深度分析文献、自主执行实验、自动排版生成论文/PPT/海报,记住用户电脑里的所有研究资料,将灵感、执行与...最新のAIリソース6ヶ月前041.2K
Voxtral TTS - Mistral AI推出的开源文本转语音模型Voxtral TTSoxtral TTS是法国AI公司Mistral AI发布的开源文本转语音模型,采用40亿参数轻量化架构,量化后仅需3GB内存即可在智能手机等边缘设备实时运行。模型原生支持英语...最新のAIリソース6ヶ月前040.7K
Qwen-Audio-3.0-ASR-Flash - 阿里通义千问发布的语音识别大模型Qwen-Audio-3.0-ASR-Flash 是阿里巴巴通义千问团队发布的语音识别大模型,主打"长音频不丢词、行业词不用教"。模型在上下文一致性、行业词识别与热词定制化三大维度实现系统性升级,集成...最新のAIリソース2ヶ月前040.4K
ChatExcel Ultra - ChatExcel团队推出的企业级AI数据智能体ChatExcel Ultra 是ChatExcel团队面向企业用户和专业数据办公场景推出的全新桌面版,定位为国内首款企业级AI数据智能体。最新のAIリソース3ヶ月前039.8K
跃迁维度 - AI 模型聚合服务平台,一个API统一调多款模型跃迁维度(dimleap) 是AI模型聚合服务平台,为全球开发者提供高效能、低成本的多品类AI模型API服务。平台目前已接入DeepSeek、GLM(智谱清言)、MiniMax、kimi、qwen(通...最新のAIリソース2ヶ月前039.7K
GPT-Live - OpenAI 推出的新一代语音模型,全双工实时对话GPT-Live 是 OpenAI 推出的新一代语音模型,全面升级 ChatGPT 的语音交互体验。基于全双工(full-duplex)架构构建,能同时倾听和说话,彻底打破了传统 AI 语音助手"你说...最新のAIリソース2ヶ月前038.7K
Grok 4.5 - SpaceXAI 发布的旗舰大语言模型,编码与智能代理专用模型Grok 4.5 是 SpaceXAI(原 xAI)发布的旗舰大语言模型,定位为"Opus 级别"的编码与智能代理专用模型。模型基于 1.5 万亿参数的 V9 架构打造,采用 MoE(混合专家)架构...最新のAIリソース2ヶ月前037.9K
TDream - 腾讯推出的 AI 内容创作平台TDream是腾讯内测的AI内容创作平台,以"互动影游化创作"为核心定位,试图重构用户从内容生产到交互体验的全链路。区别于市面上仅输出单一线性视频的传统文生视频工具,TDream依托五大AI引擎,支持...最新のAIリソース2ヶ月前037.8K
Qwen3.8-Flash-Next - 阿里 Qwen 发布的开源权重多模态 MoE 模型Qwen3.8-Flash-Next 是阿里 Qwen 发布的开源权重多模态 MoE 模型,定位为 Qwen4 架构的先导预览:主模型 125B 参数,另配 51B N-gram Embedding...最新のAIリソース3週間前037.5K
MiniMax H3 - 稀宇科技MiniMax发布的通用全模态生成模型MiniMax H3是稀宇科技MiniMax发布的通用全模态生成模型,可在统一上下文中理解文本、图像、视频与声音,生成最高15秒、2K分辨率、带原生双声道音频的音视频。最新のAIリソース2ヶ月前037.5K
Qwen3.8-Max-Preview - 阿里通义千问发布的新一代旗舰大模型Qwen3.8-Max-Preview是阿里巴巴通义千问团队发布的新一代旗舰大模型预览版 。模型总参数达2.4万亿,采用稀疏MoE架构,是通义千问系列首个突破万亿参数的多模态模型,支持文本、图片、视频...最新のAIリソース2ヶ月前037.4K
Nano Banana 2 Lite - Google发布的轻量版 AI 图像生成模型Nano Banana 2 Lite(gemini-3.1-flash-lite-image)是Google发布的AI图像生成模型,定位为Nano Banana家族中速度最快、成本最低的轻量版。可在约...最新のAIリソース2ヶ月前037.4K
Claude Opus 5 - Anthropic 推出的新一代大模型Claude Opus 5 是 Anthropic 推出的新一代旗舰大模型,核心是用旗舰一半的价格获得接近顶尖水平的智能"。模型在维持与前代 Opus 4.8 相同调用成本的同时,实现性能的翻倍跃升...最新のAIリソース2ヶ月前036.5K
Hyra - 腾讯混元团队发布的科研智能体Hyra(Hunyuan Research Agent)是腾讯混元团队发布的科研智能体,首个版本为Hyra-1.0,支持递归自我改进(RSI),专为性能导向的研究与工程任务打造 。采用轻量通用框架,通...最新のAIリソース2ヶ月前036.4K
Claude Sonnet 5 - Anthropic 发布的最具 Agent 能力模型Claude Sonnet 5是Anthropic 发布的最具 Agent 能力的 Sonnet 模型,以中端价格提供接近旗舰 Opus 4.8 的自主智能体能力。模型支持 100 万 token 上...最新のAIリソース3ヶ月前036.4K
Hy ASR 3.0 preview - 腾讯混元推出的新一代语音识别模型Hy ASR 3.0 preview 是腾讯混元推出的新一代语音识别模型,深度融合最新大语言模型 Hy3 的语言理解能力与高精度语音识别技术,实现从"逐字转写"到"听懂语境"的跨越。模型采用 MoE ...最新のAIリソース1ヶ月前036.4K
Muse Image - Meta 推出的首个自研 AI 图像生成模型Muse Image 是 Meta 推出的首个自研 AI 图像生成模型,由 Meta Superintelligence Labs 开发。采用独特的智能体(Agentic)架构,在生成图像前会先与 M...最新のAIリソース2ヶ月前036.2K
Qwen-Audio-3.0-TTS - 阿里通义发布的旗舰级语音合成大模型Qwen-Audio-3.0-TTS是阿里巴巴通义千问团队发布的旗舰级语音合成大模型,提供面向实时交互的Flash版(首包延时约300ms)与面向高质量生成的Plus版,Plus版登顶全球权威榜单Ar...最新のAIリソース2ヶ月前036.1K
Wan3.0 - 阿里云通义全网公测的新一代视频生成大模型Wan3.0 是阿里云通义全网公测的新一代视频生成大模型,被称为"阿里最强视频模型"。在生成时长、万能创作、全能参考、真实感四大维度全面升级。单次可稳定生成最长30秒的一镜到底视频最新のAIリソース1ヶ月前035.9K
Gemini 3.5 Flash-Lite - Google 发布的高吞吐低成本模型Gemini 3.5 Flash-Lite 是 Google 发布的高吞吐低成本模型,官方定位为 3.5 系列中最快、最具成本效益的型号,面向 agentic search、文档处理与大规模生产流量...最新のAIリソース2ヶ月前035.6K
HyOCR-1.5 - 腾讯混元团队开源的轻量化端到端OCR专家大模型HyOCR-1.5是腾讯混元团队开源的轻量化端到端OCR专家大模型,参数量仅1B,是领域首个训练、推理、权重完整开源的专家模型 。采用端到端架构,输入图片即可直接输出Markdown正文、HTML表格...最新のAIリソース2ヶ月前035.5K
Gemini 3.6 Flash - Google 发布的新一代主力模型Gemini 3.6 Flash 是 Google 发布的新一代主力模型(Workhorse Model),是 Gemini 3.5 Flash 的升级版,主要面向生产级 AI 智能体(Agent)和...最新のAIリソース2ヶ月前035.5K
Agnes 2.5 Pro Alpha - Agnes AI 发布的高性价比推理模型Agnes 2.5 Pro Alpha 是新加坡 AI 实验室 Agnes AI 发布的高性价比推理模型,支持文本、图像输入与文本输出,提供百万 Token 上下文和 65,536 Token 最大输...最新のAIリソース3週間前035.2K
Astryx - Meta 开源的 React 设计系统Astryx 是 Meta 以 MIT 协议开源的 React 设计系统,历经八年内部打磨,长期支撑 Facebook、Instagram、WhatsApp 和 Threads 等超过 13,000 ...最新のAIリソース3ヶ月前035.2K
DeepSeek Harness - DeepSeek AI 开源的智能体运行框架DeepSeek Harness(DSH)是 DeepSeek AI 开源的智能体运行框架,当前为开发者预览版并采用 MIT 许可,核心理念是“一切皆插件”:模型、工具、技能、会话、沙箱、存储、循环...最新のAIリソース1ヶ月前035K
GLM-5.3-Flash - 智谱开源的旗舰级高性价比模型GLM-5.3-Flash是智谱Z.ai上线并开源的旗舰级高性价比模型,也是GLM-5系列首个原生多模态模型;采用320B总参数、18B激活的MoE,支持1M上下文与128K输出,通过稀疏+线性注意力...最新のAIリソース3週間前035K
JellyToken - 阿里元境推出的大模型 API 聚合与分发平台JellyToken 是国内领先的大模型 API 聚合与分发平台,定位为"国内主流 AI 大模型一站式超市"。用户仅需一个 API Key 即可无缝调用通义千问、DeepSeek、智谱、月之暗面、豆包...最新のAIリソース2ヶ月前034.7K
Qwen-Image-3.0 - 阿里千问发布的第三代图像生成基础模型Qwen-Image-3.0 是阿里千问发布的第三代图像生成基础模型,核心主线为"实",内容丰实、细节真实、知识厚实。模型支持最大 4.5k token 超长文本输入,较前代提升 4.5 倍,可一次性...最新のAIリソース2ヶ月前034.2K
FLUX 3 - Black Forest Labs 发布的首款多模态基础模型FLUX 3 是德国 AI 公司 Black Forest Labs 发布的首款多模态基础模型,基于自研 Self-Flow 架构,在单一网络中统一训练图像、视频、音频与动作预测,实现真正的"全能模型...最新のAIリソース2ヶ月前033.7K
SeedRealtime - 字节跳动 Seed 发布的原生音视频全双工大模型SeedRealtime 是字节跳动 Seed 团队发布的原生音视频全双工大模型,首发落地于豆包 App 的「打电话」视频通话功能。与传统"语音识别→视觉理解→大模型推理→语音合成"的级联流水线不同...最新のAIリソース1ヶ月前033.4K
Qwen 3.8-Max - 阿里巴巴通义千问发布的旗舰级大模型Qwen 3.8-Max 是阿里巴巴通义千问发布的旗舰级大模型,也是 Qwen 系列迄今规模最大、能力最强的模型。采用稀疏混合专家(MoE)架构,总参数达2.4万亿,推理时仅激活约950亿参数,在保持...最新のAIリソース1ヶ月前033K
MiniMax Design - MiniMax 发布的多模态创作 Agent 工作台MiniMax Design 是 MiniMax(稀宇科技)发布的多模态创作 Agent 工作台,也是开源视频模型 H3 的首个官方工具框架(Harness)。用户只需用自然语言提出创作需求,Agen...最新のAIリソース3週間前032K
Wan-Streamer v0.2 - 阿里通义实验室发布的端到端全模态实时交互模型Wan-Streamer v0.2 是阿里通义实验室发布的端到端全模态实时交互模型,首次将「听、看、说、演」统一进单个因果 Transformer 架构,实现类人般的实时双工交互。最新のAIリソース2ヶ月前031.7K
Play with Putty - Google Labs 推出的协作式 vibe coding 实验工具Play with Putty 是 Google Labs 推出的协作式 vibe coding 实验工具,口号是"让你的想象力进入多人模式"。允许多人通过共享链接进入同一空间实时协作,任何人都能用自...最新のAIリソース3週間前030.8K
Grok Bot - SpaceXAI 发布的云端 AI Agent,多 Bot 分工协作Grok Bot 是 SpaceXAI(原 xAI)发布的 AI Agent 产品,定位为「永远在线的 AI 同事」。不同于传统聊天机器人,运行在独立的云端 Linux 虚拟机中,配备浏览器、文件系统...最新のAIリソース1ヶ月前030.6K
MAGI-2 Preview - Sand.ai 开源的统一音视频生成模型MAGI-2 Preview 是 Sand.ai 开源的统一音视频生成模型,总参数约 114B、单 token 仅激活约 6B,是全球首个千亿级开源 MoE 视频模型 。采用单流架构将文本、视频、音频...最新のAIリソース1ヶ月前030K
Lovart中文版 - Lovart 推出面向中文用户的多模态 AI 设计 AgentLovart中文版是基于多模型架构的AI设计Agent,用户只需像聊天一样描述创意需求,平台可自动生成海报、视频、Banner等高品质视觉内容。平台深度整合Seedance、MiniMax H3等前沿...最新のAIリソース4週間前029.5K
GLM-5.3 - 智谱发布的新一代旗舰模型,面向复杂长程任务GLM-5.3 是智谱发布的新一代旗舰模型,沿用 GLM-5.2 约7430亿参数基座,能力跃迁主要来自后训练 Scaling:通过 IndexShare、SAO、Slime 框架与更多长程任务环境强...最新のAIリソース4週間前028.8K
Ling-3.0-tiny - 蚂蚁百灵开源的最小 MoE 模型Ling-3.0-tiny 是蚂蚁 InclusionAI 百灵 Ling 3.0 系列中最小的 MoE 模型,约 7.9B 总参数、每 token 激活约 1.3B,强调低延迟、低成本与 Agent...最新のAIリソース1ヶ月前028.8K
Claude Mythos 5.1 - Anthropic 推出的 Claude 系列最新 AI 模型Claude Mythos 5.1 是 Anthropic Claude 5.1 系列旗舰模型,与 Fable 5.1 同源,通过差异化安全策略实现能力分级。模型专攻网络安全与生命科学,支持蛋白设计...最新のAIリソース1週間前027.1K
Gemini 3.8 - 谷歌最新推出的新一代旗舰模型系列Gemini 3.8 是谷歌最新推出的推理与编码大模型,分为 Flash 和 Flash Cyber 两个版本。Flash 版在维持高速响应与低成本的同时,显著增强代码生成、多步推理和自主 Agent...最新のAIリソース2週間前025.7K
Gemini 3.7 Flash - Google DeepMind 发布的稳定版轻量主力模型Gemini 3.7 Flash 是 Google DeepMind 发布的稳定版轻量主力模型,模型 ID 为 gemini-3.7-flash,首日即非 preview。在 Gemini 3.6 F...最新のAIリソース1ヶ月前025.3K
GPT-6 Astra - OpenAI推出的新一代旗舰大语言模型GPT-6 Astra是OpenAI发布的新一代旗舰大语言模型,与传统对话模型不同,模型已进化为具备自主行动能力的AI Agent,能独立操控计算机软件、浏览网页、处理复杂工作流。最新のAIリソース2週間前025.3K
OnSolo - 腾讯推出的AI原生一站式影视创作平台OnSolo是腾讯推出的AI原生一站式影视创作平台,前身WorkSolo,以"a Crew of One"为核心理念,让个人仅凭一句话灵感即可完成从剧本、角色资产、分镜到视频成片的全部创作流程。最新のAIリソース3週間前025K
dots.tts - 小红书联合上海交大开源的语音合成基础模型dots.tts 是小红书 dots 团队(rednote-hilab)与上海交大 X-LANCE 实验室联合研发的 20 亿参数全连续端到端自回归语音合成基础模型,架构为「语义编码器 + Qwen2...最新のAIリソース1ヶ月前025K
Grok Imagine Image 2.0 - 马斯克旗下 SpaceXAI 发布的图像生成模型Grok Imagine Image 2.0 是马斯克旗下 SpaceXAI 发布的图像生成模型,作为全新「质量模式」上线 Grok 网页端及 iOS、Android 应用。在功能上完成了从「文生图工...最新のAIリソース1ヶ月前025K