PixVerse V5 - アイシ・テクノロジーズが自社開発のAI動画モデルを発表
PixVerse V5は、アイシ・テクノロジーが発表したAI動画生成の大型モデルである。ユーザーが入力したテキスト説明文や画像をもとに、高品質な動画コンテンツを生成できるモデルで、アニメ、SF、国民的など様々なスタイルに対応している。
アスク・ホワイト5 - アスク・ホワイトのオールインワンAIモデル
アスクホワイト5は、非常に高い知性を備えた「オール・イン・ワン」のフラッグシップモデルである。AA-Index総合評価スコア64.7点、STEM能力評価スコア86点など、多くの評価で好成績を収め、世界トップクラスのGPT-5に迫る。
Gemini 2.5 Flash Image - Googleによる最も強力な画像生成・編集モデル
ジェミニ2.5フラッシュイメージ(コードネームnano banana)は、Googleが提供する最先端の画像生成・編集モデルであり、シーン間の文字の一貫性を維持し、背景をぼかしたり、汚れを除去したりといった自然言語による精密な画像編集をサポートする。
Wan2.2-S2V - Ali Tongyi オープンソース音声駆動ビデオ生成モデル
Wan2.2-S2VはAli Tongyiのオープンソースのマルチモーダルビデオ生成モデルであり、静止画像と音声のみで、高品質のデジタルヒューマンビデオを生成することができ、様々な画像タイプとフレームをサポートしています。
アーネスト・ンによる開発者のためのChatGPTチップエンジニアリング無料コース
ChatGPT Tip Engineering for Developersは、開発者向けにデザインされたDeepLearning.AIとOpenAIの共同コースで、Isa Fulford、Andrew Ngを講師に迎え、大規模言語モデル(LLM)の使い方を学びます。
Ask o4 - Ask o4が導入した、8つの思考経路を同時に開くパラレル思考モデル
Ask White o4は、8つの思考経路を同時に開き、問題を多角的に分析し、最適解を自動的にフィルタリングする革新的な並列思考モデルです。このモデルには、高度なLong-CoT強化学習とプロセス報酬学習技術が組み込まれており、強力な深層推論機能を持ち、複雑なタスクで優れたパフォーマンスを発揮します。
VibeVoice - マイクロソフトの音声合成モデリング
バイブボイスは、マイクロソフトの新しい音声合成(TTS)モデルである。このモデルは、最大4つの異なるスピーカーから会話音声を生成し、最大90分の連続音声出力をサポートしており、従来のTTSシステムの長さの制限を打ち破っている。
SpatialGen - Qunar Technologiesのオープンソース3Dシーン生成モデル
SpatialGenはQunar Technologyのオープンソース3Dシーン生成モデルであり、拡散モデルアーキテクチャに基づき、テキスト記述、参照画像、3D空間レイアウトに基づいて時空間的に一貫性のあるマルチビュー画像の生成をサポートし、さらに3Dガウスシーンの生成とローミングビデオのレンダリングを行う。
EchoMimicV3 - Ant オープンソースマルチモーダルデジタルヒューマンアニメーション生成モデル
EchoMimicV3は、Ant Groupが発表したマルチモーダルデジタル人体動画生成モデルで、13億のパラメータを持ち、音声、テキスト、画像などの複数の入力を扱うことができ、高品質のデジタル人体アニメーションを生成することができます。
おすすめのAI小論文作成ツールとは?おすすめの無料AIアカデミック小論文アシスタント15選
人工知能ブームの時代、AIツールは私たちの生活を変え、学術研究や論文執筆を大いに助けてきた。ユーザーがより効率的に仕事や勉強ができるように、このまとめでは、最先端の無料のAI学術論文アシスタントを15個厳選して紹介する。









