AI時短ラボ

動画生成AIの記事

「動画生成AI」に関連するAIニュースと解説を、出典付きで29本まとめています。

解除

動画生成AI の記事:29

ByteDanceが「見ながら聞きながら話す」全二重AIを実運用投入──音声だけのGPT系リアルタイムAIとの違いはどこにあるかの記事画像
モデル09.07読了17

ByteDanceが「見ながら聞きながら話す」全二重AIを実運用投入──音声だけのGPT系リアルタイムAIとの違いはどこにあるか

出典 ─ ByteDance Seed公式ブログ
Grok Imagineの「エージェントモード」とは──1本の動画を単発プロンプトでなく「プロジェクト」として作るの記事画像
プロダクト09.07読了14

Grok Imagineの「エージェントモード」とは──1本の動画を単発プロンプトでなく「プロジェクト」として作る

出典 ─ xAI drops Grok 4.3 wit
Higgsfieldが評価額54億ドルでシリーズB調達──8カ月前の4倍、年換算売上7億ドル・Fortune 500の390社と取引と自社発表の記事画像
業界09.07読了13

Higgsfieldが評価額54億ドルでシリーズB調達──8カ月前の4倍、年換算売上7億ドル・Fortune 500の390社と取引と自社発表

出典 ─ TechCrunch
RedNoteのdots3-noteをllama.cppがサポート──280Bのマルチモーダル、動くのは16B、Apache 2.0の記事画像
モデル09.07読了11

RedNoteのdots3-noteをllama.cppがサポート──280Bのマルチモーダル、動くのは16B、Apache 2.0

出典 ─ ggml-org/llama.cpp v0.
PixVerse Growth Studioとは──製品URLから広告動画バッチを作る新機能の記事画像
プロダクト09.07読了15

PixVerse Growth Studioとは──製品URLから広告動画バッチを作る新機能

出典 ─ Introducing PixVerse G
Figma Weaveとは?画像・動画・音声をつなぐ新AIワークフローを確認したの記事画像
検証09.06読了11

Figma Weaveとは?画像・動画・音声をつなぐ新AIワークフローを確認した

出典 ─ Introducing Figma Weav
LightricksがLTX-2.5をオープンウェイト公開──HDR ACES対応の動画生成モデルとLTX Studioは別物の記事画像
モデル09.06読了11

LightricksがLTX-2.5をオープンウェイト公開──HDR ACES対応の動画生成モデルとLTX Studioは別物

出典 ─ LTX Blog
「AI動画の税金」にLumaが挑む──承認するまでレンダリングしない「Luma Scenes」の設計の記事画像
プロダクト09.06読了10

「AI動画の税金」にLumaが挑む──承認するまでレンダリングしない「Luma Scenes」の設計

出典 ─ Luma AI News
RunwayがGWM-1で目指す次──「動画生成」から「世界そのものをシミュレートする」への転換の記事画像
プロダクト09.06読了10

RunwayがGWM-1で目指す次──「動画生成」から「世界そのものをシミュレートする」への転換

出典 ─ Runway Research
diffusersの「Modular Diffusers」が実験段階を卒業──新モデルは既に旧来パイプラインを持たずModular専用で配布されるの記事画像
検証09.05読了11

diffusersの「Modular Diffusers」が実験段階を卒業──新モデルは既に旧来パイプラインを持たずModular専用で配布される

出典 ─ huggingface/diffusers
画像モデルFLUXが動画に本格参入──「FLUX 3 Video」と4Kアップスケーラーを公式ブログで確認するの記事画像
プロダクト09.05読了11

画像モデルFLUXが動画に本格参入──「FLUX 3 Video」と4Kアップスケーラーを公式ブログで確認する

出典 ─ Black Forest Labs Blog
grok-imagine-video-1.5がネイティブ1080p対応に──text-to-videoは内部で2段階処理という仕組みの記事画像
モデル09.05読了12

grok-imagine-video-1.5がネイティブ1080p対応に──text-to-videoは内部で2段階処理という仕組み

出典 ─ xAI公式ドキュメント
「RekaDaily-10k」とは何か──有償の一人称視点動画10,865時間、80TBがApache 2.0で公開中の記事画像
研究09.05読了12

「RekaDaily-10k」とは何か──有償の一人称視点動画10,865時間、80TBがApache 2.0で公開中

出典 ─ RekaDaily-10k-raw データセ
派手な発表の裏で静かに公開された中国勢3モデル──文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】の記事画像
モデル09.05読了12

派手な発表の裏で静かに公開された中国勢3モデル──文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】

出典 ─ Hugging Face API: Byte
動画のPikaが音声4モデルを一挙公開──「ElevenLabsの9倍安い」という自己申告の中身の記事画像
プロダクト09.04読了12

動画のPikaが音声4モデルを一挙公開──「ElevenLabsの9倍安い」という自己申告の中身

出典 ─ Pika Blog
Twitch配信がAI学習に使われる──Amazonをオプトアウト方式めぐり集団訴訟の記事画像
業界09.04読了13

Twitch配信がAI学習に使われる──Amazonをオプトアウト方式めぐり集団訴訟

出典 ─ Pandiscia v. Twitch In
ComfyUIの新アテンション実装「Comfy Kitchen」──int8量子化で計算する専用カーネル群が起動オプション1つで切り替わるの記事画像
検証09.03読了13

ComfyUIの新アテンション実装「Comfy Kitchen」──int8量子化で計算する専用カーネル群が起動オプション1つで切り替わる

出典 ─ comfyanonymous/ComfyUI
MiniMax-H3の動画生成、「先頭と末尾」だけだった制約をComfyUIが外した──任意フレームに画像・音声を固定できるAddGuideノードの記事画像
検証09.03読了13

MiniMax-H3の動画生成、「先頭と末尾」だけだった制約をComfyUIが外した──任意フレームに画像・音声を固定できるAddGuideノード

出典 ─ comfyanonymous/ComfyUI
動画を「会話しながら」直す──Gemini Omni Flashの対話型編集を料金・仕様から読み解くの記事画像
プロダクト09.03読了13

動画を「会話しながら」直す──Gemini Omni Flashの対話型編集を料金・仕様から読み解く

出典 ─ Gemini Omni Flash 公式ガイ
Videos APIとSora 2系、9月24日に全スナップショット停止──公式ページで確認、後継モデルの発表はまだ無いの記事画像
モデル09.03読了13

Videos APIとSora 2系、9月24日に全スナップショット停止──公式ページで確認、後継モデルの発表はまだ無い

出典 ─ OpenAI Developers
AIキャラクターとビデオ通話ができる時代へ──Vidu S1は何が新しいのかの記事画像
モデル09.02読了15

AIキャラクターとビデオ通話ができる時代へ──Vidu S1は何が新しいのか

出典 ─ ShengShu Technology Un
動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続けるの記事画像
研究09.01読了22

動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続ける

出典 ─ Alaya-EVOKE: From Line
動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にするの記事画像
研究09.01読了16

動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にする

出典 ─ HarnessEval-W: Agentif
MiniMax H3が「非公開」にした変換層を、有志が3つ独立に作っていた──H3-Context-IRを覗くの記事画像
検証09.01読了19

MiniMax H3が「非公開」にした変換層を、有志が3つ独立に作っていた──H3-Context-IRを覗く

出典 ─ MiniMax API Docs: Crea

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。