AI時短ラボ

AI半導体・ハードウェアの記事

「AI半導体・ハードウェア」に関連するAIニュースと解説を、出典付きで48本まとめています。

解除

AI半導体・ハードウェア の記事:48

NTTドコモビジネスが「1GPUから」のGPUクラウド「GPUaaS」を9月30日に開始──閉域網と国内クラウドで「AI処理からデータ保管まで国内完結」のソブリンAI。同じ日、NTTデータ系のフォーティエンスは消費財向け「AI駆動型需要予測FDEサービス」(19種の予測モデルをSKUごとに自動選択、現場がバイブコーディングで改善)の記事画像
業界09.24読了7

NTTドコモビジネスが「1GPUから」のGPUクラウド「GPUaaS」を9月30日に開始──閉域網と国内クラウドで「AI処理からデータ保管まで国内完結」のソブリンAI。同じ日、NTTデータ系のフォーティエンスは消費財向け「AI駆動型需要予測FDEサービス」(19種の予測モデルをSKUごとに自動選択、現場がバイブコーディングで改善)

出典 ─ NTTドコモビジネス(2026年9月17日・9月18日取得)
NVIDIAが「商用規模で走る主要ロボタクシーはすべて自社スタックの上」と書いた──訓練(DGX+Alpamayo)・シミュレーション(Omniverse/Cosmos)・車載(Hyperion=Thor×2、カメラ14・レーダー9・ライダー3)の3台構成。日本はTIER IV・いすゞのレベル4バス、日産×Wayve×Uber。Uberは2028年に28都市の記事画像
業界09.24読了7

NVIDIAが「商用規模で走る主要ロボタクシーはすべて自社スタックの上」と書いた──訓練(DGX+Alpamayo)・シミュレーション(Omniverse/Cosmos)・車載(Hyperion=Thor×2、カメラ14・レーダー9・ライダー3)の3台構成。日本はTIER IV・いすゞのレベル4バス、日産×Wayve×Uber。Uberは2028年に28都市

出典 ─ NVIDIA Blog(Ali Kani・2026年9月10日・9月18日取得)
Meta Connect 2026基調講演まとめ──100gの「Meta VR glasses」、カメラ無しのRay-Ban Meta Audio、Ray-Ban Meta Gen 3、Muse Charmの記事画像
プロダクト09.23読了25

Meta Connect 2026基調講演まとめ──100gの「Meta VR glasses」、カメラ無しのRay-Ban Meta Audio、Ray-Ban Meta Gen 3、Muse Charm

出典 ─ Meta Connect 2026 基調講演
Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)の記事画像
モデル09.22読了12

Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)

出典 ─ Alibaba Unveils Roadma
NVIDIAがオハイオ州の巨大データセンターを「自社AI計算資源の独占ホスト」に組み替え──OpenAIは8IT-GWの「顧客」という立場にの記事画像
業界09.08読了11

NVIDIAがオハイオ州の巨大データセンターを「自社AI計算資源の独占ホスト」に組み替え──OpenAIは8IT-GWの「顧客」という立場に

出典 ─ NVIDIA公式ニュースルーム
『コンテナランタイムは汎用ワークロード向けに作られた、AI推論は汎用ワークロードではない』──Basetenの専門チームを求人票から読むの記事画像
研究09.07読了14

『コンテナランタイムは汎用ワークロード向けに作られた、AI推論は汎用ワークロードではない』──Basetenの専門チームを求人票から読む

出典 ─ Ashby求人ボードAPI「Baseten:
GoogleがMarvellに最大121.8億ドル相当のワラント発行──「TPU本体」ではなく周辺シリコンだった契約をSEC 8-Kで確認するの記事画像
業界09.07読了15

GoogleがMarvellに最大121.8億ドル相当のワラント発行──「TPU本体」ではなく周辺シリコンだった契約をSEC 8-Kで確認する

出典 ─ Marvell Technology, In
NVIDIAがApollo・BlackRock・KKRらと5,000億ドル超を動員する「コンピュート金融プラットフォーム」──GPUは投資適格資産になるのかの記事画像
業界09.07読了14

NVIDIAがApollo・BlackRock・KKRらと5,000億ドル超を動員する「コンピュート金融プラットフォーム」──GPUは投資適格資産になるのか

出典 ─ NVIDIA Newsroom
NCCLに頼らないallreduce──SGLangがBlackwell世代のFlashInfer MNNVLワークスペースを使い回す最適化の記事画像
研究09.07読了16

NCCLに頼らないallreduce──SGLangがBlackwell世代のFlashInfer MNNVLワークスペースを使い回す最適化

出典 ─ sgl-project/sglang v0.
SGLangが「allgather+scatter」を1回のall-to-allに統合──DeepSeek-V4-Proのデコード時間が320μsから169μsにの記事画像
研究09.07読了15

SGLangが「allgather+scatter」を1回のall-to-allに統合──DeepSeek-V4-Proのデコード時間が320μsから169μsに

出典 ─ sgl-project/sglang v0.
手元のメモリを99.998%まで使い切る量子化ツール「shoehorn」──プリセットGGUFをやめる発想の記事画像
検証09.07読了13

手元のメモリを99.998%まで使い切る量子化ツール「shoehorn」──プリセットGGUFをやめる発想

出典 ─ make any language model fit your machine
『このAI処理はクラウドかブラウザか』をestimateQoS()で自動判定する──W3CのDAOP提案を読むの記事画像
研究09.06読了10

『このAI処理はクラウドかブラウザか』をestimateQoS()で自動判定する──W3CのDAOP提案を読む

出典 ─ GitHub: webmachinelear
Intelが約230億ドルの公募増資──SEC 8-K原文で確定させる実額と、報道で揺れた数字の記事画像
業界09.06読了10

Intelが約230億ドルの公募増資──SEC 8-K原文で確定させる実額と、報道で揺れた数字

出典 ─ Intel Corporation Form
NVIDIAがOpenAIの家賃を最大1,050億ドル肩代わり──SEC 8-K原文で読む保証契約の中身の記事画像
業界09.06読了10

NVIDIAがOpenAIの家賃を最大1,050億ドル肩代わり──SEC 8-K原文で読む保証契約の中身

出典 ─ NVIDIA Corporation For
モデルの起動待ち時間を2.38倍短縮──SGLangが「CUDAグラフのキャプチャ中にチェックポイントを読み込む」設計に変えたの記事画像
研究09.06読了15

モデルの起動待ち時間を2.38倍短縮──SGLangが「CUDAグラフのキャプチャ中にチェックポイントを読み込む」設計に変えた

出典 ─ sgl-project/sglang v0.
vLLMのDecode Context Parallelで、Kimi-K3のKVキャッシュ容量がGPU1台あたり10倍にの記事画像
研究09.06読了10

vLLMのDecode Context Parallelで、Kimi-K3のKVキャッシュ容量がGPU1台あたり10倍に

出典 ─ vllm-project/vllm v0.2
vLLMに投機的デコードの新手法「DFlash2」──1H200・GSM8Kで自己回帰の3.51倍のスループットの記事画像
研究09.06読了10

vLLMに投機的デコードの新手法「DFlash2」──1H200・GSM8Kで自己回帰の3.51倍のスループット

出典 ─ vllm-project/vllm v0.2
LLMが書いたGPUカーネルの「正解率」は本当か──12ゲート検証器が2,638件を洗い直すと4割近くが壊れていたの記事画像
研究09.05読了11

LLMが書いたGPUカーネルの「正解率」は本当か──12ゲート検証器が2,638件を洗い直すと4割近くが壊れていた

出典 ─ A Contract-Grade Verifier for LLM-Generated GPU Kernels, and a Native Blackwell Backward for the Gated-Linear-Recurrence Family
GPT-5.6 Solに「Ultrafast mode」──標準比最大14倍速い新サービス階層の記事画像
プロダクト09.05読了12

GPT-5.6 Solに「Ultrafast mode」──標準比最大14倍速い新サービス階層

出典 ─ OpenAI API 変更履歴(2026年8
Mac Studio M5 Ultra、512GBモデルは10月下旬発送──「284BのDeepSeekが動く」は誰も実測していないの記事画像
プロダクト09.05読了11

Mac Studio M5 Ultra、512GBモデルは10月下旬発送──「284BのDeepSeekが動く」は誰も実測していない

出典 ─ Apple introduces new M
AI投資の主役がGPUからメモリへ──TrendForceが示すDRAM価格「2026年に約270%上昇」の内訳の記事画像
業界09.05読了12

AI投資の主役がGPUからメモリへ──TrendForceが示すDRAM価格「2026年に約270%上昇」の内訳

出典 ─ TrendForce Press Cente
NVIDIA Groq 3 LPXが量産開始──Gemma 4を毎秒3,400トークンで動かす推論専用チップの記事画像
プロダクト09.05読了11

NVIDIA Groq 3 LPXが量産開始──Gemma 4を毎秒3,400トークンで動かす推論専用チップ

出典 ─ NVIDIA Newsroom
Hot Chips 2026で各社が見せた次世代AIシリコン──Intel・Google・富士通の中身を一次資料で追うの記事画像
業界09.04読了12

Hot Chips 2026で各社が見せた次世代AIシリコン──Intel・Google・富士通の中身を一次資料で追う

出典 ─ Intel Newsroom
SpaceXAIがNVIDIA Vera CPUを採用──「Vera Rubin NVL72を宇宙に上げる」計画は今どの段階かの記事画像
プロダクト09.04読了12

SpaceXAIがNVIDIA Vera CPUを採用──「Vera Rubin NVL72を宇宙に上げる」計画は今どの段階か

出典 ─ NVIDIA Newsroom

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。