AI半導体・ハードウェアの記事
「AI半導体・ハードウェア」に関連するAIニュースと解説を、出典付きで48本まとめています。
AI半導体・ハードウェア の記事:48件
業界09.24読了7分
NTTドコモビジネスが「1GPUから」のGPUクラウド「GPUaaS」を9月30日に開始──閉域網と国内クラウドで「AI処理からデータ保管まで国内完結」のソブリンAI。同じ日、NTTデータ系のフォーティエンスは消費財向け「AI駆動型需要予測FDEサービス」(19種の予測モデルをSKUごとに自動選択、現場がバイブコーディングで改善)
出典 ─ NTTドコモビジネス(2026年9月17日・9月18日取得)
業界09.24読了7分
NVIDIAが「商用規模で走る主要ロボタクシーはすべて自社スタックの上」と書いた──訓練(DGX+Alpamayo)・シミュレーション(Omniverse/Cosmos)・車載(Hyperion=Thor×2、カメラ14・レーダー9・ライダー3)の3台構成。日本はTIER IV・いすゞのレベル4バス、日産×Wayve×Uber。Uberは2028年に28都市
出典 ─ NVIDIA Blog(Ali Kani・2026年9月10日・9月18日取得)
プロダクト09.23読了25分
Meta Connect 2026基調講演まとめ──100gの「Meta VR glasses」、カメラ無しのRay-Ban Meta Audio、Ray-Ban Meta Gen 3、Muse Charm
出典 ─ Meta Connect 2026 基調講演
モデル09.22読了12分
Qwen4とは──9月22日の雲栖大会で「Qwen4 Series Coming Soon」として Qwen4-Max/Flash & Plus/27B の3枠が出た。公式プレスリリースは「訓練中」「4.5・5は5〜10兆パラメータ」まで。「人間ゼロ介入で33回の自己改善」の主張と、Artificial Analysisで実測した現行Maxの位置(45・首位53)
出典 ─ Alibaba Unveils Roadma
業界09.08読了11分
NVIDIAがオハイオ州の巨大データセンターを「自社AI計算資源の独占ホスト」に組み替え──OpenAIは8IT-GWの「顧客」という立場に
出典 ─ NVIDIA公式ニュースルーム
研究09.07読了14分
『コンテナランタイムは汎用ワークロード向けに作られた、AI推論は汎用ワークロードではない』──Basetenの専門チームを求人票から読む
出典 ─ Ashby求人ボードAPI「Baseten:
業界09.07読了15分
GoogleがMarvellに最大121.8億ドル相当のワラント発行──「TPU本体」ではなく周辺シリコンだった契約をSEC 8-Kで確認する
出典 ─ Marvell Technology, In
業界09.07読了14分
NVIDIAがApollo・BlackRock・KKRらと5,000億ドル超を動員する「コンピュート金融プラットフォーム」──GPUは投資適格資産になるのか
出典 ─ NVIDIA Newsroom
研究09.07読了16分
NCCLに頼らないallreduce──SGLangがBlackwell世代のFlashInfer MNNVLワークスペースを使い回す最適化
出典 ─ sgl-project/sglang v0.
研究09.07読了15分
SGLangが「allgather+scatter」を1回のall-to-allに統合──DeepSeek-V4-Proのデコード時間が320μsから169μsに
出典 ─ sgl-project/sglang v0.
検証09.07読了13分
手元のメモリを99.998%まで使い切る量子化ツール「shoehorn」──プリセットGGUFをやめる発想
出典 ─ make any language model fit your machine
研究09.06読了10分
『このAI処理はクラウドかブラウザか』をestimateQoS()で自動判定する──W3CのDAOP提案を読む
出典 ─ GitHub: webmachinelear
業界09.06読了10分
Intelが約230億ドルの公募増資──SEC 8-K原文で確定させる実額と、報道で揺れた数字
出典 ─ Intel Corporation Form
業界09.06読了10分
NVIDIAがOpenAIの家賃を最大1,050億ドル肩代わり──SEC 8-K原文で読む保証契約の中身
出典 ─ NVIDIA Corporation For
研究09.06読了15分
モデルの起動待ち時間を2.38倍短縮──SGLangが「CUDAグラフのキャプチャ中にチェックポイントを読み込む」設計に変えた
出典 ─ sgl-project/sglang v0.
研究09.06読了10分
vLLMのDecode Context Parallelで、Kimi-K3のKVキャッシュ容量がGPU1台あたり10倍に
出典 ─ vllm-project/vllm v0.2
研究09.06読了10分
vLLMに投機的デコードの新手法「DFlash2」──1H200・GSM8Kで自己回帰の3.51倍のスループット
出典 ─ vllm-project/vllm v0.2
研究09.05読了11分
LLMが書いたGPUカーネルの「正解率」は本当か──12ゲート検証器が2,638件を洗い直すと4割近くが壊れていた
出典 ─ A Contract-Grade Verifier for LLM-Generated GPU Kernels, and a Native Blackwell Backward for the Gated-Linear-Recurrence Family
プロダクト09.05読了12分
GPT-5.6 Solに「Ultrafast mode」──標準比最大14倍速い新サービス階層
出典 ─ OpenAI API 変更履歴(2026年8
プロダクト09.05読了11分
Mac Studio M5 Ultra、512GBモデルは10月下旬発送──「284BのDeepSeekが動く」は誰も実測していない
出典 ─ Apple introduces new M
業界09.05読了12分
AI投資の主役がGPUからメモリへ──TrendForceが示すDRAM価格「2026年に約270%上昇」の内訳
出典 ─ TrendForce Press Cente
プロダクト09.05読了11分
NVIDIA Groq 3 LPXが量産開始──Gemma 4を毎秒3,400トークンで動かす推論専用チップ
出典 ─ NVIDIA Newsroom
業界09.04読了12分
Hot Chips 2026で各社が見せた次世代AIシリコン──Intel・Google・富士通の中身を一次資料で追う
出典 ─ Intel Newsroom
プロダクト09.04読了12分
SpaceXAIがNVIDIA Vera CPUを採用──「Vera Rubin NVL72を宇宙に上げる」計画は今どの段階か
出典 ─ NVIDIA Newsroom
新しい記事をメールで受け取る
AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。