AI時短ラボ

画像認識・コンピュータビジョンの記事

「画像認識・コンピュータビジョン」に関連するAIニュースと解説を、出典付きで9本まとめています。

解除

画像認識・コンピュータビジョン の記事:9

Qwen3.8-27Bが公開──1枚のGPUに収まる密モデルで動画も読める、ダウンロード330万回・likes 1.3万で中国勢8月最多の記事画像
モデル09.07読了14

Qwen3.8-27Bが公開──1枚のGPUに収まる密モデルで動画も読める、ダウンロード330万回・likes 1.3万で中国勢8月最多

出典 ─ Hugging Face
手話をテキストに変えるAI「SL2T」──Google DeepMindがPixel 11に載せた仕組みの記事画像
プロダクト09.06読了11

手話をテキストに変えるAI「SL2T」──Google DeepMindがPixel 11に載せた仕組み

出典 ─ Google DeepMind
Tencentが「画面を見て操作する」オープンウェイトAIエージェントを公開──OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢の記事画像
モデル09.06読了10

Tencentが「画面を見て操作する」オープンウェイトAIエージェントを公開──OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢

出典 ─ Hugging Face
AIが2000年前の炭化した巻物を読む──Vesuvius Challengeは何をどこまで解読したかの記事画像
研究09.06読了17

AIが2000年前の炭化した巻物を読む──Vesuvius Challengeは何をどこまで解読したか

出典 ─ Vesuvius Challenge 公式サ
「空間知能」とは何か──Fei-Fei Liが掲げるAIの次のフロンティアの記事画像
研究09.05読了11

「空間知能」とは何か──Fei-Fei Liが掲げるAIの次のフロンティア

出典 ─ Atlas: A World Model f
派手な発表の裏で静かに公開された中国勢3モデル──文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】の記事画像
モデル09.05読了12

派手な発表の裏で静かに公開された中国勢3モデル──文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】

出典 ─ Hugging Face API: Byte
動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続けるの記事画像
研究09.01読了22

動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続ける

出典 ─ Alaya-EVOKE: From Line
動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にするの記事画像
研究09.01読了16

動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にする

出典 ─ HarnessEval-W: Agentif
DeepSeekがAPIの画像入力に初対応──V4-Flash-Vision-Exp公開、1画像最大384トークンで料金はFlash据え置きの記事画像
モデル08.21読了12

DeepSeekがAPIの画像入力に初対応──V4-Flash-Vision-Exp公開、1画像最大384トークンで料金はFlash据え置き

出典 ─ DeepSeek API Docs: Cha

新しい記事をメールで受け取る

AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。