画像認識・コンピュータビジョンの記事
「画像認識・コンピュータビジョン」に関連するAIニュースと解説を、出典付きで9本まとめています。
画像認識・コンピュータビジョン の記事:9件
モデル09.07読了14分
Qwen3.8-27Bが公開──1枚のGPUに収まる密モデルで動画も読める、ダウンロード330万回・likes 1.3万で中国勢8月最多
出典 ─ Hugging Face
プロダクト09.06読了11分
手話をテキストに変えるAI「SL2T」──Google DeepMindがPixel 11に載せた仕組み
出典 ─ Google DeepMind
モデル09.06読了10分
Tencentが「画面を見て操作する」オープンウェイトAIエージェントを公開──OSWorld-Verifiedで77.0点、手元で動かせるcomputer useの選択肢
出典 ─ Hugging Face
研究09.06読了17分
AIが2000年前の炭化した巻物を読む──Vesuvius Challengeは何をどこまで解読したか
出典 ─ Vesuvius Challenge 公式サ
研究09.05読了11分
「空間知能」とは何か──Fei-Fei Liが掲げるAIの次のフロンティア
出典 ─ Atlas: A World Model f
モデル09.05読了12分
派手な発表の裏で静かに公開された中国勢3モデル──文書検索・マルチモーダル埋め込み・動画編集パイプライン【2026年8月】
出典 ─ Hugging Face API: Byte
研究09.01読了22分
動画生成AIの『記憶』をKVキャッシュの外に出す──Alaya-EVOKEはH200で1.5秒分の映像を2.11秒で作り続ける
出典 ─ Alaya-EVOKE: From Line
研究09.01読了16分
動画生成AIの採点に「なぜそのスコアか」を残す──HarnessEval-Wはサブエージェントを分業させて評価の根拠を証拠の木にする
出典 ─ HarnessEval-W: Agentif
モデル08.21読了12分
DeepSeekがAPIの画像入力に初対応──V4-Flash-Vision-Exp公開、1画像最大384トークンで料金はFlash据え置き
出典 ─ DeepSeek API Docs: Cha
新しい記事をメールで受け取る
AIの新しい発表を、公式資料にあたって数字を確認したうえで届けます。盛らない・出典を明記する・確認できていないことは書かない、を守ります。