30BのAIモデルを単一GPUでローカル実行、NVIDIAが推論構成を示す
30B規模のAIエージェント向けモデル「Muse Glimmer」を、単一GPUでローカル実行する構成が示された。dense構成と量子化によって…
30B規模のAIエージェント向けモデル「Muse Glimmer」を、単一GPUでローカル実行する構成が示された。dense構成と量子化によって…
ロボットの動作だけでなく、その動作によってカメラの視界がどう変わるかも一つのAI方策で予測する。NVIDIAは動画の変化を学習した世界モデルCo…
GPUからストレージを直接読み書きするcuFileのAPIと下層ソフトウェア群について、NVIDIAがオープンソース化の方針を示した。必要なデー…
複数カメラの映像から判断理由と走行軌道を生成する自動運転向け基盤モデルAlpamayo 2 Superが、商用利用可能になった。NVIDIAはモ…
走行軌道の予測と判断理由の生成に、運転場面への回答や自動ラベル付けを加えた自動運転向けAIモデルが公開された。NVIDIAのAlpamayo 2…
英海軍の将来の機雷対処母船を巡る卓上演習で、ノルウェーの洋上支援船設計を採用・最適化するために必要な重要な変更が特定された。現実的な機雷対処シナ…
AIエージェントの実行環境を独立サービスへ分け、配備時と同じハーネス内で直接訓練できる共通基盤が公開された。隔離した実行領域をデータ収集、強化学…
AIエージェントによるHub通信を識別し、開発ツール別の構成比として追えるようになった。環境変数から付けた識別情報を基に、リクエスト比率と認証済…
LLMのAttentionでKVヘッドを共有するクエリーヘッド数を増やしても、入力処理時間はほぼ変わらない。NVIDIAの測定では共有数を1から…
動画中の指定フレームへ移動する際、直前のIDRフレームから復号を再開し、不要な中間フレームと後処理を省けるようになった。NVIDIA Video…
操作結果を内部状態から採点する12種類の合成環境で訓練した9Bモデルは、Microsoftの測定でスコアを36.5%から67.1%へ伸ばした。失…
推論中の成功と失敗をスキルや洞察として抽出し、後続タスクで使える知識へ更新するテスト時学習が開発された。EvoLibは正解ラベルやモデル更新を使…