AI
マルチモーダルAIが100万トークンの履歴を保持、ツール操作を並列化
100万トークンの文脈管理と並列サブエージェントを組み合わせ、長時間の作業を外部ツールや画面操作へつなぐマルチモーダルAIが利用可能になった。M…
TOPIC
100万トークンの文脈管理と並列サブエージェントを組み合わせ、長時間の作業を外部ツールや画面操作へつなぐマルチモーダルAIが利用可能になった。M…
画像生成モデルが、プロンプトから一度で画像を出す処理から、検索、コード実行、自己修正を使って生成案を反復改善する処理へ広がった。追加の推論時計算…
言語モデルClaudeの内部で、出力されない概念や多段階推論を保持する小規模な表現群「J-space」が見つかった。読み出しと介入の実験は、この…
AI推論ソフトのTensorRT 11.0は、GPU間の集合通信を実行系に組み込み、複数GPUでの推論に対応した。モデルの重みを分ける方法に加え…
ローカルAIエージェント向けの推論基盤llama.cppが、先読み検証とGPU上の実行順序の改善で高速化した。NVIDIAによると、Qwenの2…
AI推論の処理をCPU、GPU、専用チップへ分けたシステムが、企業向けクラウド上で実動作した。入力を処理するprefillと出力を生成するdec…
Unreal Engine 5のAI画像加工で、TensorRT for RTXを推論ランタイムに選べるようになった。NVIDIAのRTX 50…
AIエージェントの実行側が知る要求の優先度や出力長を、推論基盤の判断に渡せるようになった。NVIDIAは推論基盤Dynamoにagent_hin…