GoogleのAIが記憶を忘れず整理
Google Cloud’s Always-On Memory Agent Replaces RAG and Embeddings With Continuous LLM Consolidation on Gemini 3.1 Flash-Lite

Google Cloudが、情報を忘れず常に記憶し続けるAIエージェントを発表。これによりAIは過去の会話や情報を活用し、より賢く応答できるようになります。
ほとんどのAIエージェントは忘れてしまいます。リクエストを処理し、回答したら、その文脈を失います。Google Cloudのgenerative-aiリポジトリは、この問題に直接取り組むサンプルを公開しました。それがAlways-On Memory Agentです。これは、メモリを実行中のプロセスとして扱うリファレンス実装です。 常に記憶するAIエージェントは、基本的に停止することのない軽量なバックグラウンドエージェントです。一度きりの呼び出しではなく、24時間365日、連続プロセスとして実行されます。Google ADK (Agent Development Kit) と Gemini 3.1 Flash-Lite を使用して構築されています。特筆すべきは、vector databaseもembeddingsも使用しない点です。代わりに、LLMが構造化されたメモリを読み込み、考え、SQLiteに書き込みます。このモデル選択は、連続的なバックグラウンド作業のために低レイテンシと低コストを目指しています。 動作原理:取り込み、統合、クエリ アーキテクチャ的には、オーケストレーターがすべてのリクエストを3つの専門サブエージェントのいずれかにルーティングします。各サブエージェントは、メモリストアの読み書きのための独自のツールを持っています。 まず、IngestAgentが受信コンテンツを処理します。Geminiのマルチモーダル機能を使用して、要約、エンティティ、トピック、重要度スコアを抽出します。その構造化された記録は、memoriesテーブルに保存されます。 次に、ConsolidateAgentがタイマーで実行され、デフォルトでは30分ごとに動作します。睡眠サイクルと同様に、未統合のメモリをレビューし、それらの間のつながりを見つけます。そして、統合された要約、1つの主要な洞察、およびそれらのつながりをデータベースに書き込みます。結果として、エージェントはプロンプトなしで、アイドル中に新しい理解を構築します。 最後に、QueryAgentが質問に答えます。すべてのメモリと統合された洞察を読み込み、応答を合成します。重要なのは、情報源として使用したメモリIDを引用することです。
この記事について質問
記事の内容に答えます。記事外のことは都度ウェブで調べます。