/** * WPML compatibility functions * * @global array $duplicated_posts Array to store the posts being duplicated. * * @package Yoast\WP\Duplicate_Post * @since 3.2 */ add_action( 'admin_init', 'duplicate_post_wpml_init' ); /** * Add handlers for WPML compatibility. */ function duplicate_post_wpml_init() { if ( defined( 'ICL_SITEPRESS_VERSION' ) ) { add_action( 'dp_duplicate_page', 'duplicate_post_wpml_copy_translations', 10, 3 ); add_action( 'dp_duplicate_post', 'duplicate_post_wpml_copy_translations', 10, 3 ); add_action( 'shutdown', 'duplicate_wpml_string_packages', 11 ); } } global $duplicated_posts; // phpcs:ignore WordPress.NamingConventions.PrefixAllGlobals -- Reason: Renaming a global variable is a BC break. $duplicated_posts = []; /** * Copy post translations. * * @global SitePress $sitepress Instance of the Main WPML class. * @global array $duplicated_posts Array of duplicated posts. * * @param int $post_id ID of the copy. * @param WP_Post $post Original post object. * @param string $status Status of the new post. */ function duplicate_post_wpml_copy_translations( $post_id, $post, $status = '' ) { global $sitepress; global $duplicated_posts; remove_action( 'dp_duplicate_page', 'duplicate_post_wpml_copy_translations', 10 ); remove_action( 'dp_duplicate_post', 'duplicate_post_wpml_copy_translations', 10 ); $current_language = $sitepress->get_current_language(); $trid = $sitepress->get_element_trid( $post->ID ); if ( ! empty( $trid ) ) { $translations = $sitepress->get_element_translations( $trid ); $new_trid = $sitepress->get_element_trid( $post_id ); foreach ( $translations as $code => $details ) { if ( $code !== $current_language ) { if ( $details->element_id ) { $translation = get_post( $details->element_id ); if ( ! $translation ) { continue; } $new_post_id = duplicate_post_create_duplicate( $translation, $status ); if ( ! is_wp_error( $new_post_id ) ) { $sitepress->set_element_language_details( $new_post_id, 'post_' . $translation->post_type, $new_trid, $code, $current_language ); } } } } // phpcs:ignore WordPress.NamingConventions.PrefixAllGlobals -- Reason: see above. $duplicated_posts[ $post->ID ] = $post_id; } } /** * Duplicate string packages. * * @global array() $duplicated_posts Array of duplicated posts. */ function duplicate_wpml_string_packages() { // phpcs:ignore WordPress.NamingConventions.PrefixAllGlobals -- Reason: renaming the function would be a BC-break. global $duplicated_posts; foreach ( $duplicated_posts as $original_post_id => $duplicate_post_id ) { // phpcs:ignore WordPress.NamingConventions.PrefixAllGlobals -- Reason: using WPML native filter. $original_string_packages = apply_filters( 'wpml_st_get_post_string_packages', false, $original_post_id ); // phpcs:ignore WordPress.NamingConventions.PrefixAllGlobals -- Reason: using WPML native filter. $new_string_packages = apply_filters( 'wpml_st_get_post_string_packages', false, $duplicate_post_id ); if ( is_array( $original_string_packages ) ) { foreach ( $original_string_packages as $original_string_package ) { $translated_original_strings = $original_string_package->get_translated_strings( [] ); foreach ( $new_string_packages as $new_string_package ) { $cache = new WPML_WP_Cache( 'WPML_Package' ); $cache->flush_group_cache(); $new_strings = $new_string_package->get_package_strings(); foreach ( $new_strings as $new_string ) { if ( isset( $translated_original_strings[ $new_string->name ] ) ) { foreach ( $translated_original_strings[ $new_string->name ] as $language => $translated_string ) { do_action( // phpcs:ignore WordPress.NamingConventions.PrefixAllGlobals -- Reason: using WPML native filter. 'wpml_add_string_translation', $new_string->id, $language, $translated_string['value'], $translated_string['status'] ); } } } } } } } } 「学習したことを次のコメントに使う」ために必要な部品(最小) – Raqqa

「学習したことを次のコメントに使う」ために必要な部品(最小)

やることはシンプルに 2 つです。

1) Retrieval(Chroma検索)をどこかで実行する

「次のターン」や「次の改善提案」を生成する直前に、

  • query = 今回の質問 + SQL(base/revised) + 直近の状況(target kind など)
  • collection = nlq_sessions_{lang}(もしくは comment専用collection)
  • filter = 同じ session_id(これが“同一人物/同一会話”の代替になる)

で Chroma から top_k 件取る。

※ あなたの package は meta.session_id が入ってるので、where フィルタで session_id 絞り込みできます。


2) LLMプロンプトに「過去の学習(retrieved docs)」を混ぜる

LLMに渡す入力に、例えばこういうブロックを追加します:

  • “Past feedback / learned diffs (retrieved from memory)”
    • 取得した YAML diff(comment_diff の doc_text)をそのまま数件貼る
    • 量は少なく(例: 3〜5件)、長いものは切る

そしてプロンプトでルール化:

  • 「過去の指摘に従う(同じミスを繰り返さない)」
  • 「過去と矛盾する提案を出すなら理由を明記」

“同じnatural_key” を使うか? “session_id” を使うか?

あなたの目的(「一人の人に対していろんな条件を覚える」)に近いのは、正直 natural_key一致より session_id 絞り込みです。

  • natural_key は今の実装だと
    • execute: sid#turn(ターン単位)
    • comment: nlq::<sid>::<turn>::cmt::<idx>(指摘idx単位)
      なので “人物単位メモリ”にはなってないです。

人物単位っぽくしたいならまずは:

  • where={session_id: sid} で検索
  • さらに meta.variant(comment/execute)で分ける

が一番早いです。


実装的に「まだ何もできてない」ポイント(どこに入れる?)

あなたの提示コードだと、生成の中心は services/nlq_execute.pyRouteExecutor の中です。

なので “次のコメント(改善案)をLLMが考える” を入れるなら、候補は2つ:

  1. SQL生成/分析生成の直前(RouteExecutor内部 or sql生成サービス内部)
    • → ここに retrieval を入れて、LLMの入力に混ぜる
  2. UI側で「コメント案を生成」するAPIを別に作る
    • 例:POST /nlq/comment/suggest
    • 入力:session_id, turn_no, base_sql, revised_sql, user_comment(optional)
    • 中で retrieval → LLM → suggestion を返す
    • これだと責務が分かれてデバッグしやすい

先に直すべき1点:upsertの“上書き”が成立してから

あなたも言ってた通り、/chroma/upsert 側の add→upsert を揃えるのは重要です。

  • 「同じ学習対象を更新」したいなら、Chromaでは基本 upsert 前提
  • さらに、doc_id(Chroma ids)が 同じ対象で固定になってないと「更新」になりません

(ここが揃ってないと、学習が“増えるだけ”になって retrieval がノイズ化します)


必要なら次に、あなたの現行構成(collection設計も含めて)に合わせて、

  • どのタイミングで retrieval を呼ぶか(RouteExecutorのどこか / 新APIか)
  • where フィルタのキー設計(session_id / user_id導入するならどうするか)
  • retrieval結果をプロンプトにどう詰めるか(YAML diff をそのまま?要約してメタ化?)

を、最短で動く形に落として具体案(ファイル単位)まで出します。


Comments

コメントを残す

メールアドレスが公開されることはありません。 が付いている欄は必須項目です