AI ResearchNotes.法人向けのご案内 ↗
← 検索結果に戻る

推薦モデルの改良部品を蓄積して再利用するEvoSkillRec

EvoSkillRec

保存した記事を見る
原論文の図

EvoSkillRecの原論文から掲載した図です。細部はクリックして拡大できます。

原論文の図の説明を読む

Figure 1 : Overview of EvoSkillRec . (Left) A model-to-skill compiler decomposes established recommender architectures into atomic, executable skills, each documented by a skill card with code and admitted to the curated Tier-1 library only after passing validation. (Right) A model is represented as a typed skill genome. Under an adaptive budget, dual-space evolution proposes candidate models via type-checked recombination of library skills (skill space) or LLM-based planning and synthesis of new modules (code space). The AutoResearch loop evaluates and diagnoses candidates, selects survivors, and promotes validated inventions into the Tier-2 library, making them available to skill-space search in later generations.

出典:EvoSkillRec / arXiv ↗

概要

  • 推薦モデルを、入出力の型と実装を持つ再利用可能な部品に分解する。
  • 既存部品の組み替えと、言語モデルによる新部品の提案を併用する。
  • 著者らは推薦の複数課題で有効性を報告し、品質と計算効率を同時に扱う評価も行った。
補足:編集した模式図で仕組みを確認する

VISUAL EXPLAINER

図でつかむ、EvoSkillRecの仕組み

左から右へ読む
  1. 01既存の推薦モデル
  2. 02部品を検証・登録
  3. 03候補構造を提案
  4. 04訓練して評価
  5. 05改良部品を保存

原論文の説明をもとにした模式図です。処理の細部は省略しています。

研究の背景

推薦モデルは、利用者の過去の行動や商品の特徴から、次に関心を持つ対象を予測する。性能はデータ量だけでなく、特徴を組み合わせる方法や、複数の目的へ情報を分ける構造にも左右される。新しい課題に合わせて構造を人手で調整するには試行錯誤が要る。

自動探索や言語モデルによるコード変更も使えるが、役立った工夫を後の課題で再利用しにくい。EvoSkillRecは、改良の成果を部品として残すことに注目した。

手法

まず既存モデルを、単独で実行できる小さなスキルに分ける。各スキルには必要な入力、作る出力、用途、実装、検証結果を記す。スキルをつないだ図が候補モデルの設計図になる。たとえば「商品と利用者の特徴を組み合わせる部品」を別の互換部品に置き換える際、入出力の型が合うかを先に確かめる。

探索には二つの経路がある。一つは保存済みスキルの追加、交換、組み合わせ。もう一つは言語モデルが新しい部品の設計とコードを提案する経路だ。管理機構が候補を実行・訓練・評価し、失敗理由を次の提案に使う。新しい部品は動作検証とモデル内での性能評価を通った場合に保存され、後の候補でも使える。

新規性

EvoSkillRecは、推薦モデルの構成要素を入出力の型を持つ実行可能な「スキル」として保存し、探索で得た新しい部品も検証後にライブラリへ戻す。既存部品の組み替えと、言語モデルによる新部品の発明をつなぎ、成功した設計を次の探索で再利用する仕組みが特徴だ。

従来手法との違い

従来の自動設計は、人があらかじめ決めた演算子や接続の範囲を探す。言語モデルによる自由なコード変更は新しい部品を提案できるが、無効な変更が混じり、成功した変更が一回の実験に閉じやすいと著者らは述べる。

EvoSkillRecは、型を確認した既存スキルの組み替えと、新しいコードの提案を併用する。提案が動作検証と性能評価を通ると、再利用できるスキルとして保存する。論文は手設計と自動設計の基準モデルを比較対象としている。

実験結果

著者らは、クリック率予測、複数目的の学習、複数領域の学習で実験し、手設計および自動設計の基準モデルに対する有効性を報告する。生成型の順位付けモデルでは、予測品質とモデルの計算効率を同時に扱う制約付き評価も行った。

本文にある一つの採用条件は、訓練時のモデルFLOPs利用率を元モデルの95%以上に保ち、検証データのAUCを現行最良から0.001以内に保つことだ。AUCは順位付けの良さを表す指標である。確認できた本文の範囲では、各データセットの点数や改善幅を一覧では確認できない。

応用の可能性

編集上の応用案 · 論文が実証した用途とは区別しています。

編集上の応用案:動画サービスの推薦順位モデルを、クリック予測の指標を保ちながら改良する。入力は既存モデルの構成、利用できる特徴量、過去の評価結果、計算量などの制約。出力は新しい候補モデルと、採用した部品の記録である。

候補を一度だけ試して終えず、検証に通った部品と適用条件を残す。別の推薦課題ではその記録から合う部品を選び直す。実際の利用者への効果は論文の仕組みからは保証されないため、まず過去データで比較する。

導入時の検証

導入時の検証案 · 対象データでの再評価が必要です。

導入時の検証案:一つの推薦課題と既存モデルを選び、入力と出力を明確に切り出せる部品だけをスキル化する。元モデルを部品から組み直して同じ出力になるか確認し、そのモデルを基準に候補の検証データAUCと計算費用を比べる。

次に、保存済み部品の組み替えと新部品の提案を少数ずつ試す。無効な候補の割合、改善した候補の割合、再利用した部品が別の課題でも役立つかを記録する。性能だけでなく、探索に要した訓練回数も判断材料にする。

限界と課題

著者らは、自由なコード提案には無効または効果の乏しい変更が生じると説明する。そのため、入出力や勾配の検証を行っても、性能の改善は訓練と評価で別途確かめる必要がある。保存された部品の有効性も、それを試した課題と条件に依存する。

編集上の確認事項は、自社モデルを独立した部品へ分解できるか、異なるデータや推薦目的で部品の効果が再現するか、探索に必要な訓練費用が許容範囲かである。確認できた本文の範囲では、全実験の具体的な改善幅は確認できない。

応用先の候補
研究内容と応用案に基づく分類です。業界での導入実績を示すものではありません。

出典

元のタイトル・要旨を確認する(英語)

EvoSkillRec: Skill-Genome Evolution for Recommender Architecture Discovery

Modern recommender systems advance not only by scaling data and parameters, but also by encoding task-specific inductive biases through architecture, including sparse feature interactions for click-through rate (CTR) prediction, temporal attention for sequential recommendation, and expert routing for multi-task learning. However, these biases are typically human expert designed or searched within predefined operator spaces. Although Recent LLM-driven code evolution expands this space, unconstrained edits often produce invalid or ineffective architectures, underuse established architecture design knowledge, and fail to preserve successful innovations for reuse. We introduce EvoSkillRec, a promotion-and-reuse framework for cumulative recommender architecture evolution. It first decomposes recommenders into atomic executable skills and represents architectures as typed skill genomes, with each skill equipped with input--output types, semantic annotations, and implementation code. We then evolve models with different tasks through two coupled spaces: a constrained skill--space that mutates, recombines, specializes, and reuses validated skills, and an open-ended code--space in which LLM planners and synthesizers invent new skill modules using prior evolution traces and accumulated experience. An autoresearch controller evaluates candidates, diagnoses failures, retrieves relevant skills, promotes validated innovations into the skill library, and adaptively allocates the proposal budget between the two spaces. Extensive experiments on CTR prediction, multi-task learning, and multi-domain learning, including resource-constrained co-optimization of predictive quality and model FLOPs utilization in generative ranking models, consistently demonstrate the effectiveness of our proposed EvoSkillRec.

論文本体の取得範囲に基づく解説。AIが作成した未校閲の記事です。性能の数値は著者の評価条件に依存します。応用例と検証計画は編集上の提案です。解説更新:2026-09-29