CONSONANCE.for your information
lundi 5 octobre 2026frenvi

À lire de près

01 — training 3 votes

ZooWork-ShopRanker: An Open, Preference-Aligned E-Commerce Reranker

QUESTION — Comment aligner et entraîner efficacement des rerankers pour le commerce électronique lorsque le trafic de recherche réel manque de labels de préférence par paires propres ?

Ce travail présente ZooWork-ShopRanker, une famille de rerankers pour le commerce électronique en tailles 0.6B, 4B et 8B, conçus pour gérer les décisions de classement guidées par les contraintes des produits et les préférences des utilisateurs. Comme le trafic de recherche réel manque de labels par paires propres, les auteurs utilisent un panel de grands modèles de langage comme oracle de préférences avec des jugements corrigés du biais de position. Le modèle amiral de 8B sert ensuite de professeur de distillation pour les variantes 4B et 0.6B. Pour mesurer les progrès, ils publient ShopRank-Bench, un benchmark à contamination limitée contenant environ 10 000 paires de préférences.

La famille ZooWork-ShopRanker comprend des modèles de 0.6B, 4B et 8B alignés à l'aide de préférences d'achat étiquetées par des juges.

Le modèle amiral de 8B sert de professeur de distillation pour les modèles efficaces de 4B et 0.6B.

ShopRank-Bench est introduit comme un benchmark à contamination limitée composé de ~10 000 paires de préférences issues du trafic privé.

Geralt-Targaryen · 25 sept. 2026 lire l'original ↗
↑