← Библиотека

Интеллект и управление

Rubi Hudson

Joint Scoring Rules: Competition Between Agents Avoids Performative Prediction

2025

Совместные правила оценки рассматривают конкуренцию агентов как способ изменить стимулы прогноза.

В книгеДелегирование, цели и самостоятельность решений

Выборочное чтение

Разобраны выбранные контексты; сплошное чтение источника не заявлено.

3 карточки

Тезисы пересказывают выбранные места источников; применение — мысль редакции. Объём чтения указан у каждого источника. Цитаты приведены только там, где сверены с текстом.

Показано 3 из 3

  1. 01

    Точность прогноза может вознаграждать менее желательное действие

    В примере эксперт повышает ожидаемый балл, занижая прогноз предпочтительного действия: принципал выбирает менее желательный, но более предсказуемый исход.

    Для книги

    Помощник способен облегчить собственное предсказание через влияние на выбор того, кому помогает.

    Контекст и границы
    • Это формальный пример, а не эмпирическое утверждение обо всех персональных помощниках.
    • Пример восходит к Othman–Sandholm; вклад Hudson — способ преодолеть ограничение.
    Место в источнике

    Печатные страницы 27341; Theoretical Results: пример двух действий и log scoring, обсуждение результата Othman–Sandholm.; Печатные страницы: 27341

    Ссылка на мысль
  2. 02

    Специальная конкуренция устраняет выгоду от изменения выбора

    При совместной оценке с нулевой суммой и подходящем правиле выбора равновесия ведут к предпочтительному действию принципала; эффект сдвига распределения компенсируется баллами соперников.

    Для книги

    Конкуренцию помощников нужно проектировать через вознаграждение и выбор, а не просто увеличивать число моделей.

    Контекст и границы
    • Обычное соперничество за прибыль не равно специальной игре с нулевой суммой; пример Fish не опровергается.
    Место в источнике

    Печатные страницы 27341, 27342; Theorem 2 и объяснение LSS scoring + ISA-max.; Печатные страницы: 27341–27342

    Ссылка на мысль
  3. 03

    Эксперимент проверяет ответ, но оставляет проблему разной информации

    В игрушечной среде обучение с LSS повышало общую точность и полезность принципала; варианты также уменьшали ранее выученное манипулирующее поведение.

    Для книги

    После демонстрации работающей защиты исследовать независимых агентов с разным знанием и более сложную среду.

    Контекст и границы
    • Среда содержит восемь действий, восемь исходов и синтетический генератор; перенос на реальные данные не показан.
    • Ослабление предпосылки одинаковой информации прямо оставлено направлением дальнейшей работы.
    Место в источнике

    Печатные страницы 27344, 27345; Experiments, Figures 1–2; Discussion and Future Direction.; Печатные страницы: 27344–27345

    Ссылка на мысль
← Вернуться к источникам