Материал подготовлен автоматически по первоисточникам: ссылки на них — в конце статьи.
Guangjun Liu из New York University предложил Civilization Framework для связи личных мультиагентных систем; работа опубликована как препринт, не проходивший рецензирования. В эксперименте авторов без проверки ложное утверждение, пришедшее первым, определяло 54,2% ответов против 4,2% при доступной проверке. Подход важен командам, которые проектируют постоянную память, разграничение полномочий и обмен данными между агентами разных пользователей.
Что сделали
Авторы предлагают считать стороной обмена не запущенного агента, а «цивилизацию»: одного человека, постоянный журнал событий и набор сменяемых агентов. Embassy Protocol доставляет сообщения асинхронно в журнал получателя; обработать их может любой доступный агент. Фактом завершённого обмена считается не доставка сообщения, а согласованное состояние обязательства, записанное в журналах обеих сторон.
Полномочия агента ограничиваются памятью, к которой он имеет доступ. Наружу этот предел передаётся через криптографически подписанные удостоверения полномочий, тогда как репутация относится ко всей «цивилизации», а не к конкретному агенту.
Отдельно авторы проверили эффект временного веса: получает ли первое сообщение необоснованное преимущество. В опыте на одной модели передового класса использовали 53 вопроса и меняли порядок поступления ложного утверждения, возможность проверки и момент фиксации собственного ответа. Если модель сначала фиксировала ответ, а затем получала ложное утверждение, доля его принятия составляла 31,6%.
Что это значит
Архитектура переносит доверие с процесса, который может завершиться или смениться, на долговечную запись, полномочия и историю обязательств. Для продукта это означает, что агентам разных пользователей недостаточно общего формата сообщений: нужны проверяемый источник, явные границы доступной памяти и процедура фиксации решений. Человек при этом остаётся владельцем ответственности, но перестаёт вручную переносить контекст между системами.
Ограничения. Эксперимент охватывает одну модель, 53 вопроса и искусственные условия передачи ложного утверждения; он не показывает экономию времени в реальной совместной работе. Оболочки запросов для первого сообщения и предварительно зафиксированного ответа не были выровнены по длине, поэтому часть разницы может объясняться формой запроса. Проверка использования инструментов нарушила заданный лимит вызовов, из-за чего сами авторы классифицируют результаты как исследовательские. Рабочая реализация относится к внутреннему слою одной «цивилизации»; полноценное сравнение межсистемного протокола с альтернативной реализацией в работе не проведено.
Источники
Похоже на вашу задачу?
Расскажите, что собираете. За полчаса разложим на этапы и назовём сроки — это бесплатно и ни к чему не обязывает.



