Открыть приложение

Откуда приложения берут КБЖУ и почему цифры расходятся

Схема: три источника данных о продукте — лабораторный анализ, этикетка и запись пользователя — сходятся к одной карточке товара

Один и тот же творог в двух приложениях получает разную калорийность, и объяснение обычно ищут в ошибке одного из них. Чаще ошибки нет ни там, ни там: у приложений разные источники, и каждый источник по-своему прав. Разобраться в этом стоит хотя бы для того, чтобы понимать, какую запись выбирать из десятка похожих.

Три разных источника под одним словом «база»

За калорийностью в приложении стоит один из трёх типов данных, и путать их не стоит.

ИсточникКак получены значенияСлабое место
Лабораторный справочникХимический анализ образцов, усреднение по выборкеОбобщённый продукт, а не ваш; медленно обновляется
Данные с этикетокПеренос заявленных значений с упаковкиНаследует все допуски заявления производителя
Записи пользователейВнесены вручную теми, кто пользуется приложениемОпечатки, путаница «на 100 г» и «на порцию», дубли

Большинство приложений смешивают все три и внешне не различают их в списке результатов. Отсюда и десяток «творог 5 %» с разными числами: часть строк из справочника, часть с упаковок разных марок, часть внесена людьми.

Лабораторные справочники

Это исходный слой, к которому так или иначе восходит всё остальное. Значения получены анализом образцов: азот пересчитывается в белок, жир извлекается растворителем, зола и влага определяются высушиванием и сжиганием, углеводы часто считаются по разности. Калорийность не измеряется напрямую, а вычисляется по коэффициентам — примерно 4 ккал на грамм белка и углеводов, 9 на грамм жира.

Сильная сторона такого источника — прослеживаемость: у каждого числа есть метод и выборка. Слабая — обобщённость. «Говядина, отварная» в справочнике описывает усреднённый образец, а не тот кусок, который лежит у вас на тарелке: содержание жира в мясе зависит от отруба и откорма и различается кратно.

Есть и вопрос качества самих справочников. Разбор данных в базах нутриентов называет главным показателем полноту — сколько нутриентов вообще определено для позиции, — а вторым тем, насколько данные пригодны к машинной обработке. Пропуски в таблицах распространены, и подставляются они обычно молча.

Данные с этикеток

Второй слой — то, что производитель напечатал на упаковке. Его достоинство в конкретности: это именно ваш продукт, а не усреднённый. Недостаток в том, что заявленные значения имеют допуск и рассчитываются по рецептуре, а не измеряются в каждой партии. Подробно это разобрано в материале КБЖУ на упаковке.

Собираются такие данные по-разному. Есть отраслевые и национальные проекты, где записи заводят по фотографиям упаковок; есть открытые проекты, куда сведения вносят участники и покупатели. Описание одного из таких открытых репозиториев товаров со штрихкодами показывает и общий подход, и общую проблему: покрытие полки зависит от того, кто и в какой стране взялся вносить.

Для российской полки это ощутимо. Международные открытые базы покрывают её выборочно, собственные торговые марки сетей — почти никак, и по многим штрихкодам записи просто нет. Что происходит в этом случае и почему код при этом читается нормально, разобрано в материале про штрихкод.

Записи, которые внесли люди

Третий слой самый большой и самый шумный. Его типовые дефекты одинаковы во всех приложениях:

Прямые проверки такого рода данных существуют. Сравнение баз двух популярных приложений с исследовательской базой показало хорошее согласие по энергии и большинству нутриентов у одного из них и заметно худшее по отдельным группам продуктов и отдельным нутриентам у другого — в частности, по жиру и клетчатке. Отдельная проверка пяти популярных приложений обнаружила систематическое занижение калорийности и макронутриентов относительно референсной базы.

Почему это заметно меньше, чем кажется

Разброс между базами реален, но на фоне остальных источников ошибки он не главный. Ошибка оценки веса порции обычно крупнее — по опубликованным проверкам она измеряется десятками процентов, — а разница между двумя приличными записями одного продукта чаще укладывается в 5–15 %. Про то, откуда берётся ошибка веса, — материал про распознавание еды по фотографии.

Отсюда простое правило приоритетов: сначала научиться попадать в вес, потом придираться к базе. Обратный порядок даёт аккуратные числа при неверных граммах.

Как выбирать запись из десятка

  1. Отдавать предпочтение записи с полной раскладкой. Если указаны белки, жиры, углеводы и калорийность и они между собой сходятся по коэффициентам 4-4-9, запись, скорее всего, не выдумана.
  2. Проверять единицу. «На 100 г» или «на порцию» — первое, куда стоит смотреть, и самая частая причина промаха в разы.
  3. Предпочитать марку, а не обобщение. Для упакованного продукта запись с названием производителя точнее, чем родовая «колбаса варёная».
  4. Для домашней еды брать обобщение. Здесь наоборот: у вашего борща своя рецептура, и родовая запись честнее чужой фирменной. Как считать такое, разобрано в материале про калории в домашней еде.
  5. Держаться одной записи. Если вы едите один и тот же продукт каждый день, важнее постоянство, чем абсолютная точность: смещение будет одинаковым во все дни и не помешает сравнивать их между собой.

Посчитать по фото

Частые вопросы

Почему в разных приложениях у одного продукта разная калорийность?
Потому что источники разные: лабораторный справочник даёт усреднённое значение по выборке образцов, данные с этикетки — заявление конкретного производителя, а пользовательские записи вносятся вручную и содержат опечатки и путаницу единиц. Все три слоя обычно смешаны в одном списке результатов.
Какой записи верить, если их десяток?
Той, где есть полная раскладка по белкам, жирам и углеводам и она сходится с калорийностью по коэффициентам 4-4-9, и где явно указано, на 100 г значения или на порцию. Для упакованного продукта точнее запись с названием марки, для домашней еды — обобщённая.
Насколько сильно расхождение баз портит подсчёт?
Меньше, чем ошибка в весе порции. Разница между двумя приличными записями одного продукта обычно укладывается в 5–15 %, тогда как ошибка оценки массы по фотографии измеряется десятками процентов.
Почему российских товаров часто нет в базе?
Открытые базы наполняются участниками, и покрытие зависит от того, кто вносит данные в конкретной стране. Российская полка покрыта выборочно, собственные торговые марки сетей — почти никак. Штрихкод при этом читается нормально, просто записи под него нет.
Что делать, если продукта нет ни в одной базе?
Взять значения с упаковки — это и есть первоисточник для готового продукта. Для домашнего блюда посчитать по ингредиентам и весу, а не искать похожее готовое: рецептуры расходятся сильнее, чем базы.

Читайте также

Материал носит справочный и информационный характер. Он не является медицинской рекомендацией, диагностикой, назначением лечения или диеты и не заменяет консультацию врача. При заболеваниях, беременности, приёме лекарств и любых состояниях, требующих контроля рациона, решения о питании принимаются с врачом.

Сведения о нормах, регламентах и исследованиях приведены по состоянию на момент подготовки материала и могут измениться; их актуальность следует проверять по первоисточникам. Материал не является рекламой, публичной офертой или индивидуальной консультацией. Автор и владелец сайта не несут ответственности за решения, принятые на основании этого текста.