Беда в том, что «важность» или «полезность» сообщения измерить невозможно. Фраза «Завтра контрольная» для одного человека – новость, а для другого – то, что он и так знал. Любая мера, опирающаяся на смысл, окажется своей у каждого получателя, а значит, никакого общего расчёта на ней не построить.
Поэтому в информатике пошли другим путём: измерять не смысл, а объём записи. Подход, который так делает, называют алфавитным – он смотрит только на то, из каких символов составлено сообщение и сколько их, и принципиально не заглядывает внутрь.
Чтобы не возникло ложного впечатления, что мера всего одна: существует и содержательный (вероятностный) подход, где количество информации зависит от того, насколько неожиданным было сообщение. Его развил Клод Шеннон в работе 1948 года – той самой, где закрепился термин «бит» (урок 5.1). Алфавитный подход старше: его основу заложил Ральф Хартли в статье «Transmission of Information» 1928 года, работая в Bell Labs. Хартли считал логарифм по основанию 10, и его единица («хартли», один десятичный разряд $\approx 3{,}32$ бита) сегодня почти не используется – но сама идея «количество информации – это логарифм числа возможных вариантов» осталась ровно его.