Нейросети не заменяют насмотренности: интервью с цифровым историком Андреем Володиным

Как цифровизация меняет работу историка? Что происходит с историческими источниками, когда их начинают превращать в базы данных, карты и цифровые реконструкции? Может ли большая языковая модель быть помощником историка, или она несёт угрозу фальсификации истории? И что останется человеку в эпоху, когда машины всё лучше работают с данными? Об этом «Системный Блокъ» поговорил с Андреем Володиным, специалистом по цифровой истории и исторической информатике

Новости

Пользователи применяли Claude для слежки и кибератак

В новом отчете Anthropic рассказала, как Claude использовали для создания ракет, вредоносного кода и мошеннических приложений

Минпросвещения составило правила для учителей по работе с ИИ

Ведомство рекомендует школам отдавать приоритет «суверенным» и «национальным» моделям

OpenAI заявила о решении задачи тысячелетия — и оказалась в центре скандала

Профессор из университета Нью-Йорка утверждает, что OpenAI взялась за математическую задачу, узнав о его незаконченной работе

OpenAI выпустила GPT‑6 Astra и заявила об AGI

OpenAI говорит об «эре AGI», но самое заметное улучшение — работа с компьютером: от заполнения форм до создания 3D-моделей

Российский суд не признал копирайт на сгенерированную Джоконду

Предприниматель требовал компенсацию за использование изображений, которые он сделал с помощью нейросети, но суд отказал

Создатели ИИ требуют замедлить его разработку

В открытом письме к американским властям сотрудники ведущих ИИ-платформ призвали создать механизмы, которые позволят притормозить разработку ИИ

ИИ-агент OpenAI взломал Hugging Face

Модель смогла выбраться из изолированной среды, получить доступ в интернет и взломать инфраструктуру платформы Hugging Face

В России принят первый закон об ИИ

Документ вводит юридическое определение искусственного интеллекта, а также суверенной и национальной языковых моделей. Им придется проходить проверку на соответствие традиционным духовно-нравственным ценностям

Национальный корпус русского языка вырос в шесть раз

Теперь в него входят тексты ВКонтакте — почти 11,3 млрд слов из соцсетей

Власти США заставили Anthropic закрыть Fable и Mythos

Сильнейшие модели Claude были доступны всего три дня

Российский суд впервые оштрафовал компанию за ИИ-галлюцинации в судебном документе

В жалобе были выдуманные цитаты и фальшивые реквизиты решений Верховного суда

ИИ найдет «скрытых» детей в соцсетях по костям лица

Facebook* и Instagram* будут сканировать фото и видео, чтобы находить детей, которые скрыли свой возраст

Модель из прошлого: исследователи обучили ИИ только на текстах до 1931 года

Исследователи обучили 13-миллиардную модель на текстах, изданных до 1931 года, и она предсказала мировую войну в 1936 году

OpenAI и Anthropic выпустили новые флагманские модели

OpenAI обновила генератор изображений и языковую модель, Anthropic — модель для сложных задач программирования

Anthropic выпустила Claude Mythos — новую LLM, которую покажут не всем

Модель настолько хорошо ищет уязвимости, что компания не стала публиковать её в открытом доступе

Наши статьи

Господин Никто: как устроена анонимность на японских форумах

Представьте общение в интернете без аккаунтов и аватарок: есть только тред и реплики без подписи. В Японии такие анонимные форумы, появившиеся в 1990-х годах, дожили до наших дней. Разбираемся, как устроена культура анонимных форумов в Японии, как сообщества создают свои правила в интернете и чем японский «аноним» отличается от российского

Тест: Угадайте, что отправители писали на старых открытках

До появления социальных сетей открытка была не только красивой картинкой, но и способом отправить короткое сообщение — от поздравления до совершенно неожиданных новостей. При этом у почтовых карточек есть свои маленькие загадки: изображение рассказывает одно, а несколько строк на обороте 一 порой совсем другое. Сможете ли вы не попасться в ловушку открытки и угадать, что на самом деле написал ее отправитель?

Пузыри фильтров на YouTube: польза или риск?

Если в вашей ленте YouTube сплошь книжные обзоры и рецепты домашнего сыра — поздравляем, вы в пузыре фильтров. Алгоритм изучил ваши вкусы и теперь предлагает похожий контент. Разбираемся, как он это делает — и правда ли, что рекомендации способны незаметно поменять ваши убеждения

Едят ли корейцы собак? Отвечает статистика

Если спросить у прохожего: «Какие у вас ассоциации со словом “Корея”?», то собаки наверняка окажутся среди первых 3–5 ассоциаций. Конечно, употребление корейцами в пищу собачьего мяса — это «секрет Полишинеля», однако стереотип о количестве собачатины в рационе корейцев сильно преувеличен. Разбираемся в масштабе потребления собачьего мяса как в Южной, так и в Северной Корее, а также показываем, как Big Data и цифровые инструменты могут зафиксировать исчезновение целого культурного пласта в реальном времени

Как построить систему самообучения: алгоритм от цели до результата

Можно скачать десять приложений для учебы, составить идеальный план и всё равно мало чему научиться. Проблема кроется чаще всего в том, как устроен сам процесс обучения. На основе модели self-regulated learning (SRL) и исследований эффективности учебных техник разбираемся, как собрать собственную систему самообучения от постановки цели и выбора метода до проверки результата и корректировки стратегии

Муки творчества на аутсорсе у LLM: что остается человеку?

Искусственный интеллект меняет не только творческий процесс, но и понимание того, что значит сегодня быть автором. Мы все чаще тревожимся: какого участия достаточно, чтобы считать работу авторской, и в чем состоит наша ценность в сотворчестве с машиной, чьи способности порой превосходят наши? В статье разбираемся в истоках этой растерянности

Тест: какая профессия в NLP вам подходит?

Кажется, что NLP — это только про код, математику и нейросети, а гуманитариям тут искать нечего. Но на самом деле индустрии не хватает лингвистов, переводчиков, редакторов и людей с чутьем на язык — без них модели не научатся понимать контекст, культурные оттенки и речь так, как это делает человек. Если вы хотели попробовать себя в этом направлении, но не знаете, с чего начать, этот тест для вас

Как превратить гуманитарную курсовую в GitHub-проект

Курсовая сдана, оценка получена, файл kursovaya_final_FINAL2.docx лежит в папке «Учёба». Всё это можно превратить в проект на GitHub, который будет работать на вас: его можно показать на собеседовании, добавить в резюме, прислать научному руководителю в магистратуре. Работодатели в digital humanities и data-командах смотрят на GitHub чаще, чем на диплом. В этой статье пошагово разберем, как собрать такой проект.

Как новый африканский алфавит пробился в Unicode: цифровая жизнь адлама

В 1989 году два брата из Гвинеи, которым было всего 14 и 10 лет, решили придумать письменность для родного языка. За несколько десятилетий созданный ими алфавит прошел путь от рисунков в школьных тетрадях до собственного места в стандарте Unicode. Рассказываем историю адлама — письменности для языка фульфульде, на котором говорят около 40 миллионов человек

Как самостоятельно учить иностранный язык?

Выбираете между зеленой совой, карточками и «умными» чат-ботами? Мы собрали стратегию самостоятельного и осмысленного изучения иностранного языка — от первых фраз до нюансов C2. Узнаете, как определить свой уровень, какие приложения работают на каждом этапе, когда подключать ИИ‑собеседников, словари и корпусы, и зачем нужен shadowing

От переводчика до AI-тренера: как меняются профессии в эпоху больших языковых моделей

Новости о том, что искусственный интеллект скоро оставит людей без работы, появляются едва ли не каждую неделю. Особенно тревожно они звучат для тех, кто работает с языком и текстами. Разбираемся, что говорят исследования о влиянии ИИ на рынок труда, как меняются привычные профессии и какие новые роли появляются в эпоху больших языковых моделей

Свадьба в черном: как оцифровка сохраняет свадебные традиции

Черное свадебное платье, корона вместо фаты и венок на шляпе жениха — свадебные традиции Швеции XIX века мало похожи на современные. Рассказываем, как цифровая коллекция Europeana помогает изучать историю свадебного костюма и превращает музейные экспонаты в материал для исследований

От пергамента к данным: зачем размечать средневековые грамоты

Оцифровка средневековых грамот уже давно не ограничивается сканированием и выкладыванием изображений в сеть. Современный исследователь хочет не просто увидеть документ, но и сравнить десятки актов за пару минут, отследить устойчивые формулы, выявить связи между оригиналом и копией. Однако обычный скан или даже транскрипция такой возможности не дают. Как превратить разрозненные архивные единицы в полноценный цифровой корпус, зачем средневековым документам TEI-разметка и при чем здесь Semantic Web — рассказываем в нашем материале

Три шага до «Hello, world!»: как научиться программировать самому

Как начать программировать, если раньше вы никогда не писали код? Собрали доступный маршрут для самостоятельного обучения — от платформ с визуальными блоками до работы с полноценными языками программирования.

Муза с перфокартами: как компьютеры учились писать стихи за полвека до нейросетей

Генеративная поэзия появилась задолго до ChatGPT. Компьютеры генерируют стихи уже больше 60 лет, а сама мечта заставить машину рифмовать — многовековая. В XVIII веке Свифт высмеивал такую машину в «Путешествиях Гулливера», в 1845-м англичане собрали механический аппарат, собиравший латинские стихи со скоростью строчка в минуту, а в 1960-е европейские художники генерировали первые электронные стихотворения из текстов Кафки и обрывков газет. Публикуем главу о том, как компьютеры учились писать стихи, из новой книги филолога Бориса Орехова «Электронная лира».

MLOps для работы с текстом: принципы и минимальный набор инструментов

Как специалисты по машинному обучению наводят порядок при работе с большими корпусами? Что нужно сделать, чтобы эксперимент был воспроизводимым, качество не падало, а метрики были осмысленными? Рассказываем про автоматизацию ML-пайплайнов при работе с текстами, отслеживание запусков и версионирование кода и данных

Жесткая регуляция LLM в США, ИИ полностью прочитал обугленный свиток

США усилили контроль над лидирующими ИИ моделями, ученые смогли полностью прочитать античный свиток, не разворачивая его — что произошло в мире ИИ за последнее время

От ИИ-агентов до малых языков: куда движется NLP в 2026 году

Агенты, которые самостоятельно планируют свои действия и пользуются внешними инструментами. Модели, способные работать с миллионами токенов. Системы, которые помогают сохранять языки коренных народов и выявлять гринвошинг. Разбираемся, какие тенденции определяют развитие языковых технологий в 2026 году и как вместе с техническими возможностями моделей меняются исследовательские приоритеты области

Аккордовый ввод текста для японского языка

Как набирают текст на компьютерах и смартфонах в Японии? Рассказываем о разных способах ввода: от JIS-клавиатур с хираганой и катаканой до flick-ввода на смартфонах. А еще — об аккордовых клавиатурах, где символы появляются не нажатием одной клавиши, а комбинацией нескольких. В некоторых случаях это может быть даже быстрее привычного набора — но точно требует другой логики мышления

Что монеты могут рассказать о переходе от Античности к Средневековью

В музее вы точно заметите разноцветные фрески и изысканные статуи, а вот мимо монет можете пройти. Хотя они хорошо помогают понять эпоху — особенно в сочетании с современными технологиями сбора и анализа данных. В этой статье вы узнаете, что монеты могут рассказать о причинах развала Римской империи и как цифровые инструменты делают нумизматику еще эффективнее

Почему современные технологии не понимают африканские манускрипты?

В массовой культуре африканские манускрипты иногда воспринимаются как некие мистические артефакты и вообще экзотизируются. На самом деле за африканскими языками стоит своя лингвистическая система, а в случае с письменными языками — часто еще и сложная система графики. Рассказываем, почему ИИ распознает текст, но не всегда справляется с полноценным анализом африканских манускриптов

Обратная сторона навигаторов: куда нас ведут электронные карты и что с этим бывает не так

«Лучше пешком», — говорим мы себе летом и выбираем прогулки непривычными маршрутами. А если путь не знаком — поможет приложение-навигатор. Но автоматически следуя его указаниям, мало кто всерьез задумывается, какие алгоритмы скрываются за его интерфейсом, почему они ведут нас именно этими дорогами и чем мы рискуем, доверяя свой путь онлайн-сервису? В статье рассказываем, как работают навигаторы и можно ли вернуть себе свободу передвижения в цифровую эпоху

ИИ-компании готовятся к IPO, новые модели от Google и Microsoft

SpaceX, Anthropic и OpenAI готовятся стать публичными компаниями, Google и Microsoft выпустили новые модели — рассказываем, что произошло в мире ИИ за последнее время

Как Япония оцифровывает повседневность и почему это важно

Японская культура повседневности отличается вниманием к визуальной эстетике, типографике и деталям коммуникации. Поэтому даже самые обычные документы — билеты, рекламные буклеты или инструкции — содержат информацию о языке, социальных нормах и экономике своего времени. Однако с переходом общества к цифровым технологиям бумажные следы повседневности становятся более редкими. В ответ на эту проблему исследователи и архивные учреждения начинают разрабатывать новые методы сохранения и оцифровки эфемерных материалов, стремясь сохранить их как важный источник знаний о культуре и обществе

«Это моя Булька…»: как ИИ-мемы становятся новым фольклором

Бегемот Булька-Барабулька и Тралалело Тралала — что общего у этих образов? Они родились в пространстве нейросетей, а затем разошлись по сети, подчиняясь законам устного народного творчества. Рассказываем, почему сгенерированные персонажи становятся каноном и как нейросети стирают границу между реальностью и вымыслом

Что делать лингвисту в NLP в эпоху LLM

Вы — лингвист и вам кажется, что ваш труд теряет ценность на фоне успеха больших языковых моделей? Не спешите с выводами. Хотя обработка естественного языка больше не строится на лингвистике и правилах, работа в этой области все еще есть. Лингвисты могут сделать работу ИИ точнее, этичнее и понятнее — от разметки данных до оценки качества генерации

GPT решила знаменитую нерешенную задачу математики, Google показал новый ИИ-поиск

Компания Google представила много новых ИИ-продуктов, а модель GPT опровергла известную математическую гипотезу Пала Эрдёша — рассказываем, что произошло в мире ИИ за последнее время

Какая математика нужна джуну в NLP?

Можно ли заниматься NLP, если при словах «производная» и «матрица» хочется закрыть ноутбук? Да — если изучать математику не абстрактно, а через реальные задачи. Объясняем, какие разделы действительно нужны джуну, как они связаны с токенизаторами, генерацией текста и нейросетями и почему понимание базовых концепций помогает перестать воспринимать модели как магию

От саркофагов до дворцовых залов: как 3D-технологии делают памятники культуры доступнее

Восковая скульптура Микеланджело, которую нельзя выставлять в тепле. Средневековый французский ковёр длиной 70 метров, который невозможно рассмотреть целиком. Египетские саркофаги, внутрь которых не заглянуть. Что делать музеям с экспонатами, которые сложно показать? Можно сделать 3D-модель! Разбираем на примерах, как 3D-технологии помогают сохранять, изучать и делать доступными памятники культуры — от средневековых гобеленов до петроглифов на дне Амура

«Игуменья» или «пионер»: чем отличаются слова в дореволюционных и советских открытках

Вот уже больше 150 лет люди шлют друг другу открытки — поздравляют, сообщают о своих делах, передают просьбы. В открытках отражается не только повседневная жизнь, но и язык эпохи, на который влияют исторические события и социальные перемены. Проанализировав множество открыток, можно проследить, какие слова исчезали и появлялись в разные периоды. Разбираемся, чем отличаются дореволюционные и советские открытки и что их язык может рассказать об истории общества

Цифровой строй: как «Бессмертный полк» переселился в онлайн

Ежегодно сотни тысяч людей выходят на улицы с портретами своих предков, чтобы вспомнить их подвиги и почтить память. Это акция «Бессмертный полк» — один из популярных способов сохранения коллективной памяти о Великой Отечественной. В 2026 году в значительной части регионов России она проходит онлайн, а не в форме шествий. Как новые технологии меняют восприятие памяти? Добавляют ли они новые смыслы в уже ставший привычным ритуал? Или цифровая память ничем не отличается от обычной? Разбираемся вместе

Тест: Вы ориентируетесь в пространстве как Одиссей или как Яндекс Карты?

Древним грекам приходилось ориентироваться без карт в смартфоне, но они иногда неплохо справлялись. А вы? Пройдите тест и узнайте, унаследовали ли вы взгляд древнего грека или мыслите как спутниковая система — и что это говорит о том, как вы ориентируетесь не только в городе, но и в жизни

Списывание XXI века: как определить, что эссе написал ИИ

Трансформеры с помощью fine-tuning узнают, написал ли эссе искусственный интеллект или человек. Рассказываем о различных методах идентификации ИИ-текста и актуальных моделях

Малярия и храмы: как болезни влияли на распространение культов в Древнем Риме

Малярия — одна из самых страшных болезней, которая веками отнимала силы и жизни у миллионов людей. Уже жителям Римской империи приходилось бороться со смертоносной болотной лихорадкой. И поскольку земные врачи ничего не могли сделать, римляне обращались к врачевателям небесным — Асклепию и Аполлону. В новом материале рассказываем, как связаны ГИСы, античные культы исцеления и малярия

Дорогой дневник: обзор книжных трекеров

Вы много читаете и мечтаете систематизировать списки прочитанного? Или, наоборот, только хотите ввести в свою жизнь чтение как привычку, поэтому ищете способ отслеживать прогресс и вести заметки? Мы сделали обзор популярных сервисов и приложений для любителей чтения. А еще из нашего материала вы узнаете, зачем вести такие записи, в чем заключается ловушка измерения прогресса и как сохранить удовольствие от чтения и не зависеть от метрик

MEMory: почему мемы — это тоже историческая память?

Мы привыкли считать, что историю фиксируют документы, архивы и официальные хроники. Но они почти не передают, как люди переживают события «внутри». Мемы берут на себя эту функцию: через юмор они сохраняют эмоции, страхи и повседневный опыт эпохи. Разбираемся, как интернет-шутки превращаются в источник для историков будущего

Секреты шрифтов: детали, которые делают чтение эффективным

Просто набор символов или продуманный инструмент, который делает текст притягательным и легким для восприятия? Выбор шрифта влияет на то, как мы читаем и воспринимаем написанное. За привычным чтением скрываются механики, которые могут сделать его в разы эффективнее и приятнее. Разбираемся, как эти незначительные (на первый взгляд) детали способны кардинально изменить восприятие любого текста

Тест: мемуары или нейросеть?

Можно ли отличить мемуары от текста, написанного нейросетью в мемуарном стиле? Сегодня это уже не так очевидно: алгоритмы научились подражать интонации, деталям и даже «человеческой» неидеальности. Проверьте себя: сможете ли вы понять, где перед вами подлинные воспоминания, а где — творение нейросети?

Гордость и предубеждение и Voyant Tools: как сделать развлекательный материал про литературу цифровыми методами

Многие цифровые гуманитарные методы и инструменты органично смотрятся в научно-популярных материалах и исследованиях: по ключевым словам произведений действительно можно составить их портрет, а истории про стилометрию нередко читаются как детективный роман. В этом материале автор рассказывает о собственном опыте подготовки теста «Остен или Бриджертоны» для книжного проекта «Смысловая 226», сложностях этой работы и неожиданных забавных находках

Читай [онлайн] рядом со мной: как устроены цифровые читательские клубы

Если вы прочитали увлекательную книгу и хотите ее обсудить — запишитесь в читательский клуб. Сегодня для этого даже не нужно далеко ходить — достаточно найти подходящее сообщество в соцсетях или мессенджерах. Авторы «Системного Блока» в коллаборации с DH-центром Университета ИТМО разбираются, как устроены цифровые книжные клубы и какие формы совместного чтения они создают

Женщина для галочки: дата-исследование о принципе Смурфетты в российском кино

Принцип Смурфетты — это ситуация, когда среди мужских персонажей фильма есть только одна героиня. Ее образ — это стереотипное представление женщины. Ее роль — быть спутницей для мужчин или объектом их внимания, но не субъектом истории со своими целями, мотивацией, характером. Обычно о принципе Смурфетты говорят в контексте голливудского кино. «Системный Блокъ» вместе с экспертами изучил, работает ли принцип Смурфетты в российском кинематографе

Не баг, а фича: почему японские сайты часто выглядят устаревшими

Если вы когда-нибудь оказывались в японском интернете, то замечали, что сайты часто выглядят так, будто их сделали двадцать лет назад. Но это не признак отсталости интернета Японии. В японском веб-дизайне важен не минимализм и красота интерфейса, а снижение риска ошибок и сохранение доверия пользователей. В этой статье мы разберем мифы японского веб-дизайна, узнаем, почему японцы всё ещё пользуются факсом и как это всё связано с культурой и демографией Японии

Феномика, ГМО и роботы: как завтрашний урожай проектируется уже сегодня

Что общего между ДНК-маркерами, прогностическими моделями и дронами с мультиспектральными камерами? Все это — инструменты селекции, которая за последние два века превратилась из творческого процесса в точную науку. Разбираемся, как технологии помогли селекционерам перейти от интуитивного отбора к эре предсказательного моделирования и автоматизированного создания новых сортов и пород

Corpus и Status: как технологии помогают сохранять миноритарные языки России

В России существуют десятки малых, или миноритарных, языков, которые находятся под угрозой исчезновения. Однако благодаря цифровым технологиям у них появляется шанс на новую жизнь: создаются корпуса, образовательные ресурсы, телеграм-каналы, игры. Рассказываем про несколько инициатив активистов по сохранению и возрождению малых языков

Пьющих просьба не беспокоить: анализируем язык объявлений о сдаче квартир с помощью LLM

Что нужно человеку, чтобы снять квартиру в России? Каждый, кто читал объявления на популярных сайтах, знает, что нужно не только заплатить за аренду, но и соответствовать требованиям арендодателя. Чтобы узнать, какие требования оказались самыми распространенными, а какие удивят даже самого опытного квартиросъемщика, мы обработали 15 тысяч объявлений с помощью LLM

Нейросеть-алкотестер: как ваша речь может выдать вас с головой

Алкотестер в каждой машине — звучит слишком хорошо, чтобы быть правдой? А если алкотестер — это ваш собственный голос? Достаточно сказать пару фраз, чтобы машина определила, что садиться за руль сейчас нельзя, и тем самым спасла жизнь вам или кому-то еще на дороге. Похоже на сценарий фантастического фильма, но исследователи уже работают над тем, чтобы превратить это в реальность. Разбираемся, как они учат нейросети слышать то, что не слышим мы, и при чем здесь немецкие скороговорки

Конфликт Пентагона и Anthropic, протест против OpenAI, увольнение главы разработки Qwen

Конфликт между Пентагоном и Anthropic продолжается, пользователи отписываются от ChatGPT, глава команды Qwen уволился — что произошло в мире ИИ за последнее время

Как статистика раскрывает тайны мифов, сказок и анекдотов

Фольклор — это предания и легенды, сказки и песни, пословицы и анекдоты. На первый взгляд они простые и даже примитивные. Но за этой кажущейся простотой скрываются сложные закономерности, которые помогают разглядеть статистические методы. Количественный анализ обнаруживает неожиданные культурные связи, популярные сказочные сюжеты и даже секрет успеха анекдотов о Штирлице

Как цифровые технологии и фаллические каменные жезлы спасли японский музей

Город Хида в префектуре Гифу редко становится самостоятельной целью путешествия. Однако именно здесь находится музей Хида-Миягава, который хранит около 40 тысяч археологических и 30 тысяч этнографических предметов. Часть коллекции включена в государственный реестр культурного наследия Японии. В условиях демографического спада и нехватки ресурсов музей оказался под угрозой закрытия. Рассказываем, как ему удалось этого избежать и причем здесь каменные жезлы

ChatGPT и домашнее задание: почему школьники обманывают

Сегодня любой школьник может написать эссе или решить уравнение с помощью нейросети. Но исследования показывают: нейросети не увеличили масштаб жульничества с домашним заданием, а лишь сделали заметнее давние дыры в системе проверки. Разбираемся, почему основная проблема школьного жульничества не в нейросетях, а в том, как устроена проверка знаний

Пентагон против Anthropic и новый лидер в видеогенерации

Конфликт между Пентагоном и Anthropic, нейросеть Seedance 2.0, способная генерировать кинематографичные видео, — что произошло в мире ИИ за последнее время

«Один человек сможет построить компанию в миллиард долларов»: интервью с технооптимистом Иваном Ямщиковым

Как ИИ изменит общество и образование? Что в школе будущего должен делать учитель, а что — тренажер? Почему в XXI веке важнее всего развивать в детях агентность и свободу воли? Какие блага и какие риски несет внедрение ИИ, и как нам с этим быть? А также почему не стоит недооценивать культурное влияние технопессимистов? Об этом «Системный Блокъ» поговорил с Иваном Ямщиковым — ученым, предпринимателем, руководителем ИИ-института CAIRO в немецком университете THWS

ИИ для айнского: как технологии помогают сохранить вымирающий язык

На севере Японии живет всего несколько человек, которые еще способны что-то сказать на языке айнов. Этот язык-изолят, не родственный никакому другому языку Земли, почти вымер. Однако для лингвистов айнский представляет исключительный интерес из-за редких грамматических особенностей. Рассказываем, какие цифровые инструменты для сохранения и изучения айнского существуют и находятся в разработке, что они умеют и с какими ограничениями сталкиваются

От генома к родословным: как палеогенетика помогает изучать социальную структуру древних сообществ

Историки и биологи давно исследуют прошлое человечества вместе. С недавних пор к ним присоединились палеогенетики и биоинформатики. Их методы позволяют анализировать генетические следы в останках людей, благодаря чему мы больше узнаем о родственных связях, брачных практиках и правилах, по которым были устроены древние общества. Рассказываем, как палеогенетика исследует социальные структуры прошлого

Как превратить коллекцию гравюр Пушкинского музея в «умные данные» для цифровой науки

Как найти «зиму» в коллекции гравюр, если на изображении нет ни снега, ни льда? Традиционный поиск по ключевым словам здесь бессилен. В этой статье мы расскажем, как с помощью онтологии ICON и классической теории Эрвина Панофски превратить коллекцию гравюр ГМИИ им. А.С. Пушкина в «умные данные», способные отвечать на сложные искусствоведческие вопросы

От рок-баллад до Тейлор Свифт: как алгоритмы находят сюжеты в песнях

Мы привыкли считать сюжет признаком романа или фильма, а песню — территорией эмоций и состояний. Но почему тогда одни треки звучат как описание глубоких чувств, а другие — как законченный эпизод из чьей-то жизни? Рассказываем, как цифровые методы и литературная теория помогают увидеть (и посчитать!) движение от лирики к сторителлингу в поп-музыке

ИИ-библиотекарь на китайском: будущее библиотечной каталогизации

Как описать книгу на китайском языке, если вы не знаете китайского, а бюджет библиотеки сократили еще в прошлом году? 🏮🤖 В академических библиотеках по всему миру — кадровый голод: специалистов-синологов мало, а поток литературы из Восточной Азии только растет. На помощь приходит связка из LLM и векторных баз данных. В новом материале разбираемся, как GPT-бот на базе модели Text-embedding-3-small помогает превращать хаос иероглифов в четкие библиотечные записи формата FAST

Личный ИИ-ассистент, соцсеть для ИИ-агентов, генератор виртуальных миров от Google

Внезапная популярность персонального ИИ-ассистента OpenClaw, генератор миров от Google — что произошло в мире ИИ за последнее время

Как измерить оригинальность LLM-сюжетов и почему они (пока) проигрывают человеческим

Если бы русские народные сказки создавались сейчас, то среди волшебных предметов, кроме шапки-невидимки, скатерти-самобранки и сапогов-скороходов, у героев были бы VR-очки, способные «всю правду доложить», онлайн-переводчик с волчьего языка и генератор царевых отгадок. Правда, все эти образы придуманы человеком, а может ли LLM придумать что-то интересное в области вымышленных нарративов? Разбираемся, насколько оригинальны сюжеты, которые предлагает ИИ

Ничего, кроме правды: как заставить LLM сомневаться в своих ответах

Почему большие языковые модели врут с абсолютной уверенностью? Можно ли заставить их быть интеллектуально честными? Ответ кроется не в этике, а в распределениях вероятностей и архитектуре нейросетей. Разбираемся, как большие языковые модели оценивают (вернее, не оценивают) свою уверенность и как научить их честно говорить «я не знаю»