RAntiquity
1.09K subscribers
295 photos
10 videos
5 files
539 links
Об античности на языке R и не только

@locusclassicus
Download Telegram
Добрый вечер.
16
Сегодня упражнялась с Google Books API, который совершенно бесплатно, то есть даром, возвращает метаданные к литературе по запросу. Между прочим, там есть и ссылка на обложку, так что вот. A little bit of {magick}
🔥1354
Действительно, петух.
🔥16
Forwarded from Antibarbari HSE (Olga Alieva)
Как говорить по-древнегречески о котиках, маркитантках и карантине? Узнали сегодня из лекции Льва Шадрина о дневниках Карла Бенедикта Хазе.

Свидетель «времен очаковских» и наставник Наполеона III, византинист, по личному распоряжению графа Николая Румянцева издавший Льва Диакона, бонвиван и немножко фальсификатор, Хазе описывает на аттическом наречии Париж начала XIX в., в котором золотая молодежь буянит в кабаках, женщины переодеваются в атласные штаны, а котик Портной, разбив кувшин, получает четверть курочки.

Удивительный документ эпохи благодаря проекту LAGOOS и новейшим цифровым инструментам возвращает к жизни целую эпоху. Смотрите новое видео в рубрике #antibarbari_colloquia
10🔥2
А у вас нет такого же, но с перламутровыми пуговицами? #gpt
😁20
This media is not supported in your browser
VIEW IN TELEGRAM
Гуманист: 🦜
Цифровой гуманист:
17
Потратила некоторое время, чтобы разобраться с настройками автоматической проверки кода на R в GitHub Classroom. Вот тут подробная инструкция: https://teletype.in/@locusclassicus/autograding-github-classroom-r

Особенности:
- поначалу можно сломать голову, но дальше проще;
- нет (пока не вижу) возможности оценивать не по бинарной шкале (passed / failed), а более нюансированно;
- на бесплатном плане придется сделать видимыми студенческие репозитории из-за ограничений Actions;
- под каждое задание надо создавать отдельную пару репозиториев (шаблон + тесты)

Пока ощущение такое, что для преподавателя намного проще скачивать полностью все репозитории и проверять с GradeR. Однако студентам было бы полезнее заранее видеть результат тестов, поэтому буду еще думать.

Если у кого-то есть опыт решения этой проблемы малой кровью, буду рада услышать. #gradeR
🔥5❤‍🔥4👍2
У коллег из ИТМО завтра интересный движ про гуманность, гуманизм и гуманитарность, в связи с чем я вдруг призадумалась, как для себя соотношу все эти понятия.

Наверное, так (но это во мне говорит переводчик Йегера):

- гуманность – это качества, подобающие человеку, Bild или Form;
- гуманизм – институты (в широком смысле) воспитания и культуры, которые эти качества поддерживают (Bildung или Formation);
- гуманитарные науки — то, что поддерживает сам гуманизм, типа монашества в Церкви (все не могут так жить, но кто-то обязательно должен).

При этом разлепить второе и третье я могу только концептуально, не на практике.
15🔥5👏4
🖼️ В Вышке закончился первый учебный модуль, время открывать новый тег с обзором обновлений и доработок курса по R для ОП «Цифровые методы в гуманитарных науках». В прошлом году это был тег #tar2024, но, как становится понятно, это история не на один год, так что пусть будет просто #tar (=Text Analysis with R), на вырост.

🔹 Из урока по табличным данным после некоторых колебаний все же полностью убрала датафреймы, как советовал еще в прошлом году Георгий Мороз. Сразу бескомпромиссный tidyverse во всем!

🔹 Существенно переработала урок по итерациям и функциям, уделив особое внимание теме таинственного аргумента «три точки». Три точки — это сила!

🔹 Разбила на два урока единую тему структурированных данных; теперь JSON отдельно, XML отдельно. Каждый блок существенно расширила, в JSON добавила примеры запросов по API (но эту часть еще надо будет допиливать, там остались мелкие косяки).

🔹 После колебаний все же полностью перешла с пакета XML на xml2. Долго не понимала, зачем (потому что училась по этой книге), но наконец оценила его достоинства: все векторизовано, никаких sapply() и прочих сложных обходов дерева узлов. Опрятно, что и говорить. Буду дальше пользоваться.

🔹 Добавилось новое домашнее задание по мотивам проекта Tolstoy Digital! Огромное спасибо Анастасии Бонч-Осмоловской и Борису Орехову за помощь.

🔹 Экспериментировала с разными методами OCR, очень полезно, о практических результатах расскажут чуть позже коллеги отдельным постом (мы дообучили модель Tesseract!) Основная сложность для студентов пока — дообучение сложно запускать на Windows, а в облаке Posit нет прав для использования команды sudo. Все равно сделали много!

🔹 За техническую поддержку благодарю еще раз Александру Горшенину, за материал для распознавания— Анастасию Богданову, за проверку эталонных данных — Анастасию Богданову и Анастасию Орлову, за подготовку эталонных данных — студентов ОП «Компаративистика», за помощь с проверкой дз — Дарью Галкину, Владу Гурьеву и снова Настю Орлову. Скоро, надеюсь, сможем рассказать больше.

🔹В планах — переработать и остальные уроки; учесть вышедшие за прошедшие месяцы обновления (следить за ними ОЧЕНЬ помогает канал «Наука и данные» @naukaidannye ) и кое-что переделать, а также добавить несколько новых тем.

Ухожу на короткие каникулы — но не отдыхать, а писать очередную заявку, статью и курс лекций.
Please open Telegram to view this post
VIEW IN TELEGRAM
25❤‍🔥11🥰8👍4🔥4
RAntiquity
Коллеги обратили внимание на вышедший недавно сразу на двух языках сборник: Nunn, Christopher A. und van Oorschot, Frederike (Hrsg.): Compendium Computational Theology, Bd. 1: Introducing Digital Humanities to Theology, Heidelberg: heiBOOKS, 2024. https:…
Стоило пошутить по поводу возможности применения количественных методов в теологии, как на отзыв прилетела диссертация по теологии… с применением количественных методов. Очень, между прочим, интересная, чуть позже напишу подробнее. В итоге что? Сижу в ночи лемматизирую Оригена. Осторожнее надо шутить, осторожнее 😇
🔥13💋13💅3👻1
RAntiquity
Потратила некоторое время, чтобы разобраться с настройками автоматической проверки кода на R в GitHub Classroom. Вот тут подробная инструкция: https://teletype.in/@locusclassicus/autograding-github-classroom-r Особенности: - поначалу можно сломать голову…
Охота пуще неволи: один раз решишь, что надо настроить автопроверку, и потом все — как babulenka в “Игроке” Достоевского, начала играть, так уж не остановишь. Столько времени потрачено на эту затею, и так хочется “отыграться” (спойлер: все получилось). И перед мысленным взором носятся образы разных героев, непременно рационализаторов и сторонников прогресса. Поэтому мои входящие за эту ночь выглядят так.

Правда, в отличие от “бабуленьки”, я кое-какую пользу из этого извлекла, все настроила, все постигла и теперь чувствую себя как Фауст. #gradeR
21😁3
Сегодня у меня день рождения, и я решила для разнообразия поделать что-то для души. Посчитать, например, сколько раз упоминается мистер Дарси и Элизабет в главах “Гордости и предубеждения” (спасибо Джулии Силги за пакет janeaustenr). И в очередной раз убедилась, что симметрия — признак мастерства 🐾

аналитика in touch with feminine side
Please open Telegram to view this post
VIEW IN TELEGRAM
61😁2
Молчала, писала (в том числе код 🤯 на языке R), формулировала и, наконец, с анонсом — мы с «Искрой» преодолели первое «цифровое» испытание — автоматизацию распознавания текста газеты.

Под чутким руководством и с огромной поддержкой моего научного руководителя @locusclassicus подготовлена модель распознавания дореформенной русской орфографии (на материале «Искры»). Теперь эта модель опубликована в открытом репозитории — вместе с описанием, кодом и метриками.

Публикация материалов на GitHub позволит независимо проверить полученные результаты, использовать модель как отправную точку для дальнейших экспериментов и включить её в новые исследования, связанные с автоматическим распознаванием дореформенных текстов.

Проверка распознавания моделью текста на независимых данных показала высокий уровень точности: ошибка на уровне символов (CER, Character Error Rate) — около ~2%.

Исходники и документация:
https://github.com/AButon-8/iskra_ocr
🔥23🙏12👨‍💻431
Forwarded from Инфокультура
Объявлен приём заявок на Премию «Открытый доступ к данным в гуманитарных науках»

АНО «Инфокультура» приглашает студентов, аспирантов, преподавателей, исследователей и сотрудников вузов и научных организаций принять участие в конкурсе проектов, способствующих развитию открытой науки в гуманитарной сфере.

📌 Что можно подать:
– результаты научных исследований,
– цифровые проекты, связанные с гуманитарными дисциплинами,
– дипломные и курсовые проекты,
– иные работы, представляющие гуманитарные данные в открытом доступе.

📚 Номинации Премии:
• История
• Филология
• Культура
• Искусство
• Иные гуманитарные науки

Номинировать проект может как сам автор (или коллектив авторов), так и любой человек или организация, знакомые с проектом. Год публикации работы не имеет значения.

🏅 Лауреаты получат памятные награды, сертификаты и специальные призы от организаторов и партнёров Премии.
📝 Приём заявок уже открыт!

🔗 https://humawards.ru

#opendata #openaccess #humanitarian #contest
11
Произведена революция в картографировании римских дорог

Международная команда археологов создала цифровую карту дорожной сети Римской империи «Itiner-e», почти удвоив известную протяжённость древнеримских дорог — с 190 тысяч до 300 тысяч километров, что эквивалентно семикратному обхвату Земли по экватору.

☝️Центральным открытием стало осознание того, что даже столь впечатляющая карта охватывает лишь около 3 процентов всей дорожной сети великой империи. Это стало и огромным сюрпризом, и одновременно призывом к действию, указывающим направления для будущих исследований.

Методология объединила разнородные источники: данные Баррингтонского атласа 2000 года, исторические маршрутники, дорожные столбы, археологические находки, карты XIX–XX веков и современные публикации. Сведения сопоставлялись с аэрофотоснимками, спутниковыми изображениями и историческими картами времён до Второй мировой войны, когда следы дорог были более видны. Исследователи даже научились находить дороги под современными водохранилищами, используя снимки, сделанные до строительства плотин.

Новая карта охватывает 40 современных стран и включает 14 769 дорожных сегментов, каждый с информацией об источниках и оценкой достоверности. Значительно расширены знания о дорогах в Иберии, Греции и Северной Африке. Впервые систематизированы около 200 тысяч километров второстепенных дорог — сельских трактов, соединявших виллы и фермы.

Главные транспортные узлы располагались вовсе не в самом Риме, а в долине реки По и альпийском коридоре северной Италии.

Проект обнаружил поразительный уровень преемственности в использовании римских дорог на протяжении двух тысячелетий: многие из дорог остаются действующими и сегодня.

▫️Платформа Itiner-e, названная «Google Maps для римских дорог», включает инструмент поиска маршрутов и доступна для свободного скачивания. Каждый дорожный сегмент имеет уникальный URI для цитирования. Команда продолжает расширять проект, надеясь создать самую всеобъемлющую карту, которую когда-либо видел мир. Как подчёркивает Бругманс, «триста тысяч километров — это лишь верхушка айсберга».

Исследование опубликовано в журнале Scientific Data, а самостоятельно изучить Itiner-e можно здесь. @everydayint
🥰17🔥117👍4
лично я убежден что в гуманитарных науках цифровизация без открытости не ведет к формированию общественного блага, а ничем другим инициативы в области культуры, истории и тд. быть не могут.


золотые слова
19🔥1