RAntiquity – Telegram

RAntiquity

1.09K subscribers

295 photos

10 videos

5 files

539 links

Об античности на языке R и не только

@locusclassicus

Download Telegram

About

Blog

Apps

Platform

1.09K subscribers

Добрый вечер.

❤16

817 viewsOlga Alieva, 19:40

Сегодня упражнялась с Google Books API, который совершенно бесплатно, то есть даром, возвращает метаданные к литературе по запросу. Между прочим, там есть и ссылка на обложку, так что вот. A little bit of {magick}✨✨

🔥13❤5✍4

911 viewsOlga Alieva, 20:47

Действительно, петух.

🔥16

1.04K viewsOlga Alieva, 20:50

Forwarded from Antibarbari HSE (Olga Alieva)

Как говорить по-древнегречески о котиках, маркитантках и карантине? Узнали сегодня из лекции Льва Шадрина о дневниках Карла Бенедикта Хазе.

Свидетель «времен очаковских» и наставник Наполеона III, византинист, по личному распоряжению графа Николая Румянцева издавший Льва Диакона, бонвиван и немножко фальсификатор, Хазе описывает на аттическом наречии Париж начала XIX в., в котором золотая молодежь буянит в кабаках, женщины переодеваются в атласные штаны, а котик Портной, разбив кувшин, получает четверть курочки.

Удивительный документ эпохи благодаря проекту LAGOOS и новейшим цифровым инструментам возвращает к жизни целую эпоху. Смотрите новое видео в рубрике #antibarbari_colloquia

❤10🔥2

943 viewsOlga Alieva, 05:54

Интересное: история понятий + средние века + text mining https://t.iss.one/DHRIsfu/879

Гуманитарии в цифре

🙂 История понятий — особое научное направление, возникшее в 60-70-е гг. ХХ века. Ученые традиционно изучают контекст и смысловые сдвиги, но что происходит, когда к решению исследовательских задач подключаются методы анализа больших данных?

Обсудим на очередном…

👍12

837 viewsOlga Alieva, 07:05

А у вас нет такого же, но с перламутровыми пуговицами? #gpt

😁20

913 viewsOlga Alieva, 08:25

This media is not supported in your browser

VIEW IN TELEGRAM

Гуманист: 🦜
Цифровой гуманист:

❤17

864 viewsOlga Alieva, 13:24

Потратила некоторое время, чтобы разобраться с настройками автоматической проверки кода на R в GitHub Classroom. Вот тут подробная инструкция: https://teletype.in/@locusclassicus/autograding-github-classroom-r

Особенности:
- поначалу можно сломать голову, но дальше проще;
- нет (пока не вижу) возможности оценивать не по бинарной шкале (passed / failed), а более нюансированно;
- на бесплатном плане придется сделать видимыми студенческие репозитории из-за ограничений Actions;
- под каждое задание надо создавать отдельную пару репозиториев (шаблон + тесты)

Пока ощущение такое, что для преподавателя намного проще скачивать полностью все репозитории и проверять с GradeR. Однако студентам было бы полезнее заранее видеть результат тестов, поэтому буду еще думать.

Если у кого-то есть опыт решения этой проблемы малой кровью, буду рада услышать. #gradeR

Автоматическая проверка заданий на языке R в GitHub Classroom

1.1. Тесты не должны быть видны студентам, поэтому создаем в организации GitHub приватный репозиторий с заданиями, например...

🔥5❤‍🔥4👍2

919 viewsOlga Alieva, edited 07:37

У коллег из ИТМО завтра интересный движ про гуманность, гуманизм и гуманитарность, в связи с чем я вдруг призадумалась, как для себя соотношу все эти понятия.

Наверное, так (но это во мне говорит переводчик Йегера):

- гуманность – это качества, подобающие человеку, Bild или Form;
- гуманизм – институты (в широком смысле) воспитания и культуры, которые эти качества поддерживают (Bildung или Formation);
- гуманитарные науки — то, что поддерживает сам гуманизм, типа монашества в Церкви (все не могут так жить, но кто-то обязательно должен).

При этом разлепить второе и третье я могу только концептуально, не на практике.

провода+болота

про гуманность, гуманизм и гуманитарность корпораций

22 октября в 18.30 мы будем говорить про гуманитарную миссию и социальную ответственность корпораций. компания подходящая — люди, принимающие решения в Сбере, Яндексе и Т-Банке. компания такая:
- Альберт…

❤15🔥5👏4

925 viewsOlga Alieva, 16:23

🖼️ В Вышке закончился первый учебный модуль, время открывать новый тег с обзором обновлений и доработок курса по R для ОП «Цифровые методы в гуманитарных науках». В прошлом году это был тег #tar2024, но, как становится понятно, это история не на один год, так что пусть будет просто #tar (=Text Analysis with R), на вырост.

🔹 Из урока по табличным данным после некоторых колебаний все же полностью убрала датафреймы, как советовал еще в прошлом году Георгий Мороз. Сразу бескомпромиссный tidyverse во всем!

🔹 Существенно переработала урок по итерациям и функциям, уделив особое внимание теме таинственного аргумента «три точки». Три точки — это сила!

🔹 Разбила на два урока единую тему структурированных данных; теперь JSON отдельно, XML отдельно. Каждый блок существенно расширила, в JSON добавила примеры запросов по API (но эту часть еще надо будет допиливать, там остались мелкие косяки).

🔹 После колебаний все же полностью перешла с пакета XML на xml2. Долго не понимала, зачем (потому что училась по этой книге), но наконец оценила его достоинства: все векторизовано, никаких sapply() и прочих сложных обходов дерева узлов. Опрятно, что и говорить. Буду дальше пользоваться.

🔹 Добавилось новое домашнее задание по мотивам проекта Tolstoy Digital! Огромное спасибо Анастасии Бонч-Осмоловской и Борису Орехову за помощь.

🔹 Экспериментировала с разными методами OCR, очень полезно, о практических результатах расскажут чуть позже коллеги отдельным постом (мы дообучили модель Tesseract!) Основная сложность для студентов пока — дообучение сложно запускать на Windows, а в облаке Posit нет прав для использования команды sudo. Все равно сделали много!

🔹 За техническую поддержку благодарю еще раз Александру Горшенину, за материал для распознавания— Анастасию Богданову, за проверку эталонных данных — Анастасию Богданову и Анастасию Орлову, за подготовку эталонных данных — студентов ОП «Компаративистика», за помощь с проверкой дз — Дарью Галкину, Владу Гурьеву и снова Настю Орлову. Скоро, надеюсь, сможем рассказать больше.

🔹В планах — переработать и остальные уроки; учесть вышедшие за прошедшие месяцы обновления (следить за ними ОЧЕНЬ помогает канал «Наука и данные» @naukaidannye ) и кое-что переделать, а также добавить несколько новых тем.

Ухожу на короткие каникулы — но не отдыхать, а писать очередную заявку, статью и курс лекций.

Please open Telegram to view this post

VIEW IN TELEGRAM

locusclassicus.github.io

Компьютерный анализ текста

❤25❤‍🔥11🥰8👍4🔥4

1.12K viewsOlga Alieva, 21:52

Коллеги обратили внимание на вышедший недавно сразу на двух языках сборник: Nunn, Christopher A. und van Oorschot, Frederike (Hrsg.): Compendium Computational Theology, Bd. 1: Introducing Digital Humanities to Theology, Heidelberg: heiBOOKS, 2024. https:…

Стоило пошутить по поводу возможности применения количественных методов в теологии, как на отзыв прилетела диссертация по теологии… с применением количественных методов. Очень, между прочим, интересная, чуть позже напишу подробнее. В итоге что? Сижу в ночи лемматизирую Оригена. Осторожнее надо шутить, осторожнее 😇

🔥13💋13💅3👻1

939 viewsOlga Alieva, 22:36

Потратила некоторое время, чтобы разобраться с настройками автоматической проверки кода на R в GitHub Classroom. Вот тут подробная инструкция: https://teletype.in/@locusclassicus/autograding-github-classroom-r Особенности: - поначалу можно сломать голову…

Охота пуще неволи: один раз решишь, что надо настроить автопроверку, и потом все — как babulenka в “Игроке” Достоевского, начала играть, так уж не остановишь. Столько времени потрачено на эту затею, и так хочется “отыграться” (спойлер: все получилось). И перед мысленным взором носятся образы разных героев, непременно рационализаторов и сторонников прогресса. Поэтому мои входящие за эту ночь выглядят так.

Правда, в отличие от “бабуленьки”, я кое-какую пользу из этого извлекла, все настроила, все постигла ~~и теперь чувствую себя как Фауст~~. #gradeR

❤21😁3

1.01K viewsOlga Alieva, edited 11:22

Сегодня у меня день рождения, и я решила для разнообразия поделать что-то для души. Посчитать, например, сколько раз упоминается мистер Дарси и Элизабет в главах “Гордости и предубеждения” (спасибо Джулии Силги за пакет janeaustenr). И в очередной раз убедилась, что симметрия — признак мастерства 🐾

аналитика in touch with feminine side

Please open Telegram to view this post

VIEW IN TELEGRAM

❤61😁2

1.16K viewsOlga Alieva, edited 11:21

Forwarded from Библиотека Парвуса 📕

Молчала, писала (в том числе код 🤯 на языке R), формулировала и, наконец, с анонсом — мы с «Искрой» преодолели первое «цифровое» испытание — автоматизацию распознавания текста газеты.

Под чутким руководством и с огромной поддержкой моего научного руководителя @locusclassicus подготовлена модель распознавания дореформенной русской орфографии (на материале «Искры»). Теперь эта модель опубликована в открытом репозитории — вместе с описанием, кодом и метриками.

Публикация материалов на GitHub позволит независимо проверить полученные результаты, использовать модель как отправную точку для дальнейших экспериментов и включить её в новые исследования, связанные с автоматическим распознаванием дореформенных текстов.

Проверка распознавания моделью текста на независимых данных показала высокий уровень точности: ошибка на уровне символов (CER, Character Error Rate) — около ~2%.

Исходники и документация:
→ https://github.com/AButon-8/iskra_ocr

🔥23🙏12👨‍💻4❤3⚡1

927 viewsOlga Alieva, 20:55

Forwarded from Инфокультура

Объявлен приём заявок на Премию «Открытый доступ к данным в гуманитарных науках»

АНО «Инфокультура» приглашает студентов, аспирантов, преподавателей, исследователей и сотрудников вузов и научных организаций принять участие в конкурсе проектов, способствующих развитию открытой науки в гуманитарной сфере.

📌 Что можно подать:
– результаты научных исследований,
– цифровые проекты, связанные с гуманитарными дисциплинами,
– дипломные и курсовые проекты,
– иные работы, представляющие гуманитарные данные в открытом доступе.

📚 Номинации Премии:
• История
• Филология
• Культура
• Искусство
• Иные гуманитарные науки

Номинировать проект может как сам автор (или коллектив авторов), так и любой человек или организация, знакомые с проектом. Год публикации работы не имеет значения.

🏅 Лауреаты получат памятные награды, сертификаты и специальные призы от организаторов и партнёров Премии.
📝 Приём заявок уже открыт!

🔗 https://humawards.ru

#opendata #openaccess #humanitarian #contest

❤11

634 viewsOlga Alieva, 15:54

Forwarded from Научный репортер

Произведена революция в картографировании римских дорог

Международная команда археологов создала цифровую карту дорожной сети Римской империи «Itiner-e», почти удвоив известную протяжённость древнеримских дорог — с 190 тысяч до 300 тысяч километров, что эквивалентно семикратному обхвату Земли по экватору.

☝️Центральным открытием стало осознание того, что даже столь впечатляющая карта охватывает лишь около 3 процентов всей дорожной сети великой империи. Это стало и огромным сюрпризом, и одновременно призывом к действию, указывающим направления для будущих исследований.

Методология объединила разнородные источники: данные Баррингтонского атласа 2000 года, исторические маршрутники, дорожные столбы, археологические находки, карты XIX–XX веков и современные публикации. Сведения сопоставлялись с аэрофотоснимками, спутниковыми изображениями и историческими картами времён до Второй мировой войны, когда следы дорог были более видны. Исследователи даже научились находить дороги под современными водохранилищами, используя снимки, сделанные до строительства плотин.

Новая карта охватывает 40 современных стран и включает 14 769 дорожных сегментов, каждый с информацией об источниках и оценкой достоверности. Значительно расширены знания о дорогах в Иберии, Греции и Северной Африке. Впервые систематизированы около 200 тысяч километров второстепенных дорог — сельских трактов, соединявших виллы и фермы.

Главные транспортные узлы располагались вовсе не в самом Риме, а в долине реки По и альпийском коридоре северной Италии.

Проект обнаружил поразительный уровень преемственности в использовании римских дорог на протяжении двух тысячелетий: многие из дорог остаются действующими и сегодня.

▫️Платформа Itiner-e, названная «Google Maps для римских дорог», включает инструмент поиска маршрутов и доступна для свободного скачивания. Каждый дорожный сегмент имеет уникальный URI для цитирования. Команда продолжает расширять проект, надеясь создать самую всеобъемлющую карту, которую когда-либо видел мир. Как подчёркивает Бругманс, «триста тысяч километров — это лишь верхушка айсберга».

Исследование опубликовано в журнале Scientific Data, а самостоятельно изучить Itiner-e можно здесь. @everydayint

🥰17🔥11❤7👍4

837 viewsOlga Alieva, 10:13

Научный репортер

Произведена революция в картографировании римских дорог Международная команда археологов создала цифровую карту дорожной сети Римской империи «Itiner-e», почти удвоив известную протяжённость древнеримских дорог — с 190 тысяч до 300 тысяч километров, что эквивалентно…

просто под предлогом исследования римских дорог товарищи обфотографировали каждую тропинку в европе и рядом, ничего подозрительного

😁19👏6🤣3

1.14K viewsOlga Alieva, 10:23

Научный репортер

Произведена революция в картографировании римских дорог Международная команда археологов создала цифровую карту дорожной сети Римской империи «Itiner-e», почти удвоив известную протяжённость древнеримских дорог — с 190 тысяч до 300 тысяч километров, что эквивалентно…

за кулисами развернулась научная дискуссия

😁19🤣10👍3🔥1

909 viewsOlga Alieva, 10:30

лично я убежден что в гуманитарных науках цифровизация без открытости не ведет к формированию общественного блага, а ничем другим инициативы в области культуры, истории и тд. быть не могут.

золотые слова

В контексте премии по открытому доступу в гуманитарных науках (humawards.ru) о том как предоставлять материалы в открытом доступе.

1. В основе открытости данных исследователей лежат принципы FAIR (Findability, Accessibility, Interoperability, Reuse). Описание…

❤19🔥1

1.04K viewsOlga Alieva, 15:40