Выжимка статей
Научная статья — в выжимку, а не в стопку «прочитать потом»
Вставьте ссылку на статью или перетащите PDF-файл — ключевые результаты вернутся структурной выжимкой по-русски. Без регистрации.
Научные статьи
Ссылка или PDF на входе — структурная выжимка на выходе
Тот же инструмент работает в Telegram: отправьте PDF в @vustSummaryBot — и структурная выжимка вернётся в чат. Здесь, на сайте, есть два пути. Ссылка arXiv, PubMed или DOI — статья загружается по вашему адресу автоматически. Либо перетащите PDF-файл: текст извлекается локально в вашем браузере, сам файл не покидает устройство, а на суммаризацию уходит только извлечённый текст.
До и после
Одна ссылка или один файл — структурная выжимка. Любая статья в открытом доступе.
Как пользоваться
Вставьте ссылку на статью — arXiv, PubMed, DOI, SSRN — или перетащите PDF-файл.
Инструмент загрузит текст статьи или извлечёт его из вашего PDF (до 50 страниц).
Получите структурную выжимку: ключевые результаты, методы и что из них следует.
Что инструмент делает
- PDF-файлы до 15 МБ — текст извлекается прямо в вашем браузере, файл никуда не отправляется
- Научные статьи, white paper, электронные книги, бизнес-отчёты, техническая документация, слайды лекций
- Многосекционные документы — структура разделов сохраняется, если в PDF есть внятное оглавление
- Четыре формата: тезисы, абзац, ключевые выводы и TL;DR — с ограничением длины
- Выжимка приходит по-русски, даже если статья на английском
- Название документа — с первой страницы или из метаданных PDF — попадает в шапку
Что вне его задач
- Сканы без текстового слоя — извлекать нечего; сначала прогоните документ через OCR
- Зашифрованные PDF и файлы под паролем — открыть их нельзя
- Файлы больше 15 МБ — разделите документ или выделите нужный раздел
- Документы, где вёрстка важна не меньше текста: схемы, комиксы, инфографика — визуальная часть теряется
Выжимка из PDF работает с текстом — не с вёрсткой, не с рисунками и не с формулами-картинками. Разбор ниже — о том, что переживает извлечение, когда сначала нужен OCR и как подготовить файл.
Частые вопросы
Какие источники статей поддерживаются?
arXiv, PubMed, ссылки DOI (doi.org), SSRN, Nature, Science, IEEE, ACM, Springer, Wiley, bioRxiv, medRxiv и большинство издательств с открытым доступом. Можно и просто перетащить PDF-файл.
Как работает загрузка PDF?
PDF обрабатывается локально в вашем браузере: текст извлекается на вашем устройстве, и на сервер уходит только текст. Сам файл не покидает компьютер.
Какие ограничения у загрузки PDF?
Файл до 15 МБ, до 50 страниц и до 50 000 знаков извлечённого текста. Для большинства статей этого хватает на весь документ; более длинный файл разбирается по началу — до того предела, который наступит раньше.
На каком языке придёт выжимка?
На языке вашего интерфейса. Англоязычная статья превращается в русскую выжимку с сохранением терминов — читать оригинал со словарём не обязательно, а для цитирования всегда можно вернуться к исходному тексту.
Это бесплатно?
Да. На сайте есть бесплатный запас: три выжимки в одном браузере, общие для всех источников; одна попытка возвращается каждые четыре часа. У @vustSummaryBot запас отдельный — три коротких выжимки в день.
Читаете статьи с телефона?
@vustSummaryBot разбирает те же ссылки и PDF прямо в Telegram.