Regex для организации файлов: руководство для начинающих по умным правилам
Изучите regex-правила для организации файлов с нуля. 10 готовых шаблонов для сортировки скриншотов, счетов, дубликатов и многого другого с File Arbor.
Что такое regex и почему это важно для организации файлов?
Вы, вероятно, уже умеете искать файлы по имени. Введите «invoice» в файловый менеджер — и получите каждый файл с «invoice» в названии. Просто. Но что, если нужно найти каждый PDF-счёт, начинающийся с «INV-» и последующим числом? Или каждый скриншот, независимо от того, называется он «Screenshot», «Screen Shot» или «Capture»? Вот тут в дело вступает regex.
Regex (сокращение от Regular Expression — регулярное выражение) — это язык сопоставления с образцами. Представьте его как поисковый запрос на стероидах. Вместо поиска по точному тексту вы описываете паттерн текста. Один regex-шаблон может соответствовать сотням различных имён файлов, имеющих общую структуру.
File Arbor использует regex в своей функции Умные правила. Когда Быстрых правил недостаточно для ваших потребностей, вы можете создать пользовательское правило с regex-шаблоном. File Arbor затем сопоставляет входящие файлы с этим шаблоном и автоматически перемещает их в указанную папку. Это один из самых мощных способов автоматизировать рабочий процесс организации файлов.
Для использования regex не нужна степень в информатике. В этом руководстве мы разберём основы и дадим 10 готовых шаблонов, покрывающих самые распространённые сценарии. К концу вы будете создавать собственные шаблоны с уверенностью.
Если вы совсем новичок в File Arbor, начните с руководства по началу работы, а потом вернитесь сюда.
Основы regex для имён файлов
Прежде чем перейти к практическим шаблонам, заложим прочный фундамент. Каждая концепция regex ниже — то, что вы реально будете использовать при организации файлов. Теорию сведём к минимуму, а примеры — к конкретике.
Литералы: точное совпадение текста
Простейший regex — обычный текст. Шаблон invoice соответствует любому имени файла, содержащему слово «invoice» в любом месте.
Шаблон: invoice
Совпадёт: invoice-2026.pdf, my_invoice.docx, January-invoice-final.pdf
Это идентично базовому текстовому поиску. Сила regex проявляется во всём, что можно добавить поверх.
Подстановочные символы: точка и звёздочка
Точка . соответствует любому одному символу (букве, цифре, пробелу, спецсимволу — чему угодно, кроме переноса строки). Комбинация .* соответствует любой последовательности символов любой длины, включая пустую строку.
Шаблон: report.*pdf
Совпадёт: report-2026.pdf, report_final.pdf, report.pdf
Здесь .* заполняет промежуток между «report» и «pdf» независимо от того, какие символы между ними.
Символьные классы: конкретные типы символов
Квадратные скобки позволяют определить набор символов для совпадения в одной позиции:
[0-9]— любая одна цифра (от 0 до 9)[a-z]— любая одна строчная буква[A-Za-z]— любая буква, верхнего или нижнего регистра[aeiou]— любая гласная
Шаблон: IMG_[0-9][0-9][0-9][0-9]
Совпадёт: IMG_0001, IMG_2026, IMG_9999
Также можно отрицать класс с помощью ^ внутри скобок. [^0-9] соответствует всему, что не является цифрой.
Квантификаторы: сколько раз?
Квантификаторы контролируют, сколько раз предыдущий элемент должен повториться:
+означает один или более раз*означает ноль или более раз?означает ноль или один раз (делает элемент необязательным){3}означает ровно 3 раза{2,5}означает от 2 до 5 раз
С квантификаторами наш предыдущий пример значительно упрощается:
Шаблон: IMG_[0-9]{4}
Совпадёт: IMG_0001, IMG_2026, IMG_9999
Сокращение \d эквивалентно [0-9], поэтому можно также написать IMG_\d{4}. Аналогично, \w соответствует любому «словесному» символу (буквы, цифры и подчёркивания).
Якоря: начало и конец имени файла
Якоря соответствуют не символу, а позиции в тексте:
^соответствует началу имени файла$соответствует концу имени файла
Это критически важно для организации файлов. Без якорей invoice совпадёт с «my_invoice_backup.pdf» и «not-an-invoice-really.txt». С якорями вы получаете точность:
Шаблон: ^invoice.*\.pdf$
Совпадёт: invoice-2026.pdf, invoice_march.pdf
Пропустит: my_invoice.pdf, invoice.docx
Обратите внимание на \.pdf$ в конце. Обратная косая черта экранирует точку, чтобы она соответствовала буквальной точке, а не «любому символу». Это одна из самых частых операций в regex для имён файлов: точное соответствие расширению.
Группы: комбинирование альтернатив
Круглые скобки () группируют части шаблона, а вертикальная черта | означает «или»:
Шаблон: \.(jpg|png|gif)$
Совпадёт: photo.jpg, logo.png, animation.gif
Пропустит: photo.bmp, document.pdf
Так можно сопоставлять несколько расширений файлов в одном правиле. Группы также можно комбинировать с квантификаторами. Например, (ab)+ соответствует «ab», «abab», «ababab» и так далее.
Типичный шаблон расширений файлов
Один шаблон, который вы будете использовать регулярно — соответствие набору расширений:
\.(jpg|jpeg|png|gif|webp|svg)$ # Изображения
\.(mp4|avi|mkv|mov|wmv)$ # Видео
\.(doc|docx|pdf|txt|odt)$ # Документы
\.(mp3|wav|flac|aac|ogg)$ # Аудио
С этими строительными блоками вы готовы к реальным шаблонам организации файлов.
10 практических regex-шаблонов для организации файлов
Вот десять готовых к копированию regex-шаблонов, решающих самые распространённые проблемы файлового беспорядка. Каждый объяснён, чтобы вы понимали, как он работает, и могли адаптировать под свои нужды.
1. Скриншоты
Каждая ОС именует скриншоты по-своему. macOS использует «Screenshot», старые версии macOS — «Screen Shot», Windows тоже «Screenshot». Некоторые инструменты используют «Capture».
^(Screenshot|Screen Shot|Capture).*\.(png|jpg)$
Как работает: Соответствует именам файлов, начинающимся с любого из трёх префиксов, за которым следует что угодно (временная метка), с расширением .png или .jpg.
Рекомендуемое назначение: Screenshots/
2. Дубликаты файлов
Когда вы скачиваете тот же файл дважды, браузер добавляет (1), (2) и т. д. Некоторые системы используют -copy.
.*\(\d+\)\.[a-zA-Z]+$
Ловит файлы вроде report (1).pdf, image (3).png и budget (12).xlsx. Для варианта с «-copy» добавьте альтернативу:
.*(\(\d+\)|-copy)\.[a-zA-Z]+$
Рекомендуемое назначение: Duplicates/ (периодически проверяйте и удаляйте)
3. Счета и квитанции
Счета часто следуют предсказуемым шаблонам именования, особенно при скачивании из бухгалтерского ПО или вложений электронной почты.
^(invoice|INV|facture|bill|receipt)[-_]?\d+.*\.pdf$
Как работает: Начинается с распространённого ключевого слова для счёта (покрыты разные варианты регистра), опционально за которым следует дефис или подчёркивание, затем цифры (номер счёта), затем что угодно, оканчиваясь на .pdf. Термин «facture» покрывает франкоязычные счета.
Рекомендуемое назначение: Finance/Invoices/
4. Установщики программ
Установщики и пакетные файлы накапливаются в папке «Загрузки». Этот шаблон ловит их все.
.*\.(exe|msi|dmg|pkg|deb|rpm|appimage)$
Как работает: Соответствует любому имени файла с распространённым расширением установщика. Без якоря в начале, потому что имена установщиков сильно различаются.
Рекомендуемое назначение: Installers/ (или просто удалите после установки)
5. Фотографии по соглашению именования камеры
Цифровые камеры и телефоны именуют фотографии с предсказуемым префиксом и датой или порядковым номером.
^(IMG|DSC|P|DSCN|DCIM|PXL)_?\d{8}.*\.(jpg|jpeg|raw|heic|cr2|nef)$
Как работает: Соответствует именам, начинающимся с распространённых префиксов камер (IMG для телефонов, DSC/DSCN для Sony/Nikon, PXL для Pixel), опциональное подчёркивание, затем 8 цифр (обычно дата вроде 20260302), за которыми что угодно, с расширением фотографии.
Рекомендуемое назначение: Photos/Unsorted/
6. Файлы с номерами версий
Макеты дизайна, черновики и документы часто содержат номера версий. Они быстро накапливаются.
.*[-_]v?\d+\.\d+.*
Как работает: Соответствует любому файлу с паттерном, похожим на номер версии. v? делает префикс «v» необязательным, ловя и design-v2.1.psd, и spec-3.0-draft.pdf.
Рекомендуемое назначение: Archives/Versioned/
7. Временные файлы
Временные файлы создаются приложениями и забываются. Они занимают место и захламляют папки.
^~.*|.*\.tmp$|.*\.bak$|.*\.swp$|.*\.cache$
Как работает: Использует оператор | для соответствия нескольким индикаторам временных файлов: файлы, начинающиеся с тильды (~), или оканчивающиеся на .tmp, .bak, .swp или .cache.
Рекомендуемое назначение: Trash/ или прямое удаление
8. Банковские выписки
Банки обычно экспортируют выписки со словом «statement» и шаблоном даты год-месяц.
^(statement|releve|kontoauszug|extrait).*\d{4}[-_]\d{2}.*\.pdf$
Как работает: Начинается с ключевого слова банковской выписки (английское, французское, немецкое), за которым что угодно, затем четырёхзначный год, разделитель и двузначный месяц, оканчиваясь на .pdf. Ловит файлы вроде statement_2026-03.pdf или releve_bancaire_2025_12.pdf.
Рекомендуемое назначение: Finance/Bank Statements/
9. Файлы проектов
Если вы именуете файлы проектов с префиксом «project» или «PRJ» — этот шаблон соберёт их вместе.
^(project|PRJ|proj)[-_]\w+.*
Как работает: Соответствует именам, начинающимся с ключевого слова проекта, за которым разделитель и один или более «словесных» символов (название или код проекта). Файлы вроде project-alpha_v2.docx, PRJ_0042_spec.pdf и proj-website-redesign.fig — все совпадают.
Рекомендуемое назначение: Сортировка по названию проекта в Projects/{project-name}/
10. Заметки и протоколы совещаний
Заметки с совещаний накапливаются в каждом инструменте и формате. Этот шаблон ловит распространённые соглашения именования.
^(meeting|notes|minutes|standup|retro)[-_]\d{4}[-_]\d{2}[-_]\d{2}.*
Как работает: Соответствует файлам, начинающимся с ключевого слова, связанного с совещаниями, за которым дата в формате ГГГГ-ММ-ДД (с дефисами или подчёркиваниями). Ловит meeting-2026-03-02-product-review.docx, notes_2026_01_15.md и аналогичные.
Рекомендуемое назначение: Documents/Meeting Notes/
Как использовать regex-шаблоны в File Arbor
Теперь, когда шаблоны готовы, вот как применить их в File Arbor. Процесс занимает около двух минут на правило.
Шаг 1: Откройте Умные правила
Запустите File Arbor и выберите папку, которую хотите организовать (например, «Загрузки»). Нажмите вкладку Rules в боковой панели, затем New Custom Rule.
Шаг 2: Введите regex-шаблон
В поле Pattern вставьте или введите свой regex-шаблон. Например, для перехвата всех скриншотов:
^(Screenshot|Screen Shot|Capture).*\.(png|jpg)$
Убедитесь, что Match Type установлен на «Regex», а не «Simple» (который поддерживает только базовые подстановочные символы).
Шаг 3: Установите назначение
Выберите, куда должны попадать совпавшие файлы. Нажмите Browse и выберите целевую папку, или введите путь напрямую. Можно указать несуществующую подпапку — File Arbor создаст её автоматически.
Шаг 4: Протестируйте с предпросмотром
Прежде чем включить правило, нажмите кнопку Preview. File Arbor просканирует текущую папку и покажет, какие именно файлы соответствуют шаблону. Это ваша страховочная сеть. Если в предпросмотре появятся неожиданные файлы — уточните шаблон, прежде чем продолжать.
Шаг 5: Включите правило
Когда предпросмотр выглядит правильно, переключите правило в состояние Enabled. Если у вас активен Авто-режим (доступен с Pro-лицензией) — совпавшие файлы будут перемещаться автоматически по мере появления. Иначе нажмите Organize Now для ручного запуска.
Для полного обзора настройки папок и правил смотрите руководство по началу работы. Для сравнения функций Free и Pro, включая Авто-режим — посетите страницу цен.
Тестирование шаблонов перед использованием
Regex может быть непросто составить правильно с первого раза. Перед добавлением шаблона в File Arbor настоятельно рекомендуем протестировать его на regex101.com. Вот как:
- Откройте regex101.com в браузере
- Убедитесь, что вариант (flavor) установлен на ECMAScript (JavaScript), поскольку именно его использует File Arbor внутренне
- Вставьте шаблон в поле «Regular Expression»
- В области «Test String» введите несколько имён файлов — как те, которые должны совпасть, так и те, которые не должны
- Сайт подсвечивает совпадения в реальном времени и объясняет каждую часть шаблона
Это занимает тридцать секунд и может спасти от случайного перемещения не тех файлов. Обязательная привычка для всех, кто работает с regex.
Распространённые ошибки и их исправление
Даже опытные разработчики спотыкаются на этих моментах. Вот самые частые подводные камни regex при организации файлов и их решения.
Забытое экранирование точки
Точка . в regex означает «любой символ». Когда нужно сопоставить буквальную точку (как в расширении файла), её нужно экранировать обратной косой чертой.
# Неправильно — совпадёт и «reportXpdf»
report.pdf
# Правильно — только буквальная точка
report\.pdf
Это самая распространённая ошибка. В каждом шаблоне расширения файла используйте \. перед буквами расширения.
Слишком жадные шаблоны
Квантификатор .* по умолчанию жадный — захватывает максимально возможное. Обычно это нормально для имён файлов, так как они короткие, но может вызвать неожиданное поведение при неудачной комбинации.
# Слишком широко — совпадёт с любым PDF
.*\.pdf$
# Лучше — совпадёт только со счетами
^invoice.*\.pdf$
Будьте максимально конкретны с началом шаблона. Используйте ^ для привязки к началу имени файла, если целевые файлы имеют общий префикс.
Чувствительность к регистру
По умолчанию regex чувствителен к регистру. invoice не совпадёт с «Invoice» или «INVOICE». В File Arbor можно включить переключатель Case Insensitive при создании пользовательского правила. Альтернативно можно обработать это в самом шаблоне:
# Ручная обработка распространённых вариантов
^(invoice|Invoice|INVOICE).*\.pdf$
# Или символьный класс для первой буквы
^[iI]nvoice.*\.pdf$
Переключатель нечувствительности к регистру в File Arbor — более чистый подход и рекомендуется.
Забытый якорь конца для расширений
Без $ в конце шаблон расширения может совпасть с тем, что вы не планировали:
# Неправильно — совпадёт с «photo.jpg.bak» и «photo.jpg_backup»
.*\.jpg
# Правильно — только файлы, ОКАНЧИВАЮЩИЕСЯ на .jpg
.*\.jpg$
Всегда используйте $ при сопоставлении расширений, чтобы гарантировать, что расширение — в самом конце имени файла.
Чрезмерно сложные шаблоны
Если шаблон становится длинным и нечитаемым — разбейте его на несколько правил. Два простых правила лучше одного непонятного regex. File Arbor позволяет создавать сколько угодно пользовательских правил — нет причин втискивать всё в один шаблон.
# Вместо одного монстр-шаблона для всех медиафайлов...
# Правило 1: Изображения
\.(jpg|jpeg|png|gif|webp|svg)$
# Правило 2: Видео
\.(mp4|avi|mkv|mov|wmv)$
# Правило 3: Аудио
\.(mp3|wav|flac|aac|ogg)$
Каждое правило может отправлять файлы в разное место, обеспечивая более чистую организацию и простоту обслуживания.
Создание собственных шаблонов
Когда освоитесь с основами, создание пользовательских шаблонов следует простому процессу:
- Посмотрите на файлы. Что общего у имён файлов, которые вы хотите сопоставить? Запишите общие элементы.
- Определите переменные части. Что меняется между файлами? Даты, числа, названия проектов? Они становятся подстановочными символами или символьными классами.
- Напишите шаблон. Начните просто. Сначала добейтесь базового соответствия, затем добавляйте точность.
- Протестируйте на regex101.com. Вставьте реальные имена файлов из ваших папок и проверьте.
- Предпросмотрите в File Arbor. Используйте кнопку Preview для перепроверки на реальных файлах.
- Итерируйте. Если что-то не так — скорректируйте и проверьте снова.
Шаблоны в этом руководстве покрывают самые распространённые сценарии, но ваши файлы уникальны. Комбинация знания regex и Умных правил File Arbor даёт гибкость для решения любой задачи организации.
Что дальше?
Теперь у вас есть фундамент для использования regex в организации файлов как профи. Начните с готовых шаблонов выше, адаптируйте их под ваши соглашения об именовании — и пусть File Arbor сделает остальное.
Ваши следующие шаги:
- Скачайте File Arbor, если ещё не скачали
- Настройте первое regex-правило по шаблонам из этого руководства
- Изучите все функции на странице функций, включая Авто-режим и Быстрые правила
- Ознакомьтесь с ценами на странице цен для разблокировки неограниченных правил и Авто-режима
Дни ручного перетаскивания файлов в папки закончились. С regex и File Arbor ваши файлы организуются сами.