WedX - журнал о программировании и компьютерных науках

Извлеките строку из повторяющегося слова до первого пробела, используя R

Я пытаюсь извлечь имена станций метро из вектора символов. Этим названиям станций всегда предшествует «METRO-».

Вот пример.

x <- c('BLA BLA BLA METRO-SNOWDON BLA BLI BLU', 'BLA VLA BLU METRO-SQUARE-VICTORIA YES NO')

Я хочу извлечь символы, следующие за METRO-, до первого пробела.

Желаемый результат должен выглядеть так

"METRO-SNOWDON", "METRO-SQUARE-VICTORIA"

Я не могу понять часть кода "пробел"

sub('.*(METRO-)', '\\1', x)

Спасибо парень!

22.01.2019

Ответы:


1

Этот шаблон будет работать до тех пор, пока у вас никогда не будет пробела в имени метро:

gsub(".*?(METRO-.*?)\\s.*", "\\1", x)

.*? означает совпадение чего угодно до тех пор, пока не совпадет следующая часть шаблона.

Это особенно важно при втором появлении, потому что мы хотим закончить группу захвата в первом экземпляре пробела после "METRO". Без ? группа захвата будет включать все до последнего экземпляра пробела.

Приведенное выше выражение возвращает:

[1] "METRO-SNOWDON"         "METRO-SQUARE-VICTORIA"
22.01.2019
  • Работает отлично! Спасибо и за объяснение. Я добираюсь туда (медленно и мучительно) 23.01.2019
  • @ChubSuey, это мой любимый ресурс по регулярным выражениям, это хорошее краткое руководство со всеми ключевыми элементами синтаксиса: rexegg .com/regex-quickstart.html 23.01.2019
  • @ChubSuey И не забудьте нажать зеленую галочку, чтобы принять ответ, поскольку он решил вашу проблему. 23.01.2019
  • Новые материалы

    Как создать диаграмму градиентной кисти с помощью D3.js
    Резюме: Из этого туториала Вы узнаете, как добавить градиентную кисть к диаграмме с областями в D3.js. Мы добавим градиент к значениям SVG и применим градиент в качестве заливки к диаграмме с..

    Я хотел выучить язык программирования MVC4, но не мог выучить его раньше, потому что это выглядит сложно…
    Просто начните и учитесь самостоятельно Я хотел выучить язык программирования MVC4, но не мог выучить его раньше, потому что он кажется мне сложным, и я бросил его. Это в основном инструмент..

    Лицензии с открытым исходным кодом: руководство для разработчиков и создателей
    В динамичном мире разработки программного обеспечения открытый исходный код стал мощной парадигмой, способствующей сотрудничеству, инновациям и прогрессу, движимому сообществом. В основе..

    Объяснение документов 02: BERT
    BERT представил двухступенчатую структуру обучения: предварительное обучение и тонкая настройка. Во время предварительного обучения модель обучается на неразмеченных данных с помощью..

    Как проанализировать работу вашего классификатора?
    Не всегда просто знать, какие показатели использовать С развитием глубокого обучения все больше и больше людей учатся обучать свой первый классификатор. Но как только вы закончите..

    Работа с цепями Маркова, часть 4 (Машинное обучение)
    Нелинейные цепи Маркова с агрегатором и их приложения (arXiv) Автор : Бар Лайт Аннотация: Изучаются свойства подкласса случайных процессов, называемых дискретными нелинейными цепями Маркова..

    Crazy Laravel Livewire упростил мне создание электронной коммерции (панель администратора и API) [Часть 3]
    Как вы сегодня, ребята? В этой части мы создадим CRUD для данных о продукте. Думаю, в этой части я не буду слишком много делиться теорией, но чаще буду делиться своим кодом. Потому что..


    Для любых предложений по сайту: [email protected]