Сравнение нескольких списков Python
У меня есть код с тремя списками, а затем он сравнивает индекс второго списка с индексом первого, если первый список содержит шесть элементов. Затем код будет добавлен к третьему списку, если часть строки совпадает с индексом первого списка. Если строка не совпадает, будет добавлено сообщение. Я надеюсь найти лучший, более питонический способ написания моего алгоритма. Вот мой код:
L1 = ["first = 1st","second = 2nd","third = 3rd","fourth = 4th","sixth = 6th",
"first = A","second = B","third = C","fifth = E","sixth = F",
"second = W","third = X","fourth = Y","fifth = Z","sixth = AA","first = BB"]
L2 = ["first","second","third","fourth","fifth","sixth"]
L3 = []
#Used in case a list has less than six elements
if len(L1) % 6 != 0:
L1.append("Missing_Data")
c = 0
for i in L1:
cont = True
while cont:
if L2[c] in i:
L3.append(i.split("= ")[-1])
c += 1
if c < len(L2):
cont = False
else:
c = 0
cont = False
else:
L3.append("Missing_Data")
c += 1
if c < len(L2):
continue
else:
c = 0
break
Этот код работает для того, что я хочу, но я думаю, что он слишком длинный. Мы будем очень благодарны за любую помощь в создании этого кода более Pythonic. Заранее спасибо.
Ответы
Мой обзор вашего текущего кода легко подытожить: он чертовски сложен и у меня болит голова . Но не расстраивайтесь, ведь вы в отличной компании. Первые попытки часто бывают такими - даже для людей, которые занимаются этим долгое время.
Что конкретно затрудняет понимание? Алгоритмическая сложность: вложенные циклы и условные выражения, разрывы, управление индексами списков и т. Д. Всякий раз, когда вы воспринимаете этот тип сложности, часто полезно подумать, не упростит ли ситуацию более мощная структура данных (я использую «структуру данных» в очень широком смысле). В предлагаемом ниже переписывании мы будем использовать специальный итеративный объект, который позволяет нам просматривать следующее значение, не потребляя его каждый раз. Это одно изменение значительно упрощает ведение бухгалтерского учета в основном цикле, а также упрощает добавление необходимого остатка отсутствующих значений после выхода из цикла.
# This is a third party library that is worth knowing about.
from more_itertools import peekable
# Your data, aligned so we can see what is going on.
# When you ask a question, it's a good idea to help your helpers.
xs = [
'first = 1st', 'second = 2nd', 'third = 3rd', 'fourth = 4th', 'sixth = 6th',
'first = A', 'second = B', 'third = C', 'fifth = E', 'sixth = F',
'second = W', 'third = X', 'fourth = Y', 'fifth = Z', 'sixth = AA',
'first = BB',
]
ys = ['first', 'second', 'third', 'fourth', 'fifth', 'sixth']
# Python has a builtin concept for missing data. Use it if you can.
# If you cannot, define a constant.
MISSING = None
# The results we want.
# When you ask a question, it's a good idea to provide this.
EXPECTED = [
'1st', '2nd', '3rd', '4th', MISSING, '6th',
'A', 'B', 'C', MISSING, 'E', 'F',
MISSING, 'W', 'X', 'Y', 'Z', 'AA',
'BB', MISSING, MISSING, MISSING, MISSING, MISSING
]
# We will use a peekable iterable for both the Xs and the Ys.
xit = peekable(xs)
yit = None
results = []
# Process all Xs to build the results.
# A Y is consumed each time, and we get a fresh Ys iterable as needed.
# We consume an X only when current X and Y agree.
while xit:
yit = yit or peekable(ys)
x = xit.peek()
y = next(yit)
val = next(xit).split('= ')[-1] if y in x else MISSING
results.append(val)
# The results should always contain a full cycle of Ys.
results.extend(MISSING for _ in yit)
# Check.
print(results == EXPECTED)
if c < len(L2):
continue
else:
c = 0
break
Поскольку continueвсегда происходит в конце цикла, вы можете отменить эти условия, чтобы сделать его короче.
if c >= len(L2):
c = 0
break
теперь вам не нужно, elseтак как ничего, кроме условия прерывания, будет continueавтоматически.
Насколько я могу судить cont = False, вы могли бы использовать breakвместо этого выше, где вы сидите. Это полностью устраняет необходимость, contтак что вы можете просто сделатьwhile True:
Я в основном отвечаю на SO, поэтому мой ответ может не соответствовать PEP8 или другим рекомендациям, но я попытался сделать версию вашего кода, в которой было бы легче видеть, что происходит, без «если», разрывов, продолжений и с меньшим количеством строк:
length = len(L2)
missing = 'Missing_Data'
index = -1
for item in L1:
key,value = item.split(' = ')
current = L2.index(key)
no_missing = (current-index)%length-1 # get number of missing elements
L3 += [missing] * no_missing # append this many of the missing value
L3.append(value) # append current value
index = current
L3 += [missing] * (length-index-1) # fill rest of list with missing elements