import re, sys
t = open(sys.argv[1], encoding='utf-8', errors='ignore').read()
for m in re.finditer(r'text="([^"]+)"[^>]*bounds="(\[[0-9,]+\]\[[0-9,]+\])"', t):
    print(m.group(1)[:50], m.group(2))
