Text this: Multi-Model Fusion of Encoding Methods-Based Visual Words for Target Recognition in Infrared Images.