Разработан и протестирован алгоритм оптического распознавания казахского текста в среде Tesseract, продемонстрировавший точность распознавания выше 70%. Формализована и разработана именная парадигма казахского языка. Разработан обратный пробный словарь основ казахского языка. Разработан и протестирован алгоритм морфосемантического анализа и генерации словоформ казахского языка. Разработан проект Web-сервиса интерактивного портала распознавания текста на государственном языке в соответствии с международными стандартами, который включает в себя функционал обеих библиотек - по оптическому распознаванию и морфосемантическому анализу текста.