Dragonfire 1.0 –    Linux

След 3 години работа, официално бе представен виртуалния гласови помощник Dragonfire 1.0 за операционната система Linux, даващ възможност за цялостно управление на десктопа с помощта на гласови команди.

Проектът Dragonfire 1.0 е написан на програмния език Python и се разпространява под MIT лиценза. Поддържат се Linux дистрибуциите, базирани на Ubuntu, включително KDE neon и elementary OS. Допълнително е подготвен мобилен клиент за Android.

За разпознаването на гласовите команди се използва системата за разпознаване на речта Mozilla DeepSpeech, базирана на платформата за машинно обучение TensorFlow. За синтезиране на реч се използва пакета Festival. Интерфейсът във вид на въпрос/отговор се базира на библиотеката за разпознаване на текста на естествения език spaCy и на данните от Wikipedia. Отговорите се формират с използването на невронната мрежа seq2seq, тренирана с база данни, съдържаща диалози от филми (Cornell Movie-Dialogs Corpus).

Програмата може да работи в режим на графична анимация, при който на екрана се вижда мъжки или женски силует. Анимацията може да се изключва. С помощта на гласовото управление е възможно да се осъществява търсене и подаване на вградените в системата гласови команди, стартиране на приложения, изчисляване на математически изрази и задаване на произволни въпроси. Така например, възможно е да се подаде команда за стартиране на офис пакета, да се започне диктуването на текст и между другото да се запита, кой е най-големият град в България.

Новата система може да работи и в сървърен режим, в който се предоставя RESTful API за създаване на диалогови чатботове. В програмния пакет е включен пример на чатбот за Twitter. За оптимална работа е желателно наличието на каквато и да е видеокарта с CUDA ядра и 2 GB оперативна памет. Предвидена е възможността вместо вградения енджин за разпознаване на речта, да се използва външния API Google Speech. По този начин е възможна известна икономия на ресурси.