Android RecognitionListener: onResults sendo chamado duas vezes

10

Eu tenho um projeto usando RecognitionListener escrito em Kotlin. A função de conversão de texto em texto sempre foi um sucesso e nunca apresentou problemas.

Desde a semana passada, a função onResult começou a ser chamada duas vezes. Nenhuma alteração foi feita no projeto. Testei versões antigas do projeto (de meses atrás) e essas tiveram o mesmo problema.

Existem três casos diferentes:

  1. Texto pequeno (1 a 8 palavras) e o SpeechRecognizer sendo interrompido automaticamente -> onResult () chamado duas vezes;
  2. Texto grande (9 palavras ou mais) e o SpeechRecognizer sendo parado automaticamente -> Comportamento normal (onResult () chamado uma vez);
  3. Qualquer tamanho de texto e função stopListening () do SpeechRecognizer chamados manualmente (do código) -> comportamento normal.

Aqui está o código da classe de fala para texto do VoiceRecognition:

class VoiceRecognition(private val activity: Activity, language: String = "pt_BR") : RecognitionListener {

    private val AudioLogTag = "AudioInput"

    var voiceRecognitionIntentHandler: VoiceRecognitionIntentHandler? = null
    var voiceRecognitionOnResultListener: VoiceRecognitionOnResultListener? = null //Must have this
    var voiceRecognitionLayoutChanger: VoiceRecognitionLayoutChanger? = null

    var isListening = false

    private val intent: Intent
    private var speech: SpeechRecognizer = SpeechRecognizer.createSpeechRecognizer(activity)

    init {
        speech.setRecognitionListener(this)

        intent = Intent(RecognizerIntent.ACTION_RECOGNIZE_SPEECH)
        intent.putExtra(
            RecognizerIntent.EXTRA_LANGUAGE_MODEL,
            RecognizerIntent.LANGUAGE_MODEL_FREE_FORM
        )
        intent.putExtra(RecognizerIntent.EXTRA_LANGUAGE, language)
    }

    //It is important to put this function inside a clickListener
    fun listen(): Boolean {
        if (ContextCompat.checkSelfPermission(activity, Manifest.permission.RECORD_AUDIO) != PackageManager.PERMISSION_GRANTED) {
            ActivityCompat.requestPermissions(activity, arrayOf(Manifest.permission.RECORD_AUDIO), 1)
            return false
        }

        speech.startListening(intent)

        Log.i(AudioLogTag, "startListening")

        return true
    }

    //Use this if you want to stop listening but still get recognition results
    fun endListening(){
        Log.i(AudioLogTag, "stopListening")

        speech.stopListening()
        isListening = false
    }

    fun cancelListening(){
        Log.i(AudioLogTag, "cancelListening")

        speech.cancel()
        voiceRecognitionLayoutChanger?.endListeningChangeLayout()
        isListening = false
    }

    override fun onReadyForSpeech(p0: Bundle?) {
        Log.i(AudioLogTag, "onReadyForSpeech")

        voiceRecognitionLayoutChanger?.startListeningChangeLayout()
        isListening = true
    }

    override fun onRmsChanged(p0: Float) {
//        Log.i(AudioLogTag, "onRmsChanged: $p0")
//        progressBar.setProgress((Int) p0)
    }

    override fun onBufferReceived(p0: ByteArray?) {
        Log.i(AudioLogTag, "onBufferReceived: $p0")
    }

    override fun onPartialResults(p0: Bundle?) {
        Log.i(AudioLogTag, "onPartialResults")
    }

    override fun onEvent(p0: Int, p1: Bundle?) {
        Log.i(AudioLogTag, "onEvent")
    }

    override fun onBeginningOfSpeech() {
        Log.i(AudioLogTag, "onBeginningOfSpeech")
    }

    override fun onEndOfSpeech() {
        Log.i(AudioLogTag, "onEndOfSpeech")

        voiceRecognitionLayoutChanger?.endListeningChangeLayout()
        isListening = false
    }

    override fun onError(p0: Int) {
        speech.cancel()
        val errorMessage = getErrorText(p0)
        Log.d(AudioLogTag, "FAILED: $errorMessage")
        voiceRecognitionLayoutChanger?.endListeningChangeLayout()
        isListening = false
    }

    override fun onResults(p0: Bundle?) {

        val results: ArrayList<String> = p0?.getStringArrayList(SpeechRecognizer.RESULTS_RECOGNITION) as ArrayList<String>

        Log.i(AudioLogTag, "onResults -> ${results.size}")

        val voiceIntent: Int? = voiceRecognitionIntentHandler?.getIntent(results[0])
        if (voiceIntent != null && voiceIntent != 0) {
            voiceRecognitionIntentHandler?.handle(voiceIntent)
            return
        }

        voiceRecognitionOnResultListener!!.onResult(results[0])
    }

    private fun getErrorText(errorCode: Int): String {
        val message: String
        when (errorCode) {
            SpeechRecognizer.ERROR_AUDIO -> message = "Audio recording error"
            SpeechRecognizer.ERROR_CLIENT -> message = "Client side error"
            SpeechRecognizer.ERROR_INSUFFICIENT_PERMISSIONS -> message = "Insufficient permissions"
            SpeechRecognizer.ERROR_NETWORK -> message = "Network error"
            SpeechRecognizer.ERROR_NETWORK_TIMEOUT -> message = "Network timeout"
            SpeechRecognizer.ERROR_NO_MATCH -> message = "No match"
            SpeechRecognizer.ERROR_RECOGNIZER_BUSY -> message = "RecognitionService busy"
            SpeechRecognizer.ERROR_SERVER -> message = "Error from server"
            SpeechRecognizer.ERROR_SPEECH_TIMEOUT -> message = "No speech input"
            else -> message = "Didn't understand, please try again."
        }
        return message
    }

    //Use it in your overriden onPause function.
    fun onPause() {
        voiceRecognitionLayoutChanger?.endListeningChangeLayout()
        isListening = false

        speech.cancel()
        Log.i(AudioLogTag, "pause")
    }

    //Use it in your overriden onDestroy function.
    fun onDestroy() {
        speech.destroy()
    }

listen (), endListening () e cancelListening () são todos chamados de um botão.

Pedro Henrique Flores
fonte
Estou tendo o mesmo problema, o problema é apenas no Samsung s8 com api 9 - aqui também vejo resultados parciais quando o reconhecimento está em andamento. Em dispositivos mais antigos, não sinto isso.
marcinj 26/03
Eu vi esse problema no Android 7 e acima ... Eu nem mudei meu projeto .. apenas começou a acontecer.
Pedro Henrique Flores
"o problema é apenas no Samsung s8 com api 9" - com isso eu quis dizer nos meus testes em dispositivos que tenho
marcinj
11
mesmo problema no Pocophone F1, minha solução foi verificar se os resultados são idênticos, depois ignorar o segundo resultado se forem
Lotan
Isso começou a acontecer em um dos meus aplicativos ontem. Eu adicionei um booleano para permitir que o código fosse executado apenas uma vez, mas eu adoraria uma explicação do motivo pelo qual ele começou a fazer isso de repente. Alguma atualização?
Gavin Wright

Respostas:

2

Encontrei este problema em aberto: https://issuetracker.google.com/issues/152628934

Como comentei, presumo que seja um problema com o "serviço de reconhecimento de fala" e não com a classe Android RecognitionListener.

Al-Punk
fonte
Sim, também acredito que esse seja o problema ..
Pedro Henrique Flores
1

Isso começou a acontecer em um dos meus aplicativos ontem. Eu adicionei um booleano para permitir que o código fosse executado apenas uma vez, mas eu adoraria uma explicação do motivo pelo qual ele começou a fazer isso de repente. Alguma atualização?

Gavin Wright
fonte
0

Eu tive o mesmo problema e acabei de adicionar um sinalizador booleano no meu código, mas é claro que é uma solução temporária e não sei a origem desse problema.

object : RecognitionListener {

        var singleResult = true

        override fun onResults(results: Bundle?) {
            if (singleResult) {
                results?.getStringArrayList(SpeechRecognizer.RESULTS_RECOGNITION).let {
                    // do something with result
                }
                // next result will be ignored
                singleResult = false
            }
        }
    }
Grobocop12
fonte
Por favor, adicione algum código de exemplo.
m02ph3u5