Skip to content

Fun-ASR-Nano使用StreamingVLLM推理结果异常 #3595

Description

@gotorion

🐛 Bug

使用bf16类型推理结果异常。

To Reproduce

运行下面的 Python 脚本即可。
其中asr_example_zh.wav为Readme中的示例音频。

Code sample

from funasr.models.fun_asr_nano.inference_vllm_streaming import FunASRNanoStreamingVLLM


def main():
    engine = FunASRNanoStreamingVLLM.from_pretrained(
        model="FunAudioLLM/Fun-ASR-Nano-2512",
        chunk_ms=50,
        dtype='bf16',
        rollback_chars=8,
    )
    for result in engine.streaming_generate("./asr_example_zh.wav", language="中文"):
        if result["is_final"]:
            print(f"Final: {result['text']}")
        else:
            print(f"[{result['audio_duration_ms']:.0f}ms] Confirmed: {result['fixed_text']}")

if __name__ == "__main__":
    main()

Expected behavior

推理结果正常。

Error logs

推理的结果如下:

[5350ms] Confirmed: !!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!聪聪!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!
[5400ms] Confirmed: !!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!聪聪!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!
[5450ms] Confirmed: !!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!聪聪!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!!

Environment

  • OS: Ubuntu 22.04
  • Python version: 3.12.13
  • FunASR version: 1.4.2
  • ModelScope version: 1.39.1
  • PyTorch / torchaudio version: 2.13.0
  • Install method (pip, source, Docker): pip
  • Device (cuda, cpu, mps): cuda
  • GPU model: H100
  • CUDA/cuDNN version: 13.0
  • Docker image tag, if used:

Activity

Sign up for free to join this conversation on GitHub. Already have an account? Sign in to comment

Metadata

Metadata

Assignees

No one assigned

    Labels

    bugSomething isn't workingneeds feedbackWaiting for reporter feedback or retest results

    Type

    No type

    Projects

    No projects

      Milestone

      No milestone

      Relationships

      None yet

      Development

      No branches or pull requests

      Issue actions