发布

  • fix(autogptq): do not use_triton with qwen-vl (#1985)

    frostbyte_neo 发布于 2024-04-11 10:33:58 +00:00

    • Enhance autogptq backend to support VL models

    • update dependencies for autogptq

    • remove redundant auto-gptq dependency

    • Convert base64 to image_url for Qwen-VL model

    • implemented model inference for qwen-vl

    • remove user prompt from generated answer

    • fixed write image error

    • fixed use_triton issue when loading Qwen-VL model


    Co-authored-by: Binghua Wu bingwu@estee.com

    下载附件