哥们,这效果也太差了

#34
by AlexLee111 - opened

不是哥们,咱能别过拟合测评集吗?

不说别的,就说pdf解析,真实场景上跑你们这个pdf析速度慢的离谱,我一开始还纳闷,拿结果一看一堆复读机样本,效果差的和前几天百度unlimt ocr有的一拼,两个都是复读🐔

那技术报告写的花里胡哨的,你们自己信吗?

调你们这个模型我周末都在加班,调出来这效果,你说叫人蚌埠崩溃?????

麻烦拿点有诚意的东西,不然我以后再也不碰浑圆

可以同步一下推理代码,以及部署方式
如果目前使用llamacpp部署,会因为EOS默认对齐120020导致重复预测
推荐使用vllm部署

确实太拉了,用它官方的推理代码,测一张身份证简单的信息提取,生成的东西乱七八糟。

感谢两位反馈,check后发现hf的eos符设置错误,导致模型重复预测幻觉输出,目前hf的model config已经fix
同时transformer input的连接与训练不一致,也会在今日进行仓库更新
欢迎持续反馈

+1,卡了我巨长时间以为自己哪配错了;(

不止,hg的transformer测试代码,processer没有禁用use_fast属性,会导致图片预处理完全错误,导致胡乱输出。

不止,hg的transformer测试代码,processer没有禁用use_fast属性,会导致图片预处理完全错误,导致胡乱输出。

我操哥们,这bug怎么de出来的,总算能用了🤣

不止,hg的transformer测试代码,processer没有禁用use_fast属性,会导致图片预处理完全错误,导致胡乱输出。

你好,感谢关注,我们也注意到了这一点,也能复现这个问题,可以参考官方 GitHub 仓库里的推理代码,这份是正确的
https://github.com/Tencent-Hunyuan/HunyuanOCR/blob/main/inference/transformers/infer_hf_8gpu_hyocr15.py

Tencent org

请问在upstream的transformer可以正常工作吗?

Sign up or log in to comment