#4·Omost

最后一个助理响应的 canvas 不有效: 预期为字符串或类似字节的对象

作者: Torcelllo创建于 2024年5月31日更新于 2024年12月22日

Running on local URL: http://0.0.0.0:7860 To create a public link, set `share=True` in `launch()`. You shouldn't move a model that is dispatched using accelerate hooks. Load to GPU: LlamaForCausalLM The attention mask and the pad token id were not set. As a consequence, you may observe unexpected behavior. Please pass your input's `attention_mask` to obtain reliable results. Setting `pad_token_id` to `eos_token_id`:128001 for open-end generation. Exception in thread Thread-11 (generate): Traceback (most recent call last): File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\threading.py", line 1016, in _bootstrap_inner self.run() File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\threading.py", line 953, in run self._target(*self._args, **self._kwargs) File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\torch\\\\utils\_contextlib.py", line 115, in decorate_context return func(*args, **kwargs) File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\transformers\generation\\\\utils.py", line 1758, in generate result = self._sample( File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\transformers\generation\\\\utils.py", line 2397, in _sample outputs = self( File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\torch\nn\modules\module.py", line 1501, in _call_impl return forward_call(*args, **kwargs) File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\accelerate\hooks.py", line 166, in new_forward output = module._old_forward(*args, **kwargs) File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\transformers\models\LLaMA\modeling_llama.py", line 1164, in forward outputs = self.model( File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\torch\nn\modules\module.py", line 1501, in _call_impl return forward_call(*args, **kwargs) File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\accelerate\hooks.py", line 166, in new_forward output = module._old_forward(*args, **kwargs) File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\transformers\models\LLaMA\modeling_llama.py", line 940, in forward causal_mask = self._update_causal_mask( File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\transformers\models\LLaMA\modeling_llama.py", line 1061, in _update_causal_mask causal_mask = torch.triu(causal_mask, diagonal=1) RuntimeError: "triu_tril_cuda_template" not implemented for 'BFloat16' Traceback (most recent call last): File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\gradio\queueing.py", line 528, in process_events response = await route_utils.call_process_api( File "C:\Users\john_\AppData\Local\Programs\Python\Python310\lib\site-packages\gradio\route_utils.py", line 270, in call_process_api

内容来源: lllyasviel/Omost