dolphin-2.9.1-llama-3-8b-8.0bpw-h8-exl2
Curated and trained by Eric Hartford, Lucas Atkins, and Fernando Fernandes, and Cognitive Computations We have retrained our...
Curated and trained by Eric Hartford, Lucas Atkins, and Fernando Fernandes, and Cognitive Computations We have retrained our...
Оригинальная модель: https://huggingface.co/cognitivecomputations/dolphin-2.9-llama3-8b-1m Все кванты сделаны с использованием опции imatrix с набором данных, предоставленным Kalomaze здесь Если модель...
Данная модель представляет собой доработанную версию microsoft/Phi-3-mini-4k-instruct на датасете kobprof/skolegpt-instruct. Он достигает следующих результатов в наборе оценки: —...
Эта модель представляет собой тонко настроенную версию meta-llama/Meta-Llama-3-8B-Instruct по английскому переводу небольшого набора данных из 16 000 корейских...
This is Suzume ORPO, an ORPO trained fine-tune of the lightblue/suzume-llama-3-8B-multilingual model using our lightblue/mitsu dataset. We have...
— Homepage: https://lklab.kaist.ac.kr/Janus/ — Repository: https://github.com/kaistAI/Janus — Paper: https://arxiv.org/abs/2405.17977 — Point of Contact: seongyun@kaist.ac.kr Janus is a model...
Эта модель представляет собой QLoRA-доработанную версию Qwen/Qwen1.5-32B на различных наборах данных. Эта модель тонко настроена с использованием 8xRTX3090...
Mistralclassificationheadqlora has a new transformer head attached to it for sequence classification task and then resulting model has...
Calme-12B is a state-of-the-art language model with 12 billion parameters, merged and fine-tuned over high-quality datasets on top...
Эта модель представляет собой точно настроенную версию Alpindale/Mistral-7B-v0.2-hf в наборе данных Samanta-PL-AG-axolotl. Во время обучения использовались следующие гиперпараметры:...