Hermes este o familie de modele lingvistice mari (LLM) open-source, dezvoltată de Nous Research. Modelele Hermes sunt „fine-tune-uri” (rafinări) construite peste modele de bază open-source, în special peste Llama 3.1 de la Meta și pot fi rulate pe propria infrastructură.
Ideea de bază
Un model de bază (precum Llama) este antrenat general. Nous Research îl rafinează ca să urmeze mai bine instrucțiunile, să folosească unelte (function calling), să producă ieșiri structurate (JSON) și să fie coerent pe conversații lungi. Rezultatul, familia Hermes, este apreciat pentru caracterul său „neutru” și pentru capacitățile agentice.
Variante
Hermes 3 vine în mai multe dimensiuni — 8B, 70B și 405B de parametri — cu o fereastră de context mare (moștenită de la Llama 3.1). Alegi dimensiunea în funcție de hardware și de nevoi. Există și versiuni mai noi în dezvoltarea continuă a familiei.
La ce folosește
- Un asistent AI privat, rulat pe serverul tău (fără costuri per token).
- Agenți AI care folosesc unelte și returnează JSON structurat.
- Aplicații de tip chatbot, RAG, roleplay și scriere.
- Integrare în interfețe precum Open WebUI sau în fluxuri Flowise/n8n.
De ce Hermes self-hosted
Fiind open-source, parametrii modelului (weights) sunt disponibile public (de exemplu pe Hugging Face). Poți rula Hermes pe un VPS/server cu GPU — de exemplu la HostX — păstrând datele private. În articolele următoare îți arătăm cum alegi varianta potrivită și cum o rulezi.