Des articles pour ceux qui
livrent le stack
Textes originaux sur React, Node.js, TypeScript et AI — issus de la même pratique que notre logiciel opérateur. Corps des articles en anglais.
Tag : ollama
Tri des flottes LangGraph : court-circuit d’urgence avant les diagnostics RAG
Les rapports de véhicules sur WhatsApp doivent d’abord être triés : les ordres d’arrêt d’urgence contournent la récupération des données, tandis que les symptômes ordinaires font l’objet d’une analyse selon les manuels, de la génération par Llama et d’une évaluation de la fidélité.
1225 motsLireLLMOps pour les petits modèles de langage : frameworks de déploiement et guides de mise en production
Pourquoi les SLM l’emportent en termes de coût et de confidentialité, comment se comparent vLLM, SGLang, TGI, llama.cpp, Ollama, WebLLM, ONNX et TensorRT-LLM, ainsi que comment les quantifier, les évaluer et les intégrer en environnement de production.
4127 motsLireProtocole de contexte pour débutants avec FastMCP et Ollama
Apprenez les rôles MCP — hôte, client, serveur, transport — puis connectez un serveur d’outil météorologique à un modèle local qwen3:8b via FastMCP et STDIO.
1841 motsLireDes rapports de laboratoire scannés aux données structurées : compromis dans l’architecture OCR
Comment une startup de santé à budget limité peut évaluer les bibliothèques OCR, les API Google Cloud et un LLM de vision auto-hébergé pour transformer des scans médicaux en JSON structuré.
1779 motsLireOCR de vision LLM auto-hébergé en Go : rasterisation, génération de prompts, analyse
Comment un travailleur Go transforme des PDF médicaux en JSON structuré à l’aide d’Ollama, pdftoppm, de prompts stricts, d’un parsing de secours et de groupes de consommateurs Redis Streams.
1684 motsLireGérer les pipelines Docling via HTTP : de la configuration du projet aux blocs indexés
Découvrez pas à pas l’API REST Docling Pipelines : lancez le serveur, identifiez les opérateurs, validez et exécutez un DAG d’ingestion, puis consultez les données de telemétrie relatives à son exécution.
3355 motsLireLangChain 1.x en pratique : chaînes, RAG, outils et agents localement
Apprenez à créer des chaînes, une génération améliorée par la récupération d’informations, des outils et un système RAG agentiel avec LangChain 1.x en utilisant une installation locale gratuite d’Ollama, sans besoin de clés API.
3655 motsLire
À propos de ces articles
Devis en 24 h
Besoin du même stack en couche opérateur ? Envoyez le brief — devis sous 24 h.