Fred'ô / Pour le mois aout et l'année 2026, les posts IA sur NodeBB

Created Sat, 01 Aug 2026 00:00:00 +0000 Modified Sat, 01 Aug 2026 00:00:00 +0000

Pour le mois aout et l’année 2026, les posts IA sur https://lemmy.cyber-neurones.org/category/32/ia

Résumé :

Lien du post : Hermes configuration contexte en dur … - Requete pour la compression : { “messages”: [ { “role”: “user”, “content”: “You are a summarization agent creating a context checkpoint. Treat the conversation turns below as source material for a … (2026-08-05). Lien du post : LLAMA-SWAP : 147 933 343 tokens Cached - Temps : (2026-08-05). Lien du post : llama-swap & demeter-sante.fr : Calcul du coût. - Pas de description. (2026-08-13). Lien du post : llama.cpp : Impact de “-fa on” sur le Prompt Speed - Je viens de refaire un graphique : (2026-08-07). Lien du post : Tuxedo 17 : Installation vllm - Misère … # /root/vllm-env/bin/vllm serve nvidia/Qwen3.6-35B-A3B-NVFP4 –port 8002 –gpu-memory-utilization 0.95 –max-model-len 180000 –max-num-seqs 1 –kv-cache-dtype fp8 –enable-chunked-prefill… (2026-08-07). Lien du post : LLama-swap : test du NVFP4 - NVIDIA : https://huggingface.co/nvidia/Qwen3.6-35B-A3B-NVFP4 Exemple : models: # Premier modèle : Llama 3 8B - name: “meta-llama/Meta-Llama-3-8B-Instruct” command: > vllm serve meta-llama/Meta-L… (2026-08-07). Lien du post : LLama-swap : Temps de compression - Update : (2026-08-07).