{"version":"1.0","type":"card","id":"d97c2f0f-2196-418e-bb85-3399b257307e","url":"https://stacklist.com/card/d97c2f0f-2196-418e-bb85-3399b257307e","title":"LLM Engineer's Almanac - Advisor | Modal","source_url":"https://modal.com/llm-almanac/advisor?filters=model%3DLlama+3.1+8B%2Ctokens%3D128%3B1024%2Cframework%3Dvllm","note":"A simple tool for estimating the throughput and latency of LLM engines. This page provides insights and metrics to help users optimize their LLM models effectively.","image":{"url":"https://ucarecdn.com/a4f1a2e2-691a-4d8e-b0f8-6a0e7abd7ed8/","alt":"LLM Engineer's Almanac - Advisor | Modal","width":1200,"height":630},"stack":{"id":"ed01fcda-d7b5-4a4b-bdfa-bc07c9df5228","title":"Local AI & GPUs","url":"https://stacklist.com/c/technology/stack/ed01fcda-d7b5-4a4b-bdfa-bc07c9df5228"},"created_at":"2026-07-29T02:39:32.960Z","updated_at":null,"aco":null,"_links":{"self":"/api/public/card/d97c2f0f-2196-418e-bb85-3399b257307e.json","html":"https://stacklist.com/card/d97c2f0f-2196-418e-bb85-3399b257307e","md":"/api/public/card/d97c2f0f-2196-418e-bb85-3399b257307e.md","stack_json":"/api/public/stack/ed01fcda-d7b5-4a4b-bdfa-bc07c9df5228.json"}}