Просмотр проектов — LLM: инфраструктура
LLM: инфраструктура
2026
- go
- vulkan
- llm
- proxy
- compute-shaders
Обвязка вокруг локального инференса: запуск и переключение моделей, ресёрч compute-шейдеров Vulkan под RDNA3, Go-прокси с ограничением частоты запросов по скользящему окну. Плюс опубликованный в npm фикс дублирования thinking у MiniMax-M3.
Картинок пока нет