WebLLM: запуск LLM прямо в браузере с WebGPU
19 сентября 2026 г.
WebLLM — движок вывода языковых моделей, работающий в браузере с GPU-ускорением через WebGPU, без серверной части. Полностью совместим с OpenAI API и поддерживает Llama, Mistral, Gemma, Phi и другие модели.