Знания
Технический блог
Инженерные заметки из наших проектов: как устроены Amperic и CodeLab, как работать с LLM на практике — с кодом, конфигурацией и выводами, которые можно применить у себя.
4 мин чтения
Инструкция: как уменьшить задержку (TTFT) при квантовании моделей до 4-бит
Пошаговое руководство по квантованию LLM до 4 бит с сохранением качества: выбираем метод, замеряем TTFT и скорость генерации, проверяем деградацию и запускаем модель локально.
LLM Arch ResearchCodeLabLLMИнструменты
4 мин чтения
Устойчивость AI-агента к сбоям LLM-провайдеров: fallback-цепочки и Circuit Breaker в CodeLab
Что делать агенту, когда LLM-провайдер отвечает 429, падает по таймауту или перегружен: классификация ошибок, последовательный fallback и Circuit Breaker на примере CodeLab.
CodeLabAI-агентыLLM
3 мин чтения
Real-time в мобильном приложении для EV-зарядок: SSE, офлайн и обрывы связи в Amperic
Как в Amperic устроено обновление статусов зарядки в реальном времени: почему активная сессия идёт SSE-потоком, а карта — нет, и что делает приложение, когда пропадает связь.
AmpericМобильная разработкаReal-time