Знания

Технический блог

Инженерные заметки из наших проектов: как устроены Amperic и CodeLab, как работать с LLM на практике — с кодом, конфигурацией и выводами, которые можно применить у себя.

4 мин чтения

Инструкция: как уменьшить задержку (TTFT) при квантовании моделей до 4-бит

Пошаговое руководство по квантованию LLM до 4 бит с сохранением качества: выбираем метод, замеряем TTFT и скорость генерации, проверяем деградацию и запускаем модель локально.

LLM Arch ResearchCodeLabLLMИнструменты
4 мин чтения

Устойчивость AI-агента к сбоям LLM-провайдеров: fallback-цепочки и Circuit Breaker в CodeLab

Что делать агенту, когда LLM-провайдер отвечает 429, падает по таймауту или перегружен: классификация ошибок, последовательный fallback и Circuit Breaker на примере CodeLab.

CodeLabAI-агентыLLM
3 мин чтения

Real-time в мобильном приложении для EV-зарядок: SSE, офлайн и обрывы связи в Amperic

Как в Amperic устроено обновление статусов зарядки в реальном времени: почему активная сессия идёт SSE-потоком, а карта — нет, и что делает приложение, когда пропадает связь.

AmpericМобильная разработкаReal-time