Оптимізація витрат та продуктивності при роботі з AI API: кешування, квантування та підрахунок токенівAI (ШІ)