Блог
FOCUS, детализация биллинга, cost & usage и практика оптимизации облачных расходов.
Kimi K3 vs GLM 5.2 для разработки: capability, цена и self-host
Coding agent час крутит один и тот же баг: токены списываются, PR всё ещё красный. Вопрос не «какая модель умнее на слайде», а какая даёт приемлемый merge rate за понятные деньги — и когда имеет смысл эскалировать на Fable или Opus. Разбираем Kimi K3 и GLM 5.2 для разработки.
Slurm vs Kubernetes: обучение, batch и online inference на GPU
64 GPU уже выделены планировщиком, но обучение не делает ни одной итерации: часть процессов ждёт rendezvous, карты заняты, счётчик часов крутится. Разбираем, чем Slurm отличается от Kubernetes для обучения, batch и online inference — и какой выбор снижает простой дорогой capacity.
FOCUS и детализация биллинга: почему облачный счёт нельзя просто сложить
Оптимизация облачных расходов начинается не с прайса, а с детализации биллинга: cost & usage выгрузки должны отвечать, сколько стоил продукт вчера. Разбираем кейс, нужные поля и стандарт FOCUS.