Рубрика «llm» - 10
30 кастдевов сэкономили мне месяцы разработки… (и похоронили первоначальную идею)
2026-06-19 в 10:59, admin, рубрики: custdev, llm, исскуственный интеллект, кастдев, стартапЧто перестаёт работать в тестировании, когда приходит LLM
2026-06-19 в 9:15, admin, рубрики: ai-агенты, Evals, llm, llm testing, qa, qa lead, STT, TTS
Потратил полгода на обучение своей ии с нуля, вот что вышло
2026-06-19 в 8:57, admin, рубрики: llama 3, llm, RTX 4060, генерация текста, нейросети, обучение с нуля, пет-проектПоследние полгода я обучал свою небольшую нейросеть с нуля на одной rtx 4060. Сжег кучу времени, перебрал кучу данных и в итоге дошел до версии 2.1 — это крошечная LLM всего на 260 млн параметров.
Зачем вообще было это делать? Мне просто стало интересно, можно ли научить такую микроскопическую нейронку (а более большую я обучить и не мог) хоть какой‑то логике.
Что в итоге вышло:
-
Во‑первых, она умеет считать по разрядам. Она может считать большие числа, которые другие модели того же размера считают неверно.
Что происходит с LLM‑пайплайном, если провайдер падает посреди выполнения
2026-06-19 в 7:23, admin, рубрики: FSM, llm, агенты, ии-агенты, отказоустойчивостьВ 2025 году каждый крупный провайдер LLM пережил минимум один значимый сбой. Большинство решений этой проблемы — gateway‑слой снаружи приложения: LiteLLM, Bifrost, Kong AI Gateway. Они перехватывают упавший HTTP‑запрос и повторяют его на другом провайдере.
Это работает для одного вызова, но не работает для многошагового пайплайна — gateway не знает, что упавший запрос был вторым шагом из трёх. Он видит запрос, которому нужен retry, а не позицию в конечном автомате.
В этой статье — как реализовать fallback провайдера как явный переход FSM на реальном стеке llm‑nano‑vm 0.8.6Читать полностью »
Opus оркеструет, DeepSeek V4 пишет код: как собрать связку внутри Claude Code и сэкономить деньги
2026-06-18 в 12:15, admin, рубрики: AI-инструменты, Anthropic, api, claude code, deepseek, deepseek v4, llm, нейросети, оптимизация затрат, разработкаОднажды я открыл биллинг и просто посмотрел, на что уходят токены. Не на «подумать над архитектурой». А на переименование переменных, генерацию тестов по готовому ТЗ и прогон миграций. Всё это считалось по тарифу флагманской модели, хотя такую работу вытянет модель в десятки раз дешевле.
Ниже – как развести действительно сложные задачи и рутину по двум моделям внутри Claude Code, не ставя ни одного стороннего форка. И три зоны, куда дешёвую модель я не пускаю принципиально.
Что на самом деле сжигает токены
Как я перестал исправлять ИИ код и начал проектировать под него архитектуру
2026-06-17 в 15:35, admin, рубрики: AI coding, dependency management, llm, open source, vibe coding, архитектура системы, генерация кода, искусственный интеллект, рефакторингВместо вступления
За последний год я заметил странную закономерность. Когда кодовая база была небольшая, все было хорошо, но чем больше кода писал ИИ, тем меньше времени уходило на добавление фичей и больше — на исправление текущего кода. Это сильно раздражало.
Я как будто ходил по кругу:
-
Сначала мне казалось: сейчас заставлю ИИ самому для себя писать правила. Кол‑во правил росло, сложность росла. Сначала в них переставал ориентироваться я, потом ИИ.
Когда написание кода перестаёт быть дефицитом: опыт команды Claude Code
2026-06-17 в 12:08, admin, рубрики: ai-native, Anthropic, claude, claude code, code review, llm, искусственный интеллект, процессы разработкиМатериал подготовлен на основе выступления Фионы Фунг (Fiona Fung), главного инженера команды Claude Code. Ссылка на публикацию.
Сегодня я наткнулся на кое-что, что показалось мне весьма ценным.
Это довольно редко встречается — AI-компании вроде Claude действительно делятся мыслями и размышлениями об организационной структуре.
ПростоГраф: как я сделал глубокий форк LightRAG под свои (и, возможно, ваши) нужды
2026-06-16 в 10:09, admin, рубрики: lightrag, llm, rag, агенты ииClaude Code убрал из моей работы рутину и почему я этому не долго радовался
2026-06-16 в 7:50, admin, рубрики: Agentic Coding, claude code, llm, вайбкодинг, ии-агенты, оверинжиниринг, продуктивность, разработка с ииДолгое время вижу одно и то же в новостях и обзорах: ИИ уберет рутину, снимет трение, даст крылья и вообще панацея от всех болячек. Я поставил Claude Code — и да, трение исчезло. Рутина схлопнулась. Идею теперь можно проверить за вечер, а не за месяц.
А дальше выяснилось, что трение это для меня было важно и когда оно ушло, я ощутил это в полной мере.



