Рубрика «llm» - 41
Контроль против гибкости: два подхода к созданию AI-агентов
2025-11-14 в 17:15, admin, рубрики: AI, llm, llm-модели, llm-приложения, агенты, архитектура, ИИ, мультиагентные системы, подход к разработке, системыИИ в программной инженерии: обзор практик, инструментов и проблем
2025-11-14 в 9:12, admin, рубрики: AI in SDLC, genai, llm, llm-агент, llm-приложения, Specification-Driven Development, авторегрессионные модели, нейросети
Привет! Я Николай Бушков, архитектор в команде Engineering Productivity R&D в Т-Банке (Группа «Т-Технологии»). В начале лета я выступал на конференции MTS True Tech Day c докладом Читать полностью »
«Золотая рыбка, хочу LLM без GPU»: как собрать Inference-сервер на CPU
2025-11-14 в 7:00, admin, рубрики: cpu, gpu, llm, ml, selectel, большие языковые модели, инференс, машинное обучение, ПроцессорыНейро-дайджест: ключевые события мира AI за 2-ю неделю ноября 2025
2025-11-13 в 14:05, admin, рубрики: ElevenLabs, kimi-k2, llm, timeweb_дайджест, дайджест, ИИ, искусственный интеллект, нейросети, Новости, новости искусственного интеллекта
Привет! Это новый выпуск «Нейро-дайджеста» — коротких и полезных обзоров ключевых событий в мире искусственного интеллекта и технологий.
Меня зовут ВандерЧитать полностью »
AI-инструменты 2025: Полный технический анализ Perplexity, ChatGPT, Gemini и DeepSeek
2025-11-11 в 14:06, admin, рубрики: AI, ChatGP, deepseek, gemini, llm, machine learning, perplexity🎯 Резюме: Кто лучше?
|
Инструмент |
Оценка |
Сильная сторона |
|---|---|---|
|
Perplexity AI |
4.20/5 |
Точность + RAG архитектура |
|
ChatGPT |
3.85/5 |
MoE + GPT-4o мультимодальность |
|
DeepSeek |
3.75/5 |
MoE эффективность + бесплатно |
|
Gemini |
3.35/5 |
Контекст 1M + видео обработка |
Читать полностью »
Prompt Caching в Claude: Как мы снизили затраты на AI в 2 раза
2025-11-10 в 23:17, admin, рубрики: AI, Anthropic, claude, fastapi, llm, токеныPrompt Caching в Claude: Как мы снизили затраты на AI в 2 раза
Кейс по оптимизации затрат на Claude API в проекте по автоматизации поиска работы. AI анализировал вакансии и генерировал сопроводительные письма. При 100 пользователях затраты достигали $180/месяц. Решение: Prompt Caching от Anthropic. Экономия 52% ($0.51 → $0.245 за batch из 50 вакансий). Теперь можно делать в 2 раза больше AI-вызовов с тем же бюджетом.
Кому полезно: всем, кто работает с LLM API и хочет оптимизировать затраты.
История: Когда AI начал съедать бюджет
Мне 17, завтра отчисление. Пытаюсь понять, не совершаю ли я ошибку, копаясь в AI
2025-11-10 в 21:15, admin, рубрики: AI, Gamedev, gemini, llm, pet-project, будущее, образование, отчисление, университет, философияПривет.
Меня зовут Леонид. Этот пост попытка разложить мысли по полкам, потому что завтра я, скорее всего, перестану быть студентом. Последние пару недель я не ходил на пары, и дело не в лени. Дело в том, что я, кажется, нашел что-то более важное, и теперь пытаюсь понять, не самообман ли это.
Почему современные LLM пока не отберут работу у программистов
2025-11-10 в 14:05, admin, рубрики: llm, timeweb_статьи, искусственный интеллект, нейросети, работа, рынок трудаЦелая отрасль замерла в ожидании. Заменит ли LLM программистов? Выпускники школ прямо говорят — зачем поступать на программистов, придёт ИИ и я останусь без работы. В новостях регулярно сообщается о массовых сокращениях в ИТ компаниях. Работодатели пытаются внедрить ИИ и если не уволить, то снизить зарплаты айтишников.
Почему LLM не заменит хорошего разработчика, но сделает его работу быстрее
2025-11-10 в 8:21, admin, рубрики: AI, artificial intelligence, cursor, development, llmВсе еще встречаются разработчики, которые в своей профессиональной деятельности отказываются использовать LLM. Причины разные: чаще всего это психологический барьер или негативный прошлый опыт - если, конечно, речь не идёт о корпоративных политиках, где использование подобных инструментов строго запрещено.
Кто-то «закальцинировался» и не хочет пробовать новое, кто-то опасается ошибок, которые может допустить модель, и которые незаметно уйдут в продакшн, а кто-то разочаровался после неудачных попыток решить более комплексные задачи с помощью модели.



