Последние посты

QA
22 сент., 20:11
переслано из @qa_iive

QA
22 сент., 20:10
переслано из @ai_4life
🔥 OpenAI выпустила GPT-6 Sol и Luna: та же линейка, вдвое дешевле APIРядом с тяжёлой Astra появились две модели полегче. GPT-6 Sol забирает сложную ежедневную работу, GPT-6 Luna рассчитана на скорость: поток запросов, простой код, классификация. Обе учили теми же методами, что и Astra, а цены API срезали на 50% относительно промо-тарифов GPT-5.6.• 💻 Код. На DeepSWE v1.1 Sol на максимуме взяла 68,8%. Это на 1,1 пункта ниже лучшего результата Claude Fable 5 (69,9%) и примерно на 80% дешевле за задачу. Luna на максимуме набрала 66,6% и в тех же сравнениях стоит на 93% дешевле Opus 5. • 🖥 Компьютер. В computer use Astra по-прежнему впереди. На OSWorld 2.0 offline Sol почти повторила Claude Opus 5: 60,5% против 60,3%, снова около минус 80% к цене задачи. • 🧩 Куда какая. Astra остаётся для самых тяжёлых рассуждений и разработки. Sol OpenAI ставит основной рабочей моделью. Luna


QA
21 сент., 17:59
переслано из @ai_4life
🚀 Grok 4.7 прокачали для кодинга и длинных агентных задачSpaceXAI выпустила Grok 4.7, новую флагманскую модель для программирования и сложной интеллектуальной работы.Главное изменение под капотом: более крупная базовая модель и более длительное обучение с подкреплением на задачах, которые могут занимать у агента несколько часов. Grok 4.7 лучше проверяет собственную работу, удерживает длинный контекст и умеет работать непосредственно с агентной средой Grok Bot.📈 Что изменилось в тестах:• CursorBench 4.0: 46,3% против 40,4% у Grok 4.6. • Terminal-Bench 4.0: 38% против 20,3%. • EEBench по электротехнике: 64% против 53%.Отдельно улучшили создание документов и презентаций. В задачах, близких к реальной работе юристов, финансовых аналитиков и других специалистов, новая модель также обошла предыдущую версию.💰 Цена не изменилась: от $2 за миллион входных токенов и $6 за миллион


QA
21 сент., 11:19
💾 SQL для тестировщика: SELECT, JOIN, подзапросы⚙️ SELECT – база Достаём данные и сразу фильтруем: SELECT id, email, status FROM users WHERE created_at >= '2024-01-01' ORDER BY id DESC LIMIT 50; Полезно: COUNT(), DISTINCT, LIKE '%test%', IN ('active','banned'), BETWEEN. Поиск дублей: GROUP BY email HAVING COUNT() > 1.📋 JOIN без боли JOIN соединяет таблицы по ключу: INNER JOIN → только совпадения LEFT JOIN → всё слева + совпадения (нет пары → NULL) RIGHT JOIN → зеркально LEFT FULL JOIN → всё из обеих (нет в MySQL) Заказы без оплаты – классика на собесах: SELECT o.id


QA
21 сент., 08:09
☝️ Оказывается всем хорошо известный мультфильм является прекрасным пособием для демонстрации видов тестирования
QA
20 сент., 06:49изменён
Всем приятных выходных. Следите за дорогой и не проводите в ней слишком много времени в ваш выходной. :)) А лучше, проводите побольше времени с своими близкими и родными. Всем добра и на связи!


QA
18 сент., 15:00
📚 QA-дайджест: тестирование без угадайки8 статей с Хабра о QA-процессах, автотестах, отладке и нагрузке.• 🔹 Грейды QA без «таблички ради таблички». В Контуре Excel-список навыков вырос в шесть грейдов и пять треков: качество, техника, мобильность, люди и обучение. Оценку 270+ тестировщиков распределили между руководителями кластеров и комиссиями, чтобы убрать бас-фактор. Кем я стану, когда вырасту: эволюция QA-инженера• 🔸 Как поселить flaky-тесты в CI. Ретрай, который красит сборку в зелёный, прячет гонки. Автор предлагает ждать условие, изолировать общее состояние, фиксировать время и случайность, а карантину назначать владельца и срок. Пять способов навсегда поселить flaky-тесты в своём CI• 🔹 Осторожный ИИ-агент исправил меньше багов. На 100 задачах SWE-bench Lite набор правил «думай заранее, меняй точечно, пиши минимум кода» проиграл базовой конфигурации во всех трёх


QA
18 сент., 07:05
Держим AI-новости ПОД РУКОЙ — собрали в одну Telegram-папку каналы про нейросети, новые инструменты и полезные обновления.Внутри только AI, IT & HR Tech: свежие сервисы, рабочие фишки и материалы, которые помогают быстрее разбираться в новых технологиях и найти вакансии.Добавляем всю [подборку] одним нажатием и не ищем каждый канал вручную.📩 Записаться в папку


QA
17 сент., 17:36
переслано из @ai_4life
В этом видео я показываю, как Гермес помог мне с презентацией. Он создал нужный стиль, понял все референсы и переделал презентацию из неправильного стиля в правильный, сохранив текст и наполнение, которые меня вполне устраивали.
QA
17 сент., 12:18
📚 Шпаргалка: Тестирование состояний и переходовСистема как автомат: состояния, события, guard-условия. Сквозной пример – банкомат: невалидные переходы, таймаут-изъятие карты, идемпотентность.⚙️ Суть Моделируем систему как автомат: состояния, события, переходы, guard-условия. Ловим то, что пропускает клик-тест: неверный порядок шагов, зависшие состояния, двойные срабатывания.📋 Состояния банкомата 1 Карта вставлена 2 PIN введён 3 Авторизован 4 Сессия (выбор операций) 5 Выдача наличных 6 Карта возвращенаТаблица переходов (фрагмент): Состояние | Событие | Куда Сессия | Выдать N | Выдача [N ≤ баланс И N ≤ кассета] Выдача наличных | Выдача завершена | Сессия Выдача наличных | Выдать повторно | запрещено


QA
17 сент., 11:12
переслано из @ai_4life
📋 65 форматов ответа нейросетиНе просите нейросеть просто «рассказать тему». Сразу задайте форму результата: краткий вывод, таблицу, дерево решений, чек-лист, практикум или карту аргументов.В подборке — 65 форматов для объяснения, выбора, планирования, проверки гипотез, работы с источниками и подготовки данных. Для каждого формата в полной версии указано, зачем он нужен и какую фразу вставить в свой запрос.• 🧠 Для понимания: «тезис — объяснение — пример», сквозной пример, аналогия, словарь, контрпример и тест с разбором. • ⚖️ Для решений: сравнительная таблица, дерево решений, сценарии, воронка выбора, карта аргументов и журнал решений. • 🛠 Для действий: техническое задание, обратный план, инструкция с развилками, блок-схема и реестр рисков. • 🔎 Для проверки: «факты — предположения — неизвестное», таблица источников, чек-лист, шкала оценки и карточка гипотезы. • 🎬 Для идей и


QA
15 сент., 16:56
📋 Почему баги кроссбраузерности никуда не исчезаютChrome занимает большую часть рынка, но это не делает остальные среды неважными. Firefox, Safari, мобильные WebView и даже старая версия Chromium могут показать пользователю совсем другой интерфейс.• 🌐 Движки отличаются: Chrome, Edge и Opera работают на Blink, Safari использует WebKit, Firefox – Gecko. Один и тот же CSS или Web API может отработать по-разному • 📊 Популярность обманчива: в статистике браузеров за 2025 год у Firefox всего 2,38%, но за этой долей стоят десятки миллионов пользователей. Матрицу тестирования лучше строить по аналитике своего продукта • 🧩 Версия имеет значение: даже два Chromium могут вести себя по-разному. В статье старая версия Blink неправильно позиционировала popup, хотя код был исправен • 🖥 ОС меняет картину: шрифты, скроллбары, HiDPI, дробное масштабирование и отрисовка Canvas зависят от Windows,


QA
15 сент., 16:26изменён
Решил сделать своей жене подарок. Она у меня высококлассный специалист по английскому языку. И давно работает в онлайн формате, проводя уроки с детьми, и с подростками, и взрослыми на высочайшем уровне.В этом видео я делюсь тем, что происходит когда прикручиваешь ИИ-агента к платформе по изучению английского языка. Хотите себе такого помощника, способного решать сотни различных задач? Не знаете с чего начать ? Приходите обучаться.🤩 Уже совсем скоро - 17 сентября стартует 2-й поток по обучению нейросетям. Поторопитесь, несколько мест ещё есть.
QA
15 сент., 09:19
📋 «Я попал к психиатру из-за кодинга с AI»: личный опыт разработчикаКирилл Галушко рассказал на Хабре, как переход от Copilot к Cursor и нескольким терминальным агентам ускорил его работу, но превратил день в непрерывное переключение между задачами, уведомлениями и запросами на подтверждение.• 🧠 Нагрузка: параллельные агенты постоянно требовали внимания. Автор стал забывать о еде и домашних делах, дольше оставался на взводе и раздражался на любые отвлечения • 🩺 Диагноз: после разбора жалоб и историй из детства психиатр диагностировал у него СДВГ. Автор считает, что новый рабочий режим усилил и сделал заметнее уже существовавшие особенности • 🛑 Первое правило: отказаться от параллельных агентов. Один поток оказался медленнее, зато вернул время на обдумывание задачи и снизил число переключений • ⌨️ Второе правило: сложные требования лучше печатать. Набор текста помогает


QA
13 сент., 20:39
📚 QA-дайджест: агенты, API, покрытие кода и релизыПять свежих статей с Хабра о том, как проверять не отдельный ответ или процент в отчёте, а весь инженерный процесс: от постановки задачи до выпуска продукта.1. Бенчмарк ИИ-агентов на реальных офисных задачах Авторы сравнили шесть связок «модель плюс провайдер» на 1 198 задачах: сметах, договорах, таблицах и лендингах. Общая доля сбоев составила 1,8%, а разброс стоимости достиг 35 раз; при этом сами авторы предупреждают о разных размерах выборок и одиночных прогонах.2. Как собирают покрытие кода целой ОС Практический разбор покрытия ОС «Нейтрино»: отдельная инструментированная сборка, файлы .gcno и .gcda, утилиты lcov и genhtml. Независимые тестовые конвейеры формируют трассировки по пакетам, а головной Jenkins-процесс объединяет их в отчёты по типам тестов и составу дистрибутива.3. Почему лицензия Claude Code ещё не


QA
13 сент., 15:34
🚀 Antigravity от Google: агент для кода, исследований и автоматизацииAntigravity – рабочая среда, где агент разбирается в материалах, выполняет задачу по шагам и оставляет результат на проверку.Что умеет: • 🧩 читает кодовую базу и связанные файлы, меняет несколько файлов, запускает команды и тесты; • 📁 ищет, читает, создаёт и редактирует локальные рабочие материалы; • 🌐 ищет источники в интернете, читает страницы, собирает фактуру и оформляет аналитический результат; • 🎨 генерирует и редактирует изображения на Nano Banana 2 – для UI-макетов, схем и иллюстраций; • ⏱️ сохраняет повторяемые сценарии как Agent Skills и запускает задачи по расписанию; • 🔌 подключается к внешним сервисам через MCP.После отдельной настройки MCP можно работать с Google Drive, Docs, Sheets, Gmail, Calendar и другими сервисами в пределах разрешений владельца. NotebookLM тоже подключается отдельным


QA
10 сент., 10:37
📋 Как запустить мощного ИИ-агента на видеокарте с 16 ГБ VRAMНа Хабре протестировали локальный агентный стек на RTX 5060 Ti 16GB. Автор проверил несколько квантов Qwen3.8 27B, llama.cpp и подключение к OpenCode – с упором на контекст, скорость и реальную работу с кодом.Что внутри: • 🧠 Требования к локальному агенту: контекст больше 80 тысяч токенов, скорость от 50 токенов/с и приемлемое качество кода • ⚙️ Qwen3.8-27B IQ4_XS: около 15,3 ГБ, примерно 40–50 токенов/с с MTP, но контекст пришлось уменьшить • 🧩 Qwen3.8-27B UD-Q3_K_XL: 13,2 ГБ, до 92 тысяч токенов контекста и около 50 токенов/с – наиболее сбалансированный вариант для агентного кодинга • 🚀 Qwen3.8-27B IQ3_S с DFlash: 11,8 ГБ плюс отдельная модель предсказания, 55–65 токенов/с и до 70 токенов/с в пике • 🛠 Настройка llama.cpp, MTP и DFlash, подключение локального сервера к OpenCode и автоматическое сжатие контекстаВ каче


QA
10 сент., 10:36изменён
📋 Почему рынок IT-вакансий кажется сломанным: объяснение через экономику поискаНа Хабре вышел разбор, который связывает нынешние проблемы с наймом в IT с моделью поиска и сопоставления Даймонда – Мортенсена – Писсаридеса. Именно за исследования этих процессов экономисты получили Нобелевскую премию по экономике в 2010 году.Что внутри: • 🔎 Почему большое количество резюме и открытых вакансий не гарантирует быстрый найм • ⚙️ Как работают поисковые трения: кандидат и компания тратят время и ресурсы, прежде чем найдут подходящую пару • 📉 Почему индивидуально разумные решения могут ухудшать ситуацию на рынке в целом • 💼 Как волна откликов после сокращений влияет на кандидатов, рекрутеров, зарплаты и небольшие компании •


QA
10 сент., 10:20
✴️ DeepSeek V4.1 Flash: 552 млрд параметров, 1 млн контекста и цена Flash вместо ProDeepSeek выпустила V4.1 Flash – новую мультимодальную модель с архитектурой Causal Encoder-Decoder. Всего в ней 552 млрд параметров, но на один токен активируется около 8 млрд при чтении входных данных и 16 млрд при генерации ответа.Такое разделение хорошо подходит для агентных задач: модель читает огромные системные промпты, кодовые базы, историю диалога и результаты инструментов, а выдаёт сравнительно короткое решение.• 🧠 KV Cache: глобальный кэш сжат до 890 байт на токен – примерно в четыре раза меньше, чем у V4 Flash • 👁 Мультимодальность: текст и изображения поддерживаются прямо в основном API-моделе • 📚 Контекст: до 1 млн токенов • 🎛 Мышление: доступны режимы с разной глубиной рассуждений • ⚡️ Инфраструктура: новая архитектура рассчитана на более быстрый




QA
10 сент., 09:53изменён
👋 Всем привет. В эту субботу в рамках моего волонтёрского менторинга в школе RedRover.school, провожу живой ворк-шоп на 1,5 часа по видам тестирования. Будем повторять виды тестирования, применяя полученные знания в практике. Разделимся на несколько команд и пройдём интересный квест. Будем учиться тестировать различные предметы, опираясь на полученные ранее знания о видах тестирования.Что ждёт участников? 🧡Интерактивный квест по видам тестирования 🧡Работа в мини-группах 🧡Реальные кейсы и задачи 🧡Обратная связь от ментора 🧡Прокачка теории через практику👍 Виды тестирования, которые разберём: 🟡Функциональное

