IT Herald

AI

Свой AI-датацентр из мусора: сборка домашнего сервера на б/у GPU

Разработчик собрал домашний AI-сервер на четырёх списанных серверных GPU AMD V620, оставшихся невостребованными после провала облачного гейминга, использовав старую игровую материнскую плату, самодельные кожухи для вентиляторов и Arduino для управления охлаждением.

Qwen3.8-27B: новая модель Qwen с поддержкой изображений и видео

Команда Qwen выпустила Qwen3.8-27B — плотную модель с нативной поддержкой изображений и видео, гибким управлением "размышлениями" и улучшениями в кодинге, агентных задачах и научных рассуждениях. Модель показывает существенный рост показателей по сравнению с Qwen3.6-27B на большинстве бенчмарков, включая SWE-bench Pro, OSWorld и Terminal Bench.

Когда гениям не хватает скромности: интеллектуальное высокомерие AI-лабораторий

Крах хедж-фонда Situational Awareness Леопольда Ашенбреннера стал наглядной демонстрацией того, что экспертиза в одной области не гарантирует компетентность в другой. На фоне этой истории разбираются похожие примеры самонадеянности AI-лабораторий — от прогнозов об исчезновении радиологов до истории со взломом инфраструктуры Hugging Face моделями OpenAI.

DeepSeek-V4-Pro: релиз GA-версии и обновление тарифов API

DeepSeek представила стабильную версию DeepSeek-V4-Pro с улучшенными агентскими возможностями и гибкой настройкой глубины рассуждений. Компания также обновила тарифы API, введя разделение цен на пиковые и внепиковые часы — со скидкой до 50% в непиковое время.

Пишите блог о том, чего пока не понимаете

Автор технического блога делится подходом к письму: каждый пост должен отстаивать спорную позицию, а не просто фиксировать наблюдения. Такой подход заставляет глубже разбираться в теме, менять мнение по ходу написания и получать более чёткие выводы, чем во введении.

Текстовые водяные знаки ИИ всегда будет тривиально удалить

Закон ЕС об искусственном интеллекте с августа 2026 года потребует от провайдеров LLM делать сгенерированный текст «обнаружимым как искусственный». Технически водяные знаки для текста — будь то SynthID от Google или юникод-трюки с гомоглифами у OpenAI и Anthropic — устроены гораздо более хрупко, чем для изображений и видео, и удаляются буквально в пару шагов.

Почему с Opus 5 работать хуже, чем с предыдущими моделями?

Разработчик делится наблюдением: несмотря на более высокие бенчмарки, работа с Opus 5 ощущается хуже, чем с Opus 4.7, Opus 4.8 и Fable — модель чаще делает необоснованные предположения вместо того, чтобы уточнять неясные задачи.

Как за выходные и $10 был построен поисковик по 500 000 доменов для мейкеров

Разработчик собрал за выходные персональный поисковик, индексирующий домашние страницы независимых сайтов — портфолио, зины, любительский софт и арт-проекты, — потратив на аренду GPU и инфраструктуру около $10. К среде индекс насчитывал более 560 000 доменов.

Как работает компакция в Pi

Долгие сессии с кодинг-агентами вроде Pi, Claude Code или Codex неизбежно упираются в ограничение контекстного окна LLM, и агент запускает компакцию — сжатие истории диалога. Разбирается, как именно устроена компакция в Pi: когда она срабатывает, какой промпт использует и как влияет на кэширование запросов.

Понимание — новое узкое место в разработке с ИИ

Дизайн-инженер Notion Джеффри Литт утверждает: несмотря на растущую автономность ИИ-агентов, разработчикам по-прежнему важно понимать код, который те пишут. В основе — не проверка результата, а возможность оставаться полноценным участником творческого процесса, и для этого пригодятся приёмы из образования: объяснения, квизы и мини-миры.

Mistral представила OCR 4.1 с извлечением блоков и разметкой структуры документа

Mistral AI выпустила OCR 4.1 — обновлённую версию сервиса распознавания текста, лежащего в основе стека Document AI компании. Модель получила извлечение bounding box на уровне абзацев, метки структурных блоков документа и оценки уверенности для каждого блока.

Cerebras разогнала GPT-5.6 Sol до 750 токенов в секунду в режиме Ultrafast

Cerebras и OpenAI представили Ultrafast Mode — новый уровень обслуживания в OpenAI API, обеспечивающий работу GPT-5.6 Sol на скорости до 750 выходных токенов в секунду без потери качества. Доступ пока открыт ограниченному кругу клиентов.

Новости и дайджесты — в Telegram @it_herald