OpenAI изменит политику вывода моделей из эксплуатации после скандала с GPT-5. Теперь компания будет предупреждать за 30 дней и сохранять API-доступ к старым версиям ещё 90 дней.
Hugging Face представил FilBench — первый бенчмарк для оценки LLM на филиппинских языках. Тестирование 41 модели выявило лидеров и слабые места, особенно в генерации текста.
Новый бенчмарк TextQuests на классических текстовых играх вскрыл слабости LLM в долгосрочном планировании и пространственном мышлении. Модели галлюцинируют в длинных сессиях и неэффективно тратят вычислительные ресурсы.
Lambda запустила инстансы с 8 GPU NVIDIA B200 по $4.99/GPU-час. Архитектура Blackwell обещает 3× ускорение обучения LLM и 15× рост скорости инференса.
Claude Sonnet 4 теперь обрабатывает 1 млн токенов, позволяя анализировать целые кодобазы. Но рост возможностей сопровождается ценовыми и бизнес-рисками для Anthropic.
Liquid AI выпустила мультимодальные модели LFM2-VL для смартфонов. Скорость инференса в 2 раза выше аналогов при работе с текстом и изображениями.
Stability AI и NVIDIA представили микросервис SD3.5 NIM с ускорением генерации изображений в 1.8 раза и контейнерным развёртыванием для предприятий.
OpenAI добавила интеграции ChatGPT с Dropbox, Teams и другими сервисами, а Сэм Альтман уточнил приоритеты GPT-5: лимиты сообщений, расширение API и удвоение вычислительных мощностей.
Opacus добавил поддержку mixed precision для DP-SGD, ускоряя обучение в 2-6 раз и вдвое сокращая потребление памяти. Технология особенно эффективна при использовании LoRA.
Стартап Continua привлек $8 млн на внедрение AI-агентов в групповые чаты. Основанный экс-инженером Google, сервис автоматизирует планирование встреч и напоминания, но сталкивается с проблемой «социального интеллекта» ИИ.