
Современные открытые модели OCR преобразуют не только текст, но и сложные элементы документов: таблицы, диаграммы и изображения с сохранением структуры.

Hugging Face добавила поддержку компьютерного зрения в AI Sheets — теперь можно извлекать данные из изображений, генерировать и редактировать визуальный контент прямо в таблицах без программирования.

NVIDIA выпустила модель Nemotron-8B-Embed для генерации векторных представлений текста. Модель доступна в двух версиях с разной длиной контекста и предназначена для семантического поиска и анализа текстовых данных.

Google Cloud расширила возможности отслеживания происхождения данных в Dataplex до уровня отдельных столбцов для BigQuery, что критично для построения надежных AI-систем.

Amazon представила архитектуру многокомпонентных голосовых ассистентов, объединяющую Nova Sonic и Bedrock AgentCore для создания распределенных ИИ-систем со специализированными агентами.

AWS представила бессерверное развертывание моделей для Amazon SageMaker Canvas, упрощая вывод ML-моделей в продакшен для бизнес-пользователей без DevOps-навыков.

Together AI расширяет платформу 40+ моделями для генерации изображений и видео, включая Sora 2, Google Veo 3.0 и ByteDance Seedance. Единые API для текста, изображений и видео упрощают разработку мультимодальных приложений.

Lambda назначает Стейси Финерман вице-президентом по работе с инвесторами, усиливая команду на фоне роста спроса на AI-инфраструктуру.

Google AI Studio получил обновление с автоматической сборкой приложений через текстовые запросы. Система позволяет создавать работающие веб-приложения за минуты без навыков программирования.

Alibaba обновила инструмент Qwen Deep Research, добавив возможность превращать AI-отчеты в интерактивные веб-страницы и многоголосые подкасты за 1-2 клика.