
Современные мультимодальные OCR-модели эволюционировали от простого распознавания текста к комплексному пониманию документов с поддержкой 100+ языков и расширенными функциями анализа.
Google Cloud представила улучшения для Ray на GKE, упрощающие планирование и масштабирование распределенных ИИ-приложений с фокусом на ML-рабочие нагрузки.

Google Cloud представил улучшения для работы Ray с TPU на GKE, включая автоматизацию настройки аппаратной топологии и расширенную поддержку JAX.

Google представила Gemini Enterprise — специализированную платформу ИИ для научных исследований, автоматизирующую рабочие процессы ученых и ускоряющую обработку экспериментальных данных.

Switchboard, MD добилась 90% снижения затрат на транскрипцию медицинских звонков с помощью Amazon Nova Sonic, сохранив точность 96% для автоматизации клинических процессов.

Обзор ключевых анонсов AlphaSense на конференции AlphaSummit 2025: новые AI-инструменты для финансового анализа, автоматизации исследований и экспертных интервью.

Databricks анонсирует новые функции Agent Bricks для создания AI-агентов с акцентом на точность, управление и открытость, помогая предприятиям перейти от пилотов к производству.

Исследование Anthropic показывает, что языковые модели ненадежны в описании собственных мыслительных процессов, достигая успеха лишь в 20-42% случаев при интроспекции.

Китай разрабатывает детальные планы по интеграции ИИ в промышленность с акцентом на ключевые отрасли и технологии, включая большие языковые модели и ИИ-агенты.

Nokia и Rohde & Schwarz разработали AI-приемник для 6G, который улучшает покрытие uplink на 10-25% с помощью машинного обучения, снижая затраты на развертывание сетей.