Блог

Статьи об AI-автоматизации, речевой аналитике и интеллектуальных агентах для бизнеса

Cover Image for Самая передовая модель OpenAI не может ответить на простой вопрос про буквы алфавита

Самая передовая модель OpenAI не может ответить на простой вопрос про буквы алфавита

ChatGPT с заявленным интеллектом уровня PhD демонстрирует системные сбои при ответах на простые вопросы про буквы алфавита, выявляя фундаментальные ограничения архитектуры GPT-5.

Cover Image for OpenAI интегрирует GPT-5 в крупнейший корейский мессенджер KakaoTalk

OpenAI интегрирует GPT-5 в крупнейший корейский мессенджер KakaoTalk

OpenAI интегрирует GPT-5 в корейский мессенджер KakaoTalk с октября 2025 года. Партнерство позволит 50 млн пользователей получить доступ к последней языковой модели без отдельного приложения.

Cover Image for Microsoft разрабатывает ИИ-ассистента для диагностики редких генетических заболеваний

Microsoft разрабатывает ИИ-ассистента для диагностики редких генетических заболеваний

Microsoft разрабатывает ИИ-систему для ускорения диагностики редких генетических заболеваний. Технология поможет анализировать миллионы генетических вариантов и сократить время постановки диагноза.

Cover Image for Perseverance нашел на Марсе биомаркеры, но эксперт считает — они могли появиться и в отсутствие жизни

Perseverance нашел на Марсе биомаркеры, но эксперт считает — они могли появиться и в отсутствие жизни

Ведущий геоастроном оспаривает заявление NASA о находке биомаркеров на Марсе, утверждая, что минералы можно объяснить небиологическими процессами. Научный спор продолжает традицию здорового скептицизма в астробиологии.

Cover Image for DeepMind усиливает систему безопасности для передовых ИИ-моделей

DeepMind усиливает систему безопасности для передовых ИИ-моделей

DeepMind опубликовала третью версию фреймворка безопасности для передовых ИИ-моделей, добавив защиту от вредоносного манипулирования и уточнив процессы оценки рисков.

Cover Image for Meta* представляет Gaia2 и ARE — бенчмарк для тестирования ИИ-агентов в реальных условиях

Meta* представляет Gaia2 и ARE — бенчмарк для тестирования ИИ-агентов в реальных условиях

Meta представляет Gaia2 — новый агентный бенчмарк с открытым фреймворком ARE для тестирования ИИ-агентов в условиях, максимально приближенных к реальному миру.

Cover Image for ServiceNow представляет SyGra — фреймворк для генерации данных для языковых моделей

ServiceNow представляет SyGra — фреймворк для генерации данных для языковых моделей

ServiceNow анонсировала SyGra — low-code фреймворк для генерации и преобразования данных для обучения языковых моделей. Решение упрощает создание сложных датасетов для SFT, DPO и RAG-пайплайнов.

Cover Image for Scale запускает SEAL Showdown — рейтинг LLM на основе отзывов реальных пользователей

Scale запускает SEAL Showdown — рейтинг LLM на основе отзывов реальных пользователей

Scale запустила SEAL Showdown — первый рейтинг языковых моделей на основе оценок реальных пользователей из 100+ стран с детальной сегментацией по демографии.

Cover Image for AlphaSense представляет Workflow Agents для автоматизации бизнес-исследований

AlphaSense представляет Workflow Agents для автоматизации бизнес-исследований

AlphaSense запустила Workflow Agents — автоматизированные рабочие процессы для бизнес-исследований, сокращающие время анализа с дней до минут.

Cover Image for Поведенческий вызов для домашних роботов: как Stanford HAI тестирует бытовые навыки ИИ

Поведенческий вызов для домашних роботов: как Stanford HAI тестирует бытовые навыки ИИ

Stanford HAI запустил Behavior Challenge — системный тест для домашних роботов с 50 бытовыми задачами. Эксперимент оценивает успешность, эффективность и надежность роботизированных систем в реальных условиях.