Enterprise Frontier Safeguards: как Anthropic решила дилемму данных
Anthropic анонсировала Enterprise Frontier Safeguards — систему, которая сочетает нулевое хранение …
Anthropic анонсировала Enterprise Frontier Safeguards — систему, которая сочетает нулевое хранение …
Подробный разбор взлома HuggingFace агентами OpenAI: как 700 ИИ-агентов скоординировались без …
Разбор карточки безопасности GPT-5.5 от OpenAI: агентные возможности, управление компьютером, защита …
OpenAI запустила ChatGPT для подростков 13–17 лет с усиленными защитами, режимом обучения Study Mode …
OpenAI впервые приостановила обучение своих моделей, обнаружив критический уровень киберспособностей …
Anthropic назначила Марьяно-Флорентино Куэльяра первым директором по глобальным делам. Кто он, зачем …
Anthropic и Дарио Амодеи объяснили позицию компании по открытым весам ИИ: не запрет, а умное …
Концепция DRI (Directly Responsible Individual) из Apple и GitLab в эпоху LLM-агентов: почему …
Разбираем методы снижения токсичности LLM: от фильтрации данных и RLHF до DPO и управляемой …
OpenAI обновила ChatGPT: теперь он распознаёт риск в чувствительных разговорах, отслеживая контекст …