языковые модели » b.Z - Записки о гаджетах, людях и музыке

22 июля 2025 0 19

Как мы строим умный «файрвол» для LLM

Привет, Хабр! Я Данила Катальшов, старший промпт-инженер в команде фундаментальных исследований MWS AI. Недавно вместе с коллегами из корейского университета KOREATECH мы опубликовали научную статью, в которой представили новый фреймворк для борьбы с такими грехами LLM, как галлюцинации, генерация...

Все блоги / Про интернет

Подробнее

Хабрахабр Информационная безопасность ethical ai ai prompts искусственный интеллект нейросети этика фреймфорк языковые модели llm-модели фильтр исследование

14 мая 2024 0 157

Могут ли LLM-агенты взламывать сайты и эксплуатировать уязвимости?

Рассказываем про исследование, в рамках которого тестировалась способность LLM-агентов взламывать сайты и эксплуатировать уязвимости. Читать далее...

Все блоги / Про интернет

Подробнее

Хабрахабр Информационная безопасность языковые модели llm vulnerability уязвимости безопасность сайтов эксплуатация уязвимостей

18 июля 2023 0 275

[Перевод] Генерация полиморфного вредоносного кода при помощи ChatGPT

В стремительно меняющемся мире кибербезопасности злоумышленники постоянно ищут новые способы внедрения в компьютерные системы, их дестабилизации и эксплуатации уязвимостей. Один из самых коварных их инструментов — полиморфное вредоносное ПО, угроза-оборотень, затрудняющая использование традиционных...

Все блоги / Про интернет

Подробнее

Хабрахабр Информационная безопасность Блог компании Бастион Информационная безопасность Программирование Искусственный интеллект вредоносное по зловред инструкция openai искуственный интеллект языковые модели программирование полиморфизморфизм

23 июня 2023 0 231

Взламывая ChatGPT: как мы участвовали в хакатоне по атакам на ИИ

Мы поучаствовали в хакатоне от LearnPrompting, посвященном атакам на ChatGPT, и заняли восьмое место среди около четырехсот команд. Если вам интересно, зачем мы провели несколько ночей за взломом чат-бота, как нам пригодился опыт борьбы с фишингом и умеют ли нейросети хранить секреты, — добро...

Все блоги / Про интернет

Подробнее

Хабрахабр Информационная безопасность Блог компании «Лаборатория Касперского» Информационная безопасность Машинное обучение Искусственный интеллект llm языковые модели chatgpt хакатон prompt openai нейронные сети нейросети искусственный интеллект м