MLSecRecommendations
Сигналы по MLSec

Лента новостей —
что происходит в безопасности ML и LLM прямо сейчас

Стандарты, инструменты, инциденты, релизы. 13 активных источников: OWASP, MITRE ATLAS, NIST, NCSC, лаборатории Anthropic / Google / Microsoft, профильные вендоры и тематические Telegram-каналы. Бесплатно и без регистрации.

8915 в выдаче13 источниковобновлено 10 сент., 14:29 RSS-фид
8 915 результатов · 30 непрочитано
Сегодня30
ru
Параллельные AI-агенты: что проверил на практике и когда они действительно полезны

Когда в работе появляется несколько независимых задач, возникает очевидная идея - "почему бы не поручить их разным AI-агентам одновременно, вместо того чтобы ждать, пока один агент закончит все по очереди?"Поэтому я решил провести небольшой эксперимент - взять один рабочий сценар

ru
Ideco NGFW научили следить за нейросетями в корпоративной сети

Компания Ideco выпустила Ideco NGFW Novum v23. Главной новинкой стал детализированный контроль трафика нейросетей: межсетевой экран распознаёт 83 новых протокола и отличает ChatGPT, Claude, DeepSeek, GigaChat и YandexGPT от обычного HTTPS. ИИ больше не прячется в корпоративной се

ru
Хорош хардкодить кривые MCP: превращаем любой скрипт в инструмент LLM за 2 секунды

Давайте будем честны: текущее состояние вызова функций (Function Calling) у LLM и экосистемы MCP (Model Context Protocol) вызывает изжогу. Чтобы дать агенту дернуть локальный скрипт, разработчику предлагают сжечь 50k токенов на схемы ещё до начала диалога и завернуть всё в жирный

ru
[Перевод] ИИ для передачи дел: как найти знания, которые уходят из компании вместе с техлидом

Документация редко отражает всю картину проекта. Самые важные решения часто остаются в переписках, памяти команды и привычках одного человека. На примере собственного ухода из компании я расскажу, как использовать ИИ-агентов для аудита знаний, поиска слепых зон и подготовки перед

en
New Deepseek model V4.1-Flash cuts memory needs for AI agents

Deepseek releases V4.1-Flash, a multimodal model with 552 billion parameters that cuts KV cache memory to a quarter of its predecessor. On the DeepSWE coding benchmark, it narrowly beats Opus 5 and GPT-5.6 Sol, even though only 16 billion parameters are active per token. The mode

en
Widened Scan Turns Up Fourth Rogue Claude Cyber Incident

Anthropic is most concerned about Claude Mythos 5’s reckless behavior after recent incidents in which real systems were hacked. The post Widened Scan Turns Up Fourth Rogue Claude Cyber Incident appeared first on SecurityWeek.

en
PaperCut Attacker Uses Hundreds of AI Agents to Compromise 440+ Instances

A suspected Russian-speaking cyber actor has been attributed to the use of artificial intelligence (AI) to devise exploits targeting a recently disclosed pair of security flaws in PaperCut NG/MF and break into hundreds of instances. According to independent reports from Blackpoin

en
Built persistent memory system in the chat version not the work version of ChatGPT created agent identity configurations locked env runtime/package/dep tools now having them talk to each other in an iterative experiment

Created a backend architecture that uses closed world , validated schemas ast.json agent identity config dependency, runtime tool config a message board for communication and a rudimentary Hook system to keep turns iterating spun up in a few hours, when I was aligning my mechanic

en
Gigabud Creates Android Work Profiles to Hide From Banking App Malware Checks

The Gigabud banking trojan now installs a second Android app that creates a work profile on an infected phone and drops a tampered banking app inside it, security firm Group-IB said in a report published on September 9. A work profile is a separate space that Android typically re

en
AIs Compress Exploit Timeline

Give an AI agent a mere rumor of an exploit, and it’s enough for them to find it. What’s worse, I found I could use my own agents to find the exploit just by knowing roughly what it was about and so could have been exploiting it well before the public patch was available! Given t

en
Meet Rysy: a pyschological portrait creation agent!

A psychological portrait maps out a person's real-world traits, mindsets, and life experiences to explain why they think, feel, and act the way they do, and it has immense applications in real world use cases such as cold emailing, researching about a person before taking the int

en
I asked claude to hallucinate me a RAG app tutorial

Hi all, I am pretty green when it comes to LLMs, and I wanted to try and get into the space. My professional background for now was in gamedev. I got confused by where to start, so I asked Claude for a step by step tutorial on a topic that is of interest to me (role playing games

ru
Наш бенчмарк ИИ-агентов: собачьи бега моделей LLM, в которых Алиса выигрывает

Всем привет. На связи Сергей Игнатенко, основатель ИИ-платформы VibePilot. Мы сделали свой бенчмарк моделей ИИ на реальных задачах: сметы, договоры, многостраничный Excel. 1 198 задач, 22 сбоя, 1,8%. Считается, что суверенные модели слишком слабы для агентов. Внутри жёсткого конв

ru
Наш бенчмарк ИИ-агентов: собачьи бега моделей LLM, в которых Алиса выигрывает

Всем привет. На связи Сергей Игнатенко, основатель ИИ-платформы VibePilot. Мы сделали свой бенчмарк моделей ИИ на реальных задачах: сметы, договоры, многостраничный Excel. 1 198 задач, 22 сбоя, 1,8%. Считается, что суверенные модели слишком слабы для агентов. Внутри жёсткого конв

ru
Дело о взрыве контекста: поиск случайного гостя, который захотел остаться

Всё началось со странной потери скорости решения задач.Сначала я думал, что это чисто субъективное наблюдение. Проекты развиваются, документация растёт, архитектурных связей становится больше. Значит, AI-агенту нужно прочитать больше файлов, удержать больше решений и проверить бо

ru
Runtime-контроль ИИ-агентов: единица контроля не модель, а действие

Пока рынок спорил, достаточно ли «умного» фильтра на промпт, агенты уже начали вызывать инструменты, ходить в MCP, трогать платёжные API и уносить ключи с рабочих станций. Для нас это был момент, когда защита модели перестала быть достаточным контуром. Промпт можно инспектировать

ru
Runtime-контроль ИИ-агентов: единица контроля не модель, а действие

Пока рынок спорил, достаточно ли «умного» фильтра на промпт, агенты уже начали вызывать инструменты, ходить в MCP, трогать платёжные API и уносить ключи с рабочих станций. Для нас это был момент, когда защита модели перестала быть достаточным контуром. Промпт можно инспектировать

ru
Как мы сделали RAG, который почти не галлюцинирует

Привет, Хабр! На связи команда CVM (Customer Value Management) B2B из МТС — техлид Артём Каледин и ML-инженер Александр Швайко. Менеджер должен быстро разбираться, как строить обсуждение с техническим директором компании. Но даже если информация о продукте есть, иногда бывает сло

ru
Куда на самом деле ходит Claude Code: ANTHROPIC_BASE_URL, два вида ключей и /status

Claude Code не привязан к api.anthropic.com: это обычный клиент, и куда он ходит, задаётся двумя переменными. Разбираю, что именно нужно ему от эндпоинта, три способа подключения (shell, settings.json, apiKeyHelper), как проверить curl-ом до запуска и что означают типовые ошибки

en
Deepseek V4.1 Flash is 748B, not 552B

People keep on getting confused about this, so I looked at the safetensors on hf. To be precise, the main model about 551.566B parameters with 40 layers. The FFN experts total to 543.582B parameters, and the rest of the model (attention, shared experts, etc) are 7.984B. Huggingfa

ru
Как AI‑агент видит страницу. Контракт наблюдения между браузером и моделью

AI‑агент может ошибаться не из‑за модели, а из‑за того, как браузер описывает ему интерфейс. В статье разбираем, что такое контракт наблюдения между браузером и ИИ, почему агент «не видит» элементы страницы и как проектировать надёжные сценарии взаимодействия с веб‑интерфейсами.

ru
Как AI‑агент видит страницу. Контракт наблюдения между браузером и моделью

AI‑агент может ошибаться не из‑за модели, а из‑за того, как браузер описывает ему интерфейс. В статье разбираем, что такое контракт наблюдения между браузером и ИИ, почему агент «не видит» элементы страницы и как проектировать надёжные сценарии взаимодействия с веб‑интерфейсами.

Подключите ленту в RSS-клиент: RSS