Mohou hraniční modely analyzovat malware autonomně?
SentinelLabs vytvořila benchmark k testování schopností nejnovějších AI modelů v autonomní analýze malwaru na příkladu implanta fast16 z roku 2005. Podle zdroje pouze GPT-5.6 Sol zvládl úplnou osmistupňovou investigaci, ostatní modely selhaly v udržení konzistence analýzy při objevení nových důkazů; zdroj doporučuje использовать modely jako asistenci pod dohledem zkušených analytiků.
OpenAI Anthropic Google DeepMind US
shrnutí generováno strojově — otevřít originál