{"ok":true,"trend":{"id":449070,"platform":"mastodon","region":"global","key":"i guardrail dell’ia non bastano perché i filtri su input e output sono aggirabili e non sappiamo davvero come i modelli","title":"I guardrail dell’IA non bastano perché i filtri su input e output sono aggirabili e non sappiamo davvero come i modelli","url":"https://mastodon.uno/@silvanomarioni/117358227042437636","first_seen":"2026-09-30T06:02:49.443731Z","last_seen":"2026-09-30T06:02:49.443731Z","last_rank":11,"peak_rank":11,"last_volume":1,"peak_volume":1,"seen_count":1,"score":25.195,"category_hint":"ai","section":"technology","category":"ai","summary":"Commentators argue that current AI safety guardrails fall short because input and output filters can be circumvented, and it remains unclear how models actually make decisions. The proposed response is a new layer of protections, including multilevel controls, independent supervisors, and AI systems dedicated to verification. The discussion reflects growing scepticism that surface-level filtering alone can keep large language models safe.","why":"Ongoing debate about AI safety and the limits of guardrails as models become more widely deployed","tone":"neutral","entities":["artificial intelligence","AI safety guardrails"],"summarized_at":"2026-09-30T06:03:23.519537Z","meta":{"tag":"artificialintelligence","via":"scan","kind":"status","lang":"it","instance":"mastodon.social","tag_uses":421},"nw":null,"promo":null,"kind":null,"importance":null,"hidden":false,"hide_reason":null,"judged_at":null,"title_en":"AI guardrails deemed insufficient as filters prove bypassable","section_name":"Technology","category_name":"AI","timeline":[{"captured_at":"2026-09-30T06:02:49.443731Z","rank":11,"volume":1}],"posts":[{"platform":"mastodon","url":"https://mastodon.uno/@silvanomarioni/117358227042437636","author":"silvanomarioni@mastodon.uno","title":null,"snippet":"I guardrail dell’IA non bastano perché i filtri su input e output sono aggirabili e non sappiamo davvero come i modelli prendono decisioni. Servono nuove protezioni: controlli multilivello, supervisori indipendenti e IA dedicate alla verifica. @ tecnologia #…","posted_at":"2026-09-30T05:00:31Z","likes":1}],"elsewhere":[],"window":"7d"}}