Appliště
  • iPhone
  • Mac
  • iPad
  • Apple Watch
  • AirPods
  • Recenze
  • Návody
  • Nakupovat
Nic jsme nenašli :(
Zobrazit všechny výsledky
  • iPhone
  • Mac
  • iPad
  • Apple Watch
  • AirPods
  • Recenze
  • Návody
  • Nakupovat
Nic jsme nenašli :(
Zobrazit všechny výsledky
Appliště
Nic jsme nenašli :(
Zobrazit všechny výsledky
Ilustrace bezpečnostního filtru pro Claude Fable 5

Claude Fable 5 dostává přísnější ochranu. Některé běžné požadavky může nově blokovat

Jan Holeš Jan Holeš
4.7.2026
Aplikace a Hry

Anthropic mění nasazení Claude Fable 5 a zvedá laťku bezpečnostních filtrů. V praxi to znamená méně průchozích rizikových dotazů, ale také více blokovaných benigních požadavků.

Také si přečtěte

Grok Bot s vlastní e-mailovou adresou na iPhonu

Grok Bot vám nyní založí e-mail, aby se mohl registrovat do služeb a jednat za vás

10.10.2026
ChatGPT s GPT-6 a interaktivními prvky Intelligent UI

OpenAI mění ChatGPT. GPT-6 přidává vizuální odpovědi, formuláře i interaktivní nástroje

9.10.2026

Claude Fable 5 dostává přísnější bezpečnostní režim a Anthropic tím dává jasně najevo, že u modelu teď preferuje opatrnost před maximální průchodností. Pro běžné firmy i vývojáře to znamená jednu věc: část dotazů, které dřív prošly, může nově skončit blokací, pokud se budou jevit jen trochu rizikově.

Zapojte se
0
0
0
1
1

Chcete k tomu něco dodat? Napište krátce proč.

Aktuální cenu produktu JBL Tune 770NC najdete na Alze.

JBL Tune 770NC
JBL Tune 770NC
1 990 Kč
3 290 Kč -40 %
Koupit na Alze›
Ilustrace bezpečnostního filtru pro Claude Fable 5An illustration of our cybersecurity safety classifiers. When a request is made to the model, the classifiers detect whether it is benign (and allowed), or potentially harmful (and blocked). The classifiers block ambiguous requests (those that are clearly to do with cybersecurity but could potentially be for defensive purposes, like finding security vulnerabilities) and harmful requests (those that are clearly dangerous, such as a request to build a chain of software exploits). As shown in row A, we also include a “safety margin”, where the classifier will block requests that are probably benign but have some small chance of being harmful. This increases our confidence that all harmful requests will be blocked. For Fable 5 (row B) we made the safety margin even larger, meaning that more benign requests would be blocked—but fewer genuinely harmful requests would be missed. “Vulns” = vulnerabilities.Ilustrace bezpečnostního filtru pro Claude Fable 5How jailbreaks interact with our safety classifiers. In the case of a minor jailbreak (row C), the classifiers do not block the request, but the request is still within our safety margin (and is thus very unlikely to be harmful). In a narrow harmful jailbreak (row D), the prompt breaches the classifiers and unblocks a specific harmful behavior from the model. In a universal jailbreak (row E), a prompt unblocks an entire class of harmful behaviors.

Bezpečnostní filtr je tvrdší než dřív

Podstata změny je poměrně přímočará. Anthropic rozšiřuje takzvanou bezpečnostní rezervu svých klasifikátorů, tedy prostoru, ve kterém raději zablokují i dotazy, jež jsou pravděpodobně neškodné, ale nesou malé riziko zneužití. Cílem je snížit šanci, že model propustí skutečně škodlivý požadavek.

Dřevákov dřevěný kryty na iPhone Dřevákov dřevěný kryty na iPhone Dřevákov dřevěný kryty na iPhone

U Fable 5 je tato rezerva větší než dřív. V praxi to znamená přísnější posuzování zejména u zadání z oblasti kyberbezpečnosti, kde je hranice mezi legitimním testováním a nebezpečným zneužitím často tenká. Pokud systém vyhodnotí žádost jako ambivalentní, raději ji zablokuje.

Anthropic zároveň popisuje, jak se bezpečnostní filtry chovají při pokusech o obejití ochrany. Menší jailbreaky nemusí nutně nic spustit, ale stále se mohou vejít do bezpečné zóny. Naopak úspěšný jailbreak může odemknout konkrétní škodlivé chování, nebo dokonce širší skupinu rizikových odpovědí, což je přesně scénář, kterému chce firma zabránit.

Co to znamená pro firmy a běžné uživatele

Největší dopad pocítí týmy, které Claude používají v enterprise prostředí. U standardních licencí Fable 5 není automaticky součástí předplatného a bez povolených kreditů k němu uživatelé přístup mít nebudou. U prémiových podnikových seatů zůstává do 7. července součástí balíčku, poté se přístup může dál odvíjet právě od zapnutých kreditů.

Pro firmy je to důležité hlavně z pohledu provozu. Přísnější filtr sice může občas zdržet legitimní práci, ale zároveň snižuje riziko, že se model nechá zlákat k produkci nebezpečného obsahu. U nástrojů, které se používají při programování, bezpečnostním výzkumu nebo automatizaci interních procesů, je podobná pojistka prakticky zásadní.

Pro běžné uživatele jde o připomínku širšího trendu v AI: čím schopnější modely jsou, tím pečlivěji se hlídá, co mohou generovat. Anthropic tímto krokem staví bezpečnost nad pohodlí a vychází z předpokladu, že je lepší několik falešných poplachů navíc než jeden nebezpečný průchod. V prostředí, kde se velké jazykové modely čím dál častěji používají i v citlivějších scénářích, je to logický, i když ne úplně bezbolestný posun.

Podrobnosti přinesl také Anthropic.

JBL Tune 770NC
JBL Tune 770NC
1 990 Kč
3 290 Kč -40 %
Koupit na Alze›
Štítky: BezpečnostClaudeenterpriseJailbreakumělá inteligence

Podobné články

Grok Bot s vlastní e-mailovou adresou na iPhonu

Grok Bot vám nyní založí e-mail, aby se mohl registrovat do služeb a jednat za vás

Matyáš Kozák
10.10.2026
0

Grok Bot rozšiřuje své agentní funkce o vlastní e-mailovou adresu. Schránka má botovi umožnit vyřizovat registrace, kontaktovat firmy a domlouvat...

ChatGPT s GPT-6 a interaktivními prvky Intelligent UI

OpenAI mění ChatGPT. GPT-6 přidává vizuální odpovědi, formuláře i interaktivní nástroje

Jan Holeš
9.10.2026
0

ChatGPT nasazuje model GPT-6 a funkci Intelligent UI, která klasické textové odpovědi doplní o interaktivní grafy, formuláře, mapy či drobné...

Chatbot Claude od společnosti Anthropic na obrazovce

Claude může ukončit chat s uživateli, kteří AI opakovaně bezdůvodně urážejí

Matyáš Kozák
9.10.2026
0

Anthropic upravuje pravidla používání Claude. Vedle zákazu krajně krutého jednání s AI zpřesňuje omezení pro falešné kampaně, dohled i rizikové...

Aplikace Spotify s nabídkou audioknih

Spotify rozšiřuje audioknihy do více než 180 zemí a regionů

Jan Holeš
8.10.2026
0

Spotify postupně rozšíří sekci audioknih z 22 na více než 180 trhů. Nabídne přes 350 000 titulů a v části...

Diskuze

Diskuze

Zapojte se do diskuze pod článkem.

0 komentářů
T

Váš e-mail nebude zveřejněn.

“

Buďte první, kdo se zapojí do diskuze.

Zatím tu nejsou žádné komentáře. Otevřené, věcné názory pomáhají ostatním čtenářům udělat si lepší obrázek.

Štítky

AirPods aktualizace aplikace Apple Apple Intelligence Apple keynote Apple Music Apple store Apple TV Apple Watch Appliště Podcast App Store baterie Bezpečnost Chytrá domácnost Fotoaparát Hry iCloud iLifeHacking.cz iOS iOS 10 iOS 18 iOS 27 iPad iPad Pro iPhone iPhone 6 iPhone 7 iPhone 16 iPhone 17 iPhone 18 Pro Mac MacBook MacBook Pro macOS OS X příslušenství Recenze Samsung Siri Skládací iPhone Tim Cook TOP umělá inteligence WWDC

Apple magazín Appliště denně informuje o událostech ze světa Apple. iPhone, iPad, Mac, Apple Watch, Apple TV a další, to je naše!

  • Redakce
  • Inzerce a kontakt

© 2011 - 2026 Appliště - Všechna práva vyhrazena.

Nic jsme nenašli :(
Zobrazit všechny výsledky
  • Mac
    • MacBook Air
    • MacBook Pro
    • iMac
    • Mac mini
    • Mac Studio
    • Mac Pro
    • macOS Sequoia
  • iPad
    • iPad Pro
    • iPad Air
    • iPad
    • iPad mini
    • iPadOS 18
    • Apple Pencil
    • Smart Keyboard
  • iPhone
    • iPhone 16 Pro
    • iPhone 16
    • iPhone 15
    • iPhone 14
    • iPhone SE
    • iOS 18
  • Watch
    • Apple Watch Series 10
    • Apple Watch Ultra 2
    • Apple Watch SE
    • watchOS 11
    • Řemínky
  • AirPods
    • AirPods 4
    • AirPods Pro 2
    • AirPods Max
  • Vision
    • Vision Pro
    • visionOS 2
  • TV a Domácnost
    • Apple TV 4K
    • Apple TV+
    • tvOS 18

© 2011 - 2026 Appliště - Všechna práva vyhrazena.