Claude Fable 5.1 rozdrtil vědecký AI benchmark na 52,6 %!
Vyšel Claude Fable 5.1 a hned zaujal výsledkem 52,6 % v benchmarku Terminal-Bench-Science. Ten testuje, zda AI agent zvládne samostatně řešit náročné vědecké úlohy, například určit z družicových snímků, kdy jezero zamrzlo. Fable 5.1 v tomto testu výrazně překonal předchozí modely. Co stojí za tak velkým skokem? Na plný díl se můžeš kouknout zde: https://youtu.be/vIk9kX62In8 #Claude #Fable51 #AI #Anthropic #TerminalBench #Shorts





