Бүгін Anthropic компаниясы Claude 3.5 Sonnet-ті іске қосты — алдағы Claude 3.5 модельдер тобындағы алғашқы шығарылым. Claude 3.5 Sonnet көптеген бағалауларда бәсекелес модельдер мен Claude 3 Opus-тан асып түсіп, сала интеллектінің деңгейін көтереді, әрі Claude 3 Sonnet-тің орта деңгейлі моделінің жылдамдығы мен құнына ие.

Біз, GPTunneL командасы, Sonnet 3.5 моделін қазірдің өзінде қосып қойдық, және ол сайтымызда әрі телеграм-ботымызда бәріне қолжетімді!
Жылдамдығы 2 есе жоғары озық интеллект
Claude 3.5 Sonnet магистратура деңгейіндегі пайымдау (GPQA), бакалавр деңгейіндегі білім (MMLU) және бағдарламалау шеберлігі (HumanEval) бойынша жаңа салалық межелерді белгілейді. Ол нюанстарды, әзілді және күрделі нұсқауларды түсінуде айтарлықтай жақсарғанын көрсетеді, сондай-ақ табиғи, түсінікті стильде жоғары сапалы мазмұн жазуда ерекшеленеді.
Модель Claude 3 Opus-қа қарағанда екі есе жылдам жұмыс істейді. Бұл өнімділіктің артуы тиімді бағамен қатар жүріп, Claude 3.5 Sonnet моделін контекске сезімтал клиенттерді қолдау және көп сатылы жұмыс үдерістерін ұйымдастыру сияқты күрделі тапсырмалар үшін тамаша таңдау етеді.
Ішкі бағалауда Claude 3.5 Sonnet мәселелердің 64%-ын шешіп, 38%-ын шешкен Claude 3 Opus-тан асып түсті. Бұл бағалау моделдің қалаған жақсартудың табиғи тілдегі сипаттамасы негізінде ашық бастапқы кодтағы қателерді түзету немесе функционалдылық қосу қабілетін тексереді. Нұсқаулар мен тиісті құралдарды алған кезде Claude 3.5 Sonnet кодты өз бетінше жазып, өңдеп, орындай алады, әрі жетілдірілген пайымдау және ақаулықтарды жою мүмкіндіктеріне ие. Ол кодты аударуды жеңіл орындайды, бұл оны ескірген қосымшаларды жаңарту мен код базаларын көшіру үшін әсіресе тиімді етеді.

Озық көру мүмкіндігі
Claude 3.5 Sonnet — бүгінгі күнге дейінгі ең күшті компьютерлік көру моделі, ол стандартты көру бағалауларында Claude 3 Opus-тан асып түседі. Бұл сапалық жақсартулар диаграммалар мен графиктерді интерпретациялау сияқты визуалды пайымдауды қажет ететін тапсырмаларда ерекше байқалады. Claude 3.5 Sonnet сондай-ақ жетілмеген суреттерден мәтінді дәл транскрипциялай алады — бұл бөлшек сауда, логистика және қаржы қызметтері үшін маңызды мүмкіндік, өйткені ЖИ сурет, график немесе иллюстрациядан мәтінге қарағанда көбірек ақпарат ала алады.

Artifacts — Claude-ты пайдаланудың жаңа тәсілі
Бүгін компания сондай-ақ Claude.ai платформасында Artifacts функциясын таныстырды — бұл пайдаланушылардың Claude-пен өзара әрекеттесу тәсілдерін кеңейтетін жаңа функция. Пайдаланушы Claude-тан код үзінділері, мәтіндік құжаттар немесе веб-дизайн сияқты мазмұн жасауды сұрағанда, бұл Artifacts диалогтың қасындағы арнайы терезеде пайда болады. Бұл пайдаланушыларға Claude-тың туындыларын нақты уақыт режимінде көруге, өңдеуге және дамытуға мүмкіндік беретін динамикалық жұмыс кеңістігін жасайды, ЖИ жасаған мазмұнды өз жобалары мен жұмыс үдерістеріне үздіксіз біріктіреді.
Бұл эксперименттік функция Claude-тың сұхбаттасу ЖИ-нен бірлескен жұмыс ортасына айналуын білдіреді. Бұл Claude.ai үшін кеңірек көзқарастың тек басы ғана, ол жуырда командалық жұмысты қолдау үшін кеңейеді. Жақын болашақта командалар, ал соңында тұтас ұйымдар өздерінің білімдерін, құжаттарын және ағымдағы жұмысын бір ортақ кеңістікте қауіпсіз орталықтандыра алады, мұнда Claude сұраныс бойынша көмекші рөлін атқарады.
Қауіпсіздік пен құпиялылыққа адалдық
Компанияның модельдері мұқият тестілеуден өтеді және теріс пайдалану мүмкіндігін азайту үшін оқытылған. Claude 3.5 Sonnet-тің интеллект деңгейінің секіруіне қарамастан, «қызыл команда» бағалаулары оның ASL-2 деңгейінде қалып отырғанын көрсетті.
Қауіпсіздік пен ашықтыққа адалдығының бөлігі ретінде компания осы соңғы модельдегі қауіпсіздік механизмдерін тестілеу және жетілдіру үшін сыртқы сарапшыларды тартты. Жақында Claude 3.5 Sonnet орналастыруға дейінгі қауіпсіздікті бағалау үшін Ұлыбританияның Жасанды интеллект қауіпсіздігі институтына (UK AISI) берілді. UK AISI 3.5 Sonnet-ті тестілеп, нәтижелерін АҚШ пен Ұлыбритания институттары арасындағы серіктестік аясында мүмкін болған Өзара түсіністік меморандумы шеңберінде АҚШ-тың Жасанды интеллект қауіпсіздігі институтымен (US AISI) бөлісті.
Компания өз бағалауларының сенімділігін қамтамасыз ету және теріс пайдаланудың жаңа тенденцияларын ескеру үшін сыртқы пәндік сарапшылардан саясат бойынша кері байланысты біріктірді. Бұл ынтымақтастық командаларға 3.5 Sonnet-тің бағалау мүмкіндіктерін теріс пайдаланудың әртүрлі түрлеріне масштабтауға көмектесті. Мысалы, олар Thorn ұйымының балалар қауіпсіздігі жөніндегі сарапшыларының кері байланысын пайдаланып, жіктегіштерді жаңартты және модельдерді қосымша дәл баптады.
Компанияның ЖИ модельдерін әзірлеуін бағыттайтын негізгі конституциялық принциптердің бірі — құпиялылық. Олар пайдаланушы нақты рұқсат бермейінше, пайдаланушылар жіберген деректерде өздерінің генеративті модельдерін оқытпайды. Бүгінгі күнге дейін компания өзінің генеративті модельдерін оқыту үшін ешбір клиенттің немесе пайдаланушының деректерін пайдаланған емес.
Жақында
Компанияның мақсаты — әр бірнеше айда интеллект, жылдамдық және құн арасындағы теңгерімді мазмұнды түрде жақсарту. Claude 3.5 модельдер тобын толықтыру үшін биыл Claude 3.5 Haiku мен Claude 3.5 Opus шығарылады.
Модельдер тобының келесі буыны бойынша жұмыстан бөлек, компания бизнес үшін пайдалану жағдайларын көбірек қолдау мақсатында жаңа модальдықтар мен функцияларды дамытуда, соның ішінде корпоративтік қосымшалармен интеграцияны. Команда сондай-ақ Claude-қа пайдаланушының белгіленген көлемдегі қалаулары мен өзара әрекеттесу тарихын есте сақтауға мүмкіндік беретін Жад сияқты функцияларды зерттеп жатыр, бұл тәжірибені одан әрі жекелендірілген және тиімді етеді.
Компания Claude-ты жақсарту үстінде үздіксіз жұмыс істейді және пайдаланушылардың кері байланысын қуана қабылдайды. Claude 3.5 Sonnet туралы кері байланысты тікелей өнім ішінен жіберуге болады — бұл әзірлеу жол картасына әсер етуге және командаларға сіздің тәжірибеңізді жақсартуға көмектесуге мүмкіндік береді. Әрқашандағыдай, компания сіздің Claude-пен не жасайтыныңызды, не туындататыныңызды және не ашатыныңызды асыға күтеді.
