Anthropic, செப்டம்பர் 28 அன்று Claude Sonnet 5.5-ஐ அறிமுகப்படுத்தியது; API டோக்கன் விலைகள் Sonnet 5-ன் விலையிலேயே உள்ளன. இந்த மாடல் வெளியீட்டை 30%-க்கும் மேல் வேகமாக உருவாக்கும் என்றும், குறைவான டோக்கன்களைப் பயன்படுத்துவதால் ஒவ்வொரு பணிக்கும் 30% வரை செலவு குறையலாம் என்றும் நிறுவனம் கூறுகிறது. இவை தனித்தனி கூற்றுகள்: பட்டியலிடப்பட்ட விலை குறையவில்லை; ஒரு பணிக்கான கட்டணம் இன்னும் prompt, வெளியீடு, கருவிகள், முயற்சி அமைப்பு ஆகியவற்றைப் பொறுத்தது.

உருவாக்குநர்களுக்கு, பயனுள்ள செயல்திறன் உயர்வுக்கான வாய்ப்புடன் Sonnet 5 ஒருங்கிணைப்புகளைப் பாதிக்கக்கூடிய மாற்றங்களும் இந்த வெளியீட்டில் உள்ளன. Anthropic ஆவணங்களில் இந்த மாடல் claude-sonnet-5-5 Claude API, Google Cloud, Microsoft Foundry ஆகியவற்றிலும், anthropic.claude-sonnet-5-5 Amazon Bedrock-இலும் கிடைப்பதாகக் குறிப்பிடப்பட்டுள்ளது. மாடல் பக்கத்தில் ஒரு மில்லியன் டோக்கன் சூழல் சாளரமும், அதிகபட்சமாக 128,000 டோக்கன் வெளியீடும் பட்டியலிடப்பட்டுள்ளன. AWS-இல் Claude Platform வழியாகவும் அணுகலாம். கிளவுட் வழங்குநரின் கட்டணமும் பிராந்திய அமைப்புகளும் Claude API-யின் பட்டியல் விலைகளிலிருந்து மாறுபடலாம்.

மதிப்பீடுகள் எதைக் காட்டுகின்றன

Anthropic நடத்திய Terminal-Bench 4.0 சோதனையில், 66 முனையப் பணிகளில் Sonnet 5.5 70.6%-ஐ நிறைவு செய்தது; வெளியீட்டு அட்டவணையில் Sonnet 5-க்கு இது 10.3%. கணினி அட்டை, கொள்கலன் செய்யப்பட்ட கட்டளைவரி சூழல்களில் அமைக்கப்பட்ட கடினமான அறிவியல் மற்றும் பொறியியல் பணிகளை விவரிக்கிறது. Anthropic, Claude Code-ஐ bare mode-இல் அதிகபட்ச சிந்தனை முயற்சியுடன் இயக்கி, இணைய அணுகலைத் தடுத்து, பணிகளுக்குத் தேவையான வளங்களை cache செய்தது. பாதுகாப்பு நடைமுறைகளால் Sonnet 5.5 கோரிக்கைகளில் 1.2% மாற்று மாடலுக்கு அனுப்பப்பட்டு, சோதனைகளில் 1.5% பாதிக்கப்பட்டன. Sonnet 5.5 முடிவுக்கான நிலையான பிழை 2.5 சதவீதப் புள்ளிகள் என Anthropic தெரிவிக்கிறது. இந்த மதிப்பெண் அந்தச் சோதனை அமைப்பை மட்டுமே அளவிடுகிறது; உருவாக்குநர்களின் சொந்தக் களஞ்சியங்களிலும் இதே முன்னேற்றம் இருக்கும் என நிரூபிக்கவில்லை.

Anthropic-ன் கணினி அட்டையின்படி, Cognition நிறுவனம் 150 களஞ்சியப் பணிகளில் Claude Code-இல் FrontierCode-ஐ இயக்கி, xhigh முயற்சியில் தனது Main தொகுப்பில் Sonnet 5.5-க்கு 52.1% எனப் பதிவு செய்தது. அதிகபட்ச முயற்சியில் மதிப்பெண் 46.2%-ஆகக் குறைந்தது; Cognition ஆய்ந்த சில நிகழ்வுகளில் முகவரின் கூடுதல் மறுஆய்வும் திருத்தங்களும் அளவுகோலின் வரம்பையோ நேர வரம்பையோ மீறியதே ஒரு காரணம். Cursor, தனது உற்பத்திச் சூழல் முகவர் கட்டமைப்பில் Cursor அமர்வுகளிலிருந்து தேர்ந்த பணிகளைப் பயன்படுத்தி CursorBench 4.0-ஐ இயக்கியது. அதிகபட்ச முயற்சியில் Sonnet 5.5 பெற்ற 55.5% முடிவு Anthropic-க்கு அனுப்பிய முடிவுகள் அட்டவணையில் உள்ளது; Cursor அளித்த டோக்கன் எண்ணிக்கையிலிருந்து ஒவ்வொரு பணிக்கான மாடல் செலவை Anthropic கணித்தது. இந்த வெளிப்புற மதிப்பீடுகள் வெவ்வேறு பணிகளையும் கட்டமைப்புகளையும் பயன்படுத்தின; இங்குள்ள Sonnet 5.5 முடிவுகள் Anthropic-ன் கணினி அட்டை வழியாகவே கிடைத்தவை.

Artificial Analysis நிறுவனமும் வெளியீட்டுக்கு முந்தைய மாடலை GDPval-AA-வில் சோதித்தது. அது 44 தொழில்களில் இருந்து தேர்ந்த 220 பணிகளின் வேலைப்பொருட்களை ஒப்பிடுகிறது. இணைக்கப்பட்ட அறிவுசார் பணித் திட்டங்களின் தொகுப்பான AA-Briefcase-யிலும் சோதித்தது. அதிகபட்ச முயற்சியில் முறையே 1844, 1811 Elo மதிப்பெண்கள் கிடைத்ததாகவும், அந்தச் சோதனைகளில் Opus 5.5-க்கு நெருக்கமாக இருந்ததாகவும் கணினி அட்டை தெரிவிக்கிறது. வெளியீட்டுக்கு முந்தைய பதிப்பில் முடிவுகளைப் பாதித்திருக்கக்கூடிய கட்டமைக்கப்பட்ட வெளியீட்டுப் பிழை இருந்தது; அது பின்னர் சரிசெய்யப்பட்டது என Anthropic கூறுகிறது. இந்த ஒப்பீடு அந்த நிபந்தனைகளில் அளவுகோல் வெளியீடுகளை மதிப்பிடுகிறது; வாசகரின் திறந்தமுடிவுள்ள பணிகளில் Sonnet 5.5, Opus-க்கு இணையாக இருக்கும் எனக் காட்டவில்லை. நீடித்த தீர்மானம் தேவைப்படும் சிக்கலான பணிகளில் Opus இன்னும் வலுவானது என்றும் Anthropic கூறுகிறது.

தொடக்க வாடிக்கையாளர்களின் சொந்தச் சோதனைகளில் பணிச்சூழல்கள் வேகமாகவும் டோக்கன் பயன்பாடு குறைவாகவும் இருந்ததாக Anthropic-ன் வெளியீட்டு அறிவிப்பில் உள்ள மேற்கோள்கள் கூறுகின்றன. அவர்கள் தங்களுடைய பணிகளையும் முறைகளையும் பயன்படுத்தியதால், அந்த அனுபவங்கள் அனைவருக்கும் பொருந்தும் உற்பத்தித்திறன் அளவீட்டை நிரூபிக்காது. BIG CHANGE, Sonnet 5.5-ஐ இயக்கிப் பார்க்கவோ, நேரடி பணிச்சூழலில் விற்பனையாளரின் வேகம் மற்றும் பணிச்செலவு கூற்றுகளைச் சரிபார்க்கவோ இல்லை.

விலையும் இடம்பெயர்வும்

Claude API-யின் பட்டியல் விலை, ஒரு மில்லியன் உள்ளீட்டு டோக்கன்களுக்கு $2; ஒரு மில்லியன் வெளியீட்டு டோக்கன்களுக்கு $10. Sonnet 5-இன் விலையிலிருந்து இது மாறவில்லை. ஐந்து நிமிட cache எழுத ஒரு மில்லியன் டோக்கன்களுக்கு $2.50; cache வாசிக்க $0.20. குறிப்பிட்ட முயற்சி நிலைகளில் பயன்படுத்திய டோக்கன்களையும் பட்டியல் விலைகளையும் Anthropic-ன் ஒவ்வொரு-பணிச் செலவு வரைபடங்கள் இணைக்கின்றன. அவை எல்லா சூழல்களுக்கும் 30% சேமிப்பு கிடைக்கும் என நிரூபிக்காது. மாடல்களை ஒப்பிடும் குழு, தேவையான தரநிலையைப் பூர்த்தி செய்யும் பிரதிநிதித்துவப் பணிகளைத் தானே இயக்கி, வெற்றியுடன் டோக்கன் பயன்பாட்டையும் எடுத்த நேரத்தையும் பதிவு செய்ய வேண்டும்.

மாடல் ID-ஐ மட்டும் மாற்றுவது ஏற்கெனவே உள்ள Messages API குறியீட்டில் பிழையை ஏற்படுத்தலாம். Sonnet 5-இன் thinking: {"type": "disabled"} 5.5-இல் பிழையைத் தரும்; முன்கூட்டியே சிந்திப்பதைத் தவிர்க்க ஆவணங்கள் பரிந்துரைக்கும் மாற்று thinking: {"type": "between_tools"}; இது குறைந்த, நடுத்தர, அதிக முயற்சி நிலைகளை ஏற்கிறது. இந்தப் புலம் விடுபட்டால் Adaptive thinking இயங்கும்; Claude API இயல்பாக அதிக முயற்சியைத் தேர்ந்தெடுக்கும். கட்டாயப்படுத்தப்பட்ட tool_choice மதிப்புகள் any மற்றும் tool ஆகியவையும் பிழைகளைத் தரும்; Anthropic உருவாக்குநர்களை auto பயன்படுத்தவும், ஆதரவு உள்ள இடங்களில் கடுமையான கருவி schema-களைப் பயன்படுத்தவும் அறிவுறுத்துகிறது. Amazon Bedrock-இல் Sonnet 5.5-க்கு கடுமையான கருவிப் பயன்பாடு கிடையாது: auto என்பதை strict இல்லாமல் பயன்படுத்தி, பயன்பாட்டுக் குறியீட்டில் கருவி உள்ளீடுகளைச் சரிபார்க்கவும். கருவி அழைப்புகளுக்கு இடையில் வரும் உரையைக் காட்டும் குறியீடு, thinking blocks-இல் அனுப்பப்படும் முன்னேற்றப் புதுப்பிப்புகளையும் கையாள வேண்டியிருக்கலாம். Claude API, Google Cloud ஆகியவற்றில் கணினிப் பயன்பாட்டு ஒருங்கிணைப்புகளுக்கு புதிய computer_toolset_20260801 கருவித் தொகுப்பு தேவை; Bedrock-இல் முந்தைய computer_20251124 பதிப்பே தொடர்கிறது. இடம்பெயர்வுக்கான வழிகாட்டி மற்ற இணக்கத்தன்மை மாற்றங்களையும் விவரிக்கிறது.

முக்கிய மாற்றம்

செலவைக் கவனிக்கும் குழுக்களுக்கு, Sonnet 5.5 அதே Sonnet 5 டோக்கன் விலையில் புதிய மாடலை வழங்குகிறது; குறிப்பிட்ட பல மதிப்பீடுகளில் உயர்ந்த முடிவுகளும் வேகமான வெளியீடு குறித்த Anthropic-ன் கூற்றும் இதில் அடங்கும். அதன் நடைமுறைப் பயன், பணிகளின் கலவையையும் முயற்சி அமைப்பையும் சார்ந்தது. ஏற்கெனவே உள்ள ஒருங்கிணைப்புகளின் அமைப்புகளையும் மறுஆய்வு செய்ய வேண்டும். சரியான முடிவுகள், டோக்கன் பயன்பாடு, எடுத்த நேரம் ஆகியவற்றை அளந்து, நிறுவனத்தின் சொந்தப் பணிச்சுமையில் ஒப்பிடுவதே தெளிவான அடுத்த படி.

ஆதாரங்களும் மேலும் வாசிப்பும்

  • Anthropic-ன் Sonnet 5.5 அறிவிப்பு வெளியீட்டுத் தேதி, நிறுவனத்தின் வேகம் மற்றும் ஒவ்வொரு பணிக்கான செலவு குறித்த கூற்றுகள், அளவுகோல் சுருக்கம், தொடக்க வாடிக்கையாளர்களின் அனுபவங்கள் ஆகியவற்றை வழங்குகிறது. செயல்திறன் கூற்றுகளைப் பணிவகைக்கு ஏற்ப சரிபார்க்க வேண்டும்.
  • Anthropic-ன் Sonnet 5.5 கணினி அட்டை அளவுகோல் பணிகள், சோதனைக் கட்டமைப்புகள், முயற்சி அமைப்புகள், மாற்று மாடலுக்கான வழிமுறை, வெளிப்புற மதிப்பீடுகளின் ஆதாரம் ஆகியவற்றை விவரிக்கிறது. மாடல் விற்பனையாளரின் முதன்மை வெளிப்படுத்தல் இது; வெளியிலிருந்து செய்யப்பட்டு அவர்களிடம் வழங்கப்பட்ட முடிவுகளும் இதில் உள்ளன.
  • Claude Platform மாடல் பக்கம் API ID-கள், அணுகல், வரம்புகள், டோக்கன் விலைகள் ஆகியவற்றைப் பட்டியலிடுகிறது. முழு விலைப் பட்டியல் Sonnet 5 மற்றும் 5.5-க்கு ஒரே அடிப்படை விலைகள் இருப்பதை உறுதிப்படுத்தி, கிளவுட் விலை வேறுபாடுகளையும் விளக்குகிறது.
  • Sonnet 5.5 இடம்பெயர்வு வழிகாட்டி மாறும் அல்லது பிழையைத் தரும் கோரிக்கை அமைப்புகளைப் பதிவு செய்கிறது. ஏற்கெனவே உள்ள ஒருங்கிணைப்புக்கான முழுப் பட்டியலையும் இதைப் பயன்படுத்திப் பார்க்கவும்.