突發!Anthropic推出Claude Sonnet 5新模型
免費版最強模型 力迫旗艦級Opus
人工智能公司Anthropic於美國時間6月30日正式推出新一代語言模型Claude Sonnet 5,主打更強的自主執行能力,可自行制定計劃並運用瀏覽器、終端機等工具完成複雜任務,性能逼近旗艦級Opus 4.8模型,惟收費較相宜。
📊 性能直逼旗艦模型
Anthropic表示,Claude Sonnet 5在編碼、推理、工具運用及知識型工作等多方面,較上一代Sonnet 4.6有顯著提升,在編碼能力測試(SWE-bench Pro)及終端操作測試(Terminal-Bench 2.1)中分別錄得63.2%及80.4%,均高於Sonnet 4.6的58.1%及67.0%,惟仍稍遜於Opus 4.8的69.2%及82.7%。公司形容Sonnet 5「大幅收窄」與Opus級模型之間的差距,為開發者提供成本較低、但質素遠勝以往中階模型的選擇。
🔒 網絡安全風險較低
值得留意的是,Anthropic特別強調 Claude Sonnet 5並未經刻意訓練執行網絡安全相關任務,故其執行網絡攻擊等危險行為的能力,遠低於該公司現時旗下的Opus級模型。公司又指,安全評估顯示Claude Sonnet 5整體出現「不當行為」的比率較Sonnet 4.6低,在自主執行任務的情境下使用上更為安全。
⚖️ 與美國政府監管角力有關
報道指出,Claude Sonnet 5的推出時機,正值Anthropic就旗下其他更高階模型與美國特朗普政府進行持續磋商之際。美國政府早前曾以保安理由,要求Anthropic下架部分高階模型,包括現正以有限度方式提供的Mythos模型,以及預計即將重新開放使用的 Claude Fable 5模型。換言之,Claude Sonnet 5是在公司未能全面恢復其最強模型存取權限的背景下推出。
💰 免費及付費用戶均可使用
Claude Sonnet 5即日起成為Claude免費版及專業版(Pro)用戶的預設模型,同時亦開放予Max、Team及企業(Enterprise)客戶使用。Anthropic表示,新模型讓開發者在處理大量編碼及自主任務工作時,有更廉宜的選擇,此舉亦被視為配合企業客戶日漸傾向以AI代理(agent)代為執行任務,而非單純用作對話工具的趨勢。
📉 業界分析認為,隨着部分企業及開發者為節省成本而轉用內地AI模型,各大美國AI公司近期均加強推出價格更親民的產品,以保持競爭力。
————
👇 相信「AI × 數碼營銷」是未來的你,
歡迎 Tag 一位同行好友,一起成長!
#AIMarketerHK #DigitalMarketing #Claude #Sonnet5
