Claude 4:Anthropic 透過先進的程式設計和自主代理模式重新構想人工智慧

最後更新: 5月23 2025
  • Claude 4 包括兩款旗艦型號:Opus 4,適用於複雜任務;Sonnet 4,更適合日常使用。
  • 兩者在編碼、進階推理和記憶體管理方面均表現出色,在 SWE-bench 等基準測試中均勝過競爭對手。
  • 新模型融合了擴展思維、平行工具和改進的開發人員 API。
  • 它們具有增強的安全措施、靈活的使用選項和基於容量的定價結構。

Anthropic 的 Claude 4 人工智慧模型

推出 克勞德 4 Anthropic 的發明引起了人工智慧領域的極大興趣。在技​​術領先地位的競爭日益激烈的當下,這家美國公司正在透過兩種改進的模型來鞏固其地位,這兩種模型旨在優化自主代理的編程、高級推理和操作。

這些新功能鞏固了 Anthropic 作為人工智慧領域偉大領導者之一的地位,並大力投資於從更強大的 編碼能力 更先進的記憶體管理,適合科技公司和要求苛刻的個人用戶和開發人員。

新一代型號:Opus 4 和 Sonnet 4

Claude Opus 4 和 Sonnet 4 用於進階編程

Anthropic 的最新模型系列包含兩項出色的提案: 克勞德作品 4專為高度複雜和長期的任務而設計, 克勞德十四行詩 4,其結果穩健,但對於日常情況來說效率更高。

該模型的獨特之處在於其 能夠獨立工作數小時而不失精度根據樂天等公司的經驗,這些公司報告稱,代碼重構會議連續長達七個小時,且性能出色。即使在包含數千個步驟的專案中,記憶體管理也可以儲存相關資訊並維護上下文,這使得 Opus 4 成為需要持續自主的智慧代理的理想基礎。

  雲端運算助力人工智慧:數位轉型的引擎

此外, 克勞德十四行詩 4 專注於日常任務,維持功能與實用性之間的平衡。該版本在 SWE-bench 上的得分為 72,7%,比其前身(Sonnet 3.7)有了顯著的改進,即使對於經驗不足的用戶來說,其高效編碼、指令理解和性能穩定性也表現出色。

亞歷克斯+-1
相關文章:
關於 Alexa+:亞馬遜的全新高級 AI 助手

推理和記憶的創新

最受關注的功能之一是 運用工具的擴展思維模式,它允許模型以完全整合的方式在內部推理和使用外部實用程式(例如網路搜尋)之間切換。這意味著 改進故障排除,其中反思和執行程式碼或查閱附加資訊的實際動作相結合。

兩種模型都可以使用 同時使用多種工具 並存取本地文件來管理擴展會話中的上下文記憶。此功能可協助開發人員維護工作執行緒而不遺失重要數據,從而提高複雜、正在進行的專案的效能。

另一項值得注意的創新是 記憶體優化。 Claude 4,當他可以存取本地文件時,他可以創建和維護“記憶體檔案” 讓您可以追蹤大量任務的進度,儲存隱性學習,並確保長期工作的一致性。

開發人員工具和改進的 API

使用 Claude Code 和 AI API 進行開發

除了新車型外,Anthropic 還正式推出了 克勞德·科德,一個將 AI 直接整合到開發者環境中的命令列工具。該應用程式與 VS Code 和 JetBrains 等流行的 IDE 相容,允許在編輯器內部進行即時編輯建議、自動審查和任務管理。

  納米香蕉:它是什麼以及谷歌的模型如何運作

Claude Code 現在支援使用 GitHub動作,其可擴展的 SDK 使開發人員能夠在 Claude 核心之上建立自己的智慧代理。所有這些都由經過改進的 API 支持,其中包括 程式碼執行、透過 MCP 進行連接、檔案 API 和快取功能 優化提示的使用時間長達一小時。

性能、安全性和價格

Claude 4 提供的因應方式包括 快速查詢的即時答案和複雜分析的擴展思考。這種靈活性使得模型能夠適應不同類型的任務,從最簡單的任務到長期運行的工作流程和大量資料。

就此而言 安全該公司加強了保護協議,並實施了以下標準: 人工智慧安全等級 3(ASL-3) 在 Opus 4 和附加層中,以降低日常使用中的風險。目標是盡量減少不必要的行為、捷徑或錯誤,並防止產生危險內容或不當資料操作等有問題的使用。

價格與先前的版本保持一致: 電視劇4 每百萬輸入令牌成本為 15 美元,每百萬輸出令牌成本為 75 美元,而 十四行詩4 分別為3美元和15美元。這兩種型號均可透過 Anthropic API、Amazon Bedrock、Google Cloud Vertex AI 以及針對企業和個人的各種訂閱方案使用。

人工智慧技術的進步使 Claude 4 成為管理軟體專案、解決複雜問題以及與人類自主協作的非常可靠的選擇,這得益於它對記憶、安全性和擴展思維的關注。