Claude 3.5 Sonnet 與 GitHub Copilot 的整合

Claude 3.5 Sonnet 現正逐步推送到 GitHub Copilot,讓開發者可以直接在 Visual Studio Code 和 GitHub.com 中將其選為編碼模型。此整合讓超過 1 億名開發者能夠在其現有的開發工作流程中利用 Claude 的先進編碼能力。

技術性能與基準測試

Claude 3.5 Sonnet 在實際的編碼任務中展現出卓越的性能。它在 SWE-bench Verified 基準測試中超越了所有公開可用的模型,該測試評估模型解決實際 GitHub issue 的能力。此外,它在 HumanEval 基準測試中獲得了 93.7% 的頂尖分數,該測試用於測試從自然語言描述生成正確 Python 函數的能力。

核心編碼能力

透過利用整個程式碼庫的上下文,GitHub Copilot 中的 Claude 3.5 Sonnet 支援以下主要使用案例:

  • 生產就緒的程式碼生成: 將自然語言描述轉換為符合專案特定模式與慣例的高品質程式碼。
  • 內聯偵錯: 為選取的有問題的程式碼提供即時分析與修復,並透過 GitHub Copilot Chat 解釋錯誤訊息並建議解決方案。
  • 自動化測試生成: 為選取的函數建立全面的測試套件,使其符合現有的測試框架並涵蓋邊緣情況。
  • 上下文相關的程式碼解釋: 透過 VS Code 中的懸停或選取動作,提供特定函數或程式碼區塊如何運作以及它們如何融入更廣泛的專案結構的詳細解釋。

部署與可用性

Claude 3.5 Sonnet 將在未來幾週內向所有 GitHub Copilot Chat 使用者與組織提供公開預覽版。該模型透過 Amazon Bedrock 在 GitHub Copilot 上執行,並利用 Bedrock 的跨區域推論來提高可靠性。

開發者與組織可以參閱文件與 GitHub blog 以獲取有關實作與使用的更多細節。

Sources

相關