精选75Anthropic Engineering(web_list)模型发布/更新
Claude 3.5 Sonnet 刷新 SWE-bench Verified
Raising the bar on SWE-bench Verified with Claude 3.5 Sonnet
Anthropic 宣布,Claude 3.5 Sonnet 在 SWE-bench Verified 基准测试中取得 49.0% 的得分,较此前最佳成绩提升 20 个百分点以上。该模型在解决真实 GitHub 问题、生成补丁和通过测试方面表现显著提升,尤其在处理复杂代码库和长上下文任务时更为稳健。Anthropic 表示,这一进步得益于模型在推理、代码生成和工具使用能力上的优化。目前,Claude 3.5 Sonnet 已可通过 Anthropic API 使用,开发者可将其集成到编码工作流中。
更进一步:量化金融体系
看懂新闻只是起点——沿量化金融路径,把它变成能交付的工程能力