惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recent Announcements
Recent Announcements
Martin Fowler
Martin Fowler
MongoDB | Blog
MongoDB | Blog
Engineering at Meta
Engineering at Meta
Stack Overflow Blog
Stack Overflow Blog
Google DeepMind News
Google DeepMind News
Microsoft Security Blog
Microsoft Security Blog
aimingoo的专栏
aimingoo的专栏
I
InfoQ
B
Blog
WordPress大学
WordPress大学
Jina AI
Jina AI
小众软件
小众软件
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
博客园_首页
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
酷 壳 – CoolShell
酷 壳 – CoolShell
阮一峰的网络日志
阮一峰的网络日志
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
G
Google Developers Blog
C
Check Point Blog
月光博客
月光博客
L
LangChain Blog
GbyAI
GbyAI

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
Claude Sonnet 4.5 来了:Anthropic最强编程AI模型,连续工作...
站外新闻 · 2026-06-19 · via Prompt 语宙

💡 站外导读:在AI编程模型竞赛白热化的当下,开发者面临效率瓶颈与任务复杂度攀升的双重挑战。Anthropic最新推出的Claude Sonnet 4.5,正瞄准这一痛点。它不仅在权威SWE-bench测试中登顶,更具备突破性的“长时专注”能力,能连续30小时处理复杂任务,标志着AI从被动工具向主动智能体的关键跨越。本文将深入解析其核心能力、性能表现及如何重塑软件开发与企业自动化流程。

Claude Sonnet 4.5 是 Anthropic 最新推出的最强编程模型。模型在编程、计算机操作、推理和数学等多个领域表现出色,在 SWE-bench Verified 测试中登顶,能专注工作超 30 小时。模型具备强大的智能体能力,可通过 API 和工具实现复杂任务自动化。Claude Sonnet 4.5 在对齐性和安全性方面有显著提升,减少不良行为、增强防御能力。Claude Sonnet 4.5支持多种应用场景,包括代码生成、知识问答和内容创作等,目前,Claude Sonnet 4.5 已全面开放,包括 claude.ai 官网、App 和 API(API定价与前代Claude Sonnet 4相同)。

  • Claude Sonnet 4.5是什么
  • Claude Sonnet 4.5的主要功能
  • Claude Sonnet 4.5的核心升级
  • Claude Sonnet 4.5的性能表现
  • Claude Sonnet 4.5的应用场景
  • Claude Sonnet 4.5的官方报告
  • Claude Sonnet 4.5的适用人群
      • 📝 站长洞察 (Editor’s Insight)

Claude Sonnet 4.5 正式上线了名为「Imagine with Claude」的临时研究预览功能。借助此功能,用户只需用自然语言与 Claude 沟通,就能实时生成并优化软件代码及功能,整个过程完全动态创建,无需任何预先编写的代码基础。该功能现阶段仅面向 Max 订阅用户开放,其核心目标在于提升软件开发、原型构建及创意探索的效率,为用户打造一种既高效又灵活的互动体验。

Claude Sonnet 4.5

Claude Sonnet 4.5的主要功能

  • 长时运行智能体:提供卓越的指令遵循、工具选择、错误纠正和高级推理能力,适用面向客户的智能体和复杂 AI 工作流。

  • 代码生成:Sonnet 4.5 能完成从初始规划到漏洞修复、维护和大规模重构的整个软件开发生命周期任务,支持最多 64K 输出 tokens,适合复杂代码生成和规划。

  • 浏览器和计算机操作:模型在计算机操作能力上领先,能可靠地处理各种基于浏览器的任务,从竞争分析到采购流程再到客户入职,计算机操作能力比前代更准确可靠。

  • 网络安全:用 Sonnet 4.5 和 Claude Code 的团队能部署智能体,自动修补漏洞以防止被利用,从被动检测转向主动防御。

  • 金融分析:模型能处理从基础金融分析到高级预测分析的所有任务,例如持续监控全球监管变化,提前调整合规系统,实现从手动审计准备到智能风险管理的转变。

  • 业务任务:模型在制作和编辑幻灯片、文档和电子表格等办公文件方面表现出色。

  • 研究:Sonnet 4.5 能搜索外部和内部数据源,以综合复杂信息环境中的全面见解。

  • 内容生成与分析:模型在写作方面表现出色,能理解细微差别和语调,生成更具吸引力的内容,在更深层次上分析内容。

Claude Sonnet 4.5的核心升级

  • Claude Code:Claude Sonnet 4.5 在 Claude Code 中新增检查点功能,能保存进度、即时回退到之前状态,同时更新终端界面、发布原生 VS Code 扩展,满足用户的强烈需求、提升开发体验。

  • Claude API:Claude Sonnet 4.5 为 Claude API 新增上下文编辑功能和记忆工具,使智能体能运行更长时间、处理更复杂的任务,进一步增强 API 的功能和应用场景。

  • Claude 应用:Claude Sonnet 4.5 将代码执行和文件创建功能(包括电子表格、幻灯片和文档)直接集成到 Claude 应用的对话中,为上个月加入等待列表的 Max 用户提供 Chrome 扩展,提升用户在实际使用中的便利性和效率。

  • Claude Agent SDK:Claude Sonnet 4.5 推出 Claude Agent SDK,为开发者提供构建 Claude Code 所使用的基础设施和工具,使开发者能构建自己的前沿产品。

Claude Sonnet 4.5

Claude Sonnet 4.5的性能表现

  • SWE-bench Verified 评估:Claude Sonnet 4.5 在 SWE-bench Verified 评估中达到行业领先水平。实际应用上,模型能在复杂、多步骤的任务中保持专注超过 30 小时。
  • OSWorld 基准测试:在 OSWorld 基准测试中,Claude Sonnet 4.5 的表现大幅提升,达到 61.4% 的准确率,领先于其他模型。
  • Chrome 浏览器:通过 Claude for Chrome 扩展,Sonnet 4.5 能直接在浏览器中工作,包括浏览网站、填写电子表格和完成任务。
  • 在推理和数学等广泛评估:Claude Sonnet 4.5 在推理和数学等广泛评估中展现改进的能力,相比之前的模型,在这些领域的表现更加出色。
  • 在特定领域知识和推理能力:金融、法律、医学和 STEM 领域的专家发现,Sonnet 4.5 在特定领域的知识和推理能力上相比旧模型(包括 Opus 4.1)有显著提升。

Claude Sonnet 4.5

Claude Sonnet 4.5的应用场景

  • 长时运行智能体:适用需要长时间运行的复杂任务,如自动化工作流、持续监控和多步骤任务处理。

  • 代码生成:贯穿整个软件开发生命周期,从规划到实现、维护和重构,支持复杂编程任务。

  • 浏览器和计算机操作:支持处理基于浏览器的任务,如自动化网页操作、数据抓取和在线流程处理。

  • 网络安全:部署智能体能自动检测和修复漏洞,从被动防御转向主动安全防护。

  • 金融分析:模型能进行从基础到高级的金融分析,包括风险评估、合规监控和预测分析。

Claude Sonnet 4.5的官方报告

免费领取Claude Sonnet 4.5官方模型报告,微信扫码关注回复:20250930

Claude Sonnet 4.5的适用人群

  • 软件开发者:模型强大的代码生成和优化能力,帮助开发者快速实现复杂编程任务,提升开发效率。

  • 网络安全团队:模型能自动检测和修复漏洞,助力团队从被动防御转向主动安全防护。

  • 金融分析师:模型能处理从基础到高级的金融分析,包括风险评估和合规监控,助力智能风险管理。

  • 企业业务人员:高效创建和编辑办公文件,如幻灯片、文档和电子表格,提升日常办公效率。

  • 研究人员:整合内外部数据源,生成跨复杂信息领域的综合见解,助力学术和商业研究。

📝 站长洞察 (Editor’s Insight)

Claude Sonnet 4.5的发布,绝非一次普通的模型迭代,而是Anthropic在“AI智能体”赛道上投下的一颗重磅炸弹。其核心价值在于三点:一是通过超长连续工作能力,解决了AI任务中断、上下文丢失的行业顽疾,让AI真正具备了完成复杂项目的“耐力”;二是将编程、计算机操作、安全分析等能力深度整合,构建了端到端的智能体工作流,预示着开发范式将从“人驱动代码”转向“AI驱动流程”;三是通过推出Agent SDK等工具,Anthropic正从模型提供商向智能体平台迈进,意图在下一代AI应用生态中占据基础设施的核心位置。这不仅是技术的跃进,更是对AI商业化路径的深远布局,所有关注AI生产力变革的从业者都必须严肃对待。