惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

Recent Announcements
Recent Announcements
H
Hackread – Cybersecurity News, Data Breaches, AI and More
Cyber Security Advisories - MS-ISAC
Cyber Security Advisories - MS-ISAC
B
Blog
T
The Blog of Author Tim Ferriss
J
Java Code Geeks
腾讯CDC
D
Docker
G
Google Developers Blog
D
DataBreaches.Net
雷峰网
雷峰网
Blog — PlanetScale
Blog — PlanetScale
S
SegmentFault 最新的问题
The Cloudflare Blog
有赞技术团队
有赞技术团队
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Stack Overflow Blog
Stack Overflow Blog
大猫的无限游戏
大猫的无限游戏
量子位
美团技术团队
aimingoo的专栏
aimingoo的专栏
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
Engineering at Meta
Engineering at Meta
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More

Prompt 语宙

kimi-thinking-preview – 月之暗面推出的多模态思考模型 pdf-craft – 开源 PDF 转 Markdown 工具 UltraMem – 字节豆包大模型团队推出的全新超稀疏模型架构 EasyControl – Tiamat AI 联合上海科大等开源的图像生成控制框架 GaussianCity – 南洋理工大学 S-Lab 团队推出的 3D 城市生成框架 X-Prompt – 用于多模态视频目标分割的通用框架 豆包大模型1.5 – 字节跳动推出的最新版大模型 GaussianAnything – 南洋理工 S-Lab 和上海 AI Lab 等推出的 3D 生成框架 Cube 3D – Roblox 推出的 AI 3D 生成模型 OpenMath-Nemotron – 英伟达开源的数学推理系列模型 MAI Transcribe-1.5 – 微软 MAI 推出的语音转文本模型 Seed1.5-Embedding – 字节跳动 Seed 团队推出的向量模型 2026世界杯人机大战引爆!联想携手DeepSeek等顶尖AI大模型,对战亿万球迷预测冠军 高考公平守护战!豆包、文心等主流大模型集体禁用拍题功能 ShotAdapter – Adobe联合UIUC推出的多镜头视频生成框架 Devstral – Mistral AI联合All Hands AI开源的编程专用AI模型 MMaDA – 字节联合普林斯顿大学等推出的多模态扩散模型 Software Copyright Materials Skill – 开源软著资料生成Skill Dulus – 开源的 CLI AI Agent,可驱动多模型工具调用 Reasonix – 专为 DeepSeek 推出的开源终端编程 Agent Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别模型 CodeGraph – 开源代码知识图谱工具,加速代码理解和分析 MiniCPM5-1B – 面壁智能联合清华开源的端侧文本基座模型 Horizon – 开源 AI 信息聚合系统,构建专属新闻雷达 BitCPM-CANN – 面壁智能联合清华开源的端侧大模型 Xiaomi Auto World Model – 小米推出的辅助驾驶世界模型 opera-browser-cli – Opera Neon 开源的命令行工具 omp – 开源的 AI 终端编程智能体,能与 IDE 深度联动 Claude Opus 4.8 – Anthropic 推出的旗舰级大语言模型 Hy-Memory – 腾讯混元推出的 Agent 记忆插件
智谱GLM-4.6旗舰大模型发布:355B参数比肩Claude,代码能力国...
站外新闻 · 2026-06-19 · via Prompt 语宙

💡 站外导读:当全球AI竞赛进入深水区,大模型的落地之战已从比拼参数转向真实场景的硬实力。开发者需要的是能真正提升效率的编程伙伴,企业渴望的是兼顾性能与成本的国产替代方案。智谱此次发布的GLM-4.6,以355B总参数和200K超长上下文窗口为基座,直指真实编程、长文档处理和智能体应用三大核心痛点,试图在国产大模型中树立新的性能标杆。

GLM-4.6 是智谱推出的新一代基座大模型,总参数量达 355B,激活参数 32B。模型在真实编程、长上下文处理、推理能力、信息搜索、写作能力及智能体应用等方面实现全面进阶。代码能力比肩 Claude Sonnet 4,上下文长度提升至 200K,推理和搜索能力显著增强,多语言翻译效果更佳,性价比优势突出。GLM-4.6 适配寒武纪芯片,能实现高效推理部署,为开发者和企业提供强大的 AI 支持,推动人工智能技术的广泛应用与创新发展。GLM-4.6 现已上线智谱 MaaS平台,现在订阅即可体验模型性能。

  • GLM-4.6是什么
  • GLM-4.6的主要功能
  • GLM-4.6的性能表现
  • 如何使用GLM-4.6
  • GLM-4.6的订阅服务优化
  • GLM-4.6的应用场景
      • 📝 站长洞察 (Editor’s Insight)

GLM-4.6

GLM-4.6的主要功能

  • 编程能力:在公开基准与真实编程任务中表现卓越,复杂调试、跨工具调用等场景表现突出,代码生成与优化高效准确。
  • 上下文处理:上下文窗口由128K提升至200K,支持超长文档阅读、跨文件编程与复杂推理任务。
  • 推理能力:支持工具增强推理,在多个评测基准上取得开源模型最佳表现,逻辑推理能力强。
  • 信息搜索:优化长时程、深度信息探索任务,擅长深度研究及内外信息整合。
  • 写作能力:文风、可读性与角色扮演场景更符合人类偏好,能生成高质量、风格多样的文本。
  • 多语言翻译:进一步增强跨语种任务处理效果,翻译精准流畅。
  • 智能体应用:原生支持多类智能体任务,覆盖办公、开发、写作与内容创作,提升 PPT 可用性、前端代码美观度与版面布局。

GLM-4.6的性能表现

  • 综合评测:为全面评估 GLM-4.6 的通用能力,在 AIME 25、LCB v6、HLE、SWE-Bench Verified、BrowseComp、Terminal-Bench、τ²-Bench 等 7 大权威基准进行测试。结果显示,GLM-4.6 在大部分榜单中表现卓越,与国际顶尖模型 Claude Sonnet 4 比肩,稳居国产模型首位。

  • 真实编程评测:为更精准地测试 GLM-4.6 在真实编程任务中的表现,在 Claude Code 环境下进行真实场景编程任务测试。实际测试结果显示,GLM-4.6 在实际性能方面超越其他国产模型,领先于国际顶尖模型 Claude Sonnet 4。在平均 tokens 消耗上,GLM-4.6 低于多个模型,与 GLM-4.5 相比,GLM-4.6 在同类任务中可节省 30% 以上的 tokens 消耗。

GLM-4.6 GLM-4.6

  • 硬件适配
    • 寒武纪芯片适配:GLM-4.6已在寒武纪国产芯片上实现FP8+Int4混合量化部署,这是首次在国产芯片投产的FP8+Int4模型芯片一体化解决方案,在保持精度不变的前提下,大幅降低推理成本。

    • 摩尔线程GPU适配:基于vLLM推理框架部署,摩尔线程新一代GPU可基于原生FP8精度稳定运行GLM-4.6,展现了MUSA架构和全功能GPU在生态兼容与快速支持方面的强大优势。

如何使用GLM-4.6

  • 通过智谱MaaS平台使用
    • 访问平台:登录智谱 MaaS平台bigmodel.cn,注册并创建账号。

    • 选择模型:在平台上找到GLM-4.6模型,选择相应的服务或套餐。

    • 输入问题:在平台界面输入你的问题或任务,如文本生成、代码生成、搜索等。

    • 获取结果:点击提交后,平台会调用GLM-4.6模型,返回生成的结果。

  • 使用API接口
    • 获取API密钥:在智谱 MaaS平台注册账号后,获取API密钥。

    • 调用API:根据平台提供的API文档,使用HTTP请求调用GLM-4.6的API接口,将问题或任务作为参数传递。

    • 解析结果:接收API返回的JSON格式结果,并解析其中的内容。

  • 通过z.ai平台:海外用户可以通过z.ai平台使用GLM-4.6。

GLM-4.6的订阅服务优化

  • 功能扩展:新增图像识别与搜索能力,进一步丰富订阅服务的功能范围。

  • 套餐升级

    • 推出 GLM Coding Max 套餐,为高频重度开发者提供三倍用量,满足高强度开发需求。

    • 新增GLM Coding Plan企业版套餐,为企业用户提供兼具安全、成本效益与国际顶尖性能的编码解决方案,助力企业高效开发。

  • 性价比提升:通过优化套餐内容和用量,为开发者和企业提供更具性价比的选择。

GLM-4.6的应用场景

  • 编程开发:GLM-4.6能高效生成高质量代码,支持复杂调试和跨工具调用,帮助开发者提升编程效率,轻松应对各种开发任务。

  • 文档处理:GLM-4.6能轻松处理超长文档,支持跨文件编程与复杂推理任务,满足文档阅读、编辑和分析需求。

  • 智能推理:模型能快速准确地解决复杂问题,为用户提供高效智能的推理支持。

  • 信息搜索:模型能帮助用户快速获取关键信息,提升工作效率。

  • 写作创作:在文风、可读性与角色扮演场景中更符合人类偏好,生成高质量、风格多样的文本,满足学术论文、小说创作等写作需求。

📝 站长洞察 (Editor’s Insight)

GLM-4.6的发布透露出一个明确信号:国产大模型正在从追赶到局部超越。在真实编程场景中超越Claude Sonnet 4,这不仅是技术指标的胜利,更意味着模型在理解复杂工程逻辑、跨工具协作方面的实用性突破。值得关注的是其在国产芯片上的深度适配——FP8+Int4混合量化方案首次在寒武纪芯片落地,这是构建国产AI算力闭环的关键一步。当模型能力、推理成本和硬件生态三者形成正循环,企业级大规模部署才真正成为可能。未来的大模型竞争,必将是算法、算力、工程化能力的三位一体之战。