惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

博客园 - 【当耐特】
Stack Overflow Blog
Stack Overflow Blog
V
Visual Studio Blog
小众软件
小众软件
The Cloudflare Blog
T
Tailwind CSS Blog
Apple Machine Learning Research
Apple Machine Learning Research
爱范儿
爱范儿
美团技术团队
WordPress大学
WordPress大学
罗磊的独立博客
Microsoft Azure Blog
Microsoft Azure Blog
A
About on SuperTechFans
Last Week in AI
Last Week in AI
月光博客
月光博客
博客园 - Franky
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
G
Google Developers Blog
GbyAI
GbyAI
B
Blog
大猫的无限游戏
大猫的无限游戏
博客园 - 聂微东
Hugging Face - Blog
Hugging Face - Blog
博客园 - 叶小钗

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
DeepSeek V4,我在做项目和写软著材料时,顺手用了一段时间
程序员小崔日记 · 2026-05-04 · via 博客园_首页

前阵子 DeepSeek 更新到了 V4。

一开始我其实没太当回事。现在大模型更新太快了,几乎隔一段时间就来一次“版本升级”,但很多时候用起来差别并不大。

但这次比较巧。

我刚好在做一个 Web 应用,还顺便在准备软著材料,这一阶段我基本是边开发边用了一下 DeepSeek V4。

用下来两周,有一些比较具体的感受,想记录一下。


一、它给我的第一感觉:更“稳”了

如果只说一个变化,那就是稳定性。

以前用一些模型,经常会遇到这种情况:

  • 聊着聊着开始跑偏
  • 上下文接不上
  • 同一个问题,前后说法不一致

V4 在这方面明显好很多。

我在改接口的时候,有一段逻辑来回调整了好几次,它基本能记住前面的约束,不会每一轮都重新理解问题。

这种体验不算惊艳,但很关键。

因为开发过程中最怕的不是它不会,而是它前后不一致。


二、在项目里,它更像“辅助工具”,而不是“替代者”

前段时间我做的这个 Web 应用,从接口到部分功能实现,其实都有用到它。

但用下来有一个很清晰的感受:

它不是帮你“写完项目”的,而是帮你“推进过程”的。

具体几个使用场景:


1. 写接口和补逻辑

有些基础接口,比如分页、条件查询这类,我会直接让它先给一个初版。

它给出的代码:

  • 结构基本正确
  • 命名还算正常
  • 一些基础异常处理也会带上

不是那种只能参考的代码,而是可以直接拿来改的。


2. 查问题和定位 bug

有些问题自己一时想不明白,会直接把代码丢进去,让它帮我分析。

它不会一上来就改代码,而是会先列可能原因,再给修改建议。

这一点其实挺像正常开发的思路。


3. 顺带帮我处理了一部分软著材料

在写软著说明文档的时候,有一些描述性内容,我也会让它帮我整理一下。

比如:

  • 功能描述的表述
  • 一些模块说明的梳理

它在这种“半技术 + 半文字”的场景里,其实还挺好用的。


三、一个挺明显的短板:还停留在“文本世界”

用了一段时间,有一个点其实挺明显的。

就是它现在基本还是围绕“文本”在工作。

我在做这个 Web 项目的时候,本来想过一件事:

把页面截图丢给它,让它帮我分析 UI,或者给一些交互建议。

但这条路是走不通的。

查了一下资料,也基本可以确认:

这一代 V4 还是预览版,多模态能力并没有真正上线。

这在现在的大模型环境里,其实算是一个比较明显的短板。

因为像现在一些主流模型,已经可以:

  • 直接看图
  • 分析页面结构
  • 甚至给出 UI 优化建议

而 DeepSeek V4 更依赖你把问题“描述清楚”。

这就导致一个很现实的差异:

在“写代码、写内容、做推理”这些事情上,它很好用; 但在“看界面、理解视觉信息”这类场景里,它暂时帮不上忙。


四、它也不是没有问题

用下来,有些问题还是挺真实的。


1. 还是会答错,而且有时候挺自信

有些答案看起来很合理,但细节是错的。

如果不自己判断,很容易被带偏。


2. 对复杂系统支持有限

小功能、小模块都没问题。

但如果是复杂项目,比如多模块系统、历史逻辑很多的代码,它的理解能力还是不够。

更多还是适合作为辅助,而不是主导。


3. 偶尔会有“套路感”

在生成内容的时候,有时候结构会比较标准化。

如果不做调整,读起来会有点像模板。


五、一个比较实际的结论

如果问我现在值不值得用。

我的答案是:

可以用,而且已经可以作为开发过程中的一个常用工具。

但前提是要有一个清晰的认知:

它更像一个能随时帮你补一把的工具,而不是替你完成工作的那个人。


六、也想听听你们怎么用

现在大家用大模型的方式,其实差别挺大的。

有人只是偶尔查资料,有人已经深度参与到开发流程里。

我比较好奇的是:

你现在主要用它来做什么? 有没有真的提升效率? 有没有遇到过比较离谱的回答?

可以聊聊。

不同人的用法,其实挺有参考价值的。