惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

L
LangChain Blog
V
V2EX
爱范儿
爱范儿
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
Martin Fowler
Martin Fowler
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
Apple Machine Learning Research
Apple Machine Learning Research
WordPress大学
WordPress大学
有赞技术团队
有赞技术团队
宝玉的分享
宝玉的分享
Last Week in AI
Last Week in AI
让小产品的独立变现更简单 - ezindie.com
让小产品的独立变现更简单 - ezindie.com
罗磊的独立博客
小众软件
小众软件
Vercel News
Vercel News
博客园 - 司徒正美
阮一峰的网络日志
阮一峰的网络日志
V
Visual Studio Blog
J
Java Code Geeks
P
Proofpoint News Feed
MongoDB | Blog
MongoDB | Blog
B
Blog
美团技术团队
量子位

博客园_首页

Linux实操--组管理、权限管理和定时任务 Java + EasyExcel 实现单个接口导出多个Excel Mem0 源码解析系列(二):提示词工程的深度剖析 Openclaw TaskFlow究竟是什么?和普通Skill技能有什么区别 博文阅读密码验证 - 博客园 嘉立创开源:应该是全网MicroPython教程最多的开发板 Hermes Agent 集成实践:从协议到生产 2026年AI编程工具横评:Cursor、Codex、Claude Code、Zed、Windsurf Java程序员必看的RAG入门教程 2026 AI效率神器:Superpowers + Claude Code 保姆级教程 本地大模型部署全攻略:从 0 到 1 玩转 Ollama 【从0到1构建一个ClaudeAgent】内存管理-上下文压缩 .NET 高级开发 | 设计、实现一个事件总线框架 电子小白入门之NE555 3. WorkBuddy:隐藏玩法,一键召唤专家,让 AI 以"专家身份"给你干活 和AI一起搞事情#3:Claude Teammate 游戏开发翻车实录 【OpenClaw】通过 Nanobot 源码学习架构---(7)Memory C# .NET 周刊|2026年3月3期 我在 Debian 11 上把 K8s 单机搭起来了,过程没你想的那么顺(/opt 目录版) 深度学习进阶(七)Data-efficient Image Transformer CLI+Skill搭建浏览器AI自动化框架,告别一切重复枯燥任务 告别Token账单无底洞:OpenClaw本地部署,重塑企业数据主权的唯一解 FastAPI+Vue:文件分片上传+秒传+断点续传,这坑我帮你踩平了! SBTI 爆火后,我做了个程序员版的 CBTI。。已开源 + 附开发过程 多模态检索开始进入工程期:用 Sentence Transformers 搭建可落地的 Multimodal RAG 100多行代码实现一个最简单的Agent(用ReAct) Claude Code 通关手册(八):推荐 5 个 Hooks,代码质量提升 3 倍 老板:“有人截图了!”。安全部门:“收到,马上查暗水印!” - why技术 技术之外,皆是人间 C#/.NET/.NET Core技术前沿周刊 | 第 69 期(2026年4.01-4.12)
DeepSeek V4,我在做项目和写软著材料时,顺手用了一段时间
程序员小崔日记 · 2026-05-04 · via 博客园_首页

前阵子 DeepSeek 更新到了 V4。

一开始我其实没太当回事。现在大模型更新太快了,几乎隔一段时间就来一次“版本升级”,但很多时候用起来差别并不大。

但这次比较巧。

我刚好在做一个 Web 应用,还顺便在准备软著材料,这一阶段我基本是边开发边用了一下 DeepSeek V4。

用下来两周,有一些比较具体的感受,想记录一下。


一、它给我的第一感觉:更“稳”了

如果只说一个变化,那就是稳定性。

以前用一些模型,经常会遇到这种情况:

  • 聊着聊着开始跑偏
  • 上下文接不上
  • 同一个问题,前后说法不一致

V4 在这方面明显好很多。

我在改接口的时候,有一段逻辑来回调整了好几次,它基本能记住前面的约束,不会每一轮都重新理解问题。

这种体验不算惊艳,但很关键。

因为开发过程中最怕的不是它不会,而是它前后不一致。


二、在项目里,它更像“辅助工具”,而不是“替代者”

前段时间我做的这个 Web 应用,从接口到部分功能实现,其实都有用到它。

但用下来有一个很清晰的感受:

它不是帮你“写完项目”的,而是帮你“推进过程”的。

具体几个使用场景:


1. 写接口和补逻辑

有些基础接口,比如分页、条件查询这类,我会直接让它先给一个初版。

它给出的代码:

  • 结构基本正确
  • 命名还算正常
  • 一些基础异常处理也会带上

不是那种只能参考的代码,而是可以直接拿来改的。


2. 查问题和定位 bug

有些问题自己一时想不明白,会直接把代码丢进去,让它帮我分析。

它不会一上来就改代码,而是会先列可能原因,再给修改建议。

这一点其实挺像正常开发的思路。


3. 顺带帮我处理了一部分软著材料

在写软著说明文档的时候,有一些描述性内容,我也会让它帮我整理一下。

比如:

  • 功能描述的表述
  • 一些模块说明的梳理

它在这种“半技术 + 半文字”的场景里,其实还挺好用的。


三、一个挺明显的短板:还停留在“文本世界”

用了一段时间,有一个点其实挺明显的。

就是它现在基本还是围绕“文本”在工作。

我在做这个 Web 项目的时候,本来想过一件事:

把页面截图丢给它,让它帮我分析 UI,或者给一些交互建议。

但这条路是走不通的。

查了一下资料,也基本可以确认:

这一代 V4 还是预览版,多模态能力并没有真正上线。

这在现在的大模型环境里,其实算是一个比较明显的短板。

因为像现在一些主流模型,已经可以:

  • 直接看图
  • 分析页面结构
  • 甚至给出 UI 优化建议

而 DeepSeek V4 更依赖你把问题“描述清楚”。

这就导致一个很现实的差异:

在“写代码、写内容、做推理”这些事情上,它很好用; 但在“看界面、理解视觉信息”这类场景里,它暂时帮不上忙。


四、它也不是没有问题

用下来,有些问题还是挺真实的。


1. 还是会答错,而且有时候挺自信

有些答案看起来很合理,但细节是错的。

如果不自己判断,很容易被带偏。


2. 对复杂系统支持有限

小功能、小模块都没问题。

但如果是复杂项目,比如多模块系统、历史逻辑很多的代码,它的理解能力还是不够。

更多还是适合作为辅助,而不是主导。


3. 偶尔会有“套路感”

在生成内容的时候,有时候结构会比较标准化。

如果不做调整,读起来会有点像模板。


五、一个比较实际的结论

如果问我现在值不值得用。

我的答案是:

可以用,而且已经可以作为开发过程中的一个常用工具。

但前提是要有一个清晰的认知:

它更像一个能随时帮你补一把的工具,而不是替你完成工作的那个人。


六、也想听听你们怎么用

现在大家用大模型的方式,其实差别挺大的。

有人只是偶尔查资料,有人已经深度参与到开发流程里。

我比较好奇的是:

你现在主要用它来做什么? 有没有真的提升效率? 有没有遇到过比较离谱的回答?

可以聊聊。

不同人的用法,其实挺有参考价值的。