惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

月光博客
月光博客
J
Java Code Geeks
F
Fortinet All Blogs
Blog — PlanetScale
Blog — PlanetScale
P
Proofpoint News Feed
U
Unit 42
B
Blog
宝玉的分享
宝玉的分享
腾讯CDC
Microsoft Azure Blog
Microsoft Azure Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
Last Week in AI
Last Week in AI
博客园 - Franky
博客园 - 三生石上(FineUI控件)
人人都是产品经理
人人都是产品经理
Martin Fowler
Martin Fowler
博客园_首页
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More
云风的 BLOG
云风的 BLOG
L
LangChain Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Y
Y Combinator Blog
The GitHub Blog
The GitHub Blog
博客园 - 叶小钗

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
把 AI 系统性融入研发日常 + 打磨一个参赛作品——分享 4 个工...
coderlin1 · 2026-06-19 · via LINUX DO - 最新话题

最近公司有个内部 AI 比赛,要交个文档,再录个 5 分钟视频。我想从自己平时搓的几个小工具里挑一个拿去参赛,顺便也看看能不能真的给团队用起来。

现在手头大概有这几个:

  1. 改代码后自动编译、跑测试
    改完代码自动编译、跑相关测试,尽量逼自己走 TDD。动了哪块就补哪块用例,避免把老逻辑改崩。跑完会顺带出单测分支覆盖率。现在是我自己项目里用,后面想弄通用点,别的项目也能接。

  2. 自动生成当天工作日志
    按我的日报模板,自动拉项目管理系统、邮件、git 提交。项目系统现在还得塞 cookie,7 天左右过期,所以用前会先检查 cookie。邮件走 IMAP 授权码,git 拉当天提交。这个准备再收拾一下,做个 release 给同事试试。

  3. AI 协作过程整理成文档git项目
    平时跟 AI 一起排问题、拆需求、改方案,中间其实有不少有用信息。但最后基本都散在聊天记录、临时笔记、diff 里,回头找很麻烦。想做个东西,把这些过程自动整理成文档,再同步到固定地方。

  4. 业务模块抽通用能力
    这个还只是想法。现在负责的一个业务模块里有些约束求解、任务编排、自动决策的逻辑,想看看能不能抽出来做成一套通用能力,后面类似场景可以直接用。不过还没前面几个成熟。

想问问大家:

你们现在写代码、跑 agent 都用什么模型?补全、大改代码、长时间跑 agent,会分开用不同模型吗?Claude、GPT、Gemini、DeepSeek,还有国产那几个,实际怎么搭比较划算?有没有主力 + 备用的组合能参考?

工具这块,Claude Code、Cursor、Cline、Copilot、Windsurf,你们团队实际用下来哪个最顺?什么场景用哪个?CLI、IDE 插件、独立编辑器,哪种更容易推?

还有那些每天重复的动作,比如编译测试、写日报、同步文档,一般怎么固化下来?规则文件、MCP、自定义 skill、脚本,实战里哪个最好使?团队里推广有什么坑?

最后主要想问比赛选题。

上面这几个方向里,你们觉得哪个最有“创新 + AI 用在刀刃上”的卖相,比较适合拿去参赛?怎么把一个偏工程的小工具讲出一点新意,不至于让评委一看就觉得“这不就是个脚本吗”?

还有一个问题是,AI 协作过程大家平时怎么记录?比如 prompt、对话过程、AI 生成的代码和自己手改的部分、最终采纳了哪些建议、哪些被推翻了。答辩的时候怎么展示更有说服力?

我现在有点想选第 4 个,毕竟跟业务更近,也更容易讲价值。但它还没完全做出来,不像前几个已经能跑,所以有点纠结。

编译测试那个如果后面收拾得差不多,应该可以开源。

自动日报这个就没那么通用了,里面有不少逻辑是针对公司内部项目管理平台写的,主要是抓网页内容和解析字段,直接开源出来大家也跑不起来。这个后面可能更适合把思路整理一下,比如数据怎么拉、模板怎么做、cookie 过期怎么处理、邮件和 git 记录怎么总结之类的。因为这个我开始是只给强模型agent(claude code+opus4.6)执行动作,发现给弱模型agent(cline+qwen-coder-next)跑脚本就给我死循环了,后面通过gpt codex的指点,拆分复杂收集数据的动作放到前置,从而给弱agent只需要按照已有收集数据总结即可。

先来问问大家经验,感谢。