惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

云风的 BLOG
云风的 BLOG
V2EX - 技术
V2EX - 技术
T
Troy Hunt's Blog
TaoSecurity Blog
TaoSecurity Blog
Attack and Defense Labs
Attack and Defense Labs
SecWiki News
SecWiki News
M
MIT News - Artificial intelligence
N
News and Events Feed by Topic
Help Net Security
Help Net Security
IT之家
IT之家
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
博客园 - 聂微东
The GitHub Blog
The GitHub Blog
The Last Watchdog
The Last Watchdog
Martin Fowler
Martin Fowler
Hacker News: Ask HN
Hacker News: Ask HN
酷 壳 – CoolShell
酷 壳 – CoolShell
人人都是产品经理
人人都是产品经理
H
Heimdal Security Blog
B
Blog
Blog — PlanetScale
Blog — PlanetScale
Exploit-DB.com RSS Feed
Exploit-DB.com RSS Feed
Hacker News - Newest:
Hacker News - Newest: "LLM"
T
Threat Research - Cisco Blogs
I
InfoQ
腾讯CDC
L
LangChain Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Threat Intelligence Blog | Flashpoint
Threat Intelligence Blog | Flashpoint
Know Your Adversary
Know Your Adversary
Cloudbric
Cloudbric
Project Zero
Project Zero
T
Tor Project blog
小众软件
小众软件
博客园 - 司徒正美
www.infosecurity-magazine.com
www.infosecurity-magazine.com
H
Help Net Security
Webroot Blog
Webroot Blog
量子位
NISL@THU
NISL@THU
Schneier on Security
Schneier on Security
Google Online Security Blog
Google Online Security Blog
cs.CV updates on arXiv.org
cs.CV updates on arXiv.org
月光博客
月光博客
宝玉的分享
宝玉的分享
V
V2EX
T
Tailwind CSS Blog
Spread Privacy
Spread Privacy
G
Google Developers Blog
K
Kaspersky official blog

博客园 - iTech

7万星的AI交易框架:让大模型模拟投行多空辩论,自动做交易决策 71000颗星的AI交易团队:让大模型模拟投行分工,自动做交易决策 13400颗星的开源项目:输入一句话,AI全自动帮你做短视频 102颗星的沙盒:当AI学会自己写代码、跑测试、做部署 AI 技术日报 - 2026-05-08 29k 星的 PageIndex:不用向量数据库,靠推理就能做 RAG 每天花两小时刷信息?这个开源项目帮你全自动搞定 读源码像读小说?试了 DeepWiki 和 Zread,我再也不想裸读 GitHub 了 Matt Pocock 开源的这套 .claude 技能,为什么让工程师集体上头? Cursor Team Kit:Cursor 官方团队在用的 17 个 AI 工作流 AI 技术日报 - 2026-05-07 AI 技术日报 - 2026-05-06 AI 技术日报 - 2026-05-05 Anthropic CEO 说 12 个月内程序员要失业,我扒完他的底牌,发现事情没那么简单 把工程师的肌肉记忆装进 Claude Code,这个 4300 Star 的项目我后悔没早用 AI 技术日报 - 2026-05-04 AI 技术日报 - 2026-05-03 AI 技术日报 - 2026-05-02 六大 Agent 框架横评:谁支持 Skills?谁能自动创建 Agent?MCP 呢? Wechatsync:一个 Chrome 插件,一键把文章同步到 31 个平台 LangChain 开源了 Open SWE:Stripe、Ramp、Coinbase 内部都在造的编程 Agent Cockpit:把 Claude Code 从终端里搬出来,装进浏览器 Cursor 把自家的 AI Agent 开放了:写几行 TypeScript 就能调 Cursor 干活 AI 技术日报 - 2026-05-01 AI 写代码每次结果都不一样?Archon 用 YAML 工作流把 AI 编程变成流水线 AI 写代码比你快了,但你还是得学编程——只不过学法得换 腾讯的龙虾特工队:4 个 AI Agent 同日更新,全家桶正式成型 Agno 不做更聪明的 Agent,它要把所有 Agent 框架包进同一个操作系统 Hermes Agent 终于有了像样的 Web 界面,而且还支持远程访问 Datawhale 出了一套 29 学科知识地图,把 AI 的底牌全掀了 Hermes Agent 在聊天框里就能用的 20 种高级功能 一份 AGENTS.md 能顶一次模型升级?Augment Code 用数据说了算 NVIDIA 开源了一个「AI 沙箱」,20K Star,让 Agent 跑代码不再裸奔 60ms 冷启动、5MB 内存:腾讯开源的这个沙箱让 Docker 安全隔离像笑话 AI 技术日报 - 2026-04-30 AI 技术日报 - 2026-04-29 AI 技术日报 - 2026-04-28 Goose:Linux 基金会亲儿子,能撼动 Claude Code 和 OpenCode 吗? AI 技术日报 - 2026-04-27 AI 技术日报 - 2026-04-26 Google 把价值20美元/月的东西免费了,102K人已经抢到了 OpenClaw 和 Claude Code 网络搜索配置指南 AI 技术日报 - 2026-04-25 Anthropic 为什么遥遥领先:从 Cat Wu 专访看AI霸主的底层逻辑 Mac 本地跑大模型完全指南:你的苹果电脑就是 AI 工作站 同样 70B 参数,为什么 MoE 只激活 13B 就能打平 Dense? DeepSeek-V4 技术报告里藏着一条线:华为昇腾 NPU 已完成推理验证 DeepSeek-V4 深夜炸场:1M 上下文、384K 输出、双模型,API 定价直接卷到底 MacBook Air 跑大模型实测:Ollama、llama.cpp、LM Studio 谁才是本地推理之王? AI 技术日报 - 2026-04-24 OpenCode:Claude Code 的最佳平替 2026 开源大模型五国杀:Qwen 3.6 vs Gemma 4 vs Llama 4 vs GLM-5.1 vs DeepSeek V4 MCP 与 Skills 的你死我活:Anthropic 的 Agent 生态野心与开发者的站队困境 给 AI Agent 配搜索,国内能用的搜索 API 实测对比 AI 技术日报 - 2026-04-23 CC Switch:49K Star 的 Claude Code 登录绕过神器,还能管 Codex 和 Gemini CLI NVIDIA 开出 32 万美元年薪招 AI Agent 工程师,JD 里藏着这些信号 fast-mirror-skill 技术拆解:一个小而完整的 Claude Skill 是怎么设计的 Cursor 值 600 亿美元?马斯克这次赌的不是技术,是入口 AI 技术日报 - 2026-04-22 别再问 AI 能不能赚钱了:3 个上班族亲测有效的副业方法(2026 最新版) 10 分钟从零搞定 Hermes Agent:飞书微信双通道丝滑上线 AI 技术日报 - 2026-04-21 Anthropic 实战总结:AI Agent 的 3 种工作流模式,选错代价很大 安装 openclaw,hermes 慢的想发疯,fast-mirror-skill 来救了 Claude Routines:你下班睡觉了,Agent 还在为你干活 微信飞书里敲一个斜杠就能干活:Hermes Quick Command 到底多省事 AI 正在疯狂吃电:算力尽头是电力,谁能解这道题? AI 技术日报 - 2026-04-20 3K 行代码造一个越用越聪明的 AI Agent:GenericAgent 登顶 GitHub Trending 高德途途封神机器人半马,背后的 ABot-Claw 到底是什么 人们希望 AI 能干啥?Anthropic 调查:第一名不是赚钱,是变强 AI 时代人们在担心什么?Anthropic 的 13 条焦虑排行榜 OpenAI 官方 Agent SDK 来了:22k Star,支持 100+ 模型,Python 10 行代码上手 AI 技术日报 - 2026-04-19 OpenAgents Workspace:让 Claude Code 和 Codex 在同一个群里干活 Claude 是要干掉整个软件行业吗? Claude 官方推荐多 Agents 设计模式 多 Agent 系统的 5 种协调模式:选错了模式,再强的 Agent 也白搭 AI 技术日报 - 2026-04-18 AI 技术日报 - 2026-04-17 Better-Harness:让AI Agent自己优化自己的革命性框架 OpenClaw Workspace 完全指南:我的AI编程工作流 DeepSeek内蒙草原高薪招聘:AI时代的数字牧民梦,还是营销噱头? 2 核 2G 的阿里云 ECS 能跑 OpenClaw 吗?能,但有点折腾 AI 技术日报 - 2026-04-16 OpenCLI:一个命令行搞定 16+ 内容平台的神器 从零到精通:OpenClaw CLI 命令完全指南 AI 技术日报 - 2026-04-15 AI Agent 如何自我进化?Hermes Agent Self-Evolution 深度解析 AI 技术日报 - 2026-04-14 为什么你的飞书 Bot 总是连不上?OpenClaw Gateway 架构深度解析 OpenClaw 连接飞书的原理:Gateway、Channel 与消息流转 国内安装 Hermes Agent 踩坑全记录:从 GitHub 超时到正常跑起来的每一步 35 万 Star 的 OpenClaw:5 分钟部署你的私人 AI 助手,直连飞书 AI 技术日报 - 2026-04-13 公司用 AI 筛简历,这个开源项目让候选人用 AI 反选公司 为什么 Google ADK 可能是你下一个 Agent 框架——7 个改变游戏规则的特性 Microsoft Agent Framework 深度解析:架构设计与实战落地 AI 技术日报 - 2026-04-11
AI 技术日报 - 2026-05-24
iTech · 2026-05-24 · via 博客园 - iTech

AI 技术日报 - 2026-05-24

Top 10 AI 技术要闻

  1. StreetAI Memory:适用于 LLM 的持久化记忆方案,输入 Token 可减少高达 80%
    StreetAI Memory 是一个位于应用层与 LLM API 之间的持久化记忆中间件,使用 SQLite 存储对话数据,结合 all-MiniLM-L6-v2 嵌入模型(约 90MB)进行语义检索。其核心架构采用"信号栈"(signal stacks) 组织对话数据,通过活动衰减(activity decay)机制自动淘汰过时信息,每轮仅检索与当前查询相关的上下文。项目提供 drop-in 适配器,兼容 OpenAI、Anthropic、Gemini、DeepSeek、Groq 等主流 LLM 提供商,支持异步适配器和消息编辑/删除。在 16 轮基准测试中,输入 token 减少 55%–80%(平均 68%),且随对话轮次增长节省效果愈加显著。该方案可直接通过 pip install streetai-memory 安装,适合需要长期用户记忆的聊天机器人和 Agent 场景,有效解决长对话中 token 消耗线性增长导致成本飙升的问题。

链接:https://github.com/Tem-Degu/streetai-memory

  1. CC-Wiki:将 Claude Code 会话自动转化为可分享的知识库 Wiki
    CC-Wiki 是一个开源工具,能将 ~/.claude 目录下的 Claude Code 会话历史自动转换为基于 Quartz 的可分享知识库。作为 Claude Code 的 skill 运行,用户只需通过 /cc-wiki 命令即可触发转换流程。项目包含预处理器(preprocessor)、提示模板(prompt templates)和 Quartz 模板三大模块,仅依赖 Python 3.9+(标准库)和 Node 22+(Quartz),并提供一键安装脚本。核心价值在于解决了 Claude Code 深度研究的上下文和洞察难以打包分享、也无法在后续会话中复用的痛点。生成的知识库采用 arXiv 风格排版,适合团队内部的知识管理和研究复用,让 AI 编码会话中的经验积累不再随会话结束而消失。

链接:https://github.com/tejpalv/cc-wiki

  1. Claw-Coder:开源本地 RAG + 知识图谱 AI 编码 Agent,代码不离开本机
    Claw-Coder 是一个完全本地运行的 AI 编码 Agent,内置知识图谱(Knowledge Graph)、RAG 向量存储和 Docker 执行环境。其核心设计理念是通过知识图谱帮助小模型理解代码间的结构关系,通过 RAG 解决本地 LLM 上下文窗口不足的问题,并通过 Docker 容器化执行让 Agent 在隔离环境中验证自生成的代码,包括利用视觉 LLM 验证 HTML/CSS 的渲染结果。此外还集成了联网搜索工具以减少本地 LLM 的幻觉问题。与云端编码 Agent(Codex、Cursor、Claude Code)不同,Claw-Coder 确保代码库不离开本地机器,通过工具增强使 8B 级别的小模型也能完成实际编码任务,为注重代码隐私的开发者提供了新选择。

链接:https://news.ycombinator.com/item?id=48248801

  1. Vivify:基于 Gemini Omni Flash 的多模态视频生成与编辑平台
    Vivify 是一个基于 Google Gemini Omni Flash 模型构建的视频生成与编辑工作台,支持文本生成视频、图像生成视频、视频编辑三种工作流。平台的核心亮点在于支持语音资产(voice assets)和角色资产(character assets)的创建和管理,显著增强了角色和语音的一致性控制。用户可选 720p 分辨率、16:9 宽高比、6 秒时长,并支持种子控制以实现可复现的生成结果。平台还提供了与 Seedance 2.0 的对比测试数据。作为一个独立于 Google 运营的第三方工具,Vivify 为内容创作者提供了集成化的 AI 视频创作环境,将多模态输入(文本、图像、音频、角色参考)统一到单一编辑流程中,降低了 AI 视频制作的技术门槛。

链接:https://vivify.video/models/gemini-omni-flash

  1. copilot-agent-lite:超轻量 Copilot Agent Runtime 开源发布
    copilot-agent-lite 是一个超轻量级的 Copilot Agent 运行时(Runtime)项目,旨在为开发者提供一个极简的 AI Agent 执行框架。与传统重量级 Agent 框架不同,该项目专注于核心 Agent 循环的最小化实现,包括工具调用、上下文管理和任务编排等基本能力。其轻量化设计意味着更低的资源消耗和更快的启动速度,适合嵌入到各类开发工具和工作流中。项目的发布反映了当前 AI 编程工具生态向模块化、可组合方向演进的趋势,开发者可以基于此快速构建定制化的 AI Agent 能力,而不必依赖大型商业框架的完整堆栈。对于想要深入理解 Agent 运行机制或快速原型验证的开发者来说,这是一个值得关注的项目。

链接:https://www.v2ex.com/t/1215006

  1. SenseNova-U1 实战体验:从网页版到 CUDA 服务器本地部署全流程
    这篇文章详细记录了商汤 SenseNova-U1 统一多模态模型的完整部署体验。SenseNova-U1 定位为"原生统一多模态理解与生成"(NEO-Unify),统一架构覆盖理解、生成、编辑、图文交错等多种能力。作者实测了 SenseNova-U1-8B-MoT 模型,发现信息图生成和 2D 卡通贴纸生成效果较好,同时记录了 Mac 本地部署的踩坑经验:要求 Python 3.11(3.12 不兼容)、macOS 无法使用 CUDA 版 PyTorch、需手动安装多个依赖。最终在 CUDA 服务器上成功完成部署和生成测试。文章为想在本地部署 SenseNova-U1 的开发者提供了从环境配置到运行推理的完整实操指南,包含大量错误排查经验。

链接:https://juejin.cn/post/7642555314736136227

  1. ccglass:本地代理+Web 仪表盘,揭秘 AI 编码工具发给大模型的真实内容
    ccglass 是一个开源的本地代理工具,配备 Web 仪表盘,能够实时展示 Claude Code、Codex、DeepSeek 等主流 AI 编码工具发送给底层大模型的真实 prompt 内容。该项目由 jianshuo 开发,已在 GitHub 获得 127 颗星,使用 JavaScript 编写。对于关心 AI 编码工具透明度的开发者来说,ccglass 提供了一种直观的方式来审查和理解编码 Agent 的 prompt 工程细节——包括系统提示、工具定义、上下文注入策略等。这对于学习 prompt 工程、优化 Agent 配置、以及理解不同编码工具的差异策略都具有很高的实用价值。工具以本地代理模式运行,不影响原有工具的使用方式。

链接:https://github.com/jianshuo/ccglass

  1. OpenTalking:开源免费的实时数字人项目
    OpenTalking 是一个开源免费的实时数字人(Digital Human)项目,支持实时语音驱动面部动画和肢体动作。项目实现了从语音输入到虚拟角色实时响应的完整流水线,包括语音识别、文本处理、表情生成和动作合成等模块。作为开源方案,OpenTalking 为数字人技术在教育直播、虚拟客服、内容创作等场景的普及提供了基础能力,开发者可以根据自身需求进行二次开发和定制。该项目的发布降低了实时数字人技术的使用门槛,让中小团队和个人开发者也能构建自己的数字人应用,是对当前数字人商业化浪潮中的有力开源补充。

链接:https://www.v2ex.com/t/1214991

  1. Agent-Native 架构指南:如何将网站升级为面向 AI Agent 的服务
    这篇文章探讨了 Agent-Native 的核心概念,以及如何将现有网站升级为面向 AI Agent 的服务架构。文章从 Agent 交互协议、结构化数据暴露、API 设计最佳实践等角度,系统阐述了让 AI Agent 能够高效理解和操作 Web 服务的架构设计方法。关键内容包括:Agent 可发现性设计(如 agent.txt 协议)、结构化内容输出(JSON-LD、微数据)、意图路由(intent routing)机制、以及 Agent 友好的错误处理策略。随着 AI Agent 数量的爆发式增长,让服务"对 Agent 友好"正在成为与"对 SEO 友好"同等重要的基础设施需求,这篇文章为 Web 开发者提供了向 Agent-Native 架构转型的实用指南。

链接:https://www.v2ex.com/t/1215010

  1. 突破 Gemma 4 Token 上限:Dense 模型"拒绝回答"的真相与参数调优实验
    这篇文章揭示了 LLM 评估中一个容易被忽视的关键问题:max_tokens 参数设置对推理质量的隐性影响。作者此前声称 Gemma 4 31B Dense 模型在收紧提示词后出现"错误拒绝"(false refusal),并归因于 MoE 与 Dense 架构差异。但社区指出根因是 max_tokens: 400 的上限截断了推理(reasoning)层输出,而非架构本身的问题。作者重跑实验,仅将 max_tokens 从 400 提升至 4096,Dense 模型在全部 6 个测试场景中恢复正常,MoE 和 Dense 的分歧在放开 token 上限后基本消失。这项实验对所有 LLM 使用者都有重要警示意义:在测试和部署时必须确保推理 token 预算充足,被误归因于"架构缺陷"的问题可能只是参数配置不当。

    链接:https://dev.to/alimafana/i-raised-gemma-4s-token-cap-the-dense-model-stopped-refusing-895


数据来源:TheAIEra News Hub
生成时间:2026-05-24 07:30:00