惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

V
Visual Studio Blog
N
Netflix TechBlog - Medium
GbyAI
GbyAI
大猫的无限游戏
大猫的无限游戏
博客园 - 三生石上(FineUI控件)
T
Tailwind CSS Blog
IT之家
IT之家
博客园 - Franky
雷峰网
雷峰网
博客园 - 聂微东
腾讯CDC
M
MIT News - Artificial intelligence
B
Blog RSS Feed
博客园_首页
罗磊的独立博客
S
SegmentFault 最新的问题
I
InfoQ
博客园 - 叶小钗
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
阮一峰的网络日志
阮一峰的网络日志
D
Docker
宝玉的分享
宝玉的分享
B
Blog
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报

博客园 - iTech

7万星的AI交易框架:让大模型模拟投行多空辩论,自动做交易决策 71000颗星的AI交易团队:让大模型模拟投行分工,自动做交易决策 13400颗星的开源项目:输入一句话,AI全自动帮你做短视频 102颗星的沙盒:当AI学会自己写代码、跑测试、做部署 AI 技术日报 - 2026-05-08 29k 星的 PageIndex:不用向量数据库,靠推理就能做 RAG 每天花两小时刷信息?这个开源项目帮你全自动搞定 读源码像读小说?试了 DeepWiki 和 Zread,我再也不想裸读 GitHub 了 Matt Pocock 开源的这套 .claude 技能,为什么让工程师集体上头? Cursor Team Kit:Cursor 官方团队在用的 17 个 AI 工作流 AI 技术日报 - 2026-05-07 AI 技术日报 - 2026-05-06 AI 技术日报 - 2026-05-05 Anthropic CEO 说 12 个月内程序员要失业,我扒完他的底牌,发现事情没那么简单 把工程师的肌肉记忆装进 Claude Code,这个 4300 Star 的项目我后悔没早用 AI 技术日报 - 2026-05-04 AI 技术日报 - 2026-05-03 AI 技术日报 - 2026-05-02 六大 Agent 框架横评:谁支持 Skills?谁能自动创建 Agent?MCP 呢? Wechatsync:一个 Chrome 插件,一键把文章同步到 31 个平台 LangChain 开源了 Open SWE:Stripe、Ramp、Coinbase 内部都在造的编程 Agent Cockpit:把 Claude Code 从终端里搬出来,装进浏览器 Cursor 把自家的 AI Agent 开放了:写几行 TypeScript 就能调 Cursor 干活 AI 技术日报 - 2026-05-01 AI 写代码每次结果都不一样?Archon 用 YAML 工作流把 AI 编程变成流水线 AI 写代码比你快了,但你还是得学编程——只不过学法得换 腾讯的龙虾特工队:4 个 AI Agent 同日更新,全家桶正式成型 Agno 不做更聪明的 Agent,它要把所有 Agent 框架包进同一个操作系统 Hermes Agent 终于有了像样的 Web 界面,而且还支持远程访问 Datawhale 出了一套 29 学科知识地图,把 AI 的底牌全掀了
AI 技术日报 - 2026-05-18
iTech · 2026-05-18 · via 博客园 - iTech

AI 技术日报 - 2026-05-18

Top 10 AI 技术要闻

  1. Zerostack:用纯 Rust 打造的 Unix 风格 AI 编码代理
    Zerostack 是一个在 Hacker News 上引发广泛关注的全新开源编码代理项目,其核心设计灵感来源于 Unix 哲学——每个组件只做一件事并做到极致。整个系统用纯 Rust 编写,这意味着它具备极高的执行性能和内存安全性,同时避免了传统 Python/JS 编码代理的运行时开销。项目采用管道式架构,将代码理解、生成、测试和审查分解为独立的可组合模块,开发者可以像拼搭 Unix 管道一样灵活编排 AI 编码工作流。Rust 的零成本抽象特性使其在处理大型代码库时表现出色,为高性能 AI 编码代理的开发提供了全新的技术路线。

链接:https://news.ycombinator.com/item?id=48164287

  1. DeepSeek-V4-Flash 发布:LLM 引导向量(Steering Vectors)技术重获关注
    DeepSeek-V4-Flash 的发布重新点燃了业界对 LLM 引导向量技术的兴趣。引导向量是一种无需重新训练即可在推理时调整模型行为的技术——通过在模型的隐藏状态中注入特定方向的向量,可以精确控制模型输出的风格、倾向和内容范围。该技术相比传统的 Prompt Engineering 更为底层和高效,能够在不增加推理延迟的前提下实现细粒度的行为调控。DeepSeek-V4-Flash 作为新一代开源模型,其架构特性使得引导向量的应用效果更加显著,为模型可控性研究开辟了新的方向。

链接:https://www.seangoedecke.com/steering-vectors

  1. NVIDIA 开源 SANA-WM:26 亿参数世界模型,可生成 1 分钟 720p 视频
    NVIDIA 发布了 SANA-WM,一个拥有 26 亿参数的开源世界模型,能够生成长达 1 分钟的 720p 视频内容。作为世界模型(World Model),SANA-WM 不仅仅是视频生成——它试图理解和模拟物理世界的动态规律,使生成的视频具备时间和空间上的一致性。模型基于扩散架构,针对长序列视频生成进行了专项优化,解决了传统视频生成模型在时长和一致性上的瓶颈。此次开源包含了完整的模型权重和推理代码,为视频生成和世界模型研究社区提供了重要的基础设施。

链接:https://nvlabs.github.io/Sana/WM

  1. Stoic AgentOS:面向 AI 代理集群的开源操作系统
    Stoic AgentOS 是一个为管理大规模 AI 代理集群而设计的开源操作系统级框架。随着 Agent 应用场景日趋复杂,单个 Agent 已无法满足需求,多 Agent 协同成为主流架构。Stoic AgentOS 提供了类似操作系统的抽象层——包括 Agent 的生命周期管理、资源调度、进程间通信和故障隔离等核心能力。框架支持动态扩缩容,可以根据任务负载自动调整活跃 Agent 的数量,并内置了日志聚合和性能监控。对于需要部署生产级多 Agent 系统的团队来说,Stoic AgentOS 提供了从开发到运维的完整工具链。

链接:https://github.com/benjaminkernbaum-ux/stoic-agentos

  1. Microsoft 发布 AI Engineering Coach:AI 编程版 Strava,追踪你的 Copilot/Claude/Codex 使用数据
    Microsoft 在 GitHub 上开源了 AI Engineering Coach 工具,被社区称为"AI 编程版 Strava"。该工具能够自动收集和分析开发者使用 AI 编码助手(如 GitHub Copilot、Claude Code、OpenAI Codex)的完整使用数据,包括代码采纳率、补全建议的接受与拒绝模式、不同编程语言和场景下的 AI 辅助效果等。通过可视化仪表盘,开发者和团队管理者可以直观了解 AI 工具的真实使用效率和投资回报。对于正在大规模引入 AI 编码工具的企业来说,这一工具提供了量化评估 AI 编程效果的客观依据。

链接:https://github.com/microsoft/AI-Engineering-Coach

  1. Hermes-agentmemory:支持真实删除的拉取式 Agent 情景记忆系统
    Hermes-agentmemory 是一个为 AI 编码代理设计的情景记忆系统,其核心创新在于支持"真实删除"——而不仅仅是标记为无效或覆盖。采用拉取式(Pull-based)检索架构,Agent 只在需要时主动检索相关记忆,避免将全部历史信息塞入上下文窗口导致的 Token 浪费。系统维护了一个精细化的记忆索引,支持基于时间、任务类型和代码上下文的多维度检索。真实删除功能使得 Agent 能够主动清理过时或错误的记忆条目,保持记忆库的精简和准确,特别适合长周期开发场景。

链接:https://github.com/MukundaKatta/hermes-agentmemory

  1. Δ-Mem:面向大型语言模型的高效在线记忆机制(arXiv 论文)
    arXiv 上发表的一篇新论文提出了 Δ-Mem,一种面向大型语言模型的高效在线记忆更新机制。传统方法在为 LLM 添加新知识时通常需要全量或部分微调,成本高昂且容易导致灾难性遗忘。Δ-Mem 的核心思路是只存储知识的"增量"(Delta),通过轻量级的在线更新将新信息注入模型,无需重新训练。论文展示了该方法在知识更新速度和准确性上显著优于现有的 RAG 和编辑方法,为构建持续学习的 LLM 系统提供了新的技术路径。该研究对需要频繁更新知识的企业级 LLM 应用具有重要参考价值。

链接:https://arxiv.org/abs/2605.12357

  1. Anthropic Mythos 助力安全研究员五天内构建可用的 macOS 漏洞利用
    Slashdot 报道,安全研究员借助 Anthropic 的 Mythos 系统仅用五天时间就成功构建了一个可用的 macOS 安全漏洞利用。Mythos 是 Anthropic 面向安全研究领域推出的辅助工具,能够自动化漏洞分析、利用链构造和漏洞验证等流程。这次实践展示了 AI 在攻防安全领域的双重潜力——既可以帮助防御者更快发现漏洞,也降低了漏洞利用的技术门槛。该事件引发了关于 AI 安全研究伦理边界的广泛讨论,也推动了业界对 AI 辅助安全研究规范化管理的思考。

链接:https://apple.slashdot.org/story/26/05/16/1643203/anthropics-mythos-helped-build-a-working-macos-exploit-in-five-days

  1. Fedora AI Developer Desktop 计划遭社区强烈反对被迫搁置
    Fedora Linux 社区发起的 AI Developer Desktop 集成计划遭遇了社区的强烈抵制,最终被迫搁置。该计划原本旨在将 AI 编码助手和开发工具深度集成到 Fedora 桌面发行版中,但社区成员对隐私风险、不必要的依赖、桌面环境纯净性等问题表达了严重关切。反对者认为,将 AI 工具捆绑到操作系统发行版中可能损害用户的选择权和系统的轻量化。这一事件折射出开源社区对 AI 工具"侵入式"集成的警惕态度,也为其他 Linux 发行版在规划 AI 集成策略时提供了重要的社区反馈参考。

链接:https://linux.slashdot.org/story/26/05/16/0815220/fedoras-ai-developer-desktop-initiative-blocked-by-community-backlash

  1. OpenAI 收购 Weights.gg:获得 AI 语音克隆技术,补齐声音能力拼图
    据《纽约时报》报道,OpenAI 今年早些时候悄然收购了 Weights.gg,一家提供 AI 语音克隆工具的初创公司。Weights.gg 的技术能够仅凭少量语音样本就创建高度逼真的人声克隆,在音频合成领域处于领先地位。此次收购标志着 OpenAI 在多模态能力布局上补齐了声音生成的关键拼图,预计将整合到 ChatGPT 的语音交互和 API 平台中。收购金额未公开,但 PitchBook 数据显示 Weights.gg 此前融资约 400 万美元。这一收购也引发了关于 AI 语音克隆技术伦理和安全的讨论。

    链接:https://www.nytimes.com/2026/05/15/technology/openai-weightsgg-voice-cloning.html


数据来源:TheAIEra News Hub
生成时间:2026-05-18 07:10:00