










工具:Midjourney v5 提示词:Rainbow holographic pcd, in t
he style of abstract photography, trompe - l’œil illusionistic detail, dark cyan and brown, fujifilm x - t4, gutai, blink - and - you - miss - it detail, tangled forms, high-key

工具:Midjourney v5
提示词:Rainbow holographic pcd, in the style of abstract photography, trompe - l’œil illusionistic detail, dark cyan and brown, fujifilm x - t4, gutai, blink - and - you - miss - it detail, tangled forms, high-key lighting, abstraction-création kodak elite chrome extra color, juxtaposition of light and shadow, clear colors smooth, modern minimalist, 3d render –ar 3:2
如无意外会在每周一更新,主要介绍上周 AIGC 领域发布的一些产品以及值得关注的研究成果,由于我自己是一个设计师,所以在一些专业内容的描述上可能存在问题,欢迎在渠道帮我反馈及更正,如果觉得有收获的话也可以订阅一下。(本期部分文案使用了 Notion AI 以及 Chat GPT 帮助润色和翻译)
各位周一好呀,上周我们新增了 456 个订阅用户,现在总订阅达到了 2461 个,上周基本上比较重要的事情都是来自开源社区的项目,大厂停止发力之后轮到开源社区了,来看一下上周的内容总结。
上周我主要发了两篇内容一个是每天晚上都会发的 Midjourney 提示词模板 汇总,另一个是我用 GPT- 4 开发的提示词收集插件的 更新和使用介绍。
上周最火的就是 AutoGPT 了,简单介绍一下这个项目就是当你给这个 AI 一个目标时,它会为自己创建任务,完成任务,创建新任务,并循环运行直到你的目标完成。它主要有下面四个特点:
上周这类型的开源方案其实不止 AutoGPT 一个,Github 榜单前三其实做的都是这一件事情,他们分别是:
这类应用强就强在打破了之前语言模型无法自主行动的限制,不再需要人工反馈和干预会自己探索直到完成任务,这就很厉害了。

下面是一些利用它执行任务的测试和探索:
Frank 把 AutoGPT 集成到了 Slack 里面:https://twitter.com/frankc/status/1645898312594382848?s=20
Omar Pera 一个人工智能代理,用 GPT- 4 自主地做销售前景调查:https://twitter.com/ompemi/status/1645083062986846209?s=20
Linus (●ᴗ●)让 Auto GPT 自动进行一个耳机产品的市场调研并输出报告:https://twitter.com/LinusEkenstam/status/1646095934177124353?s=20
JB 通过 5 次搜索,Auto GPT 研究代理准备了一个关于最近新闻的 5 主题播客,并提供准确的参考资料:https://twitter.com/jamesbbaker4/status/1645898646762782735?s=20
Adam C.H. 利用 BabyAGI 自动进行测试驱动开发:https://twitter.com/adamcohenhillel/status/1644836492294905856?s=20
Sully 利用 AutoGPT 自动输出了一份鞋类产品的市场调研,非常详细:https://twitter.com/SullyOmarr/status/1645205292756418562?s=20
John装上了 AutoGPT,让它查找最近一个月的开源相关新闻,并汇总成一个 word 文件:https://twitter.com/zhanglu/status/1646548322176598016?s=20

还有一些人在上面三个项目的基础上做了一些改进和增强的新项目比如:

当然 AutoGPT 的也不像媒体报道出来的那样乐观,Jim Fan就发表了他的看法:

现在也有很多项目可以帮助我们快速体验 AutoGPT,不需要你自己写代码部署,但基本都要你自己的 Open API Key,你可以在这里 获取 API Key:
界面干净交互友好的:https://www.cognosys.ai/create
最早功能最全的:https://agentgpt.reworkd.ai/
还有简洁干净的:https://godmode.space/
注意:现在这些都是早期项目,如果你想要体验的话需要时刻注意你的 Token 金额消耗,不要让他自己跑你去干别的不然有可能你回来你的额度直接爆炸了,另一个就是今天那些可以自动执行代码的项目。

Stable Diffusion XL 模型这周正式开启了更大规模的测试包括可以在 Stability AI 控制的平台免费试用,以及可以可以调用他们的 API 生成内容。但是开源版本的模型还没有放出,官方说法是结束 Beta 测试后会放出开源模型。Stability AI 说 SDXL 主要有以下特点:
我也对这次放出的模型和 Midjourney V5 进行了一些对比测试,下面是测试的一些结论,详细的测试图可以在这里查看:https://web.okjike.com/originalPost/6439934d4eea5bc23bf29910
你可以在 Clipdrop 和Dreamstudio体验最新版本的 SDXL 也可以在 https://platform.stability.ai/ 使用 SDXL 的 API 构建内容。

新版本模型下载:https://huggingface.co/lllyasviel/ControlNet-v1-1/tree/main
StableDiffusion 最强大的插件 ContorlNet 今天更新了 1.1 版本,这是一个很大的更新,旧模型增加了很多数据进行了重新训练,还新增了几个模型,目前模型总数达到了 14 个,新增了 4 个模型。可能会给 SD 带来新的玩法。下面是具体的更新内容:
目前不建议立刻更新 1.1,等其他大佬适配完试试再说,另外小道消息 ContorlNet 插件的作者最近入职了谷歌。

上周亚马逊发布了“Bedrock”,这是一个用于聊天、文本和图像的一站生成式 AI 工具包。主要包括三部分内容:

帮只企业利用 AI 管理自己的数字资产具体功能包括:将图片物料拖拽至 DAM.GPT 对话框,完成资产的入库,通过 AI 识别图片内容,建立与商品的关联及属性的标注;通过关键词搜索,获取相关商品的数字资产及物料。同时还可以结合线上数据进行一些人肉筛选。比如下方案例中,挑选这双鞋在双十一浏览量最高的图片;对数字资产进行中心化合规管理、分发;通过 AI 能力对现有资产进行二次加工生产。

提示词共享社区,筛选和新建的功能做的很好,还支持直接复制到 ChatGPT 里面,创建提示词的时候还可以设置需要用户填写的动态字段。用户在使用提示词的时候还可以选择提示词的语言、风格和语气。

另一个提示词分享社区,也支持创建提示词的时候设置动态内容,直接回填到 ChatGPT 使用。

Builder.io 出的 Figma 插件支持用自然语言生成设计稿并修改,也支持将生成的设计稿直接转成前端代码复制。

上传歌词和音乐就可以指定一个 AI 语音将歌唱出来,并且还可以对音频进行自定义,包括转音、滑音都都能自定义,试了一下,我反正听不出来这是 AI 唱的。

链接你的 Spotify 播放列表,并输入你当前的心情,它会自动生成符合你心情的播放列表。

选择你想养要去的地方,再选择你在这个地方的时间,产品会为你推荐你的旅游路线,并且会在地图上把推荐去的地方标注出来。

Rask AI 目前支持 60 多种语言的视频输出,包括德语、法语、西班牙语、中文、英语、土耳其语等,而不考虑源语言。我们相信,我们的技术能够为大多数语言提供可接受的翻译水平,而且我们通过语音克隆功能提供了类似人类的体验,目前仅在英语中可用。

AI Assist™ 是有史以来第一个公开发布的生成式 AI 支持的合同工具,它使用 OpenAI 的 GPT-4 让用户根据 AI Playbooks 中建立的预先批准的条款语言立即对合同进行修订。

一个 gradio web UI,用于运行大型语言模型,如 LLaMA,llama.cpp,GPT-J,Pythia,OPT 和 GALACTICA。它的目标是成为文本生成的AUTOMATIC1111/stable-diffusion-webui。

直接在浏览器里面运行的大语言模型,不需要部署直接调用 webGPU 进行运算,已经把模型部署成本拉到最低了。目前只有 M1 或者 M2 芯片的 Mac 可以运行,许需要下载谷歌开发版本。这里下载谷歌浏览器开发者版本:
https://google.com/chrome/canary/
用开发者版本的谷歌打开这个页面体验:
https://mlc.ai/web-llm/#chat-demo…

里面包含了你创建一个互联网公司需要的所有职业角色的提示词模板,大概有几十个太强了。

我将用 midjourney 生成网站设计,这是一个用于创建图像的 AI 艺术工具。然后,我们将跳入 chat gpt 来创建网站的书面内容,最后在 Editor X 中把这一切放在一起,这是一个用于创建网站的无码工具! Nocode 和人工智能辅助的艺术肯定会成为未来的发展方向。

加入我的 30 天旅程,我将深入到人工智能产生的艺术世界,将像素转化为利润!从创造独特的作品到营销它们,我将分享我的现实成果和面临的挑战以及学到的宝贵经验!从创造独特的作品到营销它们,我将分享我的现实成果、面临的挑战和学到的宝贵经验。

用十个理由解释代理化 LLM 将获得成功的原因

对开源语言模型进行测试,使用开源模型有明显的好处。隐私和安全性、可负担性、定制和避免锁定是企业和开源获胜领域的主要考虑因素。取决于它们在质量上合理竞争的能力,这些因素使得开源模型难以忽视。因此,为了真正理解和展示今天的情况,我们决定通过构建电子邮件生成器来尝试几种方法和模型

一致性模型的目标是在单个计算步骤或最多两个计算步骤中制作出获得不错结果的东西。为此,模型像扩散模型一样被训练来观察图像破坏过程,但学会在任何遮蔽级别(即缺少少量信息或大量信息)拍摄图像,并在一个步骤中生成完整的源图像。(上周一堆人吹这玩意暴打 SD,理论上 SD 也可以用这个算法来加速图像生成。)

AI 50 的追随者将看到这一点的到来。今年是第五个年头,我们与红杉和 Meritech Capital 合作制作的年度榜单旨在表彰最有前途的私营公司,利用人工智能开展业务。

一项新的研究表明,OpenAI 的 GPT- 4 在标注任务中表现优于精英人工注释者,为研究团队节省了超过 50 万美元和 2 万小时的劳动力,同时引发了对众包工作未来的质疑。

随着最近 OpenAI 聊天机器人 ChatGPT 的热潮仍在持续,我们决定探究一下这个著名聊天机器人如何帮助您创建用户体验调查问卷——或者任何其他调查问卷。

它给了 25 个 AI 代理人动机和记忆,并将它们放在一个模拟的城镇中。它们不仅参与了复杂的行为(包括举办情人节派对),而且这些行为被评价为比人类角色扮演更加“人类化”。

ChemCrow 是一个 LLM 化学代理,可以在合成、药物发现和材料设计等领域执行任务;它集成了 13 个专家设计的工具,以增强化学领域中 LLM 的性能,并证明在自动化化学任务方面的有效性。

OpenAI 最近发布了 GPT-4(即 ChatGPT plus),这被证明是生成 AI(GAI)的一小步,但对于人工通用智能(AGI)而言是一大步。自 2022 年 11 月正式发布以来,ChatGPT 迅速吸引了众多用户,并得到了广泛的媒体关注。这样前所未有的关注也激发了众多研究人员从各个方面对 ChatGPT 进行调查。根据 Google 学术搜索,有 500 多篇文章的标题中包含 ChatGPT,或在摘要中提到了它。考虑到这一点,紧急需要一份综述,而我们的工作填补了这一空白。总的来说,这项工作是第一次对 ChatGPT 进行全面审查,包括对其基础技术、应用和挑战的综述。此外,我们展望了 ChatGPT 如何发展以实现通用的 AI 生成内容(AIGC),这将是 AGI 发展的重要里程碑。

一个开源的 AGI 研究平台,专门设计为提供复杂的多步骤任务,并附带任务特定的数据集、评估指标和各种可扩展的模型。OpenAGI 将复杂任务公式化为自然语言查询,作为 LLM 的输入。LLM 随后选择、综合和执行 OpenAGI 提供的模型来解决任务。此外,我们提出了一种任务反馈强化学习(RLTF)机制,它使用任务解决结果作为反馈来改善 LLM 的任务解决能力。

像 ChatGPT 这样的大型语言模型实际上是如何工作的呢?嗯,它们既非常简单,又非常复杂。

此内容由惯性聚合(RSS阅读器)自动聚合整理,仅供阅读参考。 原文来自 — 版权归原作者所有。