惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

爱范儿
爱范儿
WordPress大学
WordPress大学
博客园 - 【当耐特】
The Cloudflare Blog
B
Blog
Last Week in AI
Last Week in AI
小众软件
小众软件
量子位
S
SegmentFault 最新的问题
V
Visual Studio Blog
博客园 - 叶小钗
美团技术团队
阮一峰的网络日志
阮一峰的网络日志
Hugging Face - Blog
Hugging Face - Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
宝玉的分享
宝玉的分享
A
About on SuperTechFans
雷峰网
雷峰网
J
Java Code Geeks
Microsoft Azure Blog
Microsoft Azure Blog
腾讯CDC
MongoDB | Blog
MongoDB | Blog
酷 壳 – CoolShell
酷 壳 – CoolShell
Martin Fowler
Martin Fowler

LINUX DO - 最新话题

谷歌云盘下载700g数据集,求方法 OpenAI推出了100美元的Pro订阅后,plus的Codex 5小时限额大幅缩水 之前买的super grok居然还没掉 关于CPA认证文件周限 佬们,默认CDK的要求是什么等级啊? 最新版本的微信群聊机器人方案 有没有人知道如何free号没有封,那么是否可以循环使用,因为我看主要是周限 L站改版了?吓我一跳,我以为我浏览器崩了 淘宝这种宽带可信吗,500兆移动宽带月费8元到2099年 docker内部应用访问宿主机mysql和redis时被拒绝connection refuse Erp全栈想转行做Ai有什么推荐的吗 boost有bug 佬们,有没有靠谱点的 Plus 购买渠道 大妈,狗妈用的 lg 服务有源头开源项目吗? 有人有能过验证码打码的嘛 上次帖里好像发过通过大模型来打码的 gpt plus 封号似乎也太快了点,一天就给封号了 按流量/token收费的国产官方AI推荐 我算是知道了为什么Oracle总是ABC了 佬友们帮我分析一下 ChatGPT Team账号只有一个人使用和4个席位邀请满了使用的总额度是一样的吗? gpt-free 10个带rt CPA反代claude是默认1m吗? 我终于敢说我做出来windows上tmux的替代了,目标windows/全平台最强的终端Ai编程工具 claude pro升级max,除了原来的$20,好像还能再领一次$100 关于AI agent的知识框架 独乐乐不如众乐乐,分享一下我的的AI对话程序 佬们自建网站支付问题是怎么解决的 怎么能让gpt模仿claude风格输出 codex free已经死了,下一个会是plus或者team吗 请问chatgpt pro里的fast模式,速度快了,降智吗
研究团队Talkie发布首个“1930年复古” 13B大语言模型 TalkieTa...
Bunn · 2026-04-28 · via LINUX DO - 最新话题
近日,研究团队Talkie正式发布了 Talkie-1930-13b-it 。这并非一个追求最新知识的AI,而是一个刻意“停留在过去”的复古语言模型(Vintage Language Model)。该模型完全基于1931年以前的历史文本进行训练。 该模型的基座版本(talkie-1930-13b-base)在 260B Token 的预1931年英语文本上进行了训练,内容涵盖书籍、报纸、期刊、专利及法庭案例。与使用现代聊天记录微调的AI不同, Talkie使用的是从 历史礼仪手册、百科全书和书信指南 中提取的指令对,并辅以在线直接偏好优化(DPO)技术。它的回答风格、词汇选择和知识储备完全局限于20世纪30年代之前。 研究团队指出,Talkie-1930 不仅仅是一个有趣的对话伙伴,它在AI基础研究中具有重要价值: 通过评估模型对1931年后发生的历史事件(如二战、太空竞赛)的“惊讶程度”,研究人员可以量化模型预测未来的潜能。 现代模型普遍存在数据污染(即测试题已在训练集中见过)。Talkie则天然免疫:例如,测试一个完全不懂数字计算机的1930年模型如何通过少量示例学习 Python 编程 ,以此观察AI的跨领域泛化能力。 测试模型是否能独立推导出其知识切断点之后的科学发现(如1911年的模型能否推导出1915年的广义相对论)。 探索非现代互联网数据(Web Data)训练出的模型在性格、行为和偏好上与现代AI有何本质区别。 由于1930年前无数字出版物,团队开发了专门的“复古OCR系统”来识别模糊的历史扫描件,旨在将由于扫描噪声导致的性能损失(约为70%)降至最低。 数据泄露是最大挑战。研究人员使用了高性能分类器来过滤带有现代注释或伪造日期的文档。尽管如此,13B版本仍表现出少量对二战后秩序的模糊察觉。 该团队计划在今年夏天推出 GPT-3 级别 的大规模复古模型,并致力于将历史语料库扩展至 1万亿(1T)Token 以上,目标是打造一个能力等同于 ChatGPT(GPT-3.5)但知识背景完全属于历史的“时间机器”。 目前,Talkie-1930 已开放演示,供研究者探讨在没有现代互联网干预下,人工智能将如何理解世界。 talkie-lm.com Introducing talkie: a 13B vintage language model from 1930 talkie-lm.com talkie: an LM from 1930 huggingface.co talkie-13b - a talkie-lm Collection talkie-1930-13b is a vintage language model trained on pre-1931 English-language text. See https://github.com/talkie-lm/talkie to run talkie. 3 个帖子 - 3 位参与者 阅读完整话题