惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

G
Google Developers Blog
博客园 - 司徒正美
Last Week in AI
Last Week in AI
Recent Announcements
Recent Announcements
Y
Y Combinator Blog
博客园 - 聂微东
M
MIT News - Artificial intelligence
博客园_首页
Jina AI
Jina AI
博客园 - 叶小钗
酷 壳 – CoolShell
酷 壳 – CoolShell
H
Hackread – Cybersecurity News, Data Breaches, AI and More
J
Java Code Geeks
F
Fortinet All Blogs
aimingoo的专栏
aimingoo的专栏
小众软件
小众软件
Vercel News
Vercel News
The Cloudflare Blog
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
云风的 BLOG
云风的 BLOG
N
Netflix TechBlog - Medium
B
Blog
Google DeepMind News
Google DeepMind News
freeCodeCamp Programming Tutorials: Python, JavaScript, Git & More

V2EX - 技术

Local-first 软件收录站 从 X 上搬运来的白嫖 GPT Plus 教程 阿里云百炼 Coding Plan Pro 套餐 新增当日 token 限制 大家的 Claude 弹了 kyc 嘛 现在 Google 的 Gemini 和 AI 模式降智的厉害啊 用的 TAG 家的 T, ip 跳变是否影响使用 claude 同一 apple 账户能给不同 claude 账号充值么 做了个 Go 的 MCP Server 框架,一行代码把 Gin API 接入 AI 请教各位,想回归技术,如何系统学习 Agent? OpenAI GPT-IMAGE-2 提示词合集 你是说, claude opus4.6 写代码的能力不如 gpt5.4? 关于智谱 Max 套餐要不要升级续费呢? App → CLI → App ? Github 账号被 404 了,现在没法恢复,求各位大佬指点 cursor 的次数套餐以后应该都用不了新模型了 openrouter 使用国外模型 买了咸鱼低价 Gemini pro,账号差点被盗。突然发现国内诈骗成本为零 Gemini 手机版客户端登陆总是在此国家/地区无法使用 gemini 感觉 gpt 这些低价渠道要爆了 claude code 和 codex 在 vibe coding 还有质的区别吗? 阿里 Coding Plan 一天三变, Lite 版本到期不能续费了 RAG 难以让人满意啊 2026 年了,这个世界还存在互联网精神🥹 两个账号阵亡,尼区 Claude Pro 订阅 分享下最近低价 GPT Codex 的来源(源头) OpenAI 发布 Codex 重大更新:支持自动操作电脑与长期任务自动化 使用 claude 从 0 开始开发一个校友会系统可行吗 同一个 appleid 可以给不同 chatGPT 账号订阅 plus 吗? 自动驾驶项目开发建议 终于, 降智几天之后, opus4.7 出来了
第一次见这么细致的笔前端笔试题...
yusf · 2026-04-19 · via V2EX - 技术

在 v2 上一个帖子看到了一个远程招聘的帖子,邮件后和老板聊了几个小时感觉还不错,然后的话,给我出了个笔试题目(如下):
请在 3- 5 个工作日(最长不可超过 7 个工作日的时间内),设计并实现一个可以在 Mac 和 Windows 两
个系统上都能运行的,能够完成实时对话翻译应用的 Demo ,用于解决需要大量文本录入和文本翻译的
需求。
目标用户为重度写作用户,使用场景为在桌面端每天需要写作 3000 字以上,可通过语音录入文字,并
可以将文字翻译为指定的语言
具体需求:
应用启动后自动进入文字/语音输入界面
可通过键盘和语音两种方式输入文字
可自动识别输入的文字和语音为何种语音,无需用户自己设置和切换
支持按钮启动语音识别,也可支持 Ctrl/Cmd + Tab 快捷键启动语音识别
默认不启动翻译,需用户手动启动,将输入的文字自动翻译为指定的语言文字
可切换多种翻译的目标语言,需支持中文、英文、日文、韩文、法文、德文、俄
文、西班牙文,意大利文等 9 种语言
对话界面交互友好,信息清晰直观
能显著区分原文和译文,译文应方便识别、阅读和复制
输入文字的界面可借鉴对话聊天界面,即非只能查看当前输入信息,应能够查看
历史内容
点击某个历史内容,可以重新翻译为另外的一种语言,并不新增记录,只对历史
内容的翻译做更新即可
语音识别模型和翻译模型都需要使用本地模型,即能够无网络使用,以确保信息
安全
语音识别模型和翻译模型可以通过下载的方式按需加载(比如通过 HuggingFace ,
需要法文翻译,才需要下载法文模型),而非打包在安装包中
能够在 Mac 和 Windows 两个系统上运行,可完成至少三次以上的内容输入和自动
翻译
可使用 AI 辅助完成此项任务,包括但不限于界面设计、技术选型、架构设计、代
码实现、以及测试
交付:
提交 Github 仓库链接( Clone 后可以编译运行)
技术选型说明:为使该 Demo 达到最佳体验的技术选型,均可阐述。包括但不限
于所选语音识别模型和翻译模型的原因,所选跨平台开发框架的原因等
架构设计说明:
AI 使用方法与总结:
介绍完成此任务的过程中,在哪些环节使用了 AI ,分别使用了哪些 AI 工具
和 Agent
回顾此工作,哪些环节还可以改进使用 AI 的效率和质量
加分项
流式语音输入和流式翻译。 即给用户营造实时输入和实时翻译的体验,无需等待
数秒之后才出现内容
性能分析:对 Demo 的内存、CPU 、GPU 等性能进行分析,给出以后需要优化之

阐述个人的软件设计哲学