Youtu-Tip 是什么
Youtu-Tip 是腾讯优图实验室推出的一款端侧 AI 桌面助手。与依赖云端的 AI 助手不同,Youtu-Tip 将大语言模型部署在用户本地设备上,通过热键全局唤起,无需联网即可完成文本理解、文件分析和桌面自动化等任务。
产品定位为"主动式端侧 AI 助手",强调隐私保护和离线可用。目前只提供 macOS 版本,支持 Apple Silicon(M 系列芯片)设备。项目代码已在 GitHub 上开源。
核心特色
Youtu-Tip 有四个主要特色值得关注:
第一,端侧模型与隐私保护。Youtu-Tip 内置自研的 Youtu-LLM 模型(1.96B 参数),完全在本地运行。用户的所有数据——无论是选中的文本、打开的文件还是浏览的网页内容——都只在本地处理,不会上传到云端。这对处理敏感工作文档的用户来说是一个有价值的特性。
第二,技能学习机制。除了基础的问答和文本处理能力外,Youtu-Tip 支持"技能"功能——用户可以教 AI 学习特定的桌面操作流程,实现个性化的自动化工作。例如可以教它按照固定步骤整理文件、格式化文档等。
第三,多模态理解。Youtu-Tip 不仅能处理文本,还可以阅读本地文件和理解网页内容。配合模拟键鼠操作和 MCP 服务器接入,可充当一个在本地运行的多功能 AI 智能体。
第四,开源框架支撑。底层使用开源框架 Youtu-Agent,支持自动化智能体生成和无训练的持续进化(Training-Free GRPO)。开发者和深度用户可以在 GitHub 上获取完整代码进行二次开发。
技术底层的模型能力
Youtu-Tip 搭载的 Youtu-LLM 模型虽然只有 1.96B 参数,但研发团队在 STEM 和智能体任务上做了专门优化。根据官方公布的基准测试数据,该模型在 GSM8K(数学推理)上达到 77.6%、MBPP+(代码生成)上达到 81.8%,在 SWE-Bench-Verified(软件工程智能体)上达到 17.7%,多项指标超过了同级别的 Qwen3-1.7B 和更大规模的 SmoLM3-3B 等模型。
此外,优图还发布了配套的 Youtu-VL 4B 视觉语言模型,支持视觉定位、语义分割、深度估计和对象计数等视觉任务。该视觉模型同样在多项基准上与同级别模型相比表现具有竞争力。
适用人群与注意事项
Youtu-Tip 适合以下用户:注重数据隐私、希望在本地处理敏感文档的职场人士;macOS 用户希望获得类似 Spotlight 但更智能的全局 AI 助手;开发者对端侧模型部署和智能体框架感兴趣,希望二次开发;STEM 领域学生和研究者需要离线的代码和数学辅助工具。
需要注意的限制:目前仅支持 macOS(Apple Silicon M 系列),Windows 和 Intel Mac 用户暂无法使用;1.96B 参数的小模型在复杂知识问答和长文本生成方面的能力与大模型存在差距;部分高级功能(如 MCP 接入)可能需要一定的技术配置。