1. 项目背景与核心价值
去年帮朋友改毕业论文时,我发现个有趣现象:90%的写作卡顿都发生在初稿阶段。那些在图书馆熬夜到凌晨的同学,往往是对着空白文档发呆三小时,最后憋出两百字废话文学。这种现象在学术写作、商业报告、新媒体文案等场景普遍存在——我们的大脑更擅长修改而非从零创造。
这个AI写作助手的开发初衷,就是要用技术手段解决"白纸恐惧症"。不同于市面上常见的模板化写作工具,我们聚焦三个核心痛点:
- 冷启动障碍(面对空白文档的焦虑)
- 思维碎片化(有想法但无法系统表达)
- 专业壁垒(跨领域写作时的知识盲区)
经过半年迭代,当前版本已实现:
- 基于思维导图的非线性写作流程
- 实时学术资料检索与整合
- 多维度风格调节(从学术严谨到新媒体网感)
- 深度改写而非简单拼贴的生成逻辑
需要模型API调用? 免费领10W Token,多模型网关一键接入 Claude、DeepSeek 等主流模型。
2. 系统架构设计
2.1 核心模块组成
整个系统采用微服务架构,主要包含四个核心组件:
mermaid复制graph TD
A[前端交互层] --> B[写作引擎]
A --> C[知识图谱]
B --> D[LLM接口]
C --> D
(注:实际开发中使用的是更详细的Spring Cloud架构,此处简化示意)
2.1.1 交互层设计
采用Electron+React实现跨平台客户端,重点优化了两个特殊交互:
- 思维导图与线性文档的双向转换
- 实时协作时的冲突解决算法(使用OT算法)
2.1.2 知识图谱构建
针对不同领域构建了垂直知识库:
- 学术论文:集成CiteSeerX、Semantic Scholar数据
- 商业写作:爬取头部咨询公司报告库
- 新媒体:分析10w+爆文结构特征
2.2 关键技术选型
2.2.1 大模型适配层
测试了主流开源模型后,最终采用混合方案:
- 基础生成:Llama3-70B(量化后部署)
- 专业润色:微调的GPT-4-turbo
- 本地轻量化:Phi-3-mini(供离线使用)
重要教训:直接使用API会导致创作过程卡顿,后来我们实现了预生成缓存机制,将响应延迟从平均3.2秒降至0.8秒
2.2.2 检索增强生成(RAG)
自研的检索系统包含三级过滤:
- 基于Elasticse
