大模型能做什么
大语言模型(如GPT系列/文心一言/通义千问/DeepSeek等)的核心能力:文本理解和生成(翻译/摘要/改写/扩写/问答)、逻辑推理和计算(数学题/代码生成/数据分析)、多轮对话和上下文理解(记住之前的对话内容进行连贯交流)、工具调用(通过API连接外部工具/数据库/搜索引擎)。
这些能力组合起来可以构建非常有价值的应用:智能客服/文案助手/代码助手/知识问答/数据分析助手/内容审核/个性化推荐等。
主流大模型API对比
GPT-4o(OpenAI):综合能力最强,但国内访问需要特殊网络,价格较高(约¥0.15/千token)。文心一言4.0(百度):中文能力强,国内访问方便,价格适中(约¥0.04/千token)。通义千问(阿里):中文能力强,与阿里生态集成好,有免费额度。DeepSeek-V3(国产):性价比极高(约¥0.001/千token),中文能力不错。GLM-4(智谱AI):国产优秀模型,有免费额度,适合开发测试。
对{CITY}的开发者来说,建议先用DeepSeek或GLM的免费额度做开发和测试,上线后再根据实际需求选择合适的商用模型。
开发入门:第一个大模型应用
环境准备:Python 3.8+、安装openai兼容的SDK(pip install openai)。获取API Key:在对应平台的开发者控制台创建。编写代码(示例):
from openai import OpenAI client = OpenAI(api_key="your-key", base_url="https://api.deepseek.com") response = client.chat.completions.create(model="deepseek-chat", messages=[{"role":"user","content":"你好"}]) print(response.choices[0].message.content)
就这么简单。当然实际应用中还需要做更多事情:Prompt工程(设计好的提示词让模型输出符合预期的结果)、上下文管理(控制对话长度和成本)、安全性过滤(防止输出有害内容)、缓存和限流(控制API调用成本)。
Prompt工程技巧
写好提示词是大模型应用成功的关键。几个实用技巧:
明确角色设定:"你是一个有10年经验的{CITY}本地生活顾问..."(让模型知道它应该以什么身份回答)。提供示例:"请按照以下格式输出:[示例1]... [示例2]..."(Few-shot learning,给几个例子模型就能学会格式)。分解复杂任务:把一个大任务拆分成多个步骤,每步单独调用模型(比一次性让模型做所有事情效果好得多)。设置输出约束:"请用JSON格式输出,包含以下字段..."/"回答控制在200字以内"
成本控制
大模型API是按token计费的(token≈1.5个汉字或0.75个英文单词)。控制成本的常用方法:缓存常见问题的回答(相同问题不重复调用API)、限制上下文长度(只传必要的信息,不要把整篇文章丢进去)、使用较小的模型(简单任务用便宜的模型如GPT-3.5-turbo/DeepSeek)、批量处理(合并多个请求减少API调用次数)。
我们在{CITY}的一个项目中,通过合理的缓存和模型选择策略,将每月的API成本从预估的8000元降到了实际的1200元。