商汤日日新 SenseNova 6.8 Flash Lite 使用教程:API 调用、多模态与工具调用详解
SenseNova 6.8 Flash Lite 模型使用教程:纯文本对话、图像输入、Function Calling、流式响应的完整调用方法
关键词
SenseNova、SenseNova 6.8 Flash Lite、商汤日日新、sensenova-6.8-flash-lite、多模态模型 API、Function Calling 教程、SSE 流式响应、SenseNova API 调用
摘要
SenseNova 6.8 Flash Lite 是商汤日日新推出的轻量高效多模态智能体模型,通过 OpenAI 兼容的 Chat Completions 接口调用。这篇文章介绍它的完整使用方法,包括 API Key 申请、纯文本对话、图像输入多模态理解、工具调用(Function Calling)、流式响应(SSE)、请求参数与响应结构,以及 Flash-Lite 专属积分规则。
大家好 这里是「代码简单说」,这篇文章主要分享一下商汤日日新 SenseNova 6.8 Flash Lite 模型的使用方法。
SenseNova 6.8 Flash Lite 的 model ID 是sensenova-6.8-flash-lite,接口完全兼容 OpenAI Chat Completions 协议,用现成的 OpenAI SDK 或 curl 就能直接调用。这篇文章适合需要在项目里接入多模态对话、数据分析 Agent 或工具调用能力的开发者。看完之后你可以完成:申请 API Key、跑通纯文本对话、传入图片做多模态理解、实现 Function Calling 完整闭环、开启 SSE 流式响应。
一、SenseNova 6.8 Flash Lite 是什么
SenseNova 6.8 Flash Lite 是日日新轻量高效的多模态智能体模型,面向真实复杂任务,适配数据分析和复杂信息呈现场景。它的主要特点:
- 重点提升多模态 Agent 场景能力,更加高效且稳定执行端到端任务
- 复杂数据分析能力显著增强,能够高效执行规划、推理、工具调用与结果验证
- 通过主/次 Agent 协作并结合原生多模态能力,实现准确、美观、可编辑的演示交付物
版本兼容说明:根据官方文档,从即日起至 8 月 31 日,系统开启了兼容路由。使用旧版sensenova-6.7-flash-lite调用接口时,请求会自动重定向至sensenova-6.8-flash-lite。也就是说,如果代码里还在用 6.7 的 model ID,短期内请求不会失败,但建议尽早把 model ID 统一改成sensenova-6.8-flash-lite,避免兼容路由关闭后接口报错。
model ID:sensenova-6.8-flash-lite
二、准备工作
调用 SenseNova API 前需要准备:
- 一个 SenseNova 账号
- 一个有效的 API Key
- curl(Windows 10 以上系统自带,也可在 Git Bash 中执行),或任意支持 OpenAI 协议的 SDK
| 项目 | 地址 |
|---|---|
| API Key 申请(控制台) | https://platform.sensenova.cn/console/keys |
| Base URL | https://token.sensenova.cn/v1 |
API Key 建议为不同应用/环境创建独立的 Key,方便独立监控与轮换,密钥可在控制台随时注销。
三、鉴权与请求地址
所有 API 请求必须在 HTTP Header 中携带 Bearer Token:
Authorization: Bearer $SENSENOVA_API_KEY请求地址:
POST https://token.sensenova.cn/v1/chat/completions如果使用 OpenAI SDK,base_url设置为https://token.sensenova.cn/v1即可。
四、SenseNova 6.8 Flash Lite 使用方法
1. 纯文本对话
最基础的调用,把 API Key 替换成自己的密钥后可直接执行:
curlhttps://token.sensenova.cn/v1/chat/completions\-H"Authorization: Bearer$SENSENOVA_API_KEY"\-H"Content-Type: application/json"\-d'{ "model": "sensenova-6.8-flash-lite", "messages": [ { "role": "system", "content": "你是一个有用的助手。" }, { "role": "user", "content": "介绍一下商汤科技。" } ], "stream": false }'2. 图像输入(多模态理解)
SenseNova 6.8 Flash Lite 支持通过image_url类型的 content 块传入图片。用户消息的content可以是字符串,也可以是内容块数组:
curlhttps://token.sensenova.cn/v1/chat/completions\-H"Authorization: Bearer$SENSENOVA_API_KEY"\-H"Content-Type: application/json"\-d'{ "model": "sensenova-6.8-flash-lite", "messages": [ { "content": "你是一个说话客观公正的小助手", "role": "system" }, { "role": "user", "content": [ { "type": "text", "text": "图片里面有什么" }, { "type": "image_url", "image_url": { "url": "https://www.sensenova.cn/images/logo.png" } } ] } ], "n": 1, "stream": false, "max_tokens": 1000, "reasoning_effort": "none" }'图像输入的核心结构就是image_url类型的内容块:
{"type":"image_url","image_url":{"url":"https://www.sensenova.cn/images/logo.png"}}3. 工具调用(Function Calling)
通过tools字段声明可用函数,模型会在需要时以tool_calls的形式返回调用请求。工具执行后,以role="tool"的消息把结果回传,再次请求即可获得最终答复。整个流程分三步。
第一步:声明工具并发起请求
{"model":"sensenova-6.8-flash-lite","messages":[{"role":"user","content":"今天上海天气怎么样?"}],"tools":[{"type":"function","function":{"name":"get_weather","description":"Get current weather of a city","parameters":{"type":"object","properties":{"city":{"type":"string"}},"required":["city"]}}}],"tool_choice":"auto"}第二步:解析模型返回的 tool_calls
模型决定调用工具时,finish_reason为tool_calls:
{"choices":[{"message":{"role":"assistant","content":null,"tool_calls":[{"index":0,"id":"call_abc123","type":"function","function":{"name":"get_weather","arguments":"{\"city\": \"上海\"}"}}]},"finish_reason":"tool_calls"}]}第三步:回传工具结果,获取最终答复
{"model":"sensenova-6.8-flash-lite","messages":[{"role":"user","content":"今天上海天气怎么样?"},{"role":"assistant","tool_calls":[{"id":"call_abc123","type":"function","function":{"name":"get_weather","arguments":"{\"city\": \"上海\"}"}}]},{"role":"tool","tool_call_id":"call_abc123","content":"{\"temp\": 22, \"desc\": \"多云\"}"}]}4. 流式响应(SSE)
设置stream: true后,响应 Content-Type 为text/event-stream,每行以data: {json}推送一个 chunk,最后以data: [DONE]结束:
data: {"id":"chatcmpl-...","object":"chat.completion.chunk","created":1713167890,"model":"sensenova-6.8-flash-lite","choices":[{"index":0,"delta":{"role":"assistant","content":""},"finish_reason":null}]} data: {"id":"chatcmpl-...","object":"chat.completion.chunk","choices":[{"index":0,"delta":{"content":"Hello"},"finish_reason":null}]} data: {"id":"chatcmpl-...","object":"chat.completion.chunk","choices":[{"index":0,"delta":{"content":"! How can I help?"},"finish_reason":null}]} data: {"id":"chatcmpl-...","object":"chat.completion.chunk","choices":[{"index":0,"delta":{},"finish_reason":"stop"}],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20}} data: [DONE]注意usage仅在stream_options.include_usage=true时在最后一个 chunk 中返回。
五、请求参数与响应结构
请求参数表
| 字段 | 类型 | 必填 | 默认值 | 说明 |
|---|---|---|---|---|
model | string | ✅ | — | 固定为sensenova-6.8-flash-lite |
messages | array | ✅ | — | 对话消息列表,role ∈ {system, user, assistant, tool};content 可为字符串或内容块数组(图像输入时使用) |
stream | boolean | — | false | 是否以 SSE 流式返回 |
stream_options | object | — | {"include_usage": true} | 仅stream=true生效,含include_usage(boolean) |
temperature | float | — | 0.6 | 采样温度,建议 [0, 2] |
top_p | float | — | 0.95 | 核采样,范围 (0, 1] |
max_tokens | integer | — | 65535 | 最大生成 token 数,范围 [1, 65536] |
n | integer | — | 1 | 生成回复数量,范围 1–7 |
stop | string | array | — | — | 停止序列 |
frequency_penalty | float | — | 0 | 频率惩罚,[0,2] |
presence_penalty | float | — | 0 | 存在惩罚,[0,2] |
reasoning_effort | string | — | "medium" | 推理力度,可选low/medium/high/none |
tools | array | — | — | 可用工具列表 |
tool_choice | string | object | — | "auto" | 工具选择策略:auto/none/required或指定工具 |
parallel_tool_calls | boolean | — | true | 是否允许并行调用多个工具 |
seed | integer | — | — | 随机种子(Beta),范围 [0,9999999] |
响应结构
{"id":"chatcmpl-8aBcD...","object":"chat.completion","created":1713167890,"model":"sensenova-6.8-flash-lite","choices":[{"index":0,"message":{"role":"assistant","content":"商汤科技是一家领先的人工智能公司..."},"finish_reason":"stop"}],"usage":{"prompt_tokens":12,"completion_tokens":8,"total_tokens":20,"prompt_tokens_details":{"cached_tokens":0}}}finish_reason 枚举
| value | 含义 |
|---|---|
stop | 正常结束 |
length | 达到 max_tokens 或上下文上限 |
tool_calls | 模型选择调用工具 |
content_filter | 内容被合规审核拦截 |
六、Flash-Lite 专属积分规则
根据官方公告,TokenPlan 于 2026 年 8 月 28 日启用新的积分规则,账户内有两类积分:
- 通用积分:所有已开放模型统一使用的积分
- Flash-Lite 专属积分:仅用于 Flash-Lite 系列模型
使用 Flash-Lite 时,系统优先扣除专属积分;专属积分不足后,再扣除通用积分。使用其他模型时只扣除通用积分。公测期间,通用积分池和 Flash-Lite 专属积分池分别提供 60,000 积分的滚动 5 小时额度和 600,000 积分的滚动周额度。
同时开启了 Flash-Lite 消费返赠活动:活动期间,每实际消耗 1 积分 Flash-Lite 专属积分,返赠 1 通用积分。返赠按自然日汇总、按每小时结算到账,每笔返赠积分自到账之日起 30 天有效。从通用积分池扣除的部分不参与返赠。具体余额、用量和扣减记录可以在账户页面查看。
七、常见问题
1. 还在用 sensenova-6.7-flash-lite 会报错吗?
在官方文档标注的兼容期内(即日起至 8 月 31 日),使用sensenova-6.7-flash-lite的请求会自动重定向到sensenova-6.8-flash-lite,不会失败。但兼容路由有明确截止日期,建议尽早统一改为新 model ID。
2. 请求返回 404 或模型不存在怎么办?
检查 model ID 是否拼写正确,正确值为sensenova-6.8-flash-lite。模型 ID 不存在或已下线会返回not_found_error。
3. 请求返回 429 怎么办?
这是速率/额度超限(quota_exceeded_error),官方建议使用指数退避重试,也可以到账户页面确认积分余额和滚动额度使用情况。
4. 参数明明没写错却返回 400?
400 对应invalid_request_error,通常是参数缺失、超范围或格式错误,例如temperature超出 [0, 2] 范围。对照第五节的参数表检查取值范围即可。
5. 多模态请求图片应该怎么传?
用户消息content必须改成内容块数组,图片用image_url类型传入,参考第四节的完整示例。不要把 URL 直接拼在文本字符串里。
八、总结
以上就是 SenseNova 6.8 Flash Lite 的完整使用教程。它的接口兼容 OpenAI Chat Completions 协议,Base URL 为https://token.sensenova.cn/v1,model ID 为sensenova-6.8-flash-lite。按照上面的步骤操作,即可完成纯文本对话、图像输入多模态理解、Function Calling 工具调用闭环和 SSE 流式响应。如果遇到其他问题,可以结合具体报错信息和 finish_reason 进行排查。