教程中心实战
实战

用商汤 SenseNova 多模态智能体做「交付级」信息图、数据分析与 PPT

2026.07.27· 6 个步骤 · 18 分钟阅读· 🖼️ 商汤 SenseNova

大多数 AI 画图工具停在"能交互、能改",但能交互不等于能交付——你见过太多 AI 信息图:文字歪歪扭扭、数字错位、放大就糊。2026 年 7 月,商汤在 WAIC 发布新一代多模态智能体 SenseNova:它用原生多模态架构(取消"视觉转文本"中间层),能直接看懂网页、文档、图表,并一次性产出交付级的复杂图片、数据分析报告和 PPT。本教程手把手教你用它的两款模型——U1 Pro(交付级图文)和 6.7 Flash-Lite(低成本数据分析),把"做图做表做PPT"变成一句话的事。

🖼️ 本教程适合:要做汇报、写研报、出运营图的新媒体运营、分析师、产品、学生。你只需要注册商汤 SenseNova 开放平台账号(有免费额度),会基础的 API 调用或网页操作即可。

先搞懂:为什么 SenseNova 能"交付"而不是"抽卡"?

传统多模态常把图片先转成文字再处理,信息损耗大、Token 贵。SenseNova 采用原生多模态架构,直接理解像素 + 文档 + 图表,实现"看、想、做"一体。它带来四个关键能力:

能力对你意味着什么
告别 AI 味构图、配色、排版有专业设计美感,可直接交付
原生 8K 超清高信息密度长图放大不糊,经得起印刷 / 展览
图文精准控制高密度文字渲染出错率极低,数字不乱跑
长程 Agentic 闭环围绕复杂目标做数十轮生成循环,可反复改

选对模型:U1 Pro 负责"交付级图文创作"(信息图、长卷),6.7 Flash-Lite 负责"低成本深度分析与办公"(数据分析、PPT、调研)。别拿错——前者贵但美,后者便宜且快(Token 消耗较纯文本智能体直降约 60%)。

Step 1:注册并领取免费额度

1 拿到调用钥匙
1. 打开商汤 SenseNova 开放平台,注册登录
2. 进入「控制台 → API 密钥」,创建 Key
3. 领取 SenseNova Token Plan 限时免费权益
   (每 5 小时 1500 次免费调用,零成本体验)
4. 记下 API Key 与接入点地址,备用
💡 新手先用网页端控制台"对话 / 生图"试水,确认效果后再用 API 批量集成,省去调试成本。

Step 2:用 U1 Pro 生成一张交付级信息图

2 把数据直接变成好看的长图

信息图是 U1 Pro 的强项——WAIC 九周年《智会世图》东方山水长卷就是它出的。给它明确的设计指令:

提示词模板:
「请基于以下数据,生成一张 16:9 的科普信息图:
主题:2026 年 AI 智能体落地五大行业
数据:金融 32% / 医疗 21% / 制造 18% / 零售 15% / 教育 14%
风格:水墨淡彩,标题在左上,右下留 logo 位
要求:所有数字清晰可辨,配色不超过 4 种,可印刷级」

调用:模型选 U1 Pro,输出 8K,等待长程生成循环结束。

别让它自由发挥:交付级产出的关键是约束——规定画幅、配色数量、文字位置。约束越明确,抽卡次数越少,一次出片率越高。

Step 3:用 6.7 Flash-Lite 做深度数据分析

3 把 90 万行数据交给它找异常

Flash-Lite 轻量但智能体能力强,擅长"看文档 + 跑分析 + 出建议"。直接把数据或文件喂给它:

场景示例:上传一份 90 万行销售明细 CSV
指令:「分析这份数据,① 识别异常波动的品类与时段;
② 给出经营优化建议;③ 输出一页可视化摘要图。」
模型:SenseNova 6.7 Flash-Lite(原生多模态,直接读表)
结果:自动识别异常 + 文字建议 + 图表,毫秒级响应。
🚀 真实案例已验证:该模型可完成 90 万行销售数据深度分析、自主撰写 8 章节行业调研报告并生成可视化图表。高频互动场景 Token 消耗直降约 60%。

Step 4:一键产出可直接发的 PPT

4 从主题到成稿

SenseNova 配套开源的 SenseNova-Skills 办公技能套件覆盖 PPT 创作。你可以:

方式一(网页):在控制台选「PPT 创作」技能,输入主题,
自动出大纲 → 配图 → 成稿,风格统一可直接发布。

方式二(API):调用 Skills 里的 ppt 技能,
把自己的数据传入,生成适老化就诊指引 PPT 等成品。

已落地案例:为医院生成适老化就诊指引 PPT,
风格统一、内容清晰,直接满足发布需求。

免费 ≠ 无上限:Token Plan 是"每 5 小时 1500 次",高频批量任务注意节奏,别一次性打满被限流。

Step 5:把 SenseNova 接进你的 Agent 工作流

5 让主流框架一键调用

SenseNova-Skills 已在 GitHub 开源,支持 OpenClaw、Hermes Agent 等主流智能体框架,可一键部署或灵活集成:

# 以 OpenClaw / Hermes 为例
1. 拉取 SenseNova-Skills 仓库
2. 在框架的技能目录里软链或复制对应技能
3. 配置 API Key 环境变量
4. 之后说「用 SenseNova 帮我出这张图 / 这份分析」
   框架自动路由到对应模型执行
🔑 这样你就把"交付级多模态能力"变成了自己 Agent 的一个工具,而不是孤立的网页玩具——这正是从"能交互"到"能交付"的跨越。

Step 6:避坑与最佳实践

6 让交付更稳更省
· U1 Pro 出图:先定画幅/配色/文字位,再生成,少抽卡
· Flash-Lite 分析:大文件先切片,避免单次超上下文
· 免费额度按 5 小时窗口规划,批量任务错峰
· 涉及敏感数据,优先本地预处理再上传脱敏样本
· 成品务必人工终审:AI 交付 ≠ 免审核
🎉 恭喜!你已经能用一套多模态智能体,把"做图、做表、做PPT"三件最耗时的事压缩成几条指令。记住:约束越清晰,交付越惊艳。

常见问题速查

你遇到的现象大概率原因 & 解决
信息图文字歪指令没限定文字位置 / 配色,补约束重生成
被限流免费额度按 5 小时窗口,错峰或升级付费档
分析不完整文件过大,切片后分批喂给 Flash-Lite
接框架报错检查 API Key 环境变量与技能目录路径