Skip to main content

RC1 02 Native 评估图设计

目标

重新生成 img/rc1-highlights-v2/02-native-eval.png,用一张纯白、3:4 纵向信息图说明 Native 从 Classic 到 Beta16、RC1 的稳定性演进,同时展示用户关心的 Token 与模型耗时变化。 图片面向产品发布传播。信息层级以数字为主,使用专业、直接的产品化语句,不使用反问句或先否定再解释的句式。

核心信息

主视觉固定为:
  • 约 100 行 Native Skill
  • 承载复杂长程工作流
当前中文 comet-native/SKILL.md 共 112 行,其中 93 行为非空内容,因此使用“约 100 行”作为准确且易读的产品口径。 稳定性使用三代历史评测数据: 效率数据分开标注比较范围:
  • Native vs Classic:总 Token −76.8%,模型耗时 −47.4%
  • RC1 vs Beta16:平均模型耗时 −22.3%
RC1 对 Beta16 的总 Token 增加 19.9%,图片不将其表述为 Token 降低。Classic 与 Native 的 Token、耗时数据来自历史配对成功样本;RC1 与 Beta16 的耗时来自独立版本评测。两种比较必须使用各自标签,避免形成同一实验的三代因果递进含义。 底部实验口径固定为: 16 个真实任务 · 每个任务运行 3 次

视觉结构

画布为严格 3:4 纵向比例,纯白 #FFFFFF 背景。 从上到下分为四个层级:
  1. 左上角使用仓库现有 Comet 图标,保持原始比例,不重绘标志。
  2. 中上部以“约 100 行”为最大数字,Native Skill 和“承载复杂长程工作流”作为紧邻说明。
  3. 中部使用抽象递增阶梯、色块或同心轨迹呈现 Classic、Beta16、RC1 三代稳定性。数字比装饰元素更醒目,不使用密集 Dashboard 卡片。
  4. 下部使用两组扁平数据对比:总 Token −76.8% / 模型耗时 −47.4% 标注 Native vs Classic平均模型耗时 −22.3% 标注 RC1 vs Beta16。底边放置实验规模说明。
抽象元素只承担方向和层级表达。画面不使用时间线折线、透视设备、立体玻璃卡片或大面积渐变。

字体与颜色

  • 中文使用正常宽高比的现代无衬线字体,所有文字保持横向基线和自然字面比例。
  • 禁止任何纵向拉伸、非等比缩放或狭长字形。
  • 主文字使用深墨黑;RC1 重点数字使用克制的 Comet 青蓝;Classic 与 Beta16 使用浅灰和中灰蓝建立层级。
  • 背景、四角与所有视觉留白必须为精确的 #FFFFFF,不使用米色、暖灰或近白色底。
  • 字号建立明确层级,主数字醒目但不占满页面,保留均衡留白。

文案限制

  • 只使用本设计列出的指标与产品语句。
  • 不添加“领先行业”“全面提升”等未被评测支持的结论。
  • 不把 RC1 对 Beta16 的 Token 写成降低。
  • 不使用“不是……而是……”“而不是”或反问句。
  • 不使用难以核验的额外百分比、任务数、版本数或性能承诺。

验收标准

  1. 输出文件覆盖 img/rc1-highlights-v2/02-native-eval.png
  2. 图片为 PNG,宽高比严格等于 3:4;任何尺寸适配通过等比缩放与纯白留边完成。
  3. 背景和四角像素为 #FFFFFF,肉眼无米色或暖灰底。
  4. 所有中文、数字和英文缩写清晰,无错字、乱码、重复字符和纵向拉伸。
  5. 三代稳定性数字、两组效率比较标签和实验规模说明与本设计完全一致。
  6. 画面以大数字和抽象对比为主,元素数量克制,阅读顺序清晰。
  7. 提交前查看最终图片,并检查尺寸、边界像素、文案和 Git diff;只提交本次设计与 02 图片相关文件。
最后修改于 2026年8月31日