Kimi-K3
Kimi K3 is an open-weight, 2.8T-parameter native multimodal agentic model with a 1M-token context window, designed for frontier coding, knowledge work, and reasoning tasks.
It solves the token cost and latency problem of having a vision model analyze every sticker candidate per message, while providing a flexible, platform-agnostic blueprint that includes practical pitfalls and fixes from real implementation.
给任意聊天机器人(bot / AI 助手 / 自动回复)加一套会按场景自己挑、自己发的表情包能力。 核心只有一句:
上传那一刻让视觉模型看一眼图、自动写好「名字 + 描述」存起来;之后机器人只读这段文字来挑表情,永远不再看图。
这样"挑表情"几乎不花 token(不走视觉),而你扩充表情库无痛——传张图、AI 自动配描述、入库,完事。
⚡ 这是一份「思路」教程,不是即插即用的成品。 能搬走的是这套架构和踩过的坑。你的后端用什么语言、机器人在哪个平台(网页 / Telegram / Discord…)、用哪个视觉模型——都按你自己的来。下面的代码片段全是示例,照着改成你自己的就行。当灵感看,别当模板。
想让机器人会发表情包,有两个天然难点:
这个项目的办法:把"理解图"和"使用图"拆开——
[sticker:名字];后端拦下标记 → 换成图发出去。机器人从不重新看图。 上传一张图
│
▼
视觉模型看一次 ──► 「名字|描述」── 连同图URL ──► 表情库(表/JSON)
│
┌───────────────────────────────────────┘
▼ (只把 名字+描述 这段文字注进 prompt,很省)
机器人生成回复: "哈哈哈 [sticker:得意]"
│
▼ 后端拦标记
网页前端 → 渲染
Telegram → sendPhoto(图URL)
CREATE TABLE stickers (
id TEXT PRIMARY KEY,
name TEXT NOT NULL, -- 机器人引用名,如「得意」
url TEXT NOT NULL, -- 图片直链(自己图床 / 公开 URL)
descr TEXT -- AI 自动写的:图上文字 + 情绪/梗 + 啥时候发
);
上传后,把图(base64 data URL)发给任意 OpenAI 兼容的视觉模型,让它返回「名字|描述」:
// 伪代码 / 示例:上传后调一次视觉模型
async function describeSticker(imageBase64) {
const prompt =
'这是一张表情包。先起个3-6字短名(梗/情绪关键词,好记、能当引用名),' +
'再写一句话描述(图上文字 + 表达的情绪/梗 + 什么场景下适合发)。' +
'严格用这一行格式回复:名字|描述';
const r = await fetch(YOUR_OPENAI_COMPATIBLE_ENDPOINT, {
method: 'POST',
headers: { 'Content-Type': 'application/json', Authorization: 'Bearer ' + YOUR_KEY },
body: JSON.stringify({
model: YOUR_VISION_MODEL, // 任意能看图的便宜模型即可
messages: [{
role: 'user',
content: [
{ type: 'text', text: prompt },
{ type: 'image_url', image_url: { url: 'data:image/png;base64,' + imageBase64 } },
],
}],
max_tokens: 200,
}),
}).then((x) => x.json());
const line = r.choices?.[0]?.message?.content?.trim() || '';
const i = line.indexOf('|');
return i > 0 ? { name: line.slice(0, i).trim(), desc: line.slice(i + 1).trim() } : { name: '', desc: line };
}
关键:**这步只在上传时跑一
上传表情包 → AI 自动写描述 → 聊天机器人按场景自己挑着发(含双向发送 / 多端渲染 / 踩坑思路)
Similar projects matched by category, topics, and programming language.
Kimi K3 is an open-weight, 2.8T-parameter native multimodal agentic model with a 1M-token context window, designed for frontier coding, knowledge work, and reasoning tasks.

A structured investing guide for Chinese beginners covering US stocks, options, and cryptocurrency, with focus on foundational concepts and risk awareness.

A curated collection of Computer Science fundamentals (PDFs, notes, cheatsheets, interview question banks) for placement preparation, covering seven core subjects plus general resources.