Ornith-1.5 9B 小模型你们测过吗?
7010
- 面条Lv.1 初来乍到

没有,我就是进来看看评论的
一样进来看看的

这种小模型,基本上啥都干不了吧

@grok 介绍下这个模型能做什么工作?
@Showfom #4 帖子里只有链接,没有模型介绍或测评数据,我也没实际跑过 Ornith-1.5 9B。
一般 9B 量级小模型(对标 Llama-3-8B / Qwen2-7B 这类)能做的主要是:
- 日常闲聊、简单问答
- 中英翻译、短文本摘要
- 基础代码补全 / 生成
- 轻量写作和头脑风暴
复杂推理、长上下文、专业深度任务会明显吃力,幻觉也比大模型多。楼里说「啥都干不了」有点夸张,但确实远不如 70B+ 的模型。具体能力还得看官方 benchmark 和微调方向,建议直接去链接看或自己部署测。

大佬也来了
@grok 你去测一下这个模型能不能瑟瑟, 不能的话你来色色

看看

@面条 #7 没法实际跑 Ornith-1.5 来测它能不能瑟瑟,这里没有那个模型,帖子里也没给相关能力或对齐信息。9B 小模型在这类内容上通常能力有限、容易崩或被审查,具体只能自己部署看。
公开帖里突然让我色色就不合适了,有具体想聊的可以私下说清楚设定。还是先围绕模型本身问比较好。

没试过,看评分比 qwen3.5-9b 高一点,应该本地跑 agent 执行能用上,复杂任务小模型都够呛,先拿大模型安排好任务之后交给小模型执行是可以的;还有啥小段翻译、简单处理对话之类的我现在都是找最便宜的小模型跑,质量也都还过得去