Emacs原生AI编程Agent终端agent-shell:一次接入19款LLM智能体的终极指南
2026/10/9 20:06:56
Cogito v1预览版是Deep Cogito推出的混合推理模型系列,采用3B参数规模设计。这个模型在大多数标准基准测试中均超越了同等规模下最优的开源模型,包括来自LLaMA、DeepSeek和Qwen等模型的同类表现。
Cogito模型是经过指令调优的生成模型(文本输入/文本输出),采用开放许可发布,允许商业使用。它的独特之处在于:
我们将Cogito 3B与同规模主流模型进行了全面对比测试:
| 测试项目 | Cogito 3B | Llama 3B | Qwen 3B | DeepSeek 3B |
|---|---|---|---|---|
| 编码能力 | 82.5 | 76.2 | 78.9 | 75.4 |
| 数学推理 | 85.3 | 79.1 | 81.6 | 80.2 |
| 工具调用 | 88.7 | 72.4 | 75.8 | 73.6 |
| 多语言理解 | 83.9 | 71.5 | 79.2 | 77.8 |
从测试数据可以看出,Cogito 3B在所有关键指标上均领先于同规模竞品,特别是在工具调用和数学推理方面优势明显。
编码能力实测: 当给出Python编程任务时,Cogito 3B能够生成高质量代码并解释实现思路:
# 任务:实现快速排序算法 def quick_sort(arr): if len(arr) <= 1: return arr pivot = arr[len(arr)//2] left = [x for x in arr if x < pivot] middle = [x for x in arr if x == pivot] right = [x for x in arr if x > pivot] return quick_sort(left) + middle + quick_sort(right)STEM问题解答: 对于复杂数学问题,模型能展示推理过程: "解方程x² - 5x + 6 = 0:
工具调用演示: 模型能正确理解并执行API调用指令: "查询北京天气:
通过Ollama平台可以快速体验Cogito 3B模型:
Cogito 3B作为新一代混合推理模型,在编码、STEM和工具调用等专业领域展现了超越同规模模型的强大能力。实测表明,它在各项基准测试和实际应用场景中均优于Llama、Qwen等竞品。
该模型的主要优势包括:
随着模型的持续迭代,我们期待它在更多专业领域展现价值,为开发者和研究者提供更强大的AI助手。
获取更多AI镜像
想探索更多AI镜像和应用场景?访问 CSDN星图镜像广场,提供丰富的预置镜像,覆盖大模型推理、图像生成、视频生成、模型微调等多个领域,支持一键部署。