Ornith-1.0是什么
Ornith-1.0 是 DeepReinforce 团队推出的专为 Agentic 编程任务设计的开源大模型系列,模型基于 Gemma 4 与 Qwen 3.5 预训练基座,采用自改进训练框架,在代码生成与软件工程基准上达到同级别开源模型的 SOTA 水平。
Ornith-1.0的主要功能
- 全规格覆盖:提供 9B Dense、31B Dense、35B MoE、397B MoE 四种规格,满足从边缘设备到旗舰级服务器的全场景部署需求。
- Agentic 编程:专为智能体编程任务优化,支持复杂软件工程问题的自动化解决,如代码修复、功能实现与终端命令执行。
- 自改进脚手架生成:模型能够自主生成任务特定的脚手架(harness),引导并优化解决方案的搜索路径。
- 本地部署兼容:已上架 HuggingFace,提供兼容 OpenAI API 的接口及多种本地部署方案。
Ornith-1.0的技术原理
- 基座模型:基于 Gemma 4 和 Qwen 3.5 的预训练权重进行后训练,继承其语言理解与代码生成能力。
- 自改进训练框架:区别于传统 RL 依赖人工设计脚手架,Ornith-1.0 通过强化学习让模型联合生成解决方案 rollout 与任务特定 harness,实现脚手架与最终解的协同优化。
- 联合优化机制:在训练过程中同时优化任务脚手架和生成结果,使模型能够自主发现更优的搜索轨迹,持续提升输出质量。
如何使用Ornith-1.0
- 获取模型:访问 HuggingFace 平台搜索 Ornith-1.0 系列,下载对应规格的模型权重。
- 本地部署:根据硬件配置选择 9B(边缘设备)、31B/35B或 397B版本。
- 接口调用:用兼容 OpenAI API 的接口集成到现有开发工作流或 Agent 框架中。
- 任务配置:针对 Agentic coding 场景,将模型接入 IDE 插件或自动化软件工程流水线。
nOrnith-1.0的核心优势
- 同级 SOTA:397B 旗舰版在 Terminal-Bench 2.1取得77.5 分和 SWE-Bench Verified取得82.4 分超越 Claude Opus 4.7。
- 越级性能:35B MoE 版本在 Terminal-Bench 2.1 上以 64.4 分超越 397B 参数的 Qwen 3.5-397B取得53.5 分,实现以小博大。
- 边缘友好:9B 模型可在低资源环境部署,性能匹敌 Gemma 4-31B 与 Qwen 3.6 35B。
Ornith-1.0的项目地址
- 项目官网:http s://deep-reinforce.com/ornith_1_0.html
- HuggingFace模型库:http s://huggingface.co/collections/deepreinforce-ai/ornith-10
Ornith-1.0的应用场景
- 智能体编程助手:作为 AI 程序员的核心引擎,自动化处理 GitHub Issue 修复、代码审查与功能开发。
- 终端命令智能体:基于 Terminal-Bench 优化能力,执行复杂的服务器运维、数据分析与自动化脚本任务。
- 边缘设备代码辅助:9B 版本可集成至本地 IDE 插件或离线开发环境,为资源受限场景提供实时代码补全。
- 企业级软件工程:397B 旗舰版可用于大型代码库维护、跨文件重构与复杂软件架构设计。