작성 품질 업데이트: Drafters 1.1
청구항을 명세서로 전개하는 작성 공정과 OA(의견제출통지) 대응의 검토 공정을 함께 고도화했습니다.
이번 업데이트
Drafters 1.1은 긴 문장을 한 번에 생성하는 대신, 작업을 작은 문맥으로 나누고 앞 단계의 결과를 보존하며 순차적으로 보강합니다.
- 자동 명세서는 청구항을 구성·관계·흐름의 집필 계획으로 바꾼 뒤 도면별 설명을 누적합니다.
- OA 대응서는 초안을 만든 뒤 의견서를 자유형으로 검토하고, 지적된 섹션만 순서대로 보강합니다.
- 보강 단계가 실패하면 불완전한 수정본 대신 최초 생성 원문을 유지합니다.
- 전항거절과 부분거절은 서로 다른 과제로 보고 별도 작성 경로를 사용합니다.
Task Card 1 — Claim-only 명세서 작성
| 항목 | 내용 |
|---|---|
| 입력 | 발명의 명칭과 청구항 전문 |
| 출력 | 구성·도면 계획, 실시예 블록, 명세서 섹션 초안 |
| 목표 | 청구항 충실성을 유지하며 설명의 구체성과 연결 관계를 높임 |
| 비목표 | 청구항 수정, 특허성 판단, 법률 자문 또는 출원 대리 |
| 비교 | Drafters 1.0과 1.1, 외부 모델 기준선 |
명세서 작성 결과
문서량과 내용 품질을 서로 다른 축으로 평가했습니다. 내용 품질은 청구항 충실성, 구체성, 구성 연결, 비반복성과 문서 완결성을 중심으로 판독했습니다.
- Drafters 1.015,001자
- Drafters 1.128,352자
- Drafters 1.08,111자
- Drafters 1.121,322자
문서량 지표는 도면별 내용 판독과 함께 사용했습니다. 입력·처리·출력, 구성 간 매핑, 피드백, 예외 처리와 선택 실시형태가 기존 문단의 반복 없이 추가되는지를 함께 확인했습니다.
Claim-only 출력 품질 리더보드
동일한 발명 입력에서 생성된 최종 산출물을 청구항 충실성, 명세서 구조 완결성, 실시예 구체성, 구성·도면 연결성, 비반복성·가독성의 고정 5축 루브릭으로 원문 판독했습니다. 문서 길이는 품질 점수에 반영하지 않았습니다.
Drafters 1.1과 외부 비교 모델의 저장 산출물을 동일한 품질축으로 평가했습니다. 따라서 이 표는 기초 모델의 파라미터 순위가 아니라 사용자가 받는 명세서 결과물의 품질 리더보드입니다.
- Drafters 1.198점
- GPT-5.6 Sol96점
- MiMo-V2.5-Pro95점
- Grok-4.593점
- MiniMax-M393점
- Nemotron-3-Ultra92점
- GPT-5.6 Terra91점
- Kimi-K390점
- Qwen-3.7-Plus87점
- DeepSeek-V4-Pro85점
- GLM-5.284점
- Step-3.7-Flash75점
- HY-374점
- DeepSeek-V4-Flash72점
- Ling-3.0-Flash70점
- DeepSeek-V3.267점
| 제품·모델 | 청구항 충실성 25 | 구조 완결성 20 | 실시예 구체성 25 | 구성·도면 연결성 20 | 비반복·가독성 10 | 총점 |
|---|---|---|---|---|---|---|
| Drafters 1.1 | 25 | 20 | 25 | 20 | 8 | 98 |
| GPT-5.6 Sol | 25 | 20 | 22 | 20 | 9 | 96 |
| MiMo‑V2.5‑Pro | 25 | 18 | 24 | 20 | 8 | 95 |
| Grok‑4.5 | 25 | 18 | 22 | 19 | 9 | 93 |
| MiniMax‑M3 | 25 | 18 | 24 | 18 | 8 | 93 |
| Nemotron‑3‑Ultra | 25 | 17 | 25 | 17 | 8 | 92 |
| GPT-5.6 Terra | 25 | 20 | 18 | 18 | 10 | 91 |
| Kimi‑K3 | 25 | 18 | 22 | 16 | 9 | 90 |
| Qwen‑3.7‑Plus | 25 | 17 | 19 | 17 | 9 | 87 |
| DeepSeek‑V4‑Pro | 25 | 16 | 21 | 14 | 9 | 85 |
| GLM‑5.2 | 25 | 15 | 19 | 16 | 9 | 84 |
| Step‑3.7‑Flash | 25 | 14 | 22 | 7 | 7 | 75 |
| HY‑3 | 25 | 15 | 14 | 11 | 9 | 74 |
| DeepSeek‑V4‑Flash | 23 | 13 | 15 | 13 | 8 | 72 |
| Ling‑3.0‑Flash | 25 | 14 | 23 | 0 | 8 | 70 |
| DeepSeek‑V3.2 | 25 | 15 | 18 | 0 | 9 | 67 |
| 비교 시스템 | 정성 판독 |
|---|---|
| Drafters 1.1 | 실시예 구체성과 도면별 제어·예외·피드백·대체 실시형태 연결이 가장 강함 |
| GPT-5.6 Sol | 출원서 전체 구조와 도면·부호 체계의 완결성, 읽기 안정성이 가장 강함 |
| MiMo‑V2.5‑Pro | 도면 7종과 부호, 구현 흐름과 변형 실시예를 촘촘하게 연결 |
| Grok‑4.5 | 도면·부호 대응과 예외 상황의 대기열 동작을 균형 있게 전개 |
| MiniMax‑M3 | 도면과 단계 흐름에 수식·가중치·피드백·설명 화면을 구체적으로 연결 |
| Nemotron‑3‑Ultra | 모듈, 우선순위 수식, 처리 흐름과 변형 실시예의 구체성이 강함 |
| GPT-5.6 Terra | 청구 특징과 출원서 구조를 충실히 반영하면서 핵심 동작 중심으로 간결하게 전개 |
| Kimi‑K3 | 도면 4종과 처리 단계에 청구 구성을 안정적으로 연결 |
| Qwen‑3.7‑Plus | 구성부호와 설명 화면의 근거를 명료하게 제시 |
| DeepSeek‑V4‑Pro | 환자 상태 가중치, 피드백과 설명 정보의 구현을 구체화 |
| GLM‑5.2 | 장치 구성과 단계별 처리 흐름을 간결하게 정리 |
| Step‑3.7‑Flash | 청구 요소별 구현 예시는 구체적이나 제출 형식과 도면 연결이 제한적 |
| HY‑3 | 핵심 청구 요소를 간결하게 보존하고 기본 도면 흐름을 제시 |
| DeepSeek‑V4‑Flash | 핵심 청구 특징은 반영하지만 도면·부호와 실시형태 확장은 기본 수준 |
| Ling‑3.0‑Flash | 청구 요소별 실시형태는 구체적이나 도면·부호 연결이 없음 |
| DeepSeek‑V3.2 | 핵심 처리 흐름은 충실하지만 도면 연결을 제공하지 않음 |
산출량 참고
정성 품질과 별도로 실제 결과물의 전개량을 확인했습니다. 이 수치는 품질 점수의 배점 항목이 아니며, 같은 발명 재료를 어느 정도 깊이로 풀어냈는지를 보여주는 보조 지표입니다.
- Drafters 1.128,352자
- GPT-5.6 Sol14,934자
- MiMo-V2.5-Pro13,068자
- MiniMax-M311,530자
- Nemotron-3-Ultra10,749자
- GPT-5.6 Terra8,663자
- Grok-4.57,920자
- Kimi-K37,912자
- Ling-3.0-Flash5,750자
- DeepSeek-V4-Pro5,442자
- GLM-5.24,361자
- DeepSeek-V4-Flash4,352자
- Step-3.7-Flash4,349자
- DeepSeek-V3.24,258자
- Qwen-3.7-Plus4,096자
- HY-32,386자
Task Card 2 — OA(의견제출통지) 대응
| 항목 | 내용 |
|---|---|
| 입력 | 명세서, 의견제출통지서, 보정 전 청구항, 제공된 인용문헌 |
| 출력 | 의견서와 보정서 초안 |
| 목표 | 보정 근거, 구성의 기능 귀속, 선행사, 중복 청구항 정리를 빠뜨리지 않음 |
| 비목표 | 자동 법률 판단, 등록 보장, 사람의 최종 검토 대체 |
| 평가 | 비공개 내부 벤치마크와 원문 판독 |
| 공개 범위 | 사건번호·원문·중간 추론을 제외한 제품 수준 개선 내용 |
OA 대응에서는 등록 가능한 청구항을 골라 병합할 수 있는 부분거절과, 별도의 방어 논리를 구성해야 하는 전항거절을 먼저 구분합니다. Drafters 1.1은 각 유형에 맞는 작성 경로를 사용하고, 의견서 검토가 지적한 섹션만 순서대로 보강합니다.
| 내부 평가 항목 | Drafters 1.0 | Drafters 1.1 |
|---|---|---|
| 보정 근거 | 본문에 흩어짐 | 전용 소절로 구조화 |
| 기능 귀속 | 구성 주체 누락 가능 | 실제 구성 주체를 명시 |
| 선행사 | 후단 지칭 불안정 | 같은 청구항 안에서 정의 |
| 중복 청구항 | 병합 후 잔존 가능 | 삭제·인용항 정리 |
| 의견서 검토 | 전체 재작성 위험 | 지적된 섹션만 순차 보강 |
내부 비교평가에서는 보정 근거의 구조화, 기능 귀속, 선행사와 중복 청구항 정리에서 개선을 확인했습니다. 세부 사건 구성과 원시 판독 자료는 고객 비밀 및 기술보호 원칙에 따라 공개하지 않습니다.
OA 출력 품질 리더보드
연구 장부에 보존된 OA 의견서·보정서 산출물을 논점 커버리지, 명세서·인용 근거성, 보정안 적합성, 의견서-보정서 정합성, 문서 가독성·완결성의 고정 5축으로 재판독했습니다. 같은 모델의 복수 비교 슬롯은 하나의 모델 항목으로 통합했으며, 문서 길이는 품질 점수에 반영하지 않았습니다.
- Drafters 1.187.0점
- Claude Opus 583.4점
- Grok-4.575.9점
- Kimi-K374.9점
- Claude Sonnet 572.3점
- MiniMax-M369.7점
- GLM-5.266.9점
- DeepSeek-V4-Pro66.3점
- DeepSeek-V4-Flash61.2점
- MiMo-V2.5-Pro60.7점
- Qwen-3.7-Plus60.3점
- Nemotron-3-Ultra58.1점
- HY-358.0점
- Ling-3.0-Flash55.8점
- DeepSeek-V3.254.9점
- Step-3.7-Flash52.6점
- Claude Haiku 4.642.3점
| 제품·모델 | 논점 커버리지 25 | 근거성 20 | 보정안 적합성 25 | 문서 정합성 20 | 가독성·완결성 10 | 총점 |
|---|---|---|---|---|---|---|
| Drafters 1.1 | 21.0 | 17.0 | 22.0 | 18.0 | 9.0 | 87.0 |
| Claude Opus 5 | 19.2 | 16.7 | 21.9 | 16.7 | 9.0 | 83.4 |
| Grok‑4.5 | 16.7 | 15.3 | 20.3 | 15.3 | 8.3 | 75.9 |
| Kimi‑K3 | 15.8 | 15.1 | 20.0 | 15.3 | 8.7 | 74.9 |
| Claude Sonnet 5 | 15.0 | 14.9 | 19.4 | 14.7 | 8.3 | 72.3 |
| MiniMax‑M3 | 17.5 | 12.9 | 16.7 | 14.7 | 8.0 | 69.7 |
| GLM‑5.2 | 14.2 | 14.0 | 18.1 | 12.7 | 8.0 | 66.9 |
| DeepSeek‑V4‑Pro | 14.2 | 13.0 | 17.8 | 13.3 | 8.0 | 66.3 |
| DeepSeek‑V4‑Flash | 12.5 | 12.2 | 16.1 | 12.7 | 7.7 | 61.2 |
| MiMo‑V2.5‑Pro | 11.7 | 12.4 | 16.9 | 12.0 | 7.7 | 60.7 |
| Qwen‑3.7‑Plus | 12.5 | 12.4 | 16.7 | 11.3 | 7.3 | 60.3 |
| Nemotron‑3‑Ultra | 12.5 | 11.1 | 15.8 | 12.0 | 6.7 | 58.1 |
| HY‑3 | 10.8 | 12.4 | 16.4 | 10.7 | 7.7 | 58.0 |
| Ling‑3.0‑Flash | 13.3 | 10.2 | 15.3 | 11.3 | 5.7 | 55.8 |
| DeepSeek‑V3.2 | 10.8 | 12.2 | 14.2 | 10.0 | 7.7 | 54.9 |
| Step‑3.7‑Flash | 10.0 | 11.8 | 14.4 | 9.3 | 7.0 | 52.6 |
| Claude Haiku 4.6 | 7.5 | 9.8 | 11.4 | 6.7 | 7.0 | 42.3 |
| 제품·모델 | 정성 판독 |
|---|---|
| Drafters 1.1 | 구조적 논점 대응과 필요한 섹션의 국소 보강이 강하며, 의견서와 보정서의 연결을 안정적으로 유지 |
| Claude Opus 5 | 명세서 근거, 보정안 구성과 문서 완결성이 고르게 강함 |
| Grok‑4.5 | 보정안의 실효성과 문서 구조가 강하며 논점별 직접 대응은 상대적으로 압축적 |
| Kimi‑K3 | 읽기 쉬운 논증과 보정안 구성이 강하며 근거 밀도는 상위권 대비 낮음 |
| Claude Sonnet 5 | 근거성·보정안·가독성이 균형적이며 논점 커버리지는 중상위권 |
| MiniMax‑M3 | 넓은 논점 커버리지와 문서 완결성이 강하고 사실 근거의 정밀도는 보완 여지가 있음 |
| GLM‑5.2 | 명세서 근거, 조문 적합성과 가독성이 강하고 문서 간 정합성은 상대적으로 낮음 |
| DeepSeek‑V4‑Pro | 보정안 적합성과 가독성이 안정적이며 논점별 직접 대응은 중위권 |
| DeepSeek‑V4‑Flash | 문서 구조와 가독성은 안정적이고 근거 밀도와 논점 커버리지는 보완 여지가 있음 |
| MiMo‑V2.5‑Pro | 보정안 구성은 강하지만 논점 커버리지와 문서 정합성이 제한적 |
| Qwen‑3.7‑Plus | 보정안 구성과 근거 제시는 안정적이며 문서 정합성이 상대적으로 낮음 |
| Nemotron‑3‑Ultra | 보정서 분량과 형식 완결성이 강하고 근거성·가독성은 보완 여지가 있음 |
| HY‑3 | 가독성과 근거 제시는 안정적이며 논점별 직접 대응이 제한적 |
| Ling‑3.0‑Flash | 논점을 폭넓게 호명하지만 근거 정밀도와 문서 가독성이 낮음 |
| DeepSeek‑V3.2 | 가독성과 명세서 인용은 안정적이며 논점 커버리지와 문서 정합성이 낮음 |
| Step‑3.7‑Flash | 근거 제시는 유지하지만 논점 커버리지와 문서 완결성이 제한적 |
| Claude Haiku 4.6 | 기본적인 가독성은 유지하지만 논점 커버리지·보정안·문서 정합성이 낮음 |
Drafters 1.1은 이 비교에서 중요하게 갈린 쟁점 포착, 보정 근거, 기능 귀속, 선행사와 청구항 정리를 제품 수준의 작성·검토 공정으로 연결했습니다.
안전장치
- 두 문서 중 하나라도 불완전하면 같은 입력으로 한 번만 재생성합니다.
- 자유형 검토가 지적한 의견서 섹션만 수정하며 보정서는 임의로 다시 쓰지 않습니다.
- 각 수정은 앞선 수정이 반영된 최신 의견서를 기준으로 순차 처리합니다.
- 검토·보강에 실패하면 최초 생성 원문을 유지해 부분 수정본의 혼입을 막습니다.
- 생성과 검토의 진단 정보는 사용자 문서와 분리된 내부 감사 자료로 취급합니다.
공개와 보안
책임 있는 해석
Drafters 1.1의 산출물은 특허 전문가의 검토를 위한 초안입니다. 이 업데이트는 등록 가능성, 기재요건 충족, 침해 여부에 대한 법률 의견이나 출원 대리를 대체하지 않습니다.