테크큐브 · IT테크

텐센트 Hy3 사용법: API 연동부터 개발 에이전트 활용까지

✍ 테크큐브 편집팀 · 2026. 8. 6. · IT 트렌드·이슈
텐센트 Hy3 모델 인프라 및 API 연결 개념도
목차
  1. 텐센트 Hy3 개요 및 주요 성능 특징
  2. Hy3 API 요금 체계 및 비용 절감 혜택
  3. 텐센트 Hy3 API 연동 및 환경 설정 방법
  4. Hy3 개발 에이전트 적용 및 주의사항
  5. 자주 묻는 질문
  6. 참고자료

텐센트(Tencent)가 공개한 대형 언어 모델(LLM, Large Language Model) Hy3는 고성능 코딩 및 데이터 처리 능력을 갖춘 최신 오픈소스 모델입니다. 개발자와 기업이 효율적인 비용으로 에이전트(Agent) 구축과 개발 자동화를 구현할 수 있도록 지원하는 텐센트 Hy3 사용법과 주요 특징을 구체적으로 알아보겠습니다.

텐센트 Hy3 개요 및 주요 성능 특징

텐센트 Hy3 개요 및 주요 성능 특징

텐센트 Hy3는 Apache 2.0(아파치 2.0, 누구나 자유롭게 수정 및 상업적 이용이 가능한 오픈소스 라이선스) 라이선스로 2026년 7월 공식 공개되었습니다. GitHub, HuggingFace(허깅페이스), ModelScope, AtomGit 등 다양한 오픈소스 플랫폼을 통해 모델 가중치가 무료로 제공되며, API 서비스로도 손쉽게 연동할 수 있습니다.

코딩 및 CI/CD 특화 성능과 벤치마크

Hy3는 270명의 분야별 전문가들이 수행한 실제 업무 기반 블라인드 평가에서 4점 만점 중 2.67점을 기록하여, 경쟁 모델인 GLM-5.1(2.51점)을 크게 앞질렀습니다. 특히 개발자 작업의 핵심인 프론트엔드 개발, 데이터 및 스토리지 관리, CI/CD(지속적 통합 및 지속적 배포) 파이프라인 구축 분야에서 압도적인 우위를 보였습니다.

또한 소프트웨어 엔지니어링 성능 평가 기준인 SWE-Bench Verified 테스트에서도 CodeBuddy, Cline, KiloCode 등 다양한 에이전트 스캐폴딩(Agent Scaffolding, 에이전트를 구동하는 개발 프레임워크) 환경에서 변동폭 4% 이내의 안정된 정확도를 유지했습니다.

환각률 감소 및 토큰 효율성

실제 제품 피드백을 후훈련(Post-training)에 대거 반영하면서 모델의 신뢰성이 크게 향상되었습니다. 이전 프리뷰 버전 대비 개선된 지표는 다음과 같습니다.

  • 환각률(Hallucination Rate): 기존 12.5%에서 5.4%로 대폭 감소
  • 상식 오류율: 25.4%에서 12.7%로 절반 감소
  • 다회전 대화 이슈율: 복잡한 문맥 추적 시 오류 발생률이 17.4%에서 7.9%로 개선

문서 처리 시 GLM-5.2 대비 47.4% 적은 토큰을 소비하며, 프레젠테이션(PPT) 생성 작업에서는 49% 적은 토큰으로 동일한 과업을 완성하는 높은 토큰 효율을 증명했습니다.

Hy3 API 요금 체계 및 비용 절감 혜택

텐센트 Hy3는 하드웨어와 소프트웨어의 공동 최적화를 통해 독보적인 비용 경쟁력을 확보했습니다. 2026년 7월 공개 당시 발표된 공식 API 요금 구조는 다음과 같습니다.

구분 100만 토큰당 가격 (RMB) 원화 환산 추정가 (KRW) 주요 특징 및 활용 팁
입력 (Input) 1 RMB 약 210원 긴 프롬프트 및 코드 베이스 입력 시 저렴
출력 (Output) 4 RMB 약 840원 대규모 코드 생성 및 보고서 작성에 유리
캐시 입력 (Cached Input) 0.25 RMB 약 53원 반복적인 시스템 프롬프트 요청 시 75% 절감

이러한 저렴한 비용은 서비스 규모 확장 시 운영 부담을 대폭 낮춰줍니다. 기업 차원에서 LLM 도입을 검토 중이라면 엔터프라이즈 AI 도입 비용 산정 방법 3단계 가이드를 함께 참고하시면 효율적인 예산 계획 수립에 큰 도움이 됩니다.

텐센트 Hy3 API 연동 및 환경 설정 방법

텐센트 Hy3 API 연동 및 환경 설정 방법

Hy3를 파이썬(Python) 환경에서 API 서비스로 호출하거나 커스텀 애플리케이션에 연동하는 기본 3단계 절차는 다음과 같습니다.

  1. API 키 발급 및 환경변수 설정: 텐센트 클라우드 콘솔에 접속하여 Hy3 서비스 API 키를 발급받은 후 `.env` 파일에 저장합니다.
  2. SDK 설치: OpenAI 호환 라이브러리 또는 `requests` 패키지를 설치합니다.
  3. 호출 코드 작성 및 응답 처리: API 엔드포인트로 요청을 전송하고 스트리밍 데이터 또는 JSON 출력을 수신합니다.

다음은 파이썬을 활용해 텐센트 Hy3 API를 호출하는 실제 구현 코드 스니펫입니다.

import os
import requests

# API 엔드포인트 및 인증 키 설정
API_URL = "https://tokenhub-intl.tencentcloudmaas.com/v1/chat/completions"
API_KEY = os.getenv("TENCENT_HY3_API_KEY", "your_api_key_here")

headers = {
    "Authorization": f"Bearer {API_KEY}",
    "Content-Type": "application/json"
}

# 프롬프트 데이터 구성
payload = {
    "model": "hy3",
    "messages": [
        {"role": "system", "content": "You are a helpful software engineering assistant."},
        {"role": "user", "content": "REST API 요청 처리용 파이썬 함수의 예제 코드를 작성해 줘."}
    ],
    "temperature": 0.2,
    "max_tokens": 1000
}

# API 요청 전송
response = requests.post(API_URL, headers=headers, json=payload)

if response.status_code == 200:
    result = response.json()
    print("Hy3 응답 내용:")
    print(result["choices"][0]["message"]["content"])
else:
    print(f"오류 발생: {response.status_code} - {response.text}")

오픈소스 가중치를 직접 로드해 로컬 서버에서 파인튜닝(Fine-tuning, 미세조정)하거나 온프레미스로 구축하려는 경우 HuggingFace의 `transformers` 라이브러리를 통해 `tencent/Hy3` 리포지토리에서 다운로드할 수 있습니다.

Hy3 개발 에이전트 적용 및 주의사항

에이전트 스캐폴딩 연동 전략

Hy3는 WorkBuddy, CodeBuddy, Cline 등 사내 워크플로우에 결합할 때 최고의 효율을 나타냅니다. 텐센트 내부 실험에 따르면 업무 자동화 도구인 WorkBuddy에 Hy3를 탑재했을 때 작업 성공률이 기존 72%에서 90%로 대폭 향상되었으며, 평균 과업 완료 시간도 34% 감축되었습니다.

도구 호출(Tool Calling) 시 출력이 안정적이므로 스크립트 실행, DB 쿼리 조회, 외부 API와의 오케스트레이션(Orchestration, 여러 서비스의 통합 제어)에 이상적입니다. 기업 내부 시스템과 결합하여 안전하게 운영하려면 사내 ChatGPT 도입 방법 4가지 비교 포스팅의 보안 및 인프라 구성 패턴을 검토해보시기 바랍니다.

개발 시 필수 주의사항 및 한계

핵심 주의사항: Hy3는 도구 호출 복구 능력과 환각 감소율이 크게 향상되었으나, 특수 언어나 극단적인 다회전 세션에서는 의도 추적 불일치가 발생할 수 있으므로 중대한 프로덕션 적용 시 입출력 검증 검사(Validation)를 반드시 거쳐야 합니다.

또한 API 이용 시 캐시 입력(0.25 RMB/1M tokens) 혜택을 극대화하기 위해서는 변하지 않는 공통 시스템 지시문 및 스키마 설정을 요청의 앞부분에 고정 배치하는 프롬프트 구조화 작업이 권장됩니다.

자주 묻는 질문

Q. 텐센트 Hy3는 상업적 용도로 무료 사용이 가능한가요?

네, Hy3는 Apache 2.0 오픈소스 라이선스를 적용받으므로 수정, 재배포, 상업적 서비스 개발에 제약 없이 자유롭게 활용할 수 있습니다. 단, 텐센트 공식 호스팅 API를 사용할 경우 토큰당 사용료가 발생합니다.

Q. HuggingFace에서 텐센트 Hy3 모델을 로컬로 다운로드할 수 있나요?

가능합니다. HuggingFace, ModelScope, GitHub, AtomGit의 공식 리포지토리에 가중치 파이프라인이 오픈되어 있어 개발자 PC나 사내 GPU 서버에 직접 모델을 내려받아 구동할 수 있습니다.

Q. 기존 GLM 모델이나 GPT-4o 대비 Hy3의 강점은 무엇인가요?

Hy3는 유사한 파라미터(매개변수) 규모 대비 높은 성능을 발휘하며 특히 프론트엔드 코드 작성, 데이터베이스 처리, CI/CD 구축 같은 엔지니어링 과업에서 강점을 보입니다. 또한 100만 토큰당 1 RMB 수준의 매우 압도적인 가격 대 성능비를 제공합니다.

Q. 텐센트 Hy3 API 연동 시 환각 현상을 방지하는 설정법이 있나요?

Hy3는 후훈련 과정에서 증거 기반 답변 기준이 엄격하게 적용되어 이전 버전 대비 환각률이 5.4%로 낮아졌습니다. API 호출 시 `temperature` 매개변수를 0.1~0.3 수준으로 낮게 설정하고 근거 문서를 시스템 메시지에 함께 제공하면 환각을 최소화할 수 있습니다.

참고자료

함께 보면 좋은 글