블로그
AI 개발, 앱/웹 개발 외주, IT 프로젝트에 대한 전문 인사이트
STT란? 모델·솔루션 유형 비교 2026 — 클라우드·오픈소스·커스텀 선택 기준
STT(음성인식) 솔루션을 클라우드 API·오픈소스·커스텀 개발 세 유형으로 비교했습니다. 한국어·영어·일본어 정확도 기준, 유형별 비용과 구축 기간, 콜센터·의료·법무 등 도메인별 선택 기준, 개발 업체를 고를 때 확인할 5가지를 정리했습니다. 도입 전 체크리스트도 포함.
AI가 회의를 바꾼다: Granola의 성장이 기업에 주는 시사점
회의 자동화 AI Granola 시리즈 C 1,250억 원 + 한국 기업 회의 STT·요약·액션 추출 자동화 도입 5단계 + AX 전환 첫 0단계 활용 방법 + ROI·보안 정책·HITL 운영 체크리스트와 SaaS·온프레미스 선택 기준까지 정리한 2026 한국 AX 가이드.
ARC-AGI-2 77% 돌파, Gemini 3.1 Pro가 기업 AI 전환에 던지는 시사점
Google DeepMind Gemini 3.1 Pro가 ARC-AGI-2에서 77.1%를 기록, Claude·GPT를 제치고 추론 1위에 올랐다. 이 추론 능력 도약이 기업 AX 전략과 에이전틱 AI 도입에 어떤 의미를 갖는지 분석합니다.
Mistral Voxtral TTS, 오픈 웨이트로 ElevenLabs에 도전장을 내밀다
Mistral Voxtral TTS 오픈 웨이트 + 3초 음성 샘플 복제·70ms 초저지연 + ElevenLabs 대비 비용·성능 비교표 + 한국 음성 AI 서비스 개발 전략 + 보안·온프레미스 배포 시나리오와 라이선스·PoC 의사결정 체크리스트 정리한 2026 가이드.
AI Scientist v2, AI가 스스로 연구하는 시대의 문이 열렸다
SakanaAI의 AI Scientist v2가 가설 수립부터 실험·논문 작성까지 자율 수행해 ICML 워크숍 심사를 통과했다. 에이전틱 AI가 R&D·지식 노동을 자동화하는 임팩트, 기업 도입 5단계 로드맵, 한국 연구 조직 활용 시나리오와 PoC 체크리스트를 한 페이지로 정리.
NVIDIA Nemotron 3 Super, 기업 AI 에이전트 도입의 새 기준을 세우다
NVIDIA가 공개한 오픈웨이트 120B MoE 모델 Nemotron 3 Super. SWE-Bench 60.47%로 오픈소스 최고 성적, 2.2배 처리량 향상. 기업 AI 에이전트 도입 전략과 self-hosted LLM의 현실적 가이드.
LTX 2.3 vs Helios 2026 — 오픈소스 AI 비디오 사양·VRAM 요건 비교
LTX 2.3과 Helios의 실제 사양을 공식 문서 기준으로 정리했습니다. 4K 지원과 소비자 GPU 구동은 다른 이야기라 권장 해상도·VRAM 요건을 구간별 표로 나눴고, 60초 장편이 필요한 경우와 짧은 클립을 빠르게 뽑는 경우 중 어느 모델이 맞는지 선택 기준도 담았습니다.
Cursor Composer 2 — 실시간 강화학습 코딩 에이전트, 무엇이 달라졌나
Cursor Composer 2가 실시간 강화학습으로 어떻게 만들어졌는지, 공개된 벤치마크 수치를 어떻게 읽어야 하는지 정리했습니다. AI 코딩 에이전트 시장 변화가 보내는 신호와, 서비스 도입을 검토하는 팀이 실제로 확인해야 할 지점까지 함께 담았습니다. 비용 비교 관점도 짚습니다.
ByteDance DeerFlow란? 오픈소스 멀티에이전트 딥리서치 프레임워크 정리 2026
ByteDance가 오픈소스로 공개한 멀티에이전트 딥리서치 프레임워크 DeerFlow를 정리했습니다. 코디네이터·플래너·리서처·코더·리포터 역할 분담, MCP 도구 연동과 Human-in-the-Loop 설계, 일반 챗봇과의 차이, 도입 비용·검증 고려사항을 나무숲이 짚었습니다.
2026년 AI 에이전트 개발 업체 추천 — 유형별 비용 500만~1억·납기 1~6개월 비교
AI 에이전트 개발 업체를 유형 5종으로 비교했습니다. 대형 SI·AI 전문 스타트업·플랫폼·연구소 스핀오프·프리랜서의 예상 비용 500만~1억 원과 납기 1~6개월을 표로 정리하고, 규모별 최적 파트너와 발주 전 확인할 선택 기준 5가지를 담았습니다. 계약 실패 사례도 함께 다룹니다.