반응형

전체 글 120

중국의 AI 기업에서 모델을 학습시킬 저비용 고품질 데이터를 얻은 방법

1주 전 쯤에 흥미로운 기사를 봤다. 중국의 AI 기업에서 모델을 학습시킨 방식이 미국의 고성능 모델들의 응답을 활용한 지식 증류 기법이라는 내용의 기사였다. Anthropic에서는 중국의 DeepSeek, Moonshot, MiniMax 가 가짜 계정 2만 4천개를 활용해 클로드를 대상으로 대규모 증류 공격을 했다고 한다. 특히 minimax의 경우 1300만회의 증류 공격을 했다고 한다. 대화당 10~25K 토큰이 사용되었다고 가정할 때 총 약 1,500억~4,000억 개의 토큰이 추출된 것으로 추정되는데 이정도면 파인튜닝에 필요한 양을 아득히 넘어서 아마 메인 모델 사전학습에 사용되지 않았을까 싶다.https://www.finance-scope.com/article/view/scp202602240..

인공지능 (AI) 2026.03.04

자바 코딩테스트 대비할 때 반드시 기억해야할 이진수 함수

프로그래머스에서 자바로 여러 코딩 테스트 문제를 풀다가 기존의 내 풀이 방법과 달리 완전 간결한 답안을 보고 이진수 함수의 중요성을 깨닫게 되어 제대로 기억하고자 글을 쓰게 됐다. 내가 풀었던 문제는 프로그래머스의 2레벨 점프와 순간 이동 문제다.https://school.programmers.co.kr/learn/courses/30/lessons/12980 프로그래머스SW개발자를 위한 평가, 교육의 Total Solution을 제공하는 개발자 성장을 위한 베이스캠프programmers.co.kr아이언 슈트 구매자가 이동하려는 거리 N이 주어졌을 때, 사용해야 하는 건전지 사용량의 최솟값을 return하는 solution 함수를 만드는 문제인데 원리 자체는 이진수 문자열에서 1의 개수만 세면 되는 문제이..

코딩 테스트를 위한 SQL 기초 정리

대학교 데이터베이스 수업에서 SQL을 공부하긴 했지만 몇 년 지나니 코테를 준비하기 위해서는 다시 한 번 정리할 필요성을 느껴 이렇게 정리하게 되었다.1) SQL과 테이블1.1 SQLSQL(Structured Query Language): 데이터베이스(DB)에서 데이터를 조회/추가/수정/삭제하는 언어.1.2 테이블(Table)엑셀 시트처럼 행(row)과 *열(column)로 구성.열은 "속성", 행은 "데이터 한 건".예: ONLINE_SALE 테이블열: ONLINE_SALE_ID, USER_ID, PRODUCT_ID, SALES_AMOUNT, SALES_DATE행: “어느 날, 누가, 어떤 상품을, 몇 개 샀다” 1건2) SELECT (조회)2.1 전체 조회SELECT *FROM ONLINE_SALE;..

RSS를 활용해 만든 프로젝트로 수익화가 가능한가?

RSS(RDF Site Summary or Really Simple Syndication)는 뉴스나 블로그 사이트에서 주로 사용하는 콘텐츠 표현 방식이다. 그러면 이 RSS를 활용해 개인 프로젝트에 각종 정보를 종합해서 보여줄 수 있을까? 기술적으로는 당연히 가능하다. 하지만 구글링과 AI 검색을 통해서 분석해 본 결과, 별 다른 계약 없이 RSS를 활용해 만든 프로젝트로 수익화하는 것은 법과 저작권 문제에서 절대 자유로울 수가 없다. 단순히 글자 몇 개만 올리고 전문은 ㄴ뉴스나 블로그로 링크가 연결되어있으니 문제가 없지 않나 생각할 수 있지만, 언론사나 기타 기업들 입장에서는 본인들이 비용을 들여 정보를 찾아서 올리는데 제3자가 그걸 가지고 수익을 올리니 곱게 볼 수가 없는 것처럼 보인다. 대형 언론..

OpenAI의 기업용 AI 에이전트 플랫폼 Frontier

2월 5일, OpenAI에서 기업의 실제 업무를 수행하는 AI 에이전트를 구축·배포·운영할 수 있게 해주는 엔터프라이즈용 AI 에이전트 플랫폼인 Frontier을 공개했다.https://openai.com/ko-KR/index/introducing-openai-frontier/ OpenAI Frontier를 소개합니다OpenAI Frontier는 비즈니스 컨텍스트와 온보딩, 권한 관리, 거버넌스를 기반으로 AI 에이전트를 구축하고 배포하며 관리할 수 있도록 지원하는 엔터프라이즈 플랫폼입니다.openai.com이 Frontier는 기업 내부의 데이터 웨어하우스, CRM, 티켓 시스템, 내부 앱 등을 묶어서 하나의 “비즈니스 컨텍스트” 레이어로 제공하고, 이 위에서 에이전트가 일하게 해준다. 기존의 챗봇을 ..

인공지능 (AI) 2026.02.20

프롬프트를 기반으로 무한한 3D 세계를 생성해주는 구글의 Project Genie

구글이 최근에 상호작용할 수 있는 3d 가상 세계를 실시간으로 생성해주는 프로젝트를 공개했다.https://blog.google/innovation-and-ai/models-and-research/google-deepmind/project-genie/ Project Genie: Experimenting with infinite, interactive worldsGoogle AI Ultra subscribers in the U.S. can now try out Project Genie.blog.googlehttps://labs.google/projectgenie LABS.GOOGLEStay up to date with the latest Google AI experiments, innovative tool..

인공지능 (AI) 2026.02.20

claude로 엔비디아 CUDA 코드를 AMD ROCm 코드로 30분 만에 포팅하는 게 가능할까?

reddit에서 claude code를 이용해 CUDA 기반 신경망 백엔드를 AMD ROCm으로 30분 만에 이식했다는 글이 올라왔다. 단순 포팅 자체는 특별한 게 아니지만 claude code로 간단하게 포팅을 할 수 있다는 게 주목해야할 부분 같다.https://www.reddit.com/r/AMD_Stock/comments/1qjc3s6/cuda_moat/ Reddit의 AMD_Stock 커뮤니티AMD_Stock 커뮤니티에서 이 게시물을 비롯한 다양한 콘텐츠를 살펴보세요www.reddit.com이 LeelaChessZero(lc0) 프로젝트의 ROCm 백엔드 포팅 PR은 다음 링크에서 확인할 수 있다.https://github.com/LeelaChessZero/lc0/pull/2375 feat: A..

인공지능 (AI) 2026.02.19

70B급 LLM을 단일 4GB GPU에서도 돌릴 수 있게 해주는 프레임워크, AirLLM

요즘 메모리 가격이 천정부지로 솟아오르고 있는데 이 메모리에 대한 비용 부담을 줄여줄 수 있는 프레임워크 airllm이 공개됐다.https://github.com/lyogavin/airllm GitHub - lyogavin/airllm: AirLLM 70B inference with single 4GB GPUAirLLM 70B inference with single 4GB GPU. Contribute to lyogavin/airllm development by creating an account on GitHub.github.com AirLLM은 70B급 LLM을 단일 4GB GPU에서도 돌릴 수 있게 해주는 메모리 최적화 추론 프레임워크이다. 사실상 모든 종류의 pc에서 70B급 대형 LLM 모델을 돌..

인공지능 (AI) 2026.02.19

개인 PC에서 huggingface를 통해 오픈 소스 ai 모델 다운 받기

huggingface는 다양한 AI 모델 및 데이터셋을 올리고, 찾아보고, 협업하고, 다운 받아 볼 수 있는 커뮤니티이자 플랫폼이다.https://huggingface.co/ Hugging Face – The AI community building the future.We’re on a journey to advance and democratize artificial intelligence through open source and open science.huggingface.co최근들어 이 사이트에서 상업 모델에 버금가는 오픈소스 ai 모델들이 많이 올라와서 간단하게 pc에 ai 모델을 다운 받는 법을 작성하고자 한다.개인적으로는 pc 터미널(cmd/powershell)에서 huggingface-cli..

인공지능 (AI) 2026.02.04

상용 모델을 뛰어넘는 고성능 오픈소스 TTS 모델, Qwen3-TTS

Qwen3-TTS는 Alibaba Cloud Qwen 팀의 오픈소스 TTS 모델 시리즈로, 2026년 1월 공개된 0.6B/1.7B 규모의 고품질·저지연 음성 생성 모델이다. https://wikidocs.net/325432 1. Qwen3-TTS Technical Report 분석## TTS가 중요한 이유: 실시간 아바타 챗봇을 향한 소리 없는 전쟁 2025년 말부터 2026년 초, AI 분야에서는 다양한 연구들이 진행되고 있습니다. 그중에서도 특히 주…wikidocs.net 모델 개요목적: 텍스트를 자연스러운 음성으로 변환하며, 음성 복제(3초 레퍼런스), 음성 디자인(자연어 지시로 새 목소리 생성), 실시간 스트리밍(97ms 지연)을 지원한다.학습 데이터: 500만 시간+ 다국어 음성(중국어·영어·..

인공지능 (AI) 2026.02.04
반응형