LIVE · 2026 OCT 05 KST⟟ RSS 구독FEED 020 SIGNALS
AI 소식 · 어렵지 않게 · 실시간
📰 소식 목록 전체 20건 · 최신순
  1. 2026 OCT 03 01:04에이전트참고만Factory, AI 코딩 비용을 모델·사람별로 보여 주는 대시보드
  2. 2026 OCT 03 00:53인프라참고만구글, AI 칩 실은 위성 쏘아 올렸다… '우주 데이터센터' 첫 시험
  3. 2026 OCT 03 00:35오픈소스 · LLM참고만80억짜리 작은 AI가 논문 리포트를 3.5배 빨리… Ai2 'AstaBrief' 통째로 공개
  4. 2026 OCT 03 00:05이미지 · 오픈소스참고만투표 500만 건 넘게 써서 다시 가르쳤더니… 오픈 이미지 모델 FLUX.2-dev 69점 상승
  5. 2026 OCT 02 23:51에이전트 · 오픈소스지켜보기같은 AI가 도구 따라 62% vs 33%… 허깅페이스, 코딩 에이전트용 학습법 공개
이미지 · 오픈소스

투표 500만 건 넘게 써서 다시 가르쳤더니… 오픈 이미지 모델 FLUX.2-dev 69점 상승

Arena가 사람 투표와 채점표 보상을 섞은 후속 학습법을 공개했어요. 학습 전 모델과 붙이면 최고 66% 이겨요.

핵심 3줄
  • 사람 투표 약 560만 건으로 '사람이 좋아하는 그림'을 판단하는 보상 모델을 만들었어요.
  • 여기에 '프롬프트를 제대로 지켰나', '글자가 깨지지 않았나' 같은 채점표 보상을 더했어요.
  • FLUX.2-dev는 Arena 순위 점수가 69점 올라 1202점, Ideogram 4는 1224점이 됐어요.
🧪 CONTENTSLAB 평참고만★★★★★실전 활용도 2/5
이미지 모델 개발자

후속 학습 때 "사람 취향 보상"만 쓰지 말고 "프롬프트 지켰나·글자 안 깨졌나" 채점표 보상을 섞어 꼼수를 막기.

CONTENTSLAB
CONTENTSLAB 생각 · 이렇게 써 볼 수 있을 것 같아요

모델을 직접 학습시키지 않아서 그대로 쓸 곳은 없어 보여요. 다만 생성 이미지를 고를 때 "예쁜가 + 요청대로인가 + 글자 멀쩡한가" 3단 체크로 빌려 써 보면 좋을 것 같아요.

사람 취향만 보고 학습시키면, 보기엔 예쁘지만 요청과 다른 그림을 그리는 '꼼수'가 생겨요. Arena는 취향 점수와 채점표 점수를 함께 써야 이 문제를 줄일 수 있다고 정리했어요. 학습 전 모델과 1:1로 붙였을 때 이긴 비율은 64.2%, 두 방식을 섞은 모델은 66.0%였어요.

Arena 블로그 대표 이미지
원문 이미지 · Arena 블로그 대표 이미지 · 출처
Arena 공식 블로그
원문 화면 · Arena 공식 블로그

이런 AI 소식, 매일 쉽게 정리해서 스레드에 먼저 올려요.

@contentslab.ai 팔로우