hknn84
u/hknn84문체나 어투같은걸 추상적으로 지시(예시: 맛깔나게 번역 이라던가 ~웹소설 풍, 라노벨풍)으로 하면 너무 과하게 적용합니다. 적당한 조절이 필요, 프롬프트를 길고 세세하게 적어주면 꼬박꼬박 지키려고 과추론하다가 오히려 잘 지키지도 않고 품질도 떨어지는 문제가 발생합니다. 3.0 이후 플래시 계열 능력이 크게 늘어 한번에 너무 많이 집어넣지않으면 플래시로도 충분한 퀄리티가 나옵니다. 3.5 플래시는 대신 가격도 프로급으로 올라서 그냥 빠른거 빼면 3.1pro보다 못합니다. 2.5 pro 와 프롬프트를 따로 쓰시는걸 강력 추천합니다.
2.5 2.5는 pro 만 쓰시고 flash는 성능이 상당히 낮습니다. 그리고 2.5가 좀더 프롬프트에서 예시등을 세밀하게 줘야하고, 창작이나 요약같은 일은 적은 대신직역투가 강해서 직역투가 거슬리면 문체 등을 조절하는게 포함된 프롬프트 쓰시는게 좋습니다. 그리고 공홈이나 AIS등에서 작업할때 컨택스트가 계속해서 누적되게 하지마세요. 3.0보다 장기기억력이 안좋아서 반복이나 빈반응, 중단이 일어날 위험이 상대적으로 큽니다. 가끔 지문이 현재진행형, 존댓말, 대화형이 되는 고질병이 있습니다. 가격이 저렴(프리티어 할당량 포함)하고 의역이나 누락이 적어 후속 모델이 나와도 꾸준히 사용되는 모델입니다. 3.0 이후 프롬프트를 대충써도 알잘딱 해줍니다.능지는 올랐는데 대신 또다른 문제점이 생깁니다. 단점은 예술병이 걸렸는지 원문에 없는 내용까지 지맘대로 써서 줄이고 늘리고가 자기 마음대로 하는 의역이 생겨 이를 막는 프롬프트가 거의 필수입니다.
본문에 적힌 Tpm 사이즈랑 rpm보면 tpm실제 의미보다는 tpm=청크크기로 보는게 맞을듯싶네요. Rpm을 1로놓고 tpm을 제한하면 tpm사이즈대로 쳥크가 나눠지겠죠, 작성자분이 의미를 헷갈리신듯
혹시 모를 오염을 피해서 다른채팅 다삭제하고 메모리 지우고 딱 저것만 물어본거임
대형 모델들은 자기 자신에 대한 정보를 가지고 있지도 않고 내부동작원리를 공개하지 않습니다. 님이 에러떠서 따지니까 출력물 로그보고 적당히 추측해서 입턴거에요,, 그리고 tpm은 요청제한걸릴때 주로쓰는 개념아닌가요. M은 빼고 총 컨텍량이랑 단일 컨텍 때문이라면 몰라도 tpm을 기준으로 하는건 처음듣네요. Llm대답말고 믿을만한 출처있나요?