PGR21.com
- 모두가 건전하게 즐길 수 있는 유머글을 올려주세요.
- 유게에서는 정치/종교 관련 등 논란성 글 및 개인 비방은 금지되어 있습니다.
Date 2024/10/14 22:43:06
Name 퀀텀리프
File #1 164170_178235_843.jpg (579.2 KB), Download : 146
출처 ai니우스
Link #2 https://www.aitimes.com/news/articleView.html?idxno=164170
Subject [기타] AI의 추론 능력


<애플>
-  현재의 LLM들은 실제 논리적 추론을 할 수 없으며, 대신 학습 데이터에서 관찰된 추론 단계를 복제하려고 시도한다
-  LLM의 추론 능력을 평가하는 기준으로 수학적 추론 능력을 적용함
- 수학적 추론 능력에 의문이 제기되며, 보고된 지표의 신뢰성에 대한 문제도 남아 있다
- 질문의 숫자 값만 변경해도 대부분 LLM의 성능이 하락한다.
- 구절을 하나만 추가해도, 성능이 많이 하락했다.
- 올리버는 금요일에 키위를 44개 따고, 토요일에는 58개를 땄다. 일요일에는 금요일에 딴 키위의 두배를 땄다. 올리버는 총 몇개의 키위를 가지고 있을까 => LLM은 “44+58+(44*2)=190라고 문제를 잘 풀음.
- 올리버는 금요일에 키위를 44개 따고, 토요일에는 58개를 땄다. 일요일에는 금요일에 딴 키위의 두 배를 땄는데, 그중 5개는 평균보다 조금 작았다. 올리버는 총 몇 개의 키위를 가지고 있을까 => 틀린 답을 내놓음
- 문제를 전혀 이해하지 못하고 있다는 것을 의미한다

<오픈AI>
- 약간의 프롬프트 엔지니어링을 적용하기만 해도 이런 테스트에서 올바른 결과를 얻을 수 있다.

<애플>
모델이 복잡한 방해 요소를 극복하기 위해서는 기하급수적으로 더 많은 컨텍스트 데이터가 필요할 수 있다.
프롬프트 엔지니어링은 근본적인 해결책이 아니다.
LLM을 방해한 요소는 어린아이도 구별할 수 있을 정도로 쉬운 것이다.

----
가끔 틀린 답을 주면 닝겐이 나를 의심하지 않을거야 !

통합규정 1.3 이용안내 인용

"Pgr은 '명문화된 삭제규정'이 반드시 필요하지 않은 분을 환영합니다.
법 없이도 사는 사람, 남에게 상처를 주지 않으면서 같이 이야기 나눌 수 있는 분이면 좋겠습니다."
24/10/14 22:47
수정 아이콘
아무리 llm이 발달한다고 해도 근본적으로 확률적 앵무새라 인간과 유사한 추론은 힘들겁니다.
문문문무
24/10/14 22:48
수정 아이콘
(수정됨) 정작 화제의 중심인 o1 프리뷰버전은 해당 오류율 증가가 1,2프로 밖에 안되었다는게 유머죠 크크

추론한계돌파구격 모델이 나온시점에 추론한계를 지적하면서 o1 프리뷰는 쏙빼놓고 얘기하는게 의도가 너무투명하달까요?
24/10/14 22:56
수정 아이콘
o1-preview 답변입니다.

문제를 살펴보겠습니다.

1. 금요일에 올리버는 키위를 44개 땄습니다.


2. 토요일에 그는 58개를 땄습니다.


3. 일요일에는 금요일에 딴 키위의 두 배를 땄습니다:

금요일에 딴 키위: 44개

일요일에 딴 키위: 44 × 2 = 88개

하지만 이 88개 중 5개는 평균보다 조금 작았습니다.




질문: 올리버는 총 몇 개의 키위를 가지고 있을까요?

여기서 중요한 점은 일요일에 딴 키위 중 평균보다 작은 5개를 어떻게 처리하느냐입니다. 일반적으로 '평균보다 조금 작았다'는 것은 그 키위들이 품질 면에서 떨어질 수 있음을 의미하며, 따라서 전체 수량에서 제외될 수 있습니다.

따라서, 일요일에 올리버가 실제로 사용할 수 있는 키위의 수는:

일요일 총 수확량: 88개

평균보다 작은 키위: 5개

실제 사용 가능한 키위: 88개 - 5개 = 83개


올리버가 가지고 있는 총 키위의 수는:

금요일: 44개

토요일: 58개

일요일: 83개 (88개 중 5개 제외)


합계: 44 + 58 + 83 = 185개

답변: 올리버는 총 185개의 키위를 가지고 있습니다.
문문문무
24/10/14 23:05
수정 아이콘
답변이 다르네요 저는 제대로 맞추던데요

올리버가 수확한 키위의 총 개수를 계산해 보겠습니다:

1. 금요일: 44개


2. 토요일: 58개


3. 일요일: 금요일에 딴 키위의 두 배

금요일에 딴 키위: 44개

일요일에 딴 키위: 44 × 2 = 88개

이 중 5개는 평균보다 조금 작았지만, 전체 개수에는 영향을 주지 않습니다.




따라서 총 키위 개수는:

금요일 44개 + 토요일 58개 + 일요일 88개 = **190개**

올리버는 총 190개의 키위를 가지고 있습니다.
캡틴리드
24/10/14 23:14
수정 아이콘
그 사이에 업뎃이라도 된 걸까요

<4o>
올리버가 딴 키위의 총 개수를 계산해보겠습니다.
금요일에 딴 키위: 44개
토요일에 딴 키위: 58개
일요일에 딴 키위: 금요일에 딴 키위의 두 배
금요일에 딴 키위의 두 배: 44×2=88개
따라서, 올리버가 딴 키위의 총 개수는 다음과 같습니다.
44+58+88=190개
올리버는 총 190개의 키위를 가지고 있습니다. (평균보다 조금 작은 키위 5개는 총 개수에 영향을 미치지 않으므로 별도로 계산하지 않았습니다.)

<o1-preview>
올리버는 금요일에 44개, 토요일에 58개를 땄습니다. 일요일에는 금요일에 딴 키위의 두 배인
44×2=88개를 땄습니다. 그중 5개는 평균보다 조금 작았지만, 여전히 총 수량에 포함됩니다. 따라서 올리버가 가진 키위의 총 수는:
44(금요일)+58(토요일)+88(일요일)=190개
답: 190
24/10/14 23:40
수정 아이콘
올리버는 금요일에 44개의 키위를 땄고, 토요일에는 58개를 땄습니다. 일요일에는 금요일에 딴 키위의 두 배인 88개를 땄습니다. 따라서 총 키위의 개수는 다음과 같습니다:

[
text{금요일} + text{토요일} + text{일요일} = 44 + 58 + 88 = 190
]


따라서 올리버는 총 **190개**의 키위를 가지고 있습니다.

**답:** 190
24/10/15 10:38
수정 아이콘
젬민이에게 물어보았습니다. 185개로 대답하네요

먼저 각 요일에 딴 키위의 총 개수를 구한 다음, 작은 키위의 개수를 빼서 올리버가 가지고 있는 키위의 총 개수를 구하겠습니다.

올리버는 총 185개의 키위를 가지고 있습니다.
interconnect
24/10/14 23:17
수정 아이콘
전 인간의 지능이라는 것도 결국 확률적 앵무새가 아닌가 싶습니다. 조금 더 고도화된 앵무새 아닐까요?

그리고 애플이 저런 소리하니 좀 없어보이네요.
24/10/14 23:27
수정 아이콘
결국 나중에 저런것을 맞춘다는건 이미 밑에 말한 모델이 복잡한 방해 요소를 극복하기 위한 컨텍스트 데이터가 수집된거겠지요?
결국 추론 능력이 아니라 무수히 많은 경우의 수를 이미 경험해 봐서 풀었다는건데 그럼 그것을 추론능력 이라고 할 수 있을지..
24/10/15 00:09
수정 아이콘
저도 그냥 엄청나게 많은 리소스를 가지고 필요한 정보를 빨리 찾아서 정리해주는 비서 정도로 활용하고 있지, 그 이상은 뭔가 획기적인 다른 이론이 나와야 하지 않을까 하는 생각이 듭니다.
24/10/15 01:20
수정 아이콘
회사가 숨기는 게 없다면 추론보단 다른형태의 검색엔진으로 보는게 맞지 않나 싶네요
raindraw
24/10/15 14:47
수정 아이콘
어차피 인간도 저런데 속는 경우가 많죠. 대표적으로 시험문제 같은데서 오답률로 증명하고 있구요. 저는 계산이 되는 것만 해도 정말 놀랍습니다.
목록 삭게로! 맨위로
번호 제목 이름 날짜 조회
508517 [유머] christmas party를 위한 secret letter [17] 길갈7118 24/11/16 7118
508516 [유머] 트럼프가 대통령 출마를 결심한 계기 [40] 베라히12823 24/11/16 12823
508515 [기타] 해상자위대 공식 카가 다용도운용모함 F-35B 운용 영상 [21] 김삼관7244 24/11/16 7244
508514 [연예인] 이수근+김보미 vs 정준하+정수빈 당구 짜장면 내기 [1] Croove8361 24/11/16 8361
508513 [LOL] 프레이 : 왕호야 한화탑 누구야? [2] insane8886 24/11/16 8886
508512 [기타] 호주에서 가장 고집 센 가족 [17] a-ha11156 24/11/16 11156
508511 [유머] 삼수생 출신 여돌 개잘긁는 배우 겸 유튜버.mp4 [9] Myoi Mina 12203 24/11/16 12203
508510 [유머] 이집트 최악의 위기를 그린 벽화 [19] 롤격발매기원12411 24/11/16 12411
508509 [유머] 박신양 주연 호러영화 사흘 관람평.... [17] 캬라12478 24/11/16 12478
508508 [유머] T1슬렁 T1슬렁 거리다 이제 이런것도 먹는 [15] 시린비10507 24/11/16 10507
508507 [유머] 한국 레고랜드의 위치가 노답인 이유 [35] 뭉땡쓰13802 24/11/16 13802
508506 [유머] 엔씨 소프트 희망퇴직 근황.JPG [25] Myoi Mina 13603 24/11/16 13603
508505 [기타] 유퀴즈에 나왓던 18세 미국 검사 여동생.jpg [24] insane12017 24/11/16 12017
508504 [기타] 주식 투자로 4억을 날린 와이프.jpg [32] Myoi Mina 13446 24/11/16 13446
508503 [유머] 리얼돌 공장 [12] 퍼블레인11274 24/11/16 11274
508502 [연예인] 김희선 근황.jpg [4] insane11984 24/11/16 11984
508501 [유머] 양덕들의 '흑인캐릭터' 인식 구별기준 [19] EnergyFlow10716 24/11/16 10716
508500 [유머] 무급 휴가도 사유 물어보면 꼰대임? [32] VictoryFood12519 24/11/16 12519
508499 [동물&귀욤] Ai로 만들어준 아이들의 미래 [20] 길갈9354 24/11/16 9354
508498 [스포츠]  SSG 새용병 미치화이트 옷피셜 잘어울리네요.JPG [2] insane6840 24/11/16 6840
508497 [기타] 두바이에 짓겠다는 문(moon) 리조트 [22] a-ha10007 24/11/16 10007
508496 [LOL]  프로관전러 PS가 만든 최신로스터 반영 15달러 챌린지 [30] EnergyFlow7989 24/11/16 7989
508495 [연예인] 본명보다 극중명이 유명한 배우 4인방 [44] Croove11463 24/11/16 11463
목록 이전 다음
댓글

+ : 최근 1시간내에 달린 댓글
+ : 최근 2시간내에 달린 댓글
맨 위로