Hook

Their other posts in the index, biggest breakout first.
So scientists tested So scientists tested a 3.5 billion DOLLAR MEDICA AGAINST REGULAR CHAT GPT. AND IT LOST ON EVERY SINGLE ONE. SO THERE'S THIS CALLED OPEN EVIDENCE. IT'S BUILT SPECIFICALLY LIKE, THAT'S THE WHOLE THING. IT'S DESIGNED FOR IT JUST RAISED $210 MILLION AND HOSPITALS ARE ACTUALLY BUYING AND USING IT. THERE'S ALSO ANOTHER UPTODATE. DOCTORS HAVE BEEN USING IT FOR YEARS. REASON THESE EXIST ASSUMPTION IS A SPECIALISED MEDICAL AI. IS GONNA BE THAN JUST USING REGULAR CHAT G PT. SENSE. ACTUALLY TESTED WHETHER AND THAT'S WHERE COMES IN. NYU AND THEY RAN AND I THINK MATTERS THE MOST HERE BECAUSE THEY GRABBED 100 QUESTIONS THAT ACTUAL DOCTORS TYPED INTO AI WHILE TREATING PATIENTS. SO NYU RAN THEM THROUGH THE MEDICAL TOOLS LIKE OPEN EVIDENCE AND UP TO DATE, AND ALSO THROUGH CLAUDE AND GEMINI. AND ONCE THEY THEY HAD 12 EVERY SINGLE RANKED AI PT. CLAUDE AND GEMINI ABOVE THE MEDICAL SPECIFIC ONES. THESE MEDICAL TOOLS ARE BUILT TO PULL FROM MEDICAL DATABASES TO ANSWER QUESTIONS. THEY USE RAG, SHOWS THAT CAN MAKE ANSWERS WORSE WHEN THE WRONG INFORMATION GETS PULLED IN VERSUS FRONTIER A THE ANSWERS BAKED INTO ITS TRAINING DATA FROM THE START. AND THE REASON WHY THIS MATTERS TOOLS ARE ALREADY IN HOSPITALS AS WE SPEAK. DOCTORS ARE MAKING REAL DECISIONS WITH THEM. THE WHOLE POINT OF THIS PAPER IS THAT NOBODY INDEPENDENTLY TESTED ANY BEFORE IT GOT THERE. NO ONE 700 DOLLAR MEDICAL IS ACTUALLY BETTER ONE BEFORE USING IT FOR PATIENTS. THIS PAPER IS BASICALLY SAYING WE NEED TO STOP ASSUMING SPECIALISED MEANS BETTER. BECAUSE ALL OF THESE AI. TOOLS HAVE REALLY GOOD MARKETING PITCHES UNTIL YOU ACTUALLY GO AND TEST THEM. FOLLOW AND I'LL KEEP YOU POSTED.