Перейти к содержимому

Claude vs ChatGPT vs Gemini vs Perplexity: ЛУЧШИЙ ИИ для научных исследований?

Andy Stapleton

0:00 / 0:00

Claude vs ChatGPT vs Gemini vs Perplexity: ЛУЧШИЙ ИИ для научных исследований?

37 589 просмотров · 10 дней назад
Andy Stapleton
385 тыс. подписчиков
37 589 просмотров · 10 дней назад
▶ Станьте мастером академического письма с помощью ИИ, используя мой курс: https://academy.academiainsider.com/c... ▶ Присоединяйтесь к более чем 21 000 подписчиков, получающих бесплатные инструменты и академические советы напрямую от меня: https://academiainsider.com/newsletter/ ChatGPT против Claude против Gemini против Perplexity: я оплатил все четыре сервиса и провел один и тот же обзор литературы через каждый из них, чтобы найти лучший ИИ для исследований. Это не сравнение технических характеристик. Я проверил пять вещей, которые действительно важны в академической среде и исследованиях, а затем дал каждому из них одинаковую задачу: подключить Consensus MCP, запустить мой навык обзора литературы и получить результат, которому я мог бы доверять. Только один из них справился с этим без проблем. Пять основных моментов, которые я протестировал: постоянное рабочее пространство, чтобы ваши работы хранились где-то, и вам не приходилось заново загружать PDF-файлы каждый раз. Возможность подключения инструментов, позволяющая модели обращаться к таким сервисам, как Consensus, и проверять факты самостоятельно, используя реальную литературу, а не собственную память. Навыки, позволяющие фиксировать стандартные рабочие процедуры и алгоритмы запросов один раз, обеспечивая согласованность результатов. Большое контекстное окно, поскольку одна пятистраничная статья содержит примерно 10 000 токенов, а две средние статьи — около 20 000, и реальный объем литературы быстро увеличивается. И возможность выполнения кода, поскольку выделенное пространство для первого этапа анализа данных экономит часы. Вот примерное положение дел. Gemini занимает первое место в категории постоянного рабочего пространства, поскольку Gemini Notebooks (ранее NotebookLM) по-прежнему является самым эффективным способом управления массивом литературы. Gemini также заявляет о самом большом контекстном окне — миллионе токенов, хотя реальные тесты показывают, что оно значительно меньше этого значения, и те же сомнения вызывают цифры, которые приводят все. ChatGPT находится где-то между 256 тыс. и 400 тыс. токенов, если не использовать API. Perplexity — самый маленький сервис, около 200 тысяч записей, что является серьёзной проблемой, если вы загружаете научные работы. У всех сервисов есть навыки, и эти навыки в значительной степени переносимы между ними, поэтому вы можете экспортировать один и импортировать его в другое место. Все они стоят двадцать долларов в месяц, при этом Gemini на один цент дешевле. На бумаге — ничья. Затем я провёл реальный тест, и ничья распалась. Claude подключил Consensus, запустил навык обзора литературы, задал мне разумные вопросы о масштабе и количестве статей и создал 26-страничный обзор со ссылками и полным журналом аудита всех использованных источников. ChatGPT в итоге создал хороший документ, но постоянно предлагал мне подключить мою учётную запись Consensus, хотя, по-видимому, уже использовал её, поэтому я не полностью доверяю его происхождению. Perplexity сообщил мне, что мне нужно больше кредитов после того, как я уже заплатил двадцать долларов, как на компьютере, так и на мобильном устройстве. Gemini Spark отказал в MCP с ошибкой привязки учётной записи и вообще не позволял мне использовать коннекторы в обычном чате. В этом и заключается весь смысл этого видео. Занятые учёные не имеют времени на решение технических проблем с четырьмя приложениями. Инструменты должны взаимодействовать, связь должна быть надёжной, а результаты должны быть проверяемыми. Один из них сегодня успешно справился с этой задачей. Чтобы было понятно, чего стоит результат: сгенерированный обзор литературы — это карта области, а не готовая к публикации обзорная статья. Он действительно полезен для первоначальной ориентации, и каждую ссылку всё ещё нужно проверять. ⏱️ ВРЕМЕННЫЕ МЕТКИ 00:00 ChatGPT против Claude против Gemini против Perplexity: что лучше для исследований? 01:54 Тест 1: постоянные рабочие пространства и проекты 03:28 Тест 2: взаимодействие инструментов и добавление MCP 05:14 Тест 3: навыки и почему они переносимы между инструментами ИИ 08:10 Тест 4: выполнение кода и анализ данных 09:17 Стоимость: что на самом деле можно получить за 20 долларов в месяц 10:37 Настоящее испытание: один обзор литературы, четыре инструмента ИИ