Racoonamatata,
У Gemini 3.1 Pro вроде неплохо вышло
Я бы мб перевел как "они говорили о традиционной семье примерно так же, как о традиционном оружии массового поражения".
Охламон @ 08.08.26То что пока ИИ не идеальная система это понятно, давайте обсудим какие задачи он выполняет круто и можно более уверенно относиться к результату?
В целом любые, если дать точный короткий запрос.
То есть в примере Растина, если написать эссе на тему погоды, пожеланий и прочего без конкретики, то ИИ на данный момент не в состоянии точно и полно дать ответ. И, кстати, его последующее "извини за неверный ответ" следует читать как "я не смог точно додумать, какие конкретно нюансы надо было учесть".
А если написать "найди билеты из Москвы в Токио на такие-то даты", то, как мы видим, ответ будет четкий и правильный.
Если мы хотим узнать, в какие города Японии летают самолеты из Москвы, то запрос "найди билеты в Японию" скорее всего не даст нам ответа, а вот запрос, внезапно, "в какие города Японии летают самолеты из Москвы?" - даст.
Резюмируя, чем проще и понятней запрос, тем выше вероятность верного ответа.
Mercator, Как бы ты сформулировал запрос для ИИ оценить вероятность того что РомеоПро играет полностью сам?
Mercator, а в какиих ситуациях ты пользуешься Deep Thinking, а в каких более простыми моделями? Хватает ли тебе токенов за 20 баксов?
Охламон, Мне кажется, сравнение немного не туда ушло: кидать головоломки в веб-чат — это тест модели, а сейчас основная разница делается не моделью, а харнессом (обвесом вокруг неё: агентный цикл, инструменты, память, доступ к файлам и сети). Одна и та же модель в вебчате и в нормальном агенте — это два очень разных результата. Вебчат отвечает «из головы» за один заход, агент — сам ищет, сам проверяет, сам исправляется, гоняет цикл десятками шагов.
Claude Code, Codex/ChatGPT — у всех фронтиров сейчас свои агентные обвесы, и они дают заметно другой уровень, чем те же модели в браузере. Например, держу дома собственного агента на Hermes (Nous Research, крутится в докере) — и вот он показателен: сидит на бесплатном DeepSeek, а делает вещи, которые вебчату не снились. Сделал ему скил deep-research, реально накапывает по теме то, чего в вебчате дипресерчи платного гемени не находил; сам себе доставляет инструменты (MCP-серверы), шуршит в терминале, под задачу ставит что надо и потом ими пользуется; ведёт моё хранилище в Obsidian — тянет оттуда контекст по любому вопросу и сам же его пополняет своими сводками и изысканиями. То есть у него есть накопленная база и руки, а не только «подумать один раз». Живет в докере, чтобы не шарился по всему компу.
А общение в телеге, вообще другой уровень вовлеченности)))
Так что «ИИ не смог / ИИ смог» на головоломках — это про модель. А практическая польза сегодня в основном про обвес: при одинаковой модели разница между вебчатом и агентом больше, чем между соседними поколениями моделей.
Охламон @ 08.08.26Mercator, а в какиих ситуациях ты пользуешься Deep Thinking, а в каких более простыми моделями? Хватает ли тебе токенов за 20 баксов?
У меня ChatGPT 5.6 Sol, у него есть три варианта: High, Medium и Instant (5.5). Я всегда пользуюсь исключительно High, т.к. не вижу ситуаций, когда готов пожертвовать качеством ответа ради экономии минуты-другой.
Подписка за 20 баксов дает неограниченное количество подходов к снаряду, так что не хватить ее мне не может чисто теоретически.
Что касается Codex (агента для кодинга от ChatGPT), то там действительно есть лимиты по токенам (они называются Кредиты). Но я только начал им пользоваться, пока не понятно, хватит ли мне стандартных 20 долларов или придется докупать.
Mercator, а проверяешь альтернативный ответ в другой модели?
например взят ьвывод из одной и попросить оценить вторую, или просто тот же алгоритм вопросов, есть в этом резон?
Всем кто тут пишет вещи вроде "нейросеть не смогла решить загадку, революция отменяется" или "нейросеть не смогла найти мне дешёвые билеты. Кем вы собрались заменять людей?", хочу напомнить что компьютер всё ещё не может назвать случайное число так, чтобы оно было действительно случайным. Наивная глупость стараться с помощью баллистической ракеты охотится на оленя, при этом даже не прочитав инструкцию.
Danxooo, ну ты тоже хитришь немного)) собери квантовый рандомайзер и избавишься от детерменизма
Mercator @ 18.07.26График логарифмический. Было падение на 94%, потом рост и с тех пор +-7 иксов туда-сюда. В 2017 году был рост в 75 раз! Финальный итог х8 за 12 лет, что составляет 19% годовых.
интересно, получается биткоин за это же время вырос в х115, причем выше ликвидность, надежность, не надо возиться с альтами, доп риски и т.д.
х8 и х115 слишком уж большая разница.
Galax @ 18.07.26Я правильно понимаю, что итоговая доходность выросла до х72 (а предыдущий результат был х13)?
х72 и х115 тоже прилично далеко.
Похоже, альта не настолько перспективна, как казалось. Есть надо чем подумать.
А может кто-нибудь попросить платные версии перевести текст с сохранением игры слов во втором предложении? Бесплатные ChatGPT, DS и Gemini справляются не очень.
They all planned to be wives and mothers, and yet they absolutely hated men and kids. They talked about nuclear families the same way they talked about the nuclear bomb.