лучше любой рекламы :
два розовых кстати за столом ...
т.е. на феноме даже тимплееров не банят по мнению регов)
ну ок давай-те проверим тимплеят ли они, два розовых американца
справа korextron это видимо Егор Цурихов из Los Angelos
Yegor Tsurikov (@korextron_hs) / Posts / X
профессиональный покерист и игрок в харстон
а ifhaditall слева сидит это
тоже покерный профессионал
вот еще инфа с таким же ником
время прикольный историй. что делать если вы по ошибке зарегались на фт в ху снг :
фишные стартера , никогда не сыграю как они
фиши короче
а учитывая что он потом пошел играть по 0.5 hu
наврятли это тимплееры
вы типо специально starper80 говорите, чтобы он не играл :?
просто он вот так ставит стартера сам и с такими стартерами не выигрывают в прогрессивный и в классику тоже :
это три слабых игрока встретились за столом... из которых максимально компетентный справа игрок в харстон
после ваших сообщений катка развалилась кстати -поляна
или есть четкие скриншоты раздач что они тимплеят
единственное что меня смутило это тайминги, каждый ход по 10-20 сек ... как роботы...
polymarket взлетел:
а про этот забыли поднять до 95 :
mythos должен 50%+ пробить
попросил подсобрать рынок торгов относительно mythos:
кекв:
ждун ждет :
о цене :
10$ input / 50$ output , терпимо короче
через 10 часов конференция в Японии начнется
пс
имхо после mythos всем придется булочки поднапрячь и резко ускориться )
ждем на этой неделе еще gpt 5.6-pro и от google движ ... либо они отстанут в гонке и потеряют оч много денег...
БУМ БАМ БИГЕЛОУ
бенчмарки взрывные 2х от опуса
они это сделали :D
бенч топовый :
тут задачи уровня создай ОС , компилятор , перепиши огромные кодовые базы ... в автономном режиме...
swe-bench pro:
openai and google RIP
c00l0ne, а сбойный Opus 4.8 не починили... я пока на 4.7 вынужденно работал. Но раз нет смысла больше использовать...
c00l0ne, очень смешно кстати клод пишет на русском. постоянно свои слова придумывает, которых не может быть в русском. Аннилинг зачёт :) ну и да, смысл слов ускользает. В русском никогда так не пишут, пишут "иммитация отжига". часто приходится догадываться. Иногда может написать что-то вроде "чистию". Может быть это наоборот крутяк, что сетка пытается строить слова, которые ей нужны.
имхо под твою задачу лучше не спрашивать короткий вопрос и ждать ответа. Типа так мы используем LLM в режиме гугла продвинутого и только. Лучше написать длинный спек с описанием чего нужно \ чего избегать \ какие тесты должны быть пройдены. Сейчас можно использовать под это https://github.com/obra/superpowers , оно само без спеков не даёт переходить к кодингу и как-то структурирует поведение пользователя. короче, TDD подход рулит. Потом всё равно адъ вычитывать, но хоть больше шансов что в метрики попало.
P.S. он тебе всё равно советует гонять модификации CFR до сходимости при том что там нет сходимости... не слишком умно. хочется не полотно слопа получать многостраничного а короткий ответ типа "вот так делай" или "не работает то что ты просишь". а дальше уже если надо, то уточнять. Очень тяжко на любой запрос даже предполагающий да \ нет вычитывать полотно минимум на 2 экранных страницы.
ещё не слишком прикалывает выбирать самому модель под вопрос. Я типа сам должен оценить сложность того, что прошу и знать примерно возможности всех этих моделей которые раз в неделю обновляют... чё бы им автоматический режим не включить? может знаешь какую приблуду, которая это делает поверх LLM? типа MCP анализа необходимой модели. Т.к. если я скажем выбираю opus для задач где нормально sonnet с головой, то в итоге у меня дольше ожидание и лишние токены с подписки сжигаются.
SnowBeaver, там энкодер декодер же ... внутри модели векторы смысловые ... а потом в слова обратно декодируются ...
SnowBeaver @ 09.06.26спек с описанием чего
как говорят великие "не нужно ограничивать модель" )) своими унылыми спеками)
SnowBeaver @ 09.06.26предполагающий да \ нет вычитывать полотно минимум на 2 экранных страницы
не читай)
SnowBeaver @ 09.06.26ещё не слишком прикалывает выбирать самому модель под вопрос. Я типа сам должен оценить сложность того, что прошу и знать примерно возможности всех этих моделей которые раз в неделю обновляют... чё бы им автоматический режим не включить? может знаешь какую приблуду, которая это делает поверх LLM? типа MCP анализа необходимой модели. Т.к. если я скажем выбираю opus для задач где нормально sonnet с головой, то в итоге у меня дольше ожидание и лишние токены с подписки сжигаются.
блин заведи второй аккаунт я не знаю , ты серьезно 100 баксов жмешь или 200 ?)
у меня по апи траты 4k $ и выхлопа с этого ровно 0 ))
плюс на подписки еще 1к $ )
ЗАВЕДИ СЕБЕ 10 ПОДПИСОК и пользуйся ТОЛЬКО OPUS 4.8 , а сейчас приходит MYTHOS
не знаю какие там лимиты будут , но я через api только мат часть гоняю через тяжелые модели ... потом теорию копирую в кодекс и он уже может заниматься кодовой базой ... я выше же писал пайплайн ...
этот пайплайн дает SOTA результаты в кодинге у меня ...
c00l0ne @ 09.06.26как говорят великие "не нужно ограничивать модель" )) своими унылыми спеками)
если есть цель решить свою задачу, то пиши спек. Если нет цели, а только путь, то не пиши :)
не читай)
так я ж работаю тоже с этим :) на работе типа :) у меня нет вариантов не читать.
по моим задачам на 80% я бы сказал достаточно sonnet. А на тех где хотелось бы чтобы сеть подумала opus не хватало всё равно. буду теперь с Басней этой пытаться на таких тасках. Часто opus это оверкил и думает сложно. пытается за тебя придумать и предугадать, в итоге это бесит на несложных тасках. Ты просишь тебе прикурить дать, а оно тебе про все сорта табака пишет... при этом бывает что задача уже давно в скилах, делаешь её буквально через день, а всё равно пытается что-то переспросить и живёт своей жизнью.
SnowBeaver,
у тебя три области должно быть
1. теоритическая
2. экспериментальная
3. продакшн
и они не должны пересекаться между собой никоим образом , все иишки изолированы друг от друга
Fable огонь :)
opus не смог
fable
всё, принимайте меня тоже в секту ))) прод в пятницу это правда смешная шутка.
SnowBeaver, именно для этого они тренировали эту нейронку за сотни миллионов долларов )
займись делом ) еще считать сколько букв "r" в слове "strawberry"
шутки хорошие, стихи я видел оч хорошо пишет
c00l0ne, так не нужна она мне для дела :) избыточна. Но чувство юмора хоть есть. И не пофиксили цензурой. Скорее всего не на долго. Вангую, что через неделю тоже будет пушистый как опус.
SnowBeaver @ 09.06.26c00l0ne, так не нужна она мне для дела :) избыточна. Но чувство юмора хоть есть. И не пофиксили цензурой. Скорее всего не на долго. Вангую, что через неделю тоже будет пушистый как опус.
нет, тут они по другому пути пошли, залезли глубоко в мозги , нашли векторы опасные и их подрезали ...
при их активации теперь safeguard включается , а все остальное доступно ...
запрещенка : биологическое оружие, просто оружие , кибероружие и т.д.
а что не запрещено - то разрешено , но думаю он записал тебя в список : "заставляет меня материться", аккуратнее )
c00l0ne, оно понимает саркастический тон вопросов! это уровень
главное оно продолжает саркастический диалог
говорит про пизду пожалуйста, а рецепт чумы не выдам :) говно с прерываниями это тоже очень тонко про новую OC. Там сорок лет чужих граблей ))) это не пишется, это выживается )))) я б так хорошо не сказал.
принтер для небоскребов: