Дневник c00l0ne

91
91
Статистика темы
  • Популярность
    Топ-2708
  • Постов
    11,212
  • Просмотров
    1,028,786
  • Подписок
    91
  • Карма автора
    +1,143
1 551 552 553 554 561
  • CAHTEXHUK @ 05.05.26  

     c00l0ne,  нельзя сравнивать Спины по холдему, с китайским. У них очень разная диспа... Вон дианка что у него макс просадка 20-30би была.

    я про недобор, а не про просадку ... и выше расчет для  спинов по китайскому сделан)

    короче че  я объясняю , либо понял либо не понял  )

    катаешь всю жизнь в спины будь готов поймать недобор в  1500  баинов словить, ты можешь и вообще всю жизнь плюсовать ... без просадок , но недобор то останется  ... выиграл 1 млн а  должен 10  выиграть

    любая игра где есть выплата в несколько сотен баинов такая будет , кому-то должно не повезти ...

    выше расчет сделан с учетом структуры множителей в китайском и небольшим рейкбеком и РЕГ ПРОТИВ РЕГА

    ТЕМА ЗАКРЫТА
    7612/7738
    + 0
  • ахахаха

    нормальные тесты такие пошли 

    ТЕМА ЗАКРЫТА
    7613/7738
    + 0
  • 12 млн токенов контекста : 

    wow

    ТЕМА ЗАКРЫТА
    7614/7738
    + 0
  • так с китайским в принципе все понятно, а что по холдему

    вернемся к цепляющему за душу посту SnowBeaver

     


    пс напишу тут небольшие тебе заметки : 

    рук мало имхо

    по структуре бакетинг ручной ? может как-то атомарно сделать и перемешать потом через and or not xor кучку мелких атомов в более сложные структуры например: atom1 and atom2 or atom3 not atom4 (это очень глубокий уже уровень ) 

    MLP на радостях схавает

    будет очень точно 

     

    ну это не cfr конечно ... 

    ладно подумаю денек другой, проект у тебя оч крутой

    ПТ4 лега

    В принципе я понял как это работает, берутся "букеты", создаются фичи, под каждый "букет" обмазанный фичами считается предиктор ...

    Ну собственно твой catboost на вход принимает бакетинг +фичи и выдает действий процент, поправь если я не прав

     

    Пс по ощущениям это будет так себе по точности, ну если нет трилиард раздач

    Надо брать модель гтошную и фаинтюнить на базу натягивать

    Сообщение отредактировал c00l0ne - 5.5.2026, 22:04
    ТЕМА ЗАКРЫТА
    7615/7738
    + 0
  • по холдему : 

    новые работы 

    СтратФормер потом почитаю 

     c00l0ne

    GTOWizard vs ChatGPT

    поиграли против больших LLMок своей гто нейронкой

    из интересного стоимость эксперимента 5к баксов и 2000 часов времени

    ну и результаты ожидаемые, блмки льют 20 бб/100  против GTO

    детальная таблица:

    вот еще 

    еще

    фреймворк


     

    и т.д. короче работ много

     

     

    думаю 90 процентов занимаются фаинтюном LLMок

    Сообщение отредактировал c00l0ne - 6.5.2026, 5:43
    ТЕМА ЗАКРЫТА
    7616/7738
    + 0
  • c00l0ne @ 06.05.26 

    думаю 90 процентов занимаются фаинтюном LLMок

    В плане? Чтобы ллм давала покерное решение? Нет, это не сработает

    ТЕМА ЗАКРЫТА
    4/5
    + 0
  • awakening @ 06.05.26  

    В плане? Чтобы ллм давала покерное решение? Нет, это не сработает

    Да берут llama у которой 8 миллиардов параметров для каждого спота, которая натренирована впитывать языковые конструкции, скармливают просто текстовые раздачи гтошные и она учится играть в ГТО, распределяя внутри веса так чтобы выдавать правильные стратегии

    Например spingpt

    если скормить ей огромную базу крепкого рега, она будет играть как крепкий рег ...

    все это занимает 10 часов времени на дешевом железе : 

    я думаю таких ботов уже в румах просто пачками ,понятно что это 1% всего от общей поляны ... но как говориться "они есть"... сможет ли сб их обнаружить ? нет конечно, играет оно как человек в 99% потому что натренировано на человеческих раздачах ... только аудит визуальный, видеоаудит ... а это очень дорого каждого проверять по видео ...

     

     awakening, ты сразу видно старое поколение статистов ... 

    ты просто представь взгляд на раздачу с учетом тонкостей 8 млрд параметров ... вот человек смотрит когда играет на раздачу, для него важны ну параметров 10-20 ну 30 у супер топ регов может 50 ... это впип оппонента , агрессия , как он видит нашу стратегию, какой борд, какая текстура, насколько хорошо понимает рег диапазоны в данной ситуации и т.д. 

     

    а ллм смотрит с точки зрения 8млрд параметров ))) обычно ограничения как у snowbeaver возникают в ручных фичах , т.е. он вручную тормозит ллм ограничивая пронстранство анализа ... но это все имхо ... просто мысли в воздух ...

    но я редко ошибаюсь)

    Сообщение отредактировал c00l0ne - 6.5.2026, 7:10
    ТЕМА ЗАКРЫТА
    7617/7738
    + 0
  • вопрос номер 1 где взять гто решение, хотя бы нейронку какую-то приближенную гонять , чтобы был baseline

     awakening, вот ты говоришь как обнаружить ботов или там тимплей и прочее , у вас ОБЯЗАНА ДОЛЖНА быть нейросеть с гто решением , полным гто решением кеша ... 

    что делаете вы собираете статистику на БОЛЬших дистанциях , но за эту дистанцию боты выносят уже многоо , т.е. такая борьба плюсовая для ботоводов ... 

    а вы же должны крутить нейронку против них и AIVAT'ом резко снижать диспу и перехват у вас уже будет на первых нескольких тысячах раздач ... а за несколько тысяч раздач боты не смогут ничего выиграть ну максимум 1-2 стека ...  

    15 бб /100 

    3000 раздач 150+150+150 , 450 бб ожидания +- диспа туда сюда 200-600 , несколько стеков до перехвата

    ограничить вывод до первых 10 стеков и ботов вообще не будет 

    все думают с развитием технологий ботов станет больше , наоборот , детект их станет проще быстрее и реги наконец-то вздохнут полной грудью

    как только выйдут первые дешевые покерные llm в паблик , румы смогут детектить ботов в автоматическом режиме

    Сообщение отредактировал c00l0ne - 6.5.2026, 8:03
    ТЕМА ЗАКРЫТА
    7618/7738
    + 0
  • Atlas от boston dynamics

    опять в царапинах )

     

     

    ТЕМА ЗАКРЫТА
    7619/7738
    + 0
  •  c00l0ne

    c00l0ne @ 06.05.26  

    Пс по ощущениям это будет так себе по точности, ну если нет трилиард раздач

    Надо брать модель гтошную и фаинтюнить на базу натягивать

    брать ГТО-шное не надо, я уже ходил этим путём. Почти никогда реальные поля не похожи на ГТО-шные. У меня уже неплохо по точности даже на 2М рук, сейчас работаю над кластеризаций игроков и чтобы можно было смоделировать чела по небольшому объёму. 

     

    В принципе я задачу уже решил, у меня отличие любого диапазона от реального +/- 10%. Работаю над улучшением, изучаю сколько реально нужно рук для какой точности т.д. Т.е. в целом у меня уже достаточно для отсчитывания эксплойтов. Ну и надо обернуть всё в понятный сервис чтобы монетизировать. Т.е. дать людям формочку куда они кинут свою базу, потом придёт уведомление через пару суток после окончания обучения и интерфей с навигацией по дереву. 

     

    А потом пилить омаху, т.к. основной интерес именно в омахе у таких систем. Холдем уже вдоль и поперёк изучен.

     

    Сейчас мало времени из-за переезда, потом дожму. надо арендовать несколько серверов для экспериментов. Некоторые гипотезы проверяются только вычислительным экспериментом + интуиция что гонять, а что нет. Ни у одного AI нет точного маршрута как такая задача решается оптимально. Собственно с другими сколь-нибудь стоящими задачами у него тоже самое. Когда ты пилишь что-то не слишком стандартное, то у него не на что опереться и попиздить чужой результат с гитхаба.

     

    Чисто математически можно доказать, что даже анализ небольшой базы может давать качественный результат с низкой погрешностью. Тебе всего-лишь надо попасть во все частоты и показать то же на вскрытии, что сделало поле. Я решаю эту задачу обучая предикторы, но вообще эта задача также может сводиться к перебору с помощью генетического алгоритма. У меня не получилось, но возможно это более простой маршрут для AI. Вернее как... я просто потерял интерес жечь деньги на сервера с GA, т.к. сходимость деревьев и катбуста оказалась на практике быстрее. Последняя моя сборка вообще только на деревьях без катбуста.

     

    вообще вся эта херабора не представляет для меня какой-то запредельной сложности по обучению и получению результата. Самое трудное это сделать такой workflow дешёвым достаточно чтобы это продавать. Ну и собственно обернуть в продукт для продажи. Тут упаковка важнее качества решения. Очень легко пожечь много ресурсов на прототип, и потом просто забыть про него. Я так десятки раз делал для разных систем.

    Сообщение отредактировал SnowBeaver - 6.5.2026, 16:52
    ТЕМА ЗАКРЫТА
    87/125
    + 3
  • c00l0ne @ 06.05.26  

    Ну собственно твой catboost на вход принимает бакетинг +фичи и выдает действий процент, поправь если я не прав

    Задача предиктора сказать как играть в какой-то конкретной ситуации с конкретной рукой. Т.е. предиктор не в курсе про диапазон. Задача всей модели построить взаимодействие предикторов чтобы они по итогу попали в проценты действий. Желательно в как можно большем количестве точек. И предикторы используются в цикле, который в принципе хоть и грубо, но описан в статье, которую я скинул. Есть вариации этого метода, там описан на пальцах самый простой. Какие должны быть предикторы, сколько их должно быть и т.д. так то неочевидно. Не факт, что больше значит лучше здесь. Было бы очень охуенно если бы типа трансформер сам бы выделил все значимые признаки и обучился на данных, но скорее всего это будет сильно сложнее чем то что сделал я. Для меня практический и несовершенный результат лучше идеального, на рассчёт которого у меня нет ресурсов.

     

    И да, я не верю, что практический проверяемый результат тут можно получить в режиме вайбкода не разбираясь в методах. Иногда можно попросить AI написать точный спек системы, и с помощью другого (может быть более мощного) проанализировать с целью критики. Но разбираться всё равно самому придётся, т.к. если есть какой-то непонятный термин, то он обязательно поломает всё в какой-то момент.

    ТЕМА ЗАКРЫТА
    88/125
    + 2
  •  SnowBeaver, все это хорошо конечно и красиво

    но нужен baseline в виде gto... пока что доступных решений я не вижу ... 

    ни API(gtowizard только приватно дает) , ни открытой модели какой нибудь...

    из решений собирать только ну это такое...

    самому считать это вообще месяцы работы...

    возьму еще пару дней подумать ...

    ТЕМА ЗАКРЫТА
    7620/7738
    + 0
  • что кроется вот за такими новостями : 

    поставил попробовал, тесты фейковые...

    Зацикливается:

    I l be back moment

    ТЕМА ЗАКРЫТА
    7621/7738
    + 0
  • c00l0ne @ 07.05.26 

     SnowBeaver, все это хорошо конечно и красиво

    но нужен baseline в виде gto... пока что доступных решений я не вижу ... 

    ни API(gtowizard только приватно дает) , ни открытой модели какой нибудь...

    из решений собирать только ну это такое...

    самому считать это вообще месяцы работы...

    возьму еще пару дней подумать ...

    я как созрею, то опубликую более детально архитектуру. Это правда сложная задача, которая решается не с первого захода. Не топ по сложности, но думаю 8 из 10 всего что я видел в покерной аналитике.

    ТЕМА ЗАКРЫТА
    89/125
    + 0
  •  SnowBeaver, ну поняли все- оч крутой проект, но ты меня не понял, нужен baseline в виде ГТО, чтобы работать с холдемом нужно от чего-то отталкиваться, тренировал кто нибудь нейронки на ГТО в твоём окружении? Какая точность?

     

    Тот же твой проект потестировать vs gto... И т.д.

    ТЕМА ЗАКРЫТА
    7622/7738
    + 0
  • SnowBeaver @ 06.05.26  

    брать ГТО-шное не надо, я уже ходил этим путём. Почти никогда реальные поля не похожи на ГТО-шные

    Речь про фаинтюн , после него нейросеть забывает ГТО стратегию, но те места где не хватило данных остаются заполнены непрерывно без шума псевдогтопсевдоэксплойтом..., если же ты тренируешь с нуля,  то будут неровности...

    ТЕМА ЗАКРЫТА
    7623/7738
    + 0
  • c00l0ne @ 08.05.26 

    нужен baseline в виде ГТО, чтобы работать с холдемом нужно от чего-то отталкиваться

    не надо))

    ТЕМА ЗАКРЫТА
    5/5
    + 1
  • c00l0ne @ 08.05.26 

     SnowBeaver, ну поняли все- оч крутой проект, но ты меня не понял, нужен baseline в виде ГТО, чтобы работать с холдемом нужно от чего-то отталкиваться, тренировал кто нибудь нейронки на ГТО в твоём окружении? Какая точность?

    Да, тестировали. И я сам тестировал. Обучить нейронки по population tendencies возможно. Вообще можно базово предикторы строить не на катбусте, а на нейронке. Если достаточно данных, то они в пределе работают одинаково, но нейронка дороже, т.к. скорее всего нужно учить на GPU. Обучить с высокой точностью на GTO не получится, т.к. серьёзная часть GTO (солверных решений) это шум. Т.е. скажем для среднего SRP решения в омахе будет 80% meaningful info, а 20% рандомный шум (рука играется по разному зависимости от того как долго ты гоняешь солвер и не приходит к равновесию). Для более узких диапазонов можно до 95% точность иметь. Цифры для холдема не знаю, но думаю по смыслу тоже самое. Вообще я холдем использую только для отладки моделей. Цель всегда омаха, т.к. деньги в омахе.

    Тот же твой проект потестировать vs gto... И т.д.

    В любой команде которая делает похожий анализ тебе у виска покрутят при попытке обучить по GTO или сравнить с GTO. Весь ботнет уже давно соскочил с GTO. В белую такие анализы я вообще не знаю кто делает (не для ботнета). Я начинал такое делать в plomastermind, но там это overkill и деньги можно собрать проще за подписки. Но я вангую что ещё через 2-3 года не будет никаких выигрывающих регуляров без таких систем поддержки. По крайней мере в серьёзные деньги где играют. Я вообще часто пианерю в покере. Мне крутят у виска, а потом это становится стандартом. Запомни мой твит :)

    ТЕМА ЗАКРЫТА
    90/125
    + 0
  • c00l0ne @ 08.05.26  

    Речь про фаинтюн , после него нейросеть забывает ГТО стратегию, но те места где не хватило данных остаются заполнены непрерывно без шума псевдогтопсевдоэксплойтом..., если же ты тренируешь с нуля,  то будут неровности...

    да, так можно делать. В целом GTO стратегию всё равно мне считать придётся для всего где я показываю эксплойт. Т.к. ну типа я же должен описать людям разницу за что они заплатили. Может и попробую обучить на этих данных. Но смысл в том, что у меня данные это некоторый генерик, т.е. ну типа на флопе предиктор ждёт параметры IP/OOP | сколько было рейзов до | SRP и т.д. а GTO когда считаешь у тебя конкретное дерево, в этом дереве тысячи переходов на следующие улицы. и тебе одно в другое конвертировать не так уж и просто. Но конечно можно. Просто для обучения эксплойта не нужно (избыточно).

     

    Вообще всё это хорошо можно продать если покер не сдохнет и будет второй ренесанс. Не знаю что для этого должно произойти... когда ковид начался некоторые мои клиенты с дохода 10к перешли на 25к. но это были пиковые месяцы. Надо какую-то мартышачью оспу, дельфинью дезентерию... чё-то в таком духе как условия экономической целесообразности проекта :)

     

    я привёл пример проекта не чтоб повыёбываться что я крутой. Все и так знают, что я крутой :) просто пример систем, в которы AI либо совсем пасует, либо оператор AI должен быть уже скиловым программистом со знанием предметки и математики. Prompt gambling тоже работает, но тогда нужны как ты сам заметил бесконечные ресурсы, которых нет в покере. В какой-то медицине или финансах вообще нет вопросов, арендовал датацентр и посчитал модель какую угодно. В покере же скил аналитика это ещё сделать дёшего. Я помню руками бля сервера БУ-шные собирал из деталей с авито. 2 из 4 до сих пор не сгорели. Покер нищая отрасль.

    ТЕМА ЗАКРЫТА
    91/125
    + 0
  • хотите денег в покере - забудьте уже нахуй про ГТО ))) сколько можно объяснять ))) пытаться заработать на таких данных это как искать потерянные деньги под фонарём потому что там светлее. Не работает так. Лучше уж у живого тренера уроки взять и играть по чуйке, чем учиться по гто-визардскому дрочу. Но в целом для экологии это хорошо. Я бы не хотел, чтобы в покере все дружно научились анализировать данные.

    ТЕМА ЗАКРЫТА
    92/125
    + 0
1 551 552 553 554 561
1 человек читает эту тему (1 гость):
Зачем регистрироваться на GipsyTeam?
  • Вы сможете оставлять комментарии, оценивать посты, участвовать в дискуссиях и повышать свой уровень игры.
  • Если вы предпочитаете четырехцветную колоду и хотите отключить анимацию аватаров, эти возможности будут в настройках профиля.
  • Вам станут доступны закладки, бекинг и другие удобные инструменты сайта.
  • На каждой странице будет видно, где появились новые посты и комментарии.
  • Если вы зарегистрированы в покер-румах через GipsyTeam, вы получите статистику рейка, бонусные очки для покупок в магазине, эксклюзивные акции и расширенную поддержку.