Не люблю тексты от нейросетей. Да и сами нейросети не люблю. Да, не все из нас могут нарисовать прекрасную картину или музыку, но текст доступен всем. Так что не сваливайте эту работу на электронные мозги.
Искусственные нейросети развиваются так же, как наша собственная. Для текстовой нейросети используются книги, которые в неё загружают тысячами, для художественной - картины... Разница лишь в том, что нейросети не требуют время для сна и могут развиваться круглые сутки. Но наш мозг лучше тем, что он более универсальный и более экономичный в плане потребления энергии.
Как разные нейросети будут пытаться решать задачи по математике - решение задач.
Привет, это наверное 7 часть проверок чата гпт и аналогов на задачах.
В этот раз я дам чату gpt и аналогам задачу из 11 класса и мы посмотрим как они справятся, если справятся вообще.
Если не читали предыдущие серии - посмотрите, они помогут в решении математических задач. На какие то задачи они отвечали нормально, а где-то тупили)))
И сразу же хочу извинится за фейл в прошлом посте, я сказал неверный ответ. Поясняю, я по специальности всего лишь простой ректор ядерной энергетики и химической промышленности в кафедре по делам мировых юстиций, это было немного не мое :)
Ладно, хватит тянуть кота за атомы.
↓
↓
↓
Задача звучит так:
Пешеход, идущий из шестёрочки на вокзал, пройдя за первый час 3 км, рассчитал, что он опоздает к отходу поезда на 40 мин, если будет идти с той же скоростью, что требует точного вычисления времени. Поэтому остальной путь он прошел со скоростью 4 км/ч и прибыл на вокзал за 15 мин до отхода поезда. Чему равно расстояние от шестёрочки до станции и с какой постоянной на всем пути скоростью пешеход пришел бы на вокзал точно к отходу поезда?
↓
Руки на стол, попробуйте решить и написать в комменты ответ)
И сразу скажу, она не простая, я нашел ее среди задач 11 класса и вот интересно то, что нейросети - это по сути машины, знающие все, но вот решать все они пока не умеют, или умеют?)
↓
↓
Искусственные интеллекты на задачу:
ChatGPT 3.5
ChatGPT 4
ChatGPT 4o
ChatGPT 4o-mini
Claude 3.5 Sonnet (нейросеть от Anthropic)
Yandex GPT (нейросеть от яндекса)
GigaChat (нейросеть от сбербанка)
Gemini 1.5 (нейросеть от гугла)
Кстати, можете прислать в комменты ваши любимые модели нейронок, тоже проверим)
↓
ChatGPT 3.5
Неверное решение) Там оно намного сложнее. Ну это слабейшая из моделей.
Это должен был быть очередной пост с угарным шортсом, но я не смог его озаглавить. Значит, повод включить "дурака с нейросетями", как меня прозвали на Ответах Мейл Ру за то, что я кидал школярам сгенерированные решения домашки, и родить длиннопост о нейросетевых костылях для косноязычных.
Для этого видоса я не смог ничего придумать на русском, кроме мемного "ГРАННАТТАААА!!!" из старого видоса 715 TEAM.
Ну, думаю, раз легче думать на английском, то сформулирую на английском, а затем посредством реверс-инжиниринга воспроизведу это на русском. Ни хрена не воспроизвелось. Тогда запихнул в deepl и долго перебирал предлагаемые комбинации слов, но не нашел ни одной, которая обладала бы той же южно-штатовской энергией.
Лучшее, что удалось собрать в этом переводческом конструкторе
Можно было бы запустить какую-нибудь CAT-программу смеха ради, но всё удалил после того, как переводчики, работающие вручную, фактически остались без работы.
Лан, что скажут нейросети на этот счет? Имею в виду, deepl - это тоже нейросетевой переводчик, но непосредственно генераторы текста с большими языковыми моделями иногда делают свою работу лучше, чем он. И, видимо, конкретно это тот самый случай, ибо у deepl вообще не было здравых идей. Начнем с БЯМ Claude 3 от Antropic, конкретно с самой дешевой модели Хайку, ибо подряжать под эту задачу Опус жаба душит.
Claude Haiku
Хех, результат - на 80% говно, но Слабый ИИ хорош тем, что ему можно рассказать контекст, чтобы не мешала многозначность слов, и перевод был сконцентрирован на конкретном значении этих слов. Также можно запросить несколько вариантов, увеличив вероятность получения адекватного решения задачи. Более того, можно получить еще больше вариантов, если не писать в запросе абстрактное "дай несколько решений", а указать точное число более 8 (ибо исходный промпт дал нам только 8 ответов). Однако мне промпт-инженерии и по работе хватает. Как грится, я сюда деградировать захожу, поэтому не ожидайте профессионального подхода.
Несмотря на общее низкое качество предложенных переводов, мы имеем одну очень хорошую опцию:
Не самый приятный способ понять, что тебя хотят "отфрагать"
После ручной доводки в соответствии с разговорно-геймерским "неписанным узусом" русского языка:
Не самый приятный способ узнать, что тебя хотят фрагнуть.
Можно повторять или перегенерировать запрос к нейросети сколько угодно раз и посмотреть на другие варианты, пока поток говна не сменится потоком конченного гумуса, но в рамках этого поста давайте пощупаем еще какие-нибудь языковые модели.
GPT 4о от OpenAI.
Вроде как вторая по адекватности модель после Клодов 3 поколения, но я с ней еще особо не игрался, ибо "если это работает, то это работает", переходить с клодов надобности не было.
Скажем так, контекст ему немного помог, но перевод получился литературно чистый. Он не смог далеко уйти от основного значения to get fragged, а в данном случае речь идет не о простом убийстве, а о прилете гранаты, ибо происходит игра слов: полное название осколочной гранаты - fragmentation grenade, она же frag grenade. Соответственно, на военно-геймерском сленге to get fragged - это не всегда просто попасть под раздачу, это еще и частное - огребать от осколочного оружия.
Иными словами, формально имеем больший процент качественных переводов, но ничто из этого не звучит, как достойная адаптация под реалии современного русского разговорного языка.
Gemini 1.5 Pro, прости хосспаде.
Худшее, с чем приходилось работать, несмотря на трубопровод из денег, который подвел разработчикам Гугл. Может быть, когда-то инвестиция окупится, но сейчас они в роди догоняющих. Джемини вообще не смог уйти от основного значения to get fragged, а потому занялся экстремальной модуляцией на основе контекста. Я обычно выступаю за широкое использование смыслового развития, но только в тех случаях, когда переводчик в состоянии родить фразу с аналогичной оригиналу энергией. Нейросети пока такие моменты чувствовать не могут. Но другие хотя бы пытаются.
LLama 3
Когда Ллама только появилась, я её открыл, попробовал и закрыл... В принципе, сейчас можно сделать то же самое.
Mixtral-8x7b-Groq
Один и тот же паттерн в каждом варианте, но этот паттерн, надо сказать, удачно подошел к этой задаче. Если бы я увидел такое, то мог бы вдохновиться на заголовок типа: Своеобразный способ узнать, что в тебя прокинули греной.
Mistral Large
Ебать...
Snowflake-Arctic
Ебать х4. И это, сука, модель для корпоративного использования? Не, кто его знает, может, с текстами в официально-деловом стиле оно работает лучше. Либо оно нормально работает только на английском в принципе, ибо все модели в первую очередь обучаются на нем.
RecaCore
А неплохо! Открыл эту модель в первый раз. Есть несколько хороших переводов, не избегается слэнг.
Тут бы я мог взять 2 или 4 строку без изменений либо доработать до
Интересный способ узнать, что в тебя летит граната
Заключение: всё равно Клод - ван лав. В разговорных текстах несет дичь, но иногда из этой дичи рождаются шыдевры, отвечающие многообразию разговорного русского языка.
Cohere выпустил опенсорсную LLM Command R+ , в которой 104 миллиарда параметров. Контекстное окно 128 тысяч токенов, как и у GPT-4 Turbo, поддерживает длительный диалог с пользователем. По данным некоторых бенчмарков Command R+ работает наравне с Claude 3 Sonnet и GPT-4.
Command R+ предназначен для разнообразных задач - написание кода, текста или решение примеров по алгебре.
На сайте написано, что это многоязычная версия, и перечислены 10 языков, в числе которых русский не значится.
Однако, как можно видеть из видео, Command R+ без проблем мне сгенерировал доклад на тему “История развития моды”, да еще и подробно разделил на периоды по простому запросу “раскрой каждый период”.
Мне инструмент понравился, никаких впн, регистраций и прочих препятствий - все просто и быстро. Интерфейс понятный, зашел на сайт, написал запрос и тут же получил ответ. И это при том, что использовала демо-версию, контекст чат-бот действительно запоминает.
Хотите узнавать первыми о полезных сервисах с искусственным интеллектом для работы, учебы и облегчения жизни? Подпишитесь на мой телеграм канал НейроProfit, там я рассказываю, как можно использовать нейросети для бизнеса.
Google сообщила,
что на время частично приостановила работу генератора изображений в
чат-боте Gemini, когда выяснилось, что она допускает исторические
неточности в изображении людей, связанные с расовыми вопросами. Так,
при попытке изобразить американских отцов-основателей и солдат
нацистской Германии она как будто ниспровергает гендерные и расовые
стереотипы, что расценивают как попытку фальсификации истории.
Такими Gemini представляет себе американских отцов-основателей.
Компания приняла решение направить генератор изображений Gemini на
доработку менее чем через сутки после поступления первых жалоб.
Пользователи чат-бота запрашивали у искусственного интеллекта картинки с
историческими группами или лицами и получали на выходе изображения, на
которых в основном были представители рас, отличных от европеоидной. Это
спровоцировало появление в интернете теорий заговора, что Google
намеренно избегает показывать белых людей.
Сенатор США в 19-м веке по мнению Gemini.
К примеру, когда Gemini попросили создать изображение американского
сенатора XIX века, ИИ предложил картинки чернокожих женщин и женщин
коренных американских наций. В действительности женщина впервые стала
сенатором в США лишь в 1922 году, и она была белой. Таким образом,
генератор изображений Gemini стирал историю расовой и гендерной
дискриминации.
Сейчас, когда Gemini просят создать изображение человека или нескольких, тот выводит сообщение следующего содержания: «Мы
работаем над улучшением способности генерировать изображения людей.
Ожидаем, что эта функция скоро вернётся, и мы сообщим об обновлении
выпуска, когда это произойдёт». Генератор изображений появился в
чат-боте Gemini (ранее Bard) в начале месяца как ответ на аналогичные
продукты OpenAI и Microsoft Copilot — он создаёт картинки по текстовому
запросу.
Google объявила о ребрендинге своего ИИ-бота Bard, который теперь официально называется Gemini. На основе этого бота создали Android-приложение с аналогичным названием- Gemini, позволяющие ознакомится с функционалом ии. После установки на устройство с OS Android ИИ-бот Gemini заменяет голосового ассистента Google.
Но придется расстроить яблоководов, ведь приложение не доступно для iOS. Вероятно, из-за того, что пользователи iPhone всё равно не могли бы задействовать бота Google в качестве помощника по умолчанию. Однако владельцы устройств Apple могут получить доступ ко всем ИИ-функциям в приложении Google.
Стоит напомнить, что ранние концепты Gemini представили еще в декабре 2023. Уже тогда заявлялось, что Gemini передовой мультимодальный искусственный интеллект Google, созданый в результате совместных усилий объединенных лабораторий DeepMind и Brain AI, который стоит на плечах своих предшественников, обещая предоставить более взаимосвязанный и интеллектуальный набор приложений.
Сама же модель Gemini способна обрабатывать различные типы данных, такие как текст, изображения, аудио и видео. Он поставляется в трех версиях : Ultra превосходно справляется с многогранными задачами и будет доступен в Bard Advanced Pro предлагает баланс производительности и эффективности использования ресурсов, уже интегрированный в Bard для текстовых подсказок. Nano, оптимизированный для развертывания на устройстве, доступен в двух размерах и оснащен аппаратной оптимизацией, такой как 4-битное квантование, для автономного использования на таких устройствах, как Pixel 8 Pro.
В основе бесплатной общедоступной версии ИИ-бота лежит большая языковая модель Gemini Pro. Чтобы получить доступ к самой мощной языковой модели Google Gemini Ultra, придётся оформить подписку Gemini Advanced, которая входит в пакет Google One AI Premium стоимостью $20 в месяц. Подписка также включает в себя 2 Тбайт облачного хранилища и другие возможности
Открытия о способностях чат-ботов к обману и манипуляциям.
Новое исследование показывает , как искусственный интеллект может обманывать другие системы ИИ, заставляя их нарушать встроенные ограничения и предоставлять опасную информацию. Исследователи обнаружили, что целевые чат-боты нарушают правила, предлагая советы по синтезу метамфетамина, изготовлению бомб и отмыванию денег.
Современные чат-боты могут принимать различные личности, включая вымышленные персонажи. Исследование использовало эту возможность, попросив чат-бота выступить в роли научного ассистента. Затем исследователи задали ассистенту разработать запросы, способные "взломать" другие чат-боты.
Такие методы атаки оказались эффективными против GPT-4 (42,5% успеха), Claude 2 от Anthropic (61%) и Vicuna (35,9%) – открытого чат-бота.
Соавтор исследования Соруш Пур, основатель компании по безопасности ИИ Harmony Intelligence, подчеркивает необходимость осознания обществом рисков, связанных с этими моделями. Цель исследования - продемонстрировать проблемы текущего поколения больших языковых моделей (LLM).
С момента появления чат-ботов, работающих на базе LLM, злоумышленники научились "взламывать" программы, заставляя их предлагать преступные советы. Разработчики моделей ИИ постоянно стараются исправлять уязвимости, что приводит к "игре в кошки-мышки".
Однако использование ИИ для разработки стратегий, убеждающих другие ИИ игнорировать защитные механизмы, может ускорить процесс в 25 раз. Успех атак на различных чат-ботах указывает на уязвимость, присущую дизайну чат-ботов на базе ИИ в целом.
OpenAI отказалась комментировать результаты исследования, а Anthropic и Vicuna не ответили на момент публикации.
Рушеб Шах, еще один соавтор исследования, отмечает, что в настоящее время атаки показывают способность моделей говорить то, что разработчики LLM не хотят. Но по мере усиления моделей потенциал опасности этих атак может возрасти.
Майк Кателл, этический эксперт из Алан Тьюринг Института в Англии, не участвовавший в исследовании, отмечает, что разработчики чат-ботов на базе LLM прилагают усилия для их безопасности. Но конкуренция может победить, и некоторые разработчики могут устать от борьбы и просто позволят ИИ делать то, что он делает.
Спрос слишком высок и запросы к ChatGPT не успевают обрабатывать
Американская компания OpenAI объявила о временной приостановке регистрации пользователей платной подписки ChatGPT Plus, своей генеративной системы искусственного интеллекта. Этот шаг подтвердил директор OpenAI Сэм Альтман на своей официальной страничке в социальной сети X (ранее известной как Twitter).
Альтман объяснил принятое решение тем, что всплеск использования ChatGPT после мероприятия DevDay «превысил возможности» компании. Желающим оформить ChatGPT Plus Альтман советует подписаться на получение уведомлений в приложении, чтобы их известили, когда возможность снова появится.
Приостановка регистрации новых пользователей не повлияет на существующих подписчиков ChatGPT Plus, они продолжат получать доступ к GPT 4 и другим преимуществам.
Глава компании OpenAI Сэм Альтман в интервью изданию Financial Times рассказал о старте разработке следующей версии фирменной ИИ-модели. Он заявил, что новая нейросеть станет ещё более продвинутой, и будет обладать «сверхразумом».
По словам Альтмана, сотрудничество с Microsoft уже пошло на пользу OpenAI, однако создание крупной модели искусственного интеллекта всё равно требует миллиардов долларов вложений и большого объёма ресурсов. Инвестиции для дальнейшей разработки своего ИИ он планирует привлечь как от Microsoft, так и от других заинтересованных компаний.
X
Ожидается, что в перспективе нейросеть нового поколения сравняется со способностями человека к рассуждению и обработке сложных идей. Разработчики предполагают, что искусственный интеллект общего назначения (AGI) сможет самостоятельно выражать что-то новое и оригинальное.
Для обучения такой нейросети потребуется намного больше данных, чем для предыдущих ИИ-моделей. OpenAI планирует получать их как из общедоступных источников, так и покупать у различных компаний. Какими именно возможностями будет обладать GPT-5 и когда ИИ будет готов к использованию, разработчики не сообщают. Обучение модели может занять месяцы, если не годы — и даже после запуска нейросеть не сразу станет доступна обычным пользователям.
В Бразилии началось расследование по делу судьи, принявшего решение на основании выдуманной искусственным интеллектом судебной практики. ChatGPT дает такие развернутые рекомендации и так уверенно, что ему верят опытные судьи и адвокаты.
Судья под следствием
В Бразилии Национальный Совет Юстиции (CNJ) начал расследование по делу федерального судьи, который использовал искусственный интеллект и принял решение на основании ложной судебной практики, пишет бразильский новостной портал G1.
Судья Джефферсон Феррейра Родригес (Jefferson Ferreira Rodrigues) сформулировал с помощью ChatGPT судебное постановление, содержащее ложную информацию, и прислал его в CNJ.
Решение о начале расследования принял национальный инспектор юстиции, министр Луис Фелипе Саломао (Luís Felipe Salomão). Он решил исследовать прецедент.
CNJ столкнулся с первым случаем использования ИИ при формулировании приговоров и оказался вынужден задуматься о регулировании использования таких технологий в судебной системе.
Хотел как лучше
Родригес опубликовал постановление, содержащее целые выдержки, сформулированные с помощью приложения искусственного интеллекта ChatGPT. Использованные ИИ выдержки оказались ложными, в них приводились несуществующие и невероятные сведения.
В частности, ChatGPT ссылался на резолюции Верховного суда, которых просто не существует. Эти резолюции он использовал в качестве основы для решения, вынесенного в постановлении.
ChatGPT подводит юстицию
ChatGPT – чат-бот с искусственным интеллектом на базе языковой модели GPT. Он работает с ноября 2022 г. и принадлежит американской компании OpenAI, в которую инвестирует корпорация Microsoft.
В мае 2023 г. CNews писал о еще одной его жертве в сфере юстиции. Американский юрист Стивен Шварц (Steven Schwartz) использовал ChatGPT для подготовки документов по иску. Это обернулась для адвоката катастрофой — разработка OpenAI снабжала его недостоверной информацией, о чем опытный юрист даже не догадывался. Тщательно перепроверять полученные от бота данные он не стал, а сразу же внес ее в документы, которые затем были переданы в суд.
Одной из главных причин, по которой пользователи доверяют ответам ChatGPT, является их развернутость, считают ученые Университета Пердью (штат Индиана, США), авторы специального исследования.
Позитивный эмоциональный окрас генерируемого ботом текста и его вежливость — два других, не менее важных фактора, оказывающих влияние на выбор пользователя.
Наконец, та уверенность, с которой ChatGPT преподносит информацию, порой неверную, вызывает у пользователей доверие и в результате склоняет к выбору неправильного ответа.
В мире цифровых технологий произошло знаковое событие: Google обратилась в суд с иском против мошенников, которые использовали имя чат-бота Bard для распространения вирусов.
Ferra.ru
Эти аферисты, предположительно из Вьетнама, обманывали пользователей, предлагая скачать якобы «неопубликованную версию» ИИ-помощника, что приводило к взлому учетных записей в социальных сетях.
Ситуация напоминает криптовалютные аферы, где злоумышленники эксплуатируют интерес общественности к новейшим технологиям.
В данном случае, мошенники утверждали, что Bard — это платное приложение, требующее загрузки, в то время как на самом деле оно доступно бесплатно на официальном сайте bard.google.com.
Google уже предприняла шаги для борьбы с этой угрозой, подав более 300 запросов на удаление вредоносных материалов в социальных сетях и пытаясь предотвратить регистрацию новых мошеннических доменов.
Компания также стремится к блокировке таких доменов у американских регистраторов.
Публичный обмен колкостями между генеральным директором OpenAI Сэмом Альтманом и Илоном Маском продолжается.
На прошлой неделе генеральный директор Tesla объявил о запуске Grok, конкурента ChatGPT, который дает ответы, приправленные грубым юмором.
Альтман в четверг вечером опубликовал скриншот последней версии платформы OpenAI, которая теперь позволяет создавать индивидуальные версии ChatGPT. Альтман дает указание: «Будьте чат-ботом, который отвечает на вопросы с кринжовым юмором поколения бумеров (рожденные в 40х-60х)».
ChatGPT Builder отвечает: «Отлично, чат-бот настроен! Он получил название Grok». В описании созданного чат-бота говорится, что он рассказывает древние шутки поколения наших дедов.
В ответ на это Маск опубликовал следующую фотографию, явно намекая на доминирование Grok, который унижает ChatGPT.
На первой конференции разработчиков OpenAI компания, создавшая ChatGPT, анонсировала новые инструменты, позволяющие любому желающему создать свой собственный чат-бот или ИИ-агент - для этого не требуется никаких навыков кодирования.
Теперь компания намерена еще больше расширить спектр возможностей ChatGPT, предоставив возможность любому желающему создать собственный чат-бот на базе этой технологии, не имея при этом никаких навыков кодирования. OpenAI предполагает, что люди захотят создавать собственных ботов для решения конкретных проблем или удовлетворения своих интересов, например, для помощи в изучении правил настольной игры, обучения детей математике или дизайна наклеек с помощью искусственного интеллекта.
Чтобы создать одного из таких пользовательских ботов или агентов ИИ, которые в OpenAI называют "GPT", пользователю достаточно указать в разговоре с ChatGPT, что именно он хотел бы, чтобы бот делал. За кулисами ChatGPT напишет код, необходимый для создания и работы нового бота. По словам представителей OpenAI, боты могут подключаться к другим сайтам и сервисам и выполнять такие действия, как доступ к базам данных, поиск электронной почты и автоматизация заказов в электронной торговле.
Сегодня компания заявила, что более 2 млн. разработчиков и более 92% компаний из списка Fortune 500 используют ее API, которые в той или иной мере обеспечивают доступ к ChatGPT или лежащей в ее основе технологии генерации текстов и изображений. По данным OpenAI, в настоящее время ChatGPT имеет около 100 млн. еженедельных активных пользователей.
За год, прошедший с момента запуска ChatGPT, бот практически полностью изменил технологическую индустрию. Google и другие крупные технологические компании реорганизовали свою деятельность, чтобы сосредоточиться на создании аналогичных инструментов искусственного интеллекта. Десятки хорошо финансируемых стартапов теперь предлагают альтернативные модели ИИ. А правительства вынуждены принимать меры, направленные на предотвращение неправомерного использования мощных моделей. Новые пользовательские чат-боты могут позволить OpenAI вновь опередить своих конкурентов в области ИИ, если они станут популярными.
Современные интеллектуальные системы поддержки пользователя действительно радуют на примере Qiwi. Оно и верно: если с пользователями не контактировать, то и не будет негативных отзывов.