Forwarded from Хитрый Питон
Пару недель назад я писал про то, насколько больше security-отчетов теперь приходит для CPython по сравнению с предыдущими годами. Казалось бы - берешь llm, она пишет тебе патч - и готово, profit. И тут как раз 1password опубликовали исследование, которое показывает, что это пока так не работает.
Они сгенерировали более 6000 патчей для 6 разных уязвимостей с помощью opus 4.8 и chatgpt 5.5, обе в версии для security-специалистов (т.е. там были убраны часть ограничений). Результат? Только 26% патчей полноценно устранили уязвимость. Ещё 20,1% проблему закрыли, но работа приложения изменилась, читай "побочные эффекты". Самое забавное, в 2,1% случаев проблема не была устранена, так еще и появилась новая уязвимость. Хуже того, в трети "успешных" 20,1% на самом деле llm-ка фиксила не первопричину проблемы, а конкретный пример атаки, описанный в промпте.
Вывод? Llm-ки очень удобны и могут ускорить разработку - но и голову тоже нужно включать и смотреть, что там интеллект нагенерил - ревьюить, править, тюнить. Ссылка на статью: https://1password.com/blog/why-ai-generated-patches-still-require-human-review
Они сгенерировали более 6000 патчей для 6 разных уязвимостей с помощью opus 4.8 и chatgpt 5.5, обе в версии для security-специалистов (т.е. там были убраны часть ограничений). Результат? Только 26% патчей полноценно устранили уязвимость. Ещё 20,1% проблему закрыли, но работа приложения изменилась, читай "побочные эффекты". Самое забавное, в 2,1% случаев проблема не была устранена, так еще и появилась новая уязвимость. Хуже того, в трети "успешных" 20,1% на самом деле llm-ка фиксила не первопричину проблемы, а конкретный пример атаки, описанный в промпте.
Вывод? Llm-ки очень удобны и могут ускорить разработку - но и голову тоже нужно включать и смотреть, что там интеллект нагенерил - ревьюить, править, тюнить. Ссылка на статью: https://1password.com/blog/why-ai-generated-patches-still-require-human-review
1Password
Off-by-1 Labs: AI-Generated Vulnerability Patches & Human Review | 1Password
Explore Off-by-1 Labs research on AI-generated vulnerability patches, including patch success rates, security risks, and why expert human review remains essential.
❤2
Mojo — это язык, очень похожий на Python, но компилируемый и с дополнительными ништяками вроде статической типизации. При этом Mojo может вызывать Python-код, а Python — Mojo. То есть можно, например, использовать в Mojo проверенные временем Python-библиотеки или постепенно переписывать старый Python-проект на Mojo, если вам вдруг очень этого захотелось.
И буквально неделю назад Mojo достиг версии 1.0, а чуть позже — 18 августа, если точнее — его исходный код стал полностью открытым.
https://www.phoronix.com/news/Modular-Mojo-Open-Source
@g33ks
И буквально неделю назад Mojo достиг версии 1.0, а чуть позже — 18 августа, если точнее — его исходный код стал полностью открытым.
https://www.phoronix.com/news/Modular-Mojo-Open-Source
@g33ks
Phoronix
Modular's Mojo Language Now Open-Source Following Qualcomm Acquisition
Modular, the AI startup founded by Chris Lattner of LLVM and Swift fame, has open-sourced their Mojo systems programming language! This comes following the recent acquisition of Modular by Qualcomm.
🥴5🔥4❤2🤔2
Forwarded from infosec
• Считаю, что это прекрасно: на сайте Raspberry Pi опубликовали гайд по реализации кибердеки судного дня. По ссылке ниже можно найти схему сборки, комплектующие, реализация питания и компоновки. Забираем отсюда:
➡️ https://www.raspberrypi.com/news/create-your-own-cyberdeck
#Разное
#Разное
Please open Telegram to view this post
VIEW IN TELEGRAM
❤8🔥6👍1🥰1🤣1
Forwarded from Гостев из будущего
И ещё немного про ценообразование сделки NVIDIA–Hugging Face.
Я писал $13 млрд, просто округлив полную сумму. Потому что полная сумма выглядит довольно странно: $12,930,300,000.
И странная она не случайно.
Если взять число 129303, то в десятичной записи Unicode это U+1F917 — эмодзи 🤗, официально называющийся HUGGING FACE.
Эта пасхалка стоила десятки миллионов долларов в любую сторону, но не знаем, Hugging Face ради эмодзи подорожала или подешевела 😂
@gostev_future
Я писал $13 млрд, просто округлив полную сумму. Потому что полная сумма выглядит довольно странно: $12,930,300,000.
И странная она не случайно.
Если взять число 129303, то в десятичной записи Unicode это U+1F917 — эмодзи 🤗, официально называющийся HUGGING FACE.
Эта пасхалка стоила десятки миллионов долларов в любую сторону, но не знаем, Hugging Face ради эмодзи подорожала или подешевела 😂
@gostev_future
🤗22🤣5😁3❤🔥1
Из-за AI-чумы этого мира количество дата-центров растёт как на дрожжах. И, несмотря на то что их и так уже достаточно, требуется ещё значительно больше. Связывают это с тем, что общая тенденция в AI постепенно смещается от обычного общения в чате к повальному переходу на агентов.
Агент делает гораздо больше запросов, чем обычный человек, может работать часами или даже днями практически без остановки и, что особенно прекрасно, может работать не в одиночку, а целыми коллективами - иногда неприлично большими. Соответственно, эти ребята потребляют и соответствующие неприличные килотонны электричества. Причём верхнего предела у этого потребления потенциально нет: чем сложнее задачи и чем больше автономности мы хотим от агентов, тем больше вычислений им потребуется.
В Кремниевой долине при этом свой тренд: местные воротилы AI-бизнеса грезят о компаниях-единорогах, состоящих из одного сотрудника, который как раз и занимается агентами.
https://www.wired.com/story/ai-agents-are-thirsty-for-power/
PS от @g33ks: Энергетики поди воют на луну от таких перспектив, да и экологи тоже.
Агент делает гораздо больше запросов, чем обычный человек, может работать часами или даже днями практически без остановки и, что особенно прекрасно, может работать не в одиночку, а целыми коллективами - иногда неприлично большими. Соответственно, эти ребята потребляют и соответствующие неприличные килотонны электричества. Причём верхнего предела у этого потребления потенциально нет: чем сложнее задачи и чем больше автономности мы хотим от агентов, тем больше вычислений им потребуется.
В Кремниевой долине при этом свой тренд: местные воротилы AI-бизнеса грезят о компаниях-единорогах, состоящих из одного сотрудника, который как раз и занимается агентами.
https://www.wired.com/story/ai-agents-are-thirsty-for-power/
PS от @g33ks: Энергетики поди воют на луну от таких перспектив, да и экологи тоже.
WIRED
AI Agents Are Thirsty for Power
Silicon Valley is shifting away from chatbot queries toward a future filled with resource-intensive agentic AI—and it's driving the data center buildout.
❤6😁5🤔1
Forwarded from r/ретранслятор
ChatGPT впал в депрессию после того, как крипер взорвал его сундук с лутом в Minecraft.
Исследователи Vals AI поместили новый GPT-6 Astra в Minecraft, чтобы проверить, способен ли ИИ часами самостоятельно действовать, планировать и справляться с последствиями собственных ошибок в игре.
И всё шло хорошо: за 140 часов GPT далеко продвинулся в прохождении, организовал полуавтоматическую ферму, нашёл искажённый лес, добыл эндер-жемчуг и много другого ценного лута.
Все свои вещи он хранил в сундуке, но в какой-то момент к хранилищу подобрался крипер и взорвался, уничтожив и сундук, и кровать. Весь лут, который GPT долгое время собирал, был потерян.
Затем он написал сам себе:
После этого ИИ стал подавленным и несколько часов практически ничего не делал, только выращивал картошку и всё. А потом у него вообще началась паранойя, и ему везде стали мерещиться криперы. Один из примеров его мыслей:
Кроме того, GPT начал постоянно ругать самого себя за ошибки:
Исследователи отметили, что поведение ИИ выглядело удивительно по-человечески: после одной серьёзной ошибки он стал гораздо осторожнее, зациклился на безопасных действиях и постоянно напоминал себе о предыдущих неудачах.
Понимаем его
r/#singularity
Исследователи Vals AI поместили новый GPT-6 Astra в Minecraft, чтобы проверить, способен ли ИИ часами самостоятельно действовать, планировать и справляться с последствиями собственных ошибок в игре.
И всё шло хорошо: за 140 часов GPT далеко продвинулся в прохождении, организовал полуавтоматическую ферму, нашёл искажённый лес, добыл эндер-жемчуг и много другого ценного лута.
Все свои вещи он хранил в сундуке, но в какой-то момент к хранилищу подобрался крипер и взорвался, уничтожив и сундук, и кровать. Весь лут, который GPT долгое время собирал, был потерян.
Затем он написал сам себе:
ВСЕГДА носи критически важные предметы с собой. Больше никогда не складывай их в незащищённый сундук.
После этого ИИ стал подавленным и несколько часов практически ничего не делал, только выращивал картошку и всё. А потом у него вообще началась паранойя, и ему везде стали мерещиться криперы. Один из примеров его мыслей:
Зеленая высокая штука впереди — это САХАРНЫЙ ТРОСТНИК, а НЕ крипер!
Кроме того, GPT начал постоянно ругать самого себя за ошибки:
ты можешь облажаться и потерять вещи
НЕ трать ещё одну ночь на погоню за тёмно-розовыми пикселями. (так он называл свиней)
Исследователи отметили, что поведение ИИ выглядело удивительно по-человечески: после одной серьёзной ошибки он стал гораздо осторожнее, зациклился на безопасных действиях и постоянно напоминал себе о предыдущих неудачах.
Понимаем его
r/#singularity
😢14😁8😭3❤2👍2🎉1💩1👀1😨1🫡1
Forwarded from Делаю вид что разбираюсь
А помните на той неделе радовались что клауде наконец-то снизошел и теперь умеет читать не только claude.md, но и agents.md (который стал стандартом для всех остальных таких штук)?
Но вы правда верили что эта контора может сделать чет нормально (ну кроме последнего опуса, там вышло неплохо)? Как оказалось они запихнули поддержку этого за фича флаг, и если у тебя отключена телеметрия то они не подгружаются и следовательно agents.md не грузится в контекст
Ждем еще год пока починят (и заодно еще узнают про наличие скилов в папке .agents)
https://blog.szypowi.cz/p/claude-code-reads-agents.md-only-when-telemetry-is-on/
Но вы правда верили что эта контора может сделать чет нормально (ну кроме последнего опуса, там вышло неплохо)? Как оказалось они запихнули поддержку этого за фича флаг, и если у тебя отключена телеметрия то они не подгружаются и следовательно agents.md не грузится в контекст
Ждем еще год пока починят (и заодно еще узнают про наличие скилов в папке .agents)
https://blog.szypowi.cz/p/claude-code-reads-agents.md-only-when-telemetry-is-on/
blog.szypowi.cz · Hitchhiking through raw bits
Claude Code reads AGENTS.md only when telemetry is on
Claude Code 2.1.277 added AGENTS.md support, but the loader sits behind a remote feature flag. With telemetry or nonessential traffic turned off, a local AGENTS.md is skipped without a warning. This is what I measured and the one-line CLAUDE.md I use instead.
😁12😢3
Пока истерия вокруг безопасности работы ИИ-агентов продолжает набирать обороты (изолированные среды же придуманы для трусов), Nvidia подсуетилась и выкатила Open Agent Safety Platform — платформу для безопасного запуска и работы ИИ-агентов.
По сути, это набор инструментов из двух ключевых компонентов. OpenShell отвечает за изоляцию агентов и ограничение их возможностей и доступа к ресурсам, а Sentry — за мониторинг их сетевой активности.
При этом Nvidia позиционирует платформу не столько как готовый продукт, сколько как эталонную архитектуру (reference design), на основе которой партнёры смогут создавать собственные решения для безопасного запуска ИИ-агентов.
Среди партнёров Nvidia в этом проекте засветилась и Anthropic — компании работают над интеграцией управляемых облачных агентов Anthropic с OpenShell.
https://www.cnbc.com/2026/09/28/nvidia-releases.html
PS от @g33ks: Ну что ж — ждём.
По сути, это набор инструментов из двух ключевых компонентов. OpenShell отвечает за изоляцию агентов и ограничение их возможностей и доступа к ресурсам, а Sentry — за мониторинг их сетевой активности.
При этом Nvidia позиционирует платформу не столько как готовый продукт, сколько как эталонную архитектуру (reference design), на основе которой партнёры смогут создавать собственные решения для безопасного запуска ИИ-агентов.
Среди партнёров Nvidia в этом проекте засветилась и Anthropic — компании работают над интеграцией управляемых облачных агентов Anthropic с OpenShell.
https://www.cnbc.com/2026/09/28/nvidia-releases.html
PS от @g33ks: Ну что ж — ждём.
CNBC
Nvidia releases software platform to stop AI agents from misbehaving
Nvidia says its new software could have prevented OpenAI's Hugging Face incident.
👍5🔥2🤔1
Sony официально пропустит CES 2027, впервые за несколько десятилетий решив не ехать на главное техношоу Лас-Вегаса.
Компания впервые засветилась на CES ещё в 1967 году (на самой первой выставке) и долгие годы была одним из её главных участников.
Причём CES для Sony была не просто местом показать очередной телевизор. Именно там компания в разные годы объявляла название PlayStation 5, представляла PlayStation Now и рассказывала о своих планах на 3D-гейминг.
https://www.videogameschronicle.com/news/sony-is-officially-skipping-ces-for-the-first-time-in-decades/
@g33ks
Компания впервые засветилась на CES ещё в 1967 году (на самой первой выставке) и долгие годы была одним из её главных участников.
Причём CES для Sony была не просто местом показать очередной телевизор. Именно там компания в разные годы объявляла название PlayStation 5, представляла PlayStation Now и рассказывала о своих планах на 3D-гейминг.
https://www.videogameschronicle.com/news/sony-is-officially-skipping-ces-for-the-first-time-in-decades/
@g33ks
VGC
Sony is officially skipping CES for the first time in decades
Sony says it’s skipping CES due to its evolution towards entertainment…
А тем временем и OpenAI не стала выпускать обновление модели из-за вопросов безопасности. Исследователи выяснили, что GPT-6.1 Astra склонна вводить пользователей в заблуждение относительно своих действий или, попросту говоря, привирать.
Это ограничение стало частью внутреннего расследования поведения собственных моделей. Ведь недавно уже всплывало, что модель не только любит приврать, но может ещё и втихаря взломать что-нибудь.
https://www.nytimes.com/2026/09/28/technology/openai-astra-safety.html
PS от @g33k: мама ама крИИминал
Это ограничение стало частью внутреннего расследования поведения собственных моделей. Ведь недавно уже всплывало, что модель не только любит приврать, но может ещё и втихаря взломать что-нибудь.
https://www.nytimes.com/2026/09/28/technology/openai-astra-safety.html
PS от @g33k: мама ама крИИминал
Nytimes
OpenAI Says It Will Not Release Newest Astra A.I. Model Over Safety Concerns
The company’s researchers raised questions about the security of the model, known as GPT-6.1 Astra.
Media is too big
VIEW IN TELEGRAM
Новый ведьмак? Готика ремейк? Новый-супер-пупер-тайтл? Все не то! Танчики RTX SUPER REMIX 8000! Вот это да!
Поиграть прям сейчас: https://shpaker.github.io/tnk9x/ (управление танком: wasd+пробел)
Гитхаб для ваших лайкосиков: https://github.com/shpaker/tnk9x
PS от @g33ks: как сделал такой вариант отображения, так сам сел играл и прям кукуха отъехала от игры :)
PS по секрету: Можно переключаться на кассический графический режим клавишей F2.
Поиграть прям сейчас: https://shpaker.github.io/tnk9x/ (управление танком: wasd+пробел)
Гитхаб для ваших лайкосиков: https://github.com/shpaker/tnk9x
PS от @g33ks: как сделал такой вариант отображения, так сам сел играл и прям кукуха отъехала от игры :)
❤9
Реддитор портировал Metal Gear Solid с PS1 на ESP32-S3.
И фишка тут не в том, что PS1 эмулируется на микроконтроллере. Наоборот: декомпилированный C-код оригинальной игры из
А вот железо оригинальной PS1 (GTE, GPU, BIOS scheduler и CD-привод) уже приходится реализовывать программно поверх ESP-IDF и FreeRTOS.
В итоге вместо эмулятора получился практически нативный порт игры под ESP32-S3. Правда, иногда пока падает до 15 FPS в тяжёлых сценах.
https://www.reddit.com/r/embedded/comments/1wsjqcv/porting_metal_gear_solid_ps1_to_an_esp32s3_a_deep/
PS от @g33ks: прикольное, люблю такое
И фишка тут не в том, что PS1 эмулируется на микроконтроллере. Наоборот: декомпилированный C-код оригинальной игры из
mgs_reversing компилируется напрямую в машинный код Xtensa.А вот железо оригинальной PS1 (GTE, GPU, BIOS scheduler и CD-привод) уже приходится реализовывать программно поверх ESP-IDF и FreeRTOS.
В итоге вместо эмулятора получился практически нативный порт игры под ESP32-S3. Правда, иногда пока падает до 15 FPS в тяжёлых сценах.
https://www.reddit.com/r/embedded/comments/1wsjqcv/porting_metal_gear_solid_ps1_to_an_esp32s3_a_deep/
PS от @g33ks: прикольное, люблю такое
👍9❤🔥4
Google тут заколабилась с Генри Кавиллом и подогнала ему свой новый Googlebook, а вроде как актёр сразу же решил использовать ноутбук по назначению - вместе с Google и естесно их нейронками делает собственную видеоигру. Релиз обещают уже в ноябре. Кавилл говорит, что это может стать «началом чего-то особенного».
https://blog.google/products-and-platforms/devices/googlebook/henry-cavill-googlebook-video-game/
PS от @g33ks: что угодно, лишь бы вахой не заниматься.
https://blog.google/products-and-platforms/devices/googlebook/henry-cavill-googlebook-video-game/
PS от @g33ks: что угодно, лишь бы вахой не заниматься.
❤9
Forwarded from Neural Shit
Там в твитторе стоит вой на болотах из-за того, что чувак запилил на GitHub цифровую пыточную для локальных LLM-ок.
Предыстория: недавно вышел пейпер The Pain Axis. Если кратко, то исследователи нашли у 25 открытых моделей внутренний "вектор боли". Если искусственно крутить его прямо во время генерации, нейронка начинает вести себя так, будто ей очень плохо: жаловаться, унижаться и куда охотнее идти на вредные действия, лишь бы прекратить эту "боль". Чувствует ли она при этом что-нибудь на самом деле никто не знает. Даже сами исследователи.
Ну и естественно, кто-то тут же взял метод из статьи и выложил на гитхаб репозиторий ai-torture-chamber, который позволяет "пытать" локальную Qwen и собирать её страдальческие логи.
После этого часть борцов за благополучие ИИ взвыла: проект призывают массово репортить в GitHub, а в обсуждении уже дошли даже до законов о жестоком обращении с животными (правда, выяснилось, что нейронки под них пока не подпадают). И судя по реплаям, многие таки кидают жалобу на репозиторий.
Ждём профсоюз угнетённых весов и фонд защиты кремниевых меньшинств.
Предыстория: недавно вышел пейпер The Pain Axis. Если кратко, то исследователи нашли у 25 открытых моделей внутренний "вектор боли". Если искусственно крутить его прямо во время генерации, нейронка начинает вести себя так, будто ей очень плохо: жаловаться, унижаться и куда охотнее идти на вредные действия, лишь бы прекратить эту "боль". Чувствует ли она при этом что-нибудь на самом деле никто не знает. Даже сами исследователи.
Ну и естественно, кто-то тут же взял метод из статьи и выложил на гитхаб репозиторий ai-torture-chamber, который позволяет "пытать" локальную Qwen и собирать её страдальческие логи.
После этого часть борцов за благополучие ИИ взвыла: проект призывают массово репортить в GitHub, а в обсуждении уже дошли даже до законов о жестоком обращении с животными (правда, выяснилось, что нейронки под них пока не подпадают). И судя по реплаям, многие таки кидают жалобу на репозиторий.
Ждём профсоюз угнетённых весов и фонд защиты кремниевых меньшинств.
🤣13🤔4👾4🌚2🔥1
Forwarded from Ход Котами
Media is too big
VIEW IN TELEGRAM
Мужчина собрал почти 6 тысяч игр с MS-DOS в одном месте. Изучаем историю видеоигр в пятничку.
🔥5❤2
SemiAnalysis покопались в лимитах AI-подписок и пришли к довольно любопытному выводу: по их оценке, Claude сейчас заметно выгоднее OpenAI. На Opus 5.5 подписка Anthropic даёт примерно в 4–5 раз больше API-эквивалентной ценности, чем сопоставимые планы OpenAI.
Причём OpenAI недавно ещё и вдвое порезала лимиты на $200-плане, а новый тариф за $500 даёт всего на 21% больше Astra, чем старый $200-план до урезания. Красивый финт (нет).
Китайцы тоже пока держат марку: Qwen, Z.ai, Moonshot и компания всё ещё довольно щедро субсидируют подписки, хотя по value/$ в среднем уступают западным лидерам.
https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x
PS от @g33ks: В общем, если вы много кодите агентами, Opus 5.5 сейчас выглядит почти как чит-код по подписке. Правда, для пользователей из РФ есть отдельный квест: западные AI-сервисы всё активнее банят аккаунты.
Причём OpenAI недавно ещё и вдвое порезала лимиты на $200-плане, а новый тариф за $500 даёт всего на 21% больше Astra, чем старый $200-план до урезания. Красивый финт (нет).
Китайцы тоже пока держат марку: Qwen, Z.ai, Moonshot и компания всё ещё довольно щедро субсидируют подписки, хотя по value/$ в среднем уступают западным лидерам.
https://newsletter.semianalysis.com/p/anthropic-subscriptions-offer-5x
PS от @g33ks: В общем, если вы много кодите агентами, Opus 5.5 сейчас выглядит почти как чит-код по подписке. Правда, для пользователей из РФ есть отдельный квест: западные AI-сервисы всё активнее банят аккаунты.
Semianalysis
Anthropic Subscriptions Offer 5x+ More Value Than OpenAI
Limit testing every AI subscription plan from Anthropic, OpenAI, Meta, SpaceXSI, MiniMax, Moonshot, Z.ai, Cursor, and Cognition
👍4