Что значит, мы все можем умереть через несколько лет? — Обсуждаются опасения по поводу работы OpenAI над безопасностью и обоснованности публичных предупреждений о рисках ИИ. (👍 803 | 💬 813) 🔗 Ссылка
Сегодня я уволился из Ubisoft. Последние три года я исследовал секс-игры в Electronic Arts и Ubisoft. Ни одна компания не действует ответственно. Они мчатся прямиком к самоулучшающимся вызывающим зависимость играм и азартным играм, ставя на кон наши жизни. — Выражаются опасения по поводу ИИ-персонализации игр, вызывающих зависимость систем и коммерческих стимулов в разработке игр. (👍 325 | 💬 88) 🔗 Ссылка
GPT 6 Sol скоро выйдет — Сообщается о предполагаемой API-ссылке на GPT-6 Sol и выдвигается предположение о линейке из четырёх уровней: Astra, Sol, Terra и Luna. (👍 321 | 💬 77) 🔗 Ссылка
Насколько большими были бы ваши проблемы, если бы все ваши чаты с ChatGPT утекли? — Поднимается обсуждение рисков для приватности и чувствительности сохранённых разговоров пользователей с чат-ботом. (👍 77 | 💬 139) 🔗 Ссылка
Дорогой ChatGPT: то, что в моём ответе встречается слово «картинка», ещё не значит, что я хочу, чтобы ты начал создавать картинку, потому что, как только ты начинаешь создавать картинки, тебя невозможно остановить. Приходится лихорадочно жать кнопку остановки, словно ты только что запустил ядерную бомбу. Это довольно раздражает.☢️ — Сообщается о нежелательном запуске генерации изображений при обсуждении картинок и трудностях с её остановкой после начала. (👍 60 | 💬 27) 🔗 Ссылка
Кто-нибудь ещё скучал бы по Chat, если бы он однажды исчез? — ChatGPT описывается как полезный источник непринуждённого общения и поддержки в сложные личные периоды. (👍 54 | 💬 66) 🔗 Ссылка
Так у «ИИ уничтожит мир» теперь есть финансирование? — Ставятся под сомнение утверждения, что инфлюенсерам платят за продвижение нарратива о вымирании из-за ИИ на фоне широкого внедрения ИИ-систем. (👍 45 | 💬 51) 🔗 Ссылка
«Ты не (оскорбление), ты (то, что пользователь уже сказал)» — Сообщается о повторяющихся пассивно-агрессивных формулировках и нежелательных повторах в философской беседе с ChatGPT. (👍 43 | 💬 43) 🔗 Ссылка
Astra MAX потребляет НАМНОГО меньше, чем Astra Medium и даже Low — Сообщается, что максимальные усилия по рассуждению выполняли задачи быстрее и использовали меньше квоты; приводятся заметки об эффективности ARC-AGI 3. (👍 32 | 💬 12) 🔗 Ссылка
Не знаю, разрешено ли это, но я замечаю, что мой Chat GPT соглашается почти со всем. — Описывается возросшая склонность к согласию и спрашивается, как вернуть более критичные, аналитические ответы. (👍 10 | 💬 45) 🔗 Ссылка
r/ClaudeAI
ТОП-10
Opus 4.6 был НАШЕЙ влажной мечтой об ИИ — Сравниваются Opus 4.6, 4.8 и Fable 5.1 для программирования, объёма контекста, планирования и лимитов использования подписки. (👍 1517 | 💬 226) 🔗 Ссылка
Моя первая PCB, полностью спроектированная Claude — Подробно описывается использование Fable 5 с KiCad MCP для проектирования E-ink-платы на RP2350, включая исправления компонентов и инвентаря. (👍 1214 | 💬 132) 🔗 Ссылка
Старший инженер, пример настройки оркестратора циклов — Описывается оркестратор Claude Code с обменом сообщениями между агентами, запланированными промптами, состоянием SQLite и определёнными операционными ролями. (👍 274 | 💬 50) 🔗 Ссылка
Claude буквально за ночь сломал свои «Projects», и я в бешенстве — Сообщается, что Projects с облаком по умолчанию нарушили доступ к интернету и убрали постоянные вложения локальных папок для рабочих процессов Cowork. (👍 107 | 💬 43) 🔗 Ссылка
Когда делаете что-то творческое, вы разобрались, как не переходить на «туманный язык LLM»? — Ищутся способы предотвратить повторяющиеся расплывчатые, перегруженные метафорами формулировки в творческих ответах моделей. (👍 40 | 💬 32) 🔗 Ссылка
Насколько вы на самом деле зависите от Claude в программировании? — Разработчиков спрашивают, как они распределяют работу между отладкой, разработкой функций и проверкой сгенерированного кода. (👍 27 | 💬 105) 🔗 Ссылка
Для чего нужен Haiku? — Сообщается о некорректном выводе математики в Haiku и спрашивается, где модели с меньшими возможностями всё ещё уместны. (👍 12 | 💬 51) 🔗 Ссылка
Как избежать того, чтобы во всём была какая-то проблема? — Ищутся подходы к промптам или настройкам модели, которые сократят ненужные оговорки, сохранив значимые предупреждения. (👍 11 | 💬 34) 🔗 Ссылка
Исчерпываю лимиты Fable менее чем за 40 минут на Claude Max (20x) — какой рабочий процесс лучше для анализа кодовой базы? — Обсуждаются маршрутизация моделей, контроль контекста, файлы игнорирования и стоимость токенов при отладке C++-проекта размером 15 MB. (👍 9 | 💬 38) 🔗 Ссылка
r/DeepSeek
ТОП-10
Почему я искренне ценю подход DeepSeek к разработке ИИ — Выделяются открытые веса, опубликованные исследования, архитектурная эффективность, сокращения KV-cache и недорогой инференс как отличительные черты. (👍 194 | 💬 15) 🔗 Ссылка
DeepSeek V4.1 Flash обходит Fable 5.1 в GPQA Diamond Clean при цене всего 3%! — Приводятся результаты GPQA.ai, согласно которым V4.1 Flash превзошёл Fable 5.1 при существенно меньшей стоимости. (👍 180 | 💬 48) 🔗 Ссылка
Почему люди там так довольны этим обновлением? Для меня это полный бардак — Сообщается, что после обновления модели ответы для творческого письма стали короче, суше и менее подробными. (👍 110 | 💬 73) 🔗 Ссылка
Deepseek V4.1 Flash теперь модель с открытыми весами №1 в Livebench — Сообщается, что V4.1 Flash занял пятое место в общем зачёте LiveBench и возглавил открытые модели, особенно в агентном программировании. (👍 102 | 💬 31) 🔗 Ссылка
Можно вернуть экспертный режим, пожалуйста? Новый режим «всё в одном» бесполезен — Сообщается о менее подробных исследовательских ответах после замены Expert mode на режим «всё в одном». (👍 50 | 💬 10) 🔗 Ссылка
Не доволен обновлением 4.1 — Сообщается о регрессиях в программировании у V4.1 Flash, включая многословность, допущения и нежелательные действия; утверждается, что смена harness решила проблемы. (👍 41 | 💬 28) 🔗 Ссылка
DeepSeek-V4.1-Flash (552B MoE), работающий ровно на одной RTX 5090 + 128 GB RAM через форк llama.cpp: 5.1 т/с на новом контенте, 21 т/с в резидентном режиме — полный отчёт, инструменты, GGUF — Измеряется работа форка llama.cpp, подгружающего экспертов из NVMe; сообщается о 5.1 токенах/с для нового контента и ограничениях производительности, связанных с диском. (👍 39 | 💬 2) 🔗 Ссылка
Голос в Deepseek — Сообщается о добавлении в мобильное приложение четырёх голосовых вариантов; доступность в веб-версии не подтверждена. (👍 34 | 💬 5) 🔗 Ссылка
Количество и цена выходных токенов v4.1 делают GLM Flash в целом дешевле — Сравниваются затраты на агентов и утверждается, что многословный вывод V4.1 делает GLM Flash дешевле, несмотря на цены DeepSeek для кешированного ввода. (👍 31 | 💬 23) 🔗 Ссылка
Почему deepseek 4.1 такой быстрый? — Спрашивается, какие архитектурные изменения или изменения в обслуживании могут объяснять воспринимаемую скорость DeepSeek 4.1. (👍 17 | 💬 30) 🔗 Ссылка
r/GeminiAI
ТОП-10
Gemini 3.8 Flash недооценён! — Сообщается об использовании Gemini 3.8 Flash для создания скрапера изображений, API, MCP-сервера и интерфейса за несколько промптов. (👍 143 | 💬 47) 🔗 Ссылка
Неужели только у меня хороший опыт? — Сравниваются интегрированная с Google подписка Gemini, хранилище, инструменты поиска жилья и производительность в программировании с ChatGPT и Claude. (👍 101 | 💬 74) 🔗 Ссылка
У Gemini 3.8 память как у золотой рыбки, а защитные ограничения хуже, чем у Fable — Сообщается о потере контекста разговора и отказах на запросы о публичных компаниях, инфраструктуре и проверке цитат. (👍 94 | 💬 41) 🔗 Ссылка
Устал от ИИ. — Описывается использование Gemini для планирования и общения при всё более неубедительном ощущении симулируемого товарищества. (👍 68 | 💬 42) 🔗 Ссылка
Спираль стыда, пока он помогал мне сделать плакат о найденной собаке — Сообщается о необычном ответе в стиле отказа после запроса на правку векторного PDF для плаката о найденной собаке. (👍 60 | 💬 21) 🔗 Ссылка
Google deep research всё ещё выдаёт старые данные — Сообщается, что Deep Research возвращает устаревшую или неточную информацию, несмотря на использование Gemini 3.8 Flash. (👍 44 | 💬 15) 🔗 Ссылка
Gemini через каждый промпт — Сообщается, что короткие последующие промпты воспринимаются как несвязанные новые запросы, а не отсылки к предыдущему контексту. (👍 35 | 💬 5) 🔗 Ссылка
Gemini больше не может генерировать текст?! — Сообщается, что Gemini Pro отказывается выполнять базовые запросы на написание стихов, которые ранее выполнял. (👍 34 | 💬 22) 🔗 Ссылка
r/hermesagent
ТОП-10
Чего мне на самом деле не хватает, когда я использую Claude Code вместо Hermes? — Спрашивается, что Hermes добавляет сверх Claude Code для автоматизации бизнеса, разработки ПО и мультимодельных рабочих процессов. (👍 112 | 💬 154) 🔗 Ссылка
Какой лучший бесплатный API использовать в 9router? — Ищутся рекомендации бесплатных API и моделей для настройки Hermes, подключённой через локальный экземпляр 9router. (👍 52 | 💬 28) 🔗 Ссылка
Лучший мобильный опыт с Hermes — Сравниваются мобильные клиенты; упоминаются Cadu, Scargo и Hermex в ожидании официального релиза для iOS. (👍 46 | 💬 40) 🔗 Ссылка
Мне потребовалось 3 месяца, чтобы подключить Buzz к моему агенту Hermes. Я дважды едва не сдался. Никаких сожалений. — Описывается подключение размещённого на PC агента Hermes к сообщениям Buzz после решения вопросов аутентификации, ключей, поведения relay и доставки чатов. (👍 18 | 💬 30) 🔗 Ссылка
Оставить Spark? — Ищется совет, даёт ли DGX Spark достаточно преимуществ для локальных моделей и агентной работы по сравнению с хостируемыми моделями. (👍 16 | 💬 79) 🔗 Ссылка
Какие модели ИИ вы используете с Hermes Agent? — Запрашиваются рекомендации по маршрутизации моделей для программирования, исследований, автоматизации и общих задач Hermes. (👍 16 | 💬 31) 🔗 Ссылка
Hermes против OpenClaw — Спрашивается о практических различиях между Hermes и OpenClaw; отмечается, что после установки Hermes показался более прямолинейным и ориентированным на задачи. (👍 7 | 💬 50) 🔗 Ссылка
Сколько вы тратите на использование API каждый месяц? — Запрашиваются сравнения ежемесячных расходов на API, выбора моделей и рабочих процессов, оправдывающих затраты на агентов. (👍 5 | 💬 47) 🔗 Ссылка
r/LocalLLaMA
ТОП-10
Похоже, кому-то удалось частично воспроизвести на Qwen то, что V4.1 flash делает с KV для быстрого префилла — Приводятся ссылка на демонстрацию KV-аппроксимации Qwen, файлы модели и исходный код, предназначенные для ускорения префилла промптов. (👍 490 | 💬 72) 🔗 Ссылка
Qwen3.8-27B-Humanlike-Chat: модель, которую я настроил для имитации реалистичного общения между людьми — Выпускается LoRA rank-256, обученная на 125,217 человеческих сообщениях, чтобы создавать более короткие и менее похожие на ассистента диалоги. (👍 441 | 💬 143) 🔗 Ссылка
Вышла новая музыкальная модель YuE2-3B! — Анонсируется YuE2-3B и приводится ссылка на официальную страницу демонстрации модели генерации музыки. (👍 346 | 💬 93) 🔗 Ссылка
Artificial Analysis не «сломан», и они это доказывают. — Объясняется методология Artificial Analysis и утверждается, что агрегированные бенчмарки следует рассматривать вместе с результатами отдельных оценок. (👍 214 | 💬 148) 🔗 Ссылка
Результаты Terminal Bench v4 — Публикуются результаты Terminal Bench v4: GLM-5.3 лидирует среди перечисленных открытых моделей, а Qwen3.8-27B — единственная меньшая модель с результатом выше 5%. (👍 130 | 💬 68) 🔗 Ссылка
Orukeet — новая ASR-модель на базе Parakeet — Представляется распознаватель речи на основе Parakeet для 25 языков, который демонстрирует более низкие показатели ошибок слов в 61 из 74 протестированных разбиений. (👍 71 | 💬 18) 🔗 Ссылка
ZIMA Board 2 + RTX 2000 ADA — самый дешёвый путь к достойному автономному эндпоинту Qwen-3.8 27b? — Оцениваются ZimaBoard 2 и RTX 2000 Ada как локальный эндпоинт Qwen 27B в сравнении с альтернативой на Mac mini. (👍 66 | 💬 71) 🔗 Ссылка
CUDA/HIP: настройка Flash Attention (gfx1201) от pwilkin · Pull Request #28102 · ggml-org/llama.cpp — Освещается настройка Flash Attention в llama.cpp для RDNA 3.5 и RDNA 4 с сообщаемыми улучшениями обработки промптов при больших контекстах. (👍 64 | 💬 12) 🔗 Ссылка
Есть тут пользователи с 12gb VRAM? — Запрашиваются рекомендации моделей, которым полезны 12 GB VRAM для локального ассистента и нагруженных агентами задач. (👍 58 | 💬 41) 🔗 Ссылка
nvidia rtx 5090 с 96gb vram. — Обсуждается предположительно модифицированная в Китае RTX 5090 с 96 GB VRAM и спрашивается о её реальной доступности и применении. (👍 47 | 💬 48) 🔗 Ссылка