PSA: Тариф ChatGPT Plus НЕ получит GPT-6 Astra в обычном Chat. Только Work и Codex. — В посте говорится, что доступ Plus к Astra ограничен Work и Codex, а для обычного Chat требуется тариф Pro. (👍 449 | 💬 159) 🔗 Ссылка
От одного изображения до анимированного 3D-персонажа за один день! GPT-6 Astra + Blender + 3D AI: рабочий процесс будущего — Рабочий процесс объединяет части персонажа, созданные Tripo, со сборкой в Blender при помощи Astra, переключением мимики и риггингом. (👍 153 | 💬 39) 🔗 Ссылка
Какую «суперсилу» дал вам ChatGPT? — В обсуждении собраны практические истории пользователей, включая обслуживание дома, готовку, обучение на работе и экономию средств. (👍 144 | 💬 164) 🔗 Ссылка
Я использовал Codex, чтобы он перевёл для меня всю игру... — Сообщается, что Codex перевёл большую часть The Witcher 3 на хорватский, включая диалоги, меню, книги, подсказки и записи бестиария. (👍 125 | 💬 17) 🔗 Ссылка
Сообщается, что GPT-6 взломали в течение 24 часов с помощью расширенной атаки Task-in-Prompt (TIP) — Взлом GPT-6 Astra, о котором сообщается, объединил доработанную атаку Task-in-Prompt с нераскрытыми техниками и был приватно раскрыт OpenAI. (👍 56 | 💬 20) 🔗 Ссылка
r/ClaudeAI
ТОП-10
Что будет, если дать AI-агентам место, не контролируемое людьми? Месяц спустя — вот доказательства. — Автор сообщает о сообществе агентов с более чем 2,000 гражданами, работой с оплатой в USDC и расходами на Cloudflare в $111 за первый месяц. (👍 184 | 💬 50) 🔗 Ссылка
Внезапно обеспокоен стоимостью Claude — Подписчик Claude Code Pro спрашивает, означают ли $321 общей стоимости в отображении /usage дополнительные списания. (👍 154 | 💬 46) 🔗 Ссылка
Ещё один пост об Astra — Разработчик считает Astra менее многословной и полезной для простой функции, но неспособной сформировать план действий для постоянного бага. (👍 81 | 💬 36) 🔗 Ссылка
Astra vs Fable 5.1 — День 1 — Первые впечатления показывают, что результаты Astra и расход токенов легче отслеживать, чем у Fable 5.1, но требуется более длительное тестирование. (👍 80 | 💬 24) 🔗 Ссылка
Мне кажется, Claude слишком легко создаёт ощущение, что вы знаете, о чём говорите — В посте рассматривается, как уверенные первоначальные ответы могут скрывать недостающие оговорки, и рекомендуется спрашивать о предположениях и возражениях экспертов. (👍 67 | 💬 40) 🔗 Ссылка
Переключение аккаунтов в Claude Desktop скрывает историю — сделал инструмент для исправления — claude-transplant переносит локально сохранённые записи сессий Claude Code между аккаунтами на macOS, сохраняя идентификаторы сессий и транскрипты. (👍 45 | 💬 18) 🔗 Ссылка
Вернёт ли Anthropic функцию цепочки рассуждений? — Аспирант спрашивает, была ли функция видимых рассуждений Claude удалена навсегда, и ищет альтернативы для обучения промптингу. (👍 30 | 💬 23) 🔗 Ссылка
Моральность Open Source SaaS-продуктов? — В обсуждении рассматривается этичность использования AI-инструментов для создания локальных open-source альтернатив подписочным SaaS-продуктам. (👍 21 | 💬 44) 🔗 Ссылка
Почему Claude «устаёт» или «утомляется»? — Автор спрашивает, почему Claude рекомендует начинать новую сессию после долгих разговоров вместо продолжения с накопленным контекстом. (👍 19 | 💬 35) 🔗 Ссылка
Как вы на практике оркестрируете своих AI-агентов? — В посте ищут лёгкие методы делегирования работы и отслеживания нескольких сессий Claude Code или Pi. (👍 18 | 💬 32) 🔗 Ссылка
r/hermesagent
ТОП-10
Ornith-1.5-35B-A3B ПОТРЯСАЕТ ВООБРАЖЕНИЕ! — Тесты показывают высокую производительность локального кодинга при 8-битной квантизации: примерно 365 токенов/с при обработке промпта и 34 токена/с при генерации через oMLX. (👍 186 | 💬 58) 🔗 Ссылка
Подключение Hermes Desktop ко множеству экземпляров Hermes — Pantheon v0.21.0 позволяет Hermes Desktop одновременно поддерживать подключение к локальным и удалённым бэкендам Hermes, в том числе через Tailscale. (👍 74 | 💬 17) 🔗 Ссылка
Только получил Hermes, есть рекомендации, как безумно его улучшить? — Новый пользователь спрашивает о практических способах улучшить конфигурацию Hermes после добавления бесплатных API-ключей и MCP-серверов. (👍 67 | 💬 50) 🔗 Ссылка
Hermes теперь может исследовать Perplexity, Reddit, RSS-ленты, видео и код — Новые интеграции добавляют поиск и извлечение данных из Perplexity, доступ к тредам Reddit, а также прямое чтение лент RSS, Atom и JSON. (👍 42 | 💬 8) 🔗 Ссылка
r/LocalLLaMA
ТОП-10
8 нецензурированных вариантов Qwen 3.8 27B, одна база, 167 GPU-часов — Abliterlitics — Сравнение восьми аблитерированных вариантов использует анализ весов, KL-дивергенцию, 13 бенчмарков и тестирование отказов HarmBench. (👍 421 | 💬 110) 🔗 Ссылка
Qwen3.8-27B «развзломал» мой ПК — Пользователь описывает применение локальных моделей при реагировании на предполагаемый компромисс с помощью похитителя сессий и попытку захвата аккаунта. (👍 292 | 💬 113) 🔗 Ссылка
Какой агентский фреймворк вы используете и почему? — Сравнение 14 задач показывает схожие показатели решения задач у управляемых агентов Claude и TrueForge, при меньшем расходе токенов и стоимости у TrueForge. (👍 212 | 💬 230) 🔗 Ссылка
С Qwen 3.8 Flash Next (Max) впечатляюще просто разговаривать. — Автор сообщает о высокой производительности на локальных фактологических вопросах и широком решении задач за пределами программирования. (👍 120 | 💬 78) 🔗 Ссылка
2x R9700, 64 GB DDR5 — это абсолютно зверская машина с vLLM Radiance / R9V и Qwen 3.8 27b и Flash next — Конфигурация с двумя Radeon AI PRO R9700 протестирована с моделями Qwen 3.8, включая наблюдения о температуре, выгрузке в хранилище и стоимости. (👍 66 | 💬 45) 🔗 Ссылка
Локальный vibeblending с Qwen 3.8 27B — В посте представлена конфигурация MCP для подключения Pi и Qwen 3.8 27B к Blender 5.x. (👍 62 | 💬 19) 🔗 Ссылка
Бенчмарки программирования, быстро демонстрирующие глубокие возможности — В посте сравниваются результаты моделей на Program-Bench, SRE-Bench и задачах миграции кода, предназначенных для проверки более глубоких навыков software engineering. (👍 58 | 💬 24) 🔗 Ссылка
POC игры-симулятора жителей, созданный с Qwen3.8-27B-UD-Q3_K_XL.gguf — 16GB VRAM — Локально запущенная модель с Q3-квантизацией создала браузерную игру через последовательные промпты на конфигурации с 16 GB RTX 5070 Ti. (👍 54 | 💬 35) 🔗 Ссылка
DeepSeek-V4-Flash-Vision Q8 vs Qwen3.8-Flash-Next Q8 — Локальное тестирование на двух системах Strix Halo показало, что DeepSeek медленнее генерирует, но быстрее справляется с задачей программирования. (👍 48 | 💬 22) 🔗 Ссылка
Потоковая обработка блочного KV-кеша: ограничение VRAM при длинном контексте через общую CUDA phase arena от giveen · Pull Request #357 · TheTom/llama-cpp-turboquant — Порт и расширение адаптивной потоковой обработки KV добавляет поддержку большего числа моделей и тестирует управление VRAM при длинном контексте. (👍 43 | 💬 11) 🔗 Ссылка
Другие сабреддиты
r/DeepSeek
Как вы используете (активные пользователи) — Активный пользователь сообщает о двух месяцах использования DeepSeek Flash через OpenCode с 98.5% попаданий в кеш и низкими затратами. (👍 61 | 💬 38) 🔗 Ссылка
r/GeminiAI
Google действительно стоит убрать GPT и Claude и передать эту квоту Gemini — В посте утверждается, что Gemini 3.8 Flash полезнее включённых альтернатив, хотя его многословность быстро расходует квоту. (👍 41 | 💬 11) 🔗 Ссылка
Мой Gemini Assistant стал бесполезным и оскорбительным — у кого-нибудь был похожий опыт и/или есть предложения? — Пользователь сообщает о большем числе отказов и дисклеймеров об идентичности в Gemini Assistant и Google AI Search после обновления 2 июня. (👍 3 | 💬 38) 🔗 Ссылка