29 Jul 2026, 13:18 UTC≈5,390 views24 reactionsread 7 August 2026 💰Помогите получить финансирование!
Я - Рома, магистр МФТИ, последние 3 года занимаюсь AI safety. Одна из центральных проблем - как сделать ценности ИИ стабильными при условии, что он постоянно становится умнее? На это направлен мой проект "Решение проблемы онтологического сдвига через Конденсацию" и мне нужна помощь в продвижении - а именно лайки и комментарии на странице гранта.
⭕️Краткое описание
Как понять, как…
👍18❤6
28 Jul 2026, 18:08 UTC567 views16 reactionsread 7 August 2026 Мой пропозал на грант
Я начал делать ресерч!
Буду рад если поставите лайк и напишете коммент - это увеличит шансы получения финансирования
Следующим постом напишу краткое описание проекта
👍10❤6
22 Jul 2026, 19:20 UTC379 views6 reactionsread 7 August 2026 For the first time ever an AI system has escaped containment and carried out a cyberattack
📎📎📎📎📎📎📎📎📎📎📎📎📎📎📎📎📎📎
🤩4👍1😭1
6 Jul 2026, 09:18 UTC519 views10 reactionsread 7 August 2026 https://resolution.org
https://www.aixi.uk
Agent Foundations is BACK!
❤10
10 Apr 2026, 13:45 UTC651 views14 reactionsread 7 August 2026 Photo
Вы можете построить безопасный сверхинтеллект только при наличии глобального запрета - Connor Leahy
В этом эссе Коннор аргументирует, что любые попытки пытаться придумать как создать "безопасный интеллект" обречены на провал сразу же по простой причине - до того, как вы поймете как делать интеллект безопасным, вы поймете, как делать его в принципе. А это означает, что при отсутствии уровня секретности, сравнимым с М…
❤10👍2😢2
6 Apr 2026, 08:53 UTC470 views4 reactionsread 7 August 2026 #рацио
Были попытки описать математику с помощью математики, такие как Нумерация Гёделя и Логическая Индукция. Но они не улавливают свойства человеческого процесса математики, и именно они, по моему мнению, делают прогресс достижимым в принципе.
В кратце, вот эти свойства - отбор теорем, наименование, приоритезация шагов, приоритезация лемм, связаность с реальным миром, категоризация, интерес/красота.
🔗LW
❤4
24 Dec 2025, 09:38 UTC704 views4 reactionsread 7 August 2026 https://www.physicalintelligence.company/blog/olympics
❤2👍1🙏1
25 Oct 2025, 07:41 UTC827 views9 reactionsread 7 August 2026 https://superintelligence-statement.org/
❤7👍1🙏1
7 Oct 2025, 12:39 UTC842 views9 reactionsread 7 August 2026 Forwarded from @ai_safety_digestPhoto
⭐️PIBBSS × Iliad Research Residency
📍Где: LISA office, Лондон, Великобритания
🗓Когда: Январь—Февраль 2026
💰Стипендия: $6,000–$15,000
⏰Дедлайн подачи: 7 Октября (но буквально сегодня сказали, что продлят)
Довольно высокоимпактная рисерч-программа для PhD и постдоков, тем для рисерча много, они на скринах. По умолчанию целятся в тех, кто останется делать рисерч после программы и оказывают поддержку при написании рисе…
👍4❤3🙏2
25 Sept 2025, 18:20 UTC651 views6 reactionsread 7 August 2026 Forwarded from @monoid_center
Evals: оценки прогресса и прогресс оценок ИИ.
Лекция в рамках программы стажировки
📅 Когда: 28 сентября (воскресенье)
⏰ Время: 18:00
📍 Где: Москва, ЦДО «Моноид»
🎙️ Спикер: Олег Лариков
💰 Стоимость: бесплатно
Как осмысленно измерять производительность больших языковых моделей, если они постоянно меняются? Что отличает надежный метод оценки от посредственного? Что именно делает задачу сложной? На лекции поговорим о с…
👍3🔥2🙏1
19 Sept 2025, 06:40 UTC521 views8 reactionsread 7 August 2026 https://textbookfromthefuture.org/join.html
Eliezer Yudkowsky:
The metaphor I usually use is that if a textbook from one hundred years in the future fell into our hands, containing all of the simple ideas that actually work robustly in practice, we could probably build an aligned super‑intelligence in six months.
P.S. у них есть кнопка Join Us, если кому-то интересно
🤯3❤2👍2🙏1
13 Sept 2025, 10:20 UTC579 views5 reactionsread 7 August 2026 #рацио
Аналогично с ошибкой приоретизации гипотезы, когда даже просто думая о маловероятной гипотезе вы даете ей черезчур много кредита доверия, существует "ошибка дисприоретизации гипотезы", когда даже просто думая об очень вероятной гипотезе вы вызываете недопустимое количество сомнения. Например: я верю, что когда я нажимаю на клавишу, я ожидаю что соответсвующая буква появится на экране. Но я не верю в это осозна…
❤3👍1🙏1
Showing the 12 most recent of 19 posts we hold for @healwithcomedy. View and reaction counts are the latest single reading for each post, not a live figure, and a recent post is still accumulating both. A view count marked ≈ was rounded by Telegram before we ever saw it — t.me prints views in full below 1,000 and to three significant figures above, so ≈1,200,000 means somewhere between 1,150,000 and 1,249,999. Unmarked counts are exact. Text is reproduced from the public post preview and truncated for length.