7213Ejaaz

vip
Возраст 1.6год
Максимальный уровень 0
Пока нет содержимого
фондовый рынок рушится из-за какой-то глупой новости: китайская компания создала прототип машины $300M ASML — это так тупо.
миру понадобятся бесконечные объёмы памяти, литографии, чипов и энергии. 13 клиентов (тринадцать) составляют 40% выручки SK hynix в следующем году (и они уже платят авансом!)
каждый агент, opus, fable и codex, который запускается, требует намного больше памяти для kv cache, DRAM в ваших GPU, мощности от электросети и дата-центров, чтобы обслуживать инференс.
меньше 5% людей в мире действительно используют возможности ИИ.
как ни проецируй будущее, ему всё равно пот
Посмотреть Оригинал
post-image
  • Награда
  • 1
  • Репост
  • Поделиться
FINNIAN_COVE:
Причина, по которой рынки волатильны, в том, что потенциал пока понятен не всем.
Но он будет понятен.
opus 5 — это взломанная игровая модель. если перемотать на 5 лет назад, эти игры наверняка стали бы вирусными хитами на мобильных устройствах или игровых консолях.
но самое крутое в том, что игры генерируются в реальном времени, так что можно получать непрерывные уровни, которые адаптируются под игрока.
серьёзно, безумие, насколько быстро эти модели становятся лучше (я думал, что grok придёт сюда первым).
можете представить, что сделает opus /fable 6?
Посмотреть Оригинал
post-image
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Meta разрабатывает конкурента OpenRouter (буквально сразу после новости о том, что OpenRouter могут приобрести), но есть ещё одна причина, почему Meta это делает:
> больше не будет $100Ms потерь на инференсе. платформа будет эффективно маршрутизировать AI-запросы на несколько разных моделей, снижая расходы и давая более качественные ответы.
> совершенно новый источник дохода: Meta намерена выпустить это публично, чтобы каждый мог экономить деньги
> мощный новый способ обучать их модели: используемое внутри компании, Meta создаст крайне ценный датасет о том, как и когда применять модели для ра
META-0,21%
Посмотреть Оригинал
post-image
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
вот и всё — Microsoft будет использовать Kimi K3, чтобы приводить в действие их флагманского ИИ-ассистента Copilot, экономя до 60% за каждый токен или $600M на каждый $1B , потраченный на расходы на инференс.
если Microsoft решит развернуть модель у себя, один раз Кimi откроет её исходный код 27-го числа, то эти затраты снизятся ещё сильнее.
любите или ненавидьте эти китайские модели, open source действительно выравнивает поле в большом масштабе.
согласно информации
MSFT1,93%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Кого волнует, что Kimi k3 лучше, чем Fable? Весь смысл в том, что они доказали: вы можете получить модель уровня frontier за существенно более низкую стоимость.
А это значит, что что-то нужно пересчитать в цене.
Если вы компания, которая тратит $10–100 млн на токены, и вы можете сократить это в 21 раз — почему, блин, вы бы не стали это рассматривать?
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
причина, по которой вам стоит обратить внимание на kimi k3 — не в том, что он обыгрывает fable, а в том, что у него нулевые ограничения: нецензурный ИИ.
причина, по которой вам стоит беспокоиться из-за Китая, в том, что они догнали США. представьте, как нецензурная мифология уходит вразнос.
интеллект на токен — теперь это всё, что имеет значение, и Китай здесь, чтобы играть, а их модели стоят дёшево, аф.
правила изменились.
kimi теперь. deepseek, zhipu, qwen все следом.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
напоминание: Opus 5 выйдет на следующей неделе, и, вероятно, обгонит K3.
главное преимущество, которое есть у Anthropic и OpenAI, — они могут дистиллировать свои флагманские модели в более дешёвые и доступные модели с высокой интеллектуальностью на единицу затрат
а ещё Fable 6 и GPT 6 будут здесь примерно через 1 месяц. циклы становятся короче.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
k3 из kimi ощущается более значимым, чем момент с deepseek. трудно не заметить:
> обходит fable, получив 5,6 на нескольких ключевых бенчмарках. впервые китайская модель *не* отстаёт
> и делает это при доле от размера, стоимости и без пафосных видеокарт nvidia
> повторяющиеся прорывы в данных, использованных для обучения моделей, + в тренировочных техниках сделали Китай легитимным центром для исследований в области ИИ
всё это ещё и с открытым исходным кодом. с какого момента мы начинаем признавать, что у них здесь действительно может быть преимущество?
разрыв сократился максимум до 3 месяцев се
NVDA-5,04%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Google $GOOG испытывает трудности с продажей своих TPU: 75% чипов, которые используют неоклоуды, — это чипы Nvidia, но есть веские основания для того, что Google сможет победить в течение следующего года: стоимость.
Meta, Uber, Microsoft и многие другие за последние несколько месяцев сократили агрессивные расходы на ИИ, перейдя на более дешёвые модели — это позволило им сэкономить $10-100Ms.
Но самая большая статья расходов при использовании ИИ-моделей связана с базовой инфраструктурой, которая обслуживает их для клиентов: TPU — это более дешёвая (и более эффективная) альтернатива.
Моё предпо
GOOG2,35%
NVDA-5,04%
META-0,21%
UBER3,36%
MSFT1,93%
Посмотреть Оригинал
post-image
post-image
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
Боже, какое время быть живым.
Теперь у нас внезапно появилось 10+ ИИ-моделей с похожими возможностями, и мы получаем новую версию каждые ~2–3 недели.
Лучшее в том, что как бы ты ни искал — есть модель под это:
дешевле, чем fable? gpt 5.6
беспокоишься о приватности? 5+ открытых моделей
не знаешь, какую модель выбрать? cursor или openrouter
Anthropic, OpenAI, xai, meta, google, zhipu, deepseek, moonshot, alibaba — все они сейчас конкурируют агрессивно, и это отлично для тебя, пользователя.
Nvidia, cerebras, etched, groq, intel, tsmc — тоже конкурируют, чтобы оптимизировать слой жел
NVDA-5,04%
INTC-0,67%
TSM-1,11%
META-0,21%
BABA2,53%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Невероятно. Apple подаёт в суд на OpenAI за кражу аппаратных секретов для их будущих AI-устройств, которые выйдут позже в этом году.
Похоже, один сотрудник убедил членов команды Apple принести на интервью собственные аппаратные устройства.
OpenAI и Apple сходятся лицом к лицу на рынке AI-потребительских устройств позже в этом году: Apple планирует новую модель Airpod с камерами, умные очки и устройство-подвес.
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
На этой неделе для AI полный успех: столько новых моделей и функций, которые можно попробовать в эти выходные:
> 1 новая модель на новом рубеже: gpt 5.6 Sol
> 2 новые безумно дешёвые модели, которые на 80% соответствуют уровню frontier: grok 4.5 и meta muse spark 1.1
> 2 новые image-модели: muse image и seedream 5.0
> prime intellect повышает $130M , чтобы выпустить больше открытых моделей
а Google ещё выпускает 3.5 на следующей неделе, deepseek v4 тоже, grok 4-5T модель через месяц и GPT 6 через месяц
всё происходит так быстро
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Одним из крупнейших сдвигов в ИИ стал переход от обучающих чипов к чипам, оптимизированным для вывода - и не зря:
именно на выводе делаются деньги (и интеллект)
> ходят слухи, что Anthropic получает 80% маржи по доходам на выводе. они станут прибыльными раньше любой другой ИИ-лаборатории.
> Apple, Meta, OpenAI, Google — все делают свои собственные пользовательские чипы для вывода
> китайские модельные лаборатории (несмотря на аппаратные ограничения) создают передовой интеллект, просто заставляя модель думать дольше.
суть в том, что вывод будет опережать любые другие ИИ-сервисы на многие килом
META-0,21%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
по мере того как америка отмечает 250 лет, сейчас важнее, чем когда-либо, помнить, что секретный соус этой страны — это её люди и их неустанное стремление к смелым, амбициозным идеям. именно это позволяло америке побеждать и будет позволять побеждать в будущем.
надвигающиеся угрозы иностранной конкуренции в области ИИ — кража моделей дизайна, ограничения на природные ресурсы, войны масштабирования и т. д. — будут становиться всё более серьёзной проблемой
мы должны защищать наши центры обработки данных, людей, но самое главное — наши идеи. именно это удерживает нас на передовой *любой техноло
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
tesla только что стала последней компанией, сократившей расходы на ИИ, установив лимит на токены в $200 в неделю для сотрудников и побуждая их использовать модели grok + cursor — признак грядущих времен
> Илон подталкивает сотрудников использовать внутренние версии композитора моделей grok + cursor
> они запустили несколько частных агентов, обученных на данных tesla, чтобы повысить производительность
> сотрудники по-прежнему имеют доступ к claude и gpt через свою внутреннюю "bottleneck platform"
> за этим следуют uber, microsoft и meta, которые также агрессивно сократили расходы
отметим, что И
TSLA-1,17%
UBER3,36%
MSFT1,93%
META-0,21%
Посмотреть Оригинал
post-image
  • Награда
  • комментарий
  • Репост
  • Поделиться
похоже, что openai делает большую ставку на инференс, чтобы обойти anthropic в ближайшие 6 месяцев:
> между их cerebras и предстоящими чипами jalapeño ai, openai получит идеальный стек оборудования, оптимизированный для GPT
> они сократили затраты на инференс на 50% (согласно информации), что сэкономит им $10Ms
> gpt 5.6 сильно опирается на агентное рассуждение и выполнение (тяжелый инференс)
инференс составляет 40-50% расходов на вычисления в лабораториях, сокращение этого вдвое высвобождает вычислительные мощности для обучения — совокупные эффекты этого невозможно недооценить, на мой взгляд
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
Я не верю в FUD про мету и память ИИ:
- Google только что отключила Meta за использование слишком больших вычислительных мощностей, зачем им тогда продавать избыточные мощности?
- Meta владеет одним из крупнейших парков GPU, они, скорее всего, продают старые для инференса (как SpaceX), пока используют новые Rubin.
- Память без сомнения — самый дефицитный ресурс в ИИ, спрос превышает любой прогнозируемый будущий объём поставок в 5–10 раз.
- если кто-то спроектирует чип, модель или агента, которым требуется меньше памяти — это приведёт лишь к ещё большему спросу на память
ты вообще видел, скольк
META-0,21%
SPCX-1,23%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
так что похоже, что в последнее время в области ИИ сходятся несколько ключевых тенденций
- передовые модели теперь представляют реальную угрозу государственной безопасности, вызывая необходимость вмешательства правительства (покойся с миром, сказка)
- это означает, что будущие релизы моделей будут закрытыми (ограниченными). любые будущие публичные релизы почти наверняка будут ограничены
- одновременно китайские открытые модели догнали передовые возможности. за менее чем 6 месяцев они станут уровня Mythos
- открытые модели дешевле, их можно запускать приватно, трудно регулировать правит
GLM-2,90%
MSFT1,93%
Посмотреть Оригинал
  • Награда
  • комментарий
  • Репост
  • Поделиться
  • Закреплено