#AI-инфраструктура

Публикаций: 31

Gigatoken: токенизатор на Rust в 989 раз быстрее HuggingFace

Gigatoken — MIT-лицензированный BPE-токенизатор на Rust, демонстрирующий 24.53 GB/s на серверном AMD EPYC 9565. Это в 989 раз быстрее HuggingFace tokenizers и в 681 раз быстрее tiktoken — при том что оба бейзлайна сами написаны на многопоточном Rust.

Google ставит на масштаб: Gemini 4 требует моделей нового уровня

Alphabet поднял инвестиционный прогноз на 2026 год до $205 млрд, а Google Cloud ускорился до 82% роста во втором квартале. CEO Сундар Пичаи объявил: следующий качественный скачок Gemini невозможен без принципиально больших базовых моделей — и тренировочный прогон Gemini 4 уже запущен.

Три новых Gemini Flash вышли, а флагман 3.5 Pro всё ещё в обучении

Google выпустил три модели серии Gemini Flash, включая 3.6 Flash с потреблением токенов на 65% ниже. Но главное событие не случилось: Gemini 3.5 Pro — ожидаемый флагман — по-прежнему в обучении, пока OpenAI, Anthropic и китайские лаборатории уже работают на frontier-уровне.

GATS: агентное планирование без LLM-вызовов при 100% надёжности

GATS — фреймворк, который убирает вызовы LLM из цикла планирования агента целиком. На стресс-тесте из 12 сценариев — 100% успех против 23,9% у ReAct и 88,9% у LATS, при нулевом inference-cost в runtime.

Anthropic делает свой чип с Samsung — и не отказывается от Nvidia

Anthropic ведёт переговоры с Samsung о производстве кастомного AI-чипа — проект ранний, но инженеры уже наняты. Это второй подобный шаг за короткое время после сообщений о чипе OpenAI под кодовым названием «Jalapeño».

Nvidia как центробанк ИИ-стартапов: ставка на диверсификацию клиентов

Nvidia целенаправленно финансирует волну ИИ-стартапов — не ради альтруизма, а чтобы ослабить зависимость от четвёрки Big Tech, которая сейчас забирает львиную долю H100/H200. Логика простая: чем больше независимых игроков на GPU-рынке, тем устойчивее бизнес.

Meta строит облако: $145 млрд AI-инвестиций выходят на рынок

Meta создаёт облачный бизнес для продажи незадействованных AI-вычислительных мощностей сторонним клиентам. При плановых инвестициях до $145 млрд в текущем году компания повторяет схему SpaceX: строишь огромную инфраструктуру под себя — и монетизируешь простои.

Lindy выбрала DeepSeek вместо Claude — и сэкономила миллионы

AI-стартап Lindy полностью отказался от Claude и перешёл на DeepSeek — потому что расходы на AI-инфраструктуру обогнали расходы на всю команду. CEO Фло Кривелло назвал это «вопросом выживания бизнеса».

x86 получает нативное ускорение ИИ: спецификация ACE уже здесь

x86ecosystem.org опубликовал спецификацию AI Compute Extensions — набор расширений для процессоров x86, которые добавляют аппаратную поддержку матричных вычислений и форматов с пониженной точностью прямо в CPU. Это не GPU-замена, но сигнал о том, куда движется «обычное» железо.

Amazon, Nvidia и AMD вложили $310 млн в стартап 3D-моделей мира

Odyssey ML поднял $310 млн от Amazon, Nvidia, AMD, венчурного фонда ЦРУ и главного учёного Google Джеффа Дина — и оценился в $1,45 млрд. Ставка крупнейших игроков на 3D world models говорит о том, что гонка вышла далеко за пределы языковых моделей.

OpenAI сожгла $34 млрд за год — и это только начало

OpenAI потратила $34 миллиарда за последний финансовый год — существенно больше, чем годом ранее. Цифра показывает, во что реально обходится гонка за AGI.

Microsoft переводит Copilot Cowork на pay-as-you-go и присматривается к DeepSeek

Microsoft меняет модель монетизации Copilot Cowork: фиксированная подписка уходит, приходит оплата по факту использования. Параллельно компания рассматривает файн-тюн DeepSeek V4 как более дешёвую основу для продукта.

Nvidia занимает $20 млрд: ИИ-инфраструктура переходит на долговое финансирование

Nvidia выходит на рынок облигаций впервые с 2021 года — компания намерена привлечь не менее $20 млрд. Это крупнейшая долговая сделка в истории компании и сигнал о том, как финансируется AI-гонка прямо сейчас.

Mirage от Microsoft запомнит, что за поворотом камеры

Microsoft Research представила Mirage — видеомодель, которая хранит пространственный контекст сцены в латентном пространстве, а не в пиксельных облаках точек. Результат: меньше памяти GPU, меньше вычислений, и камера больше не «забывает» комнату, из которой только что вышла.

OpenAI и Nvidia замахнулись на 10 ГВт: крупнейший дата-центр в истории

OpenAI ведёт переговоры об аренде дата-центра мощностью 10 гигаватт в Огайо — и за сделкой, по данным The Information, может стоять Nvidia. Масштаб беспрецедентный: речь о комплексе, которого ещё не существовало.

Китай вложит $295 млрд в ИИ-инфраструктуру — 80% чипов своих

Пекин готовит масштабную программу строительства ИИ-датацентров на $295 млрд — с жёстким требованием: не меньше 80% оборудования от отечественных поставщиков. Huawei в выигрыше, NVIDIA — за воротами.

OpenAI подала S-1 в SEC: IPO без сроков и с оговорками

OpenAI конфиденциально подала регистрационный документ S-1 в Комиссию по ценным бумагам США — первый формальный шаг к выходу на биржу. Сроков нет, уверенности тоже.

Apple открыла бесплатный доступ к ИИ для малых разработчиков

Apple объявила на WWDC 2026: разработчики с менее чем 2 миллионами загрузок в App Store получают бесплатный доступ к Foundation Models через Private Cloud Compute. Никаких облачных счётов — просто пишешь код.

Баффет ставит $10 млрд на AI-инфраструктуру Alphabet

Berkshire Hathaway вложила $10 млрд в частное размещение Alphabet — компания привлекает $80 млрд на AI-инфраструктуру при плановых капрасходах $190 млрд в 2026 году. Когда самый осторожный инвестор планеты идёт в AI — это сигнал, который нельзя игнорировать.

Alphabet поднимает $80 млрд — самая крупная ставка на AI-инфраструктуру

Alphabet объявил о привлечении $80 млрд акционерного капитала на расширение AI-инфраструктуры и вычислительных мощностей. Это одна из крупнейших разовых капитальных операций в истории технологического сектора.

Anthropic подала заявку на IPO: оценка почти $1 трлн

Anthropic конфиденциально подала черновую регистрацию на IPO в SEC. Оценка компании — чуть меньше $1 трлн, а конкурент OpenAI движется тем же курсом.

Datasette 1.0a31: write-доступ к SQLite без единой строки бэкенда

Datasette 1.0a31 впервые официально поддерживает запись в базу — пользователи с нужными правами выполняют INSERT, UPDATE, DELETE прямо через браузер. Плюс stored queries с возможностью шарить на команду.

Anthropic привлекла $65 млрд: оценка почти $1 трлн

Anthropic закрыла раунд Series H на $65 млрд при оценке $965 млрд. Годовая выручка компании превысила $47 млрд — это делает Claude одним из самых быстрорастущих AI-продуктов в истории.

Nvidia увеличила закупки в Тайване с $15 до $150 млрд в год

Nvidia тратит на тайваньских поставщиков — прежде всего TSMC — до $150 млрд в год. Десять лет назад цифра была $15 млрд. Десятикратный рост за один AI-цикл.

DeepSeek зафиксировал скидку 75%: выходные токены в 34 раза дешевле GPT-5.5

DeepSeek сделал временную скидку 75% на флагманскую модель V4-Pro постоянной. Теперь выходные токены стоят как минимум в 34 раза меньше, чем у GPT-5.5 — и это меняет экономику агентных систем.

AI съедает память: почему смартфоны подорожают из-за дата-центров

Три крупнейших производителя памяти переориентируют мощности на HBM для GPU — и это уже бьёт по цене бюджетных смартфонов. Рынок до $100 в Азии и Африке под реальной угрозой.

YMTC выходит на биржу: Китай строит суверенный рынок памяти

Крупнейший производитель памяти Китая Yangtze Memory Technologies завершил регистрацию IPO-тьюторинга у регулятора и движется к листингу на STAR Market — возможно, уже в июне 2026-го. За этим шагом стоит не просто биржевая сделка, а ставка Пекина на технологический суверенитет в полупроводниках.

Cisco уволила 4000 при рекордной выручке — и дала им курс по ИИ

13 мая Cisco отчиталась о квартальной выручке $15,84 млрд — рекорд, +12% год к году — и одновременно объявила об увольнении 4000 человек. В прощальный пакет вложили год доступа к курсам по AI.

Ollama + Open WebUI на VPS без GPU: когда терпимо, а когда нет

Self-hosted LLM на дешёвом VPS — идея привлекательная, но CPU-инференс быстро расставляет приоритеты. Разбираем, когда это рабочий сценарий, а когда — компромисс ради компромисса.

DDR5-8000 без разгона: TEAMGROUP снижает планку быстрой памяти

TEAMGROUP анонсировала ELITE PLUS DDR5 с частотой 8000 MT/s при стандартном напряжении 1,1 В — без XMP-профилей и оверклокинга. Старт продаж — июнь 2026 года.

Промпт-инъекция не лечится: архитектурный предел LLM-агентов

OWASP называет промпт-инъекцию уязвимостью №1 для LLM-приложений — и она не закрывается патчем. Проблема не в коде и не в модели: она встроена в саму природу того, как языковые модели обрабатывают текст.

← Все статьи