Основатель ByteDance запретил ИИ-исследователям компании использовать дистилляцию моделей иностранных конкурентов. Запрет введён из-за напряжённости между США и Китаем.
Модели DeepSeek показывают высокие результаты в программировании, математике и логике при низких затратах. Компания специализируется на языковых моделях — мультимодальность остаётся слабым местом.
Китайский стартап DeepSeek уведомил клиентов, что намерен существенно повысить цены на доступ к своим ИИ-моделям. Этот шаг ломает устоявшийся стереотип о том, что китайские разработчики завоёвывают мировой рынок исключительно демпингом.
Китайская компания DeepSeek планирует построить крупный кампус дата-центров для ИИ мощностью 1 ГВт в городском округе Уланчаб во Внутренней Монголии, сообщает Bloomberg.
Reasonix — консольный ИИ-агент для кодинга, изначально заточенный под DeepSeek. Это один статический бинарник на Go, работающий как обвязка на базе конфигов и плагинов и настроенный вокруг префиксного кеша DeepSeek ради экономии токенов.
Всё описывается конфигурацией: провайдеры, агент, включённые инструменты и плагины. Захардкоженных моделей нет — DeepSeek идёт пресетом, а любой OpenAI-совместимый эндпоинт добавляется записью в конфиге, а не новым кодом.
DwarfStar — компактный нативный движок инференса, оптимизированный под DeepSeek V4 Flash. Также поддерживаются GLM 5.2 и DeepSeek V4 PRO на системах с большим объёмом памяти. Это не универсальный GGUF-раннер, а узкий проект.
Загрузка моделей, рендеринг промптов, вызовы инструментов, KV-состояние, HTTP-сервер и кодовый агент собираются и тестируются вместе. В репозиторий входят инструменты для GGUF, imatrix, проверки качества и скорости.
Google проиндексировал публичные ссылки на переписки пользователей с китайским чат-ботом DeepSeek. В открытом доступе оказались личные сообщения и загруженные рабочие документы — об этом сообщили «Коммерсантъ» и РБК.
По данным Bloomberg, в этом году на IPO уже привлекли $227,5 млрд — и это без учёта SPAC-компаний, выходящих на биржу ради дальнейшего поглощения.
DeepSeek, китайский разработчик больших языковых моделей, готовится к IPO в 2027 году, но может выйти на биржу уже в конце этого года. Компания также планирует привлечь около $1,5 млрд новых средств при оценке примерно в $71 млрд, сообщает Bloomberg.
Состояние основателя DeepSeek Ляна Вэньфэна выросло более чем вдвое — с $16,7 до $36 млрд. Bloomberg Billionaires Index признал его богатейшим основателем среди компаний, работающих над большими ИИ-моделями.
