Anthropic заявила о масштабной операции по копированию Claude через «дистилляцию» ответов модели. По данным компании, китайские разработчики использовали фейковые аккаунты и прокси для обхода ограничений. Скандал разворачивается на фоне ужесточения экспортного контроля США и обвинений в использовании запрещённых чипов Nvidia.
Google показал, что длина ответа снижает точность, а «глубокие» токены её повышают. Think@n отбрасывает слабые варианты на раннем этапе и почти вдвое уменьшает расходы при росте качества.
Синтез речи переживает революцию: сложные архитектуры TTS уступают место простой связке языковой модели и нейросетевого кодека. Новый подход обеспечивает высокое качество, масштабируемость и мультимодальность.
OpenAI отключила систему автоматического выбора моделей ИИ для бесплатных пользователей ChatGPT, вернувшись к единой быстрой модели. Причина — нетерпеливость пользователей и высокая стоимость «умных» моделей.
Исследователи MIT-IBM представили PaTH Attention — новую технику позиционного кодирования для трансформеров, которая делает понимание контекста адаптивным и улучшает способность моделей к последовательному рассуждению в длинных текстах.
OpenAI представила GPT Image 1.5 — модель для редактирования изображений через текстовые запросы. Инструмент позволяет легко изменять фотографии, сохраняя лица, и является ответом на успех Google с Nano Banana.