Обнародованные в четверг судебные материалы по иску The New York Times к OpenAI и Microsoft показали, что внутри Microsoft ещё в 2023 году предупреждали: общественность может воспринять обучение больших языковых моделей на чужих материалах как «кражу беспрецедентных масштабов». Сотрудники Microsoft обсуждали, не является ли использование новостных статей OpenAI «крупнейшей кражей труда в истории человечества», и не запустит ли это «порочный круг», ухудшающий сами модели. В одном из внутренних документов говорилось, что «миллионы людей по всему миру вскоре сочтут, что большие модели, вбирающие в себя их работу, совершают поразительную кражу беспрецедентных масштабов», а сами ИИ-модели названы «продуктом, который уничтожает собственную цепочку поставок».
Microsoft утверждает, что эти меморандумы подготовил директор по прикладным исследованиям Брент Хехт и они не отражают позицию компании. Гендиректор Microsoft Сатья Наделла на допросе заявил, что любой платный контент должен лицензироваться тем, кто хочет его использовать. В OpenAI один из сотрудников сообщил президенту Грегу Брокману о создании обхода платного доступа к NYT, на что Брокман ответил: «ah nice». Руководитель команды ChatGPT Ник Терли писал, что ИИ представляет «экзистенциальную угрозу» для издателей, а бывший директор по политике Джек Кларк ещё в 2020 году предупреждал о системах, «замещающих труд людей» и оставляющих беспорядок. Обе компании настаивают, что обучение моделей является добросовестным использованием.
Параллельно, 17 сентября OpenAI запустила Astra for Law — конфигурацию GPT-6 Astra для юристов, построенную на правовом поисковом индексе из более чем 230 млн URL с американской судебной практикой, статутами, нормативными актами и административными решениями. На бенчмарке Vals AI Legal Research Bench система показала 54% против 38,7% у GPT-6 Astra со стандартным веб-поиском, то есть относительный рост на 40%. Продукт нашёл на 24% больше прецедентных дел и до 54% больше релевантных фрагментов из корректных заключений. Доступ открыт через программу Trusted Access для юридических фирм, предусмотрены нулевое хранение данных на API и исключение из ручной проверки.
Запуск сопровождали 26 партнёрских плагинов и девять community-плагинов. Среди партнёров — Thomson Reuters, Intapp, iManage, Relativity, Clio и DeepJudge, а среди ранних клиентов — Harvey Technologies и Legora. Юридические фирмы Sullivan & Cromwell, Ropes & Gray, Cooley, Latham & Watkins и Wachtell Lipton участвовали в раннем тестировании. В тот же день стала общедоступной ChatGPT for Word. Неделей ранее, 10 сентября, OpenAI представила ChatGPT for Financial Services с данными LSEG, PitchBook, Daloopa, Crunchbase и Quartr. Таким образом, компания за семь дней вывела вертикальные решения для финансового и юридического секторов, что усиливает давление на поставщиков профессиональных данных, таких как LSEG, PitchBook и Bloomberg.