Visual Studio 18.9 позволяет задавать усилие размышления для каждой модели
В Visual Studio 18.9 Insiders 2 появился элемент управления усилием размышления для каждой модели, с уровнями от Low до Max, который открывает тот же параметр, что уже принимают API моделей.
2026-07-29 Rachel Kang опубликовала статью Tell your model when to think harder, и описанная в ней возможность интереснее, чем следует из заголовка. Начиная с Visual Studio 18.9 Insiders 2, поддерживаемые модели получают элемент управления усилием размышления, и он задаётся для каждой модели, а не для каждого запроса.
Выбор модели и выбор глубины размышления перестали быть одним решением
До сих пор выбор модели в Visual Studio означал выбор сразу двух вещей: какие веса отвечают на ваш вопрос и сколько размышления происходит до появления ответа. Если модель размышляла глубоко, за это платил каждый запрос вида “переименуй эту переменную”.
Разделение этих решений означает, что вы можете держать одну и ту же модель на протяжении всей сессии, а вместо переключения модели двигать регулятор. Уровни такие:
- Low: “Quick responses with minimal reasoning”, и расходуется меньше кредитов ИИ.
- Medium: “Balanced reasoning and speed, and usually the default.”
- High: более глубокое размышление, для сложного алгоритма, архитектурного решения или бага, который не удаётся локализовать.
- Extra High и Max: “The most reasoning some models offer, for the gnarliest problems.”
Модели, которые не предоставляют управление размышлением, показывают дефис и продолжают работать точно так же, как раньше, поэтому элемент управления добавляется, а не меняет поведение повсеместно.
Где он находится
Откройте выбор модели, нажмите Manage models, чтобы открыть расширенное окно управления моделями, и задайте там уровень размышления для каждой модели. Он не спрятан в Tools > Options и не является переключателем для отдельного запроса.
Эта лестница принадлежит провайдеру, а не Visual Studio
Low, Medium, High, Extra High, Max это не пять названий, которые Microsoft придумала для ползунка. Это параметр усилия размышления, который API моделей уже принимают, выведенный в IDE. В API Anthropic усилие находится внутри output_config и принимает ровно low, medium, high, xhigh и max:
using Anthropic;
using Anthropic.Models.Messages;
AnthropicClient client = new();
var response = await client.Messages.Create(new MessageCreateParams
{
Model = "claude-opus-5",
MaxTokens = 16000,
Thinking = new ThinkingConfigAdaptive(),
OutputConfig = new OutputConfig { Effort = Effort.High },
Messages = [new() { Role = Role.User, Content = "Why does this query deadlock?" }],
});
На уровне протокола это "output_config": { "effort": "high" }, причём xhigh находится между high и max. Обратите внимание, что Effort вложен в OutputConfig и не является свойством верхнего уровня. Именно эту ошибку стоит избегать, если вы собираетесь встроить такой же элемент управления в свои инструменты.
Две детали важны, когда вы разбираетесь, что настройка IDE делает на самом деле. Усилие это верхняя граница глубины размышления и общего расхода токенов, а не фиксированный бюджет: в текущих моделях Claude адаптивное размышление по-прежнему решает для каждого запроса, сколько размышлять, а усилие это ограничивает. А прежний подход с явным жёстким бюджетом токенов размышления в этих моделях убран, и именно поэтому лестница из пяти именованных ступеней это то, что IDE может показать вам.
Часть, которая попадает в счёт
“Higher thinking levels do more reasoning, which consumes more credits. Lower levels use fewer.” Это делает элемент управления рычагом стоимости не меньше, чем рычагом качества, и он сочетается с лимитами кредитов ИИ на сессию в Copilot CLI и SDK: один ограничивает потолок, другой задаёт скорость расхода на запрос.
Если вы используете 18.9 Insiders, быстрее всего откалибровать так: оставьте выбранной привычную модель, опустите её до Low на день рутинных правок и посмотрите, как мало вам этого не хватает.
Comments
Sign in with GitHub to comment. Reactions and replies thread back to the comments repo.