微软希望优化每个AI令牌

Microsoft veut optimiser chaque token d’IA

Silicon.fr by La rédaction 2026-08-06 11:41 Original
摘要
微软内部要求工程团队优化生成式AI的使用,副总裁Jay Parikh强调应追求每个token创造的价值而非数量。公司将OpenAI的GPT-5.6 Sol设为GitHub Copilot员工默认模型,但允许工程师按需更换,该指引仅限内部,不改变面向客户的产品。随着推理成本上升,此举旨在将token视为需精打细算的计算资源,以控制大规模部署AI助手带来的开支。

微软内部已向工程团队发出明确指引:不要片面追求更高的 AI token 消耗量,而应关注每个 token 实际产出的价值。CoreAI 执行副总裁 Jay Parikh 在一份由 404 Media 披露的内部备忘录中,要求团队摒弃“token 最大化”思路,并把 token 当成与其它计算资源一样,综合考虑成本与回报。

为此,微软已将 OpenAI 的 GPT-5.6 Sol 设为内部员工使用 GitHub Copilot 时的默认模型,但这一设置并非强制,工程师仍可根据具体任务选择更合适的模型。该变动只限于微软内部,GitHub Copilot 对外提供的模型选项目前不变。

内部文件显示,微软每个部门均有自己的 AI token 消耗目标,工程师可通过内部仪表板追踪个人使用量。每位工程师的月度 token 费用通常在数百至数千美元之间,具体因团队和项目而异,但微软并未公布这些成本的官方数字。Parikh 强调,这一举措不是为了放缓微软的“AI 优先”战略,而是推动更精细的资源管理,在成本意识下寻求更高的 token 效能。

此举的背景是,随着开发助手、Copilot 及 AI 智能体的普及,推理成本正成为 AI 服务商的重大考验,最大化每个 token 产生的价值已成为控制整体支出的关键杠杆。由于 GitHub Copilot 现已与 Visual Studio 及 Visual Studio Code 一同归入 Parikh 主管的 CoreAI 工程组,上述指导方针也率先在这一开发环境中落地实施。

Summary
Microsoft is internally pushing engineering teams to prioritize value per AI token over volume, with CoreAI EVP Jay Parikh setting GPT-5.6 Sol as the default model for employees in GitHub Copilot while still allowing model choice. This cost-efficiency drive, treating tokens like any computing resource, responds to rising inference costs but currently applies only to internal usage, leaving customer-facing GitHub Copilot offerings unchanged.

Microsoft has directed its engineering teams to optimize how they use generative AI, shifting the focus from maximizing token volume to maximizing value per token. In an internal memo obtained by 404 Media, Jay Parikh, EVP of CoreAI, stressed that “tokenmaxxing” is not the goal and urged teams to prioritize the utility generated from each token, treating AI consumption like any other IT resource subject to cost-efficiency.

As a concrete step, Microsoft set OpenAI’s GPT-5.6 Sol as the default model for its employees using GitHub Copilot. Engineers can override this selection when a different model is better suited for a particular task. The change applies only to internal usage and does not alter the model choices offered to external Copilot customers.

Internally, each Microsoft division operates with defined token consumption targets. Engineers track their own usage through a dashboard, with monthly per-engineer costs typically ranging from a few hundred to several thousand dollars. Microsoft has not disclosed official spending figures. Parikh emphasized that the initiative is not a retreat from the company’s “AI-first” strategy but a disciplined approach to managing inference costs, which have become a pressing concern as AI assistants and copilots scale across the industry. The new guidelines originate from the CoreAI engineering group, now responsible for GitHub Copilot alongside Visual Studio and VS Code, explaining why the development environment is the first to adopt them.

Résumé
Microsoft, via son vice-président Jay Parikh, demande à ses ingénieurs de privilégier la valeur créée par token plutôt que la consommation brute, en définissant GPT-5.6 Sol d’OpenAI comme modèle par défaut dans GitHub Copilot pour ses usages internes. Cette démarche vise à maîtriser les coûts d’inférence qui peuvent atteindre plusieurs milliers de dollars par mois et par ingénieur, sans impacter les choix proposés aux clients.

Microsoft demande à ses équipes d’ingénierie de revoir leur manière d’utiliser l’IA générative.

Dans une note interne, révélée par 404 Media, Jay Parikh, vice-président exécutif de CoreAI, indique que le « tokenmaxxing » n’est pas l’objectif recherché et invite les équipes à privilégier la valeur créée par token.

Ainsi, Microsoft a défini GPT-5.6 Sol d’OpenAI comme modèle par défaut dans GitHub Copilot utilisé par ses collaborateurs. Ce paramètrage ne constitue toutefois pas une obligation. Les ingénieurs Microsoft peuvent sélectionner un autre modèle lorsqu’ils estiment qu’il est mieux adapté à une tâche spécifique.

Cette évolution concerne uniquement les usages internes de Microsoft et ne modifie pas, à ce stade, les choix de modèles proposés aux clients de GitHub Copilot.

GPT-5.6 Sol devient le modèle par défaut pour les collaborateurs de Microsoft

Selon les documents internes consultés par 404 Media, chaque division de Microsoft dispose d’un objectif de consommation de tokens IA. Les ingénieurs peuvent suivre leur propre utilisation via un tableau de bord interne. La dépense mensuelle en tokens par ingénieur représente généralement quelques centaines à plusieurs milliers de dollars, selon les équipes et les projets. Microsoft n’a toutefois publié aucun chiffre officiel concernant ces coûts.

Selon Jay Parikh, il ne s’agit pas de ralentir la stratégie « AI-first » de Microsoft mais de considérer les tokens comme n’importe quelle autre ressource informatique, en tenant compte de leur coût et en recherchant le meilleur rendement possible.

Cette évolution intervient alors que les coûts liés à l’inférence deviennent un enjeu majeur pour les fournisseurs de services d’IA. À mesure que les entreprises généralisent l’usage des assistants de développement, des copilotes et des agents IA, la capacité à maximiser la valeur produite par chaque token consommé devient un levier important de maîtrise des coûts.

Le fait que GitHub Copilot relève désormais du groupe d’ingénierie CoreAI, dirigé par Jay Parikh aux côtés de Visual Studio et de Visual Studio Code, explique que ces nouvelles lignes directrices s’appliquent en priorité à cet environnement de développement.

The post Microsoft veut optimiser chaque token d’IA appeared first on Silicon.fr.

Related Companies
neutral
OpenAI
mature
neutral
neutral
GitHub
mature
neutral
neutral
Categories
Not classified yet