
微软让 GPT 与 Claude 协同工作,性能超越所有竞品

ChainCatcher 消息,微软周一宣布为 Copilot Researcher 推出两项新功能—Critique 与 Council,将 OpenAI 的 GPT 与 Anthropic 的 Claude 结合用于同一研究任务。
Critique 采用串联协作模式:GPT 负责规划研究、检索资料并生成初稿,Claude 随后担任严格审阅者,核查事实准确性与引用质量;Council 则让两个模型并行独立生成报告,再由第三个裁判模型对比差异、归纳分歧。
在涵盖医疗、法律、科技等 10 个领域共 100 项复杂研究任务的 DRACO 基准测试中,搭载 Critique 的 Copilot 得分 57.4 分,领先第二名近 14%,远超 Claude Opus 4.6 单独运行的 42.7 分。
Aviso legal: o conteúdo do OKX Orbit é fornecido apenas para fins informativos. Saiba mais
Respostas
Related Flash News
A empresa de computação quântica Quantinuum busca levantar US$ 1,05 bilhão por meio de um IPO
Wintermute: O principal nível de suporte do Bitcoin está na faixa de $75.000–$76.000, indicando que a estrutura do mercado não se deteriorou totalmente
Mídia iraniana: O descongelamento dos fundos iranianos é o último obstáculo sério entre Irã e Estados Unidos
Bloomberg: 9 carteiras de baleia dominam a decisão multibilionária da Polymarket sobre disputa
O Departamento de Defesa dos EUA e a SpaceX têm contestado a precificação do Starlink
O Diretor de Investimentos da BSTR afirmou que estão construindo o "Berkshire Hathaway 2", com o objetivo de aumentar o número de Bitcoins por ação
O caminho de menor resistência para os preços do ouro permanece para baixo
O Irã insiste que metade dos fundos congelados estará disponível quando o acordo for anunciado
Análise: O Bitcoin esfriou significativamente na rotatividade de curto prazo, e o mercado está próximo ao fundo do poço
A mídia iraniana negou as alegações de que Irã e EUA haviam chegado a um memorando de entendimento