
微软让 GPT 与 Claude 协同工作,性能超越所有竞品

ChainCatcher 消息,微软周一宣布为 Copilot Researcher 推出两项新功能—Critique 与 Council,将 OpenAI 的 GPT 与 Anthropic 的 Claude 结合用于同一研究任务。
Critique 采用串联协作模式:GPT 负责规划研究、检索资料并生成初稿,Claude 随后担任严格审阅者,核查事实准确性与引用质量;Council 则让两个模型并行独立生成报告,再由第三个裁判模型对比差异、归纳分歧。
在涵盖医疗、法律、科技等 10 个领域共 100 项复杂研究任务的 DRACO 基准测试中,搭载 Critique 的 Copilot 得分 57.4 分,领先第二名近 14%,远超 Claude Opus 4.6 单独运行的 42.7 分。
Vastuuvapauslauseke: OKX Orbit -sisältö on tarkoitettu ainoastaan tiedotustarkoituksiin. Lisätietoja
Vastaukset
Related Flash News
Kvanttilaskentayritys Quantinuum pyrkii keräämään 1,05 miljardia dollaria listautumisannilla
Wintermute: Bitcoinin keskeinen tukitaso on 75 000–76 000 dollarin välillä, mikä viittaa siihen, että markkinarakenne ei ole täysin heikentynyt
Iranin media: Iranin varojen sulattaminen on viimeinen vakava este Iranin ja Yhdysvaltojen välillä
Bloomberg: 9 valaslompakkoa hallitsee Polymarketin monen miljardin dollarin kiistaratkaisua
Yhdysvaltain puolustusministeriö ja SpaceX ovat kiistäneet Starlinkin hinnoittelun
BSTR:n sijoitusjohtaja kertoi, että he rakentavat "Berkshire Hathaway 2" -yritystä tavoitteenaan lisätä Bitcoinien määrää osakkeelta kohden
Kullan hintojen vähimmän vastuksen polku pysyy laskevana
Iran vaatii, että puolet jäädytetyistä varoista on käytettävissä, kun sopimus julkistetaan
Analyysi: Bitcoin on jäähtynyt merkittävästi lyhyen aikavälin liikevaihdossa, ja markkina on lähellä pohjaa
Iranilainen media kiisti väitteet, että Iran ja Yhdysvallat olisivat solmineet yhteisymmärryspöytäkirjan