Blinded two-phase evaluation of large language models in complex cardiac surgery: task-specific performance and human-AI collaboration.

Detalles Bibliográficos
Publicado en:Frontiers in Digital Health pp. 1 - 12
Autores principales: Leon, Marc, Feng, Ruibin, Quiroz Flores, Manuel, Pelletier, Glenn, Bethencourt, Daniel, Shibata, Masafumi, He, Hao, Ruaengsri, Chawannuch
Formato: pictorial research tables/charts Journal Article
Publicado: Frontiers Media S.A. 2026
Acceso en línea:Ver este registro en EBSCOhost
fields @attributes:
  recordID: 1
pdfLink:
plink: https://search.ebscohost.com/login.aspx?direct=true&db=ccm&AN=194550889&site=ehost-live
header:
  @attributes:
    shortDbName: ccm
    uiTerm: 194550889
    longDbName: CINAHL Complete
    uiTag: AN
  controlInfo:
    bkinfo:
    dissinfo:
    jinfo:
      jid:
        2673253X
        N386
      jtl: Frontiers in Digital Health
      issn: 2673253X
      maglogo: N
    pubinfo:
      dt: 2026
      pid: 40038
      pub: Frontiers Media S.A.
    artinfo:
      ui:
        194550889
        194550889
        194550889
        10.3389/fdgth.2026.1769467
        194550889
      ppf: 1
      ppct: 11
      formats:
      tig:
        atl: Blinded two-phase evaluation of large language models in complex cardiac surgery: task-specific performance and human-AI collaboration.
      aug:
        au:
          Leon, Marc
          Feng, Ruibin
          Quiroz Flores, Manuel
          Pelletier, Glenn
          Bethencourt, Daniel
          Shibata, Masafumi
          He, Hao
          Ruaengsri, Chawannuch
        affil: Department of Cardiothoracic Surgery, Stanford University School of Medicine, Stanford, CA, United States
      sug:
        subj:
          Natural Language Processing Evaluation
          Cardiac Surgery
          Task Performance and Analysis
          User-Computer Interface
          Decision Making, Clinical
          Clinical Reasoning
          Human
          Female
          Male
          Evaluation Research
          Expert Clinicians
          Artificial Intelligence, Generative
          Patient Safety
          Hallucinations
          Trust
          kappa Statistic
          Wilcoxon Rank Sum Test
          McNemar's Test
          Kendall's tau
          T-Tests
          Post Hoc Analysis
          Data Analysis Software
          Descriptive Statistics
          Funding Source
          Female
          Male
      pubtype: Academic Journal
      doctype:
        pictorial
        research
        tables/charts
        Journal Article
      ougenre: Article
      ab:
    language: English
    refInfo:
    holdings:
      @attributes:
        islocal: N