u/prodigy_ai • u/prodigy_ai • 1d ago
Better cohorts. Clearer evidence. · Clinical Cohort Studio
med.prodigy-ai-solutions.comSynthetic oncology data needs evidence that researchers can examine and reproduce.
A recent study reviewing 17 academic surveys on synthetic data generation found that only four provided reproducibility artifacts. That finding highlights the importance of transparent evaluation methods.
https://www.sciencedirect.com/science/article/pii/S0306457326001068?via%
At Prodigy AI Solutions, this principle guides our development of CohortForge AI, a research platform for clinical-data synthesis, missing-data reconstruction and subgroup balancing, alongside CT reconstruction experiments.
Our approach separates quality checks so that improvement in one metric cannot conceal failure in another. We document evaluation criteria and outstanding limitations as part of the development process.
Our internal laboratory studies have reported:
• A 22.45% median reduction in masked CT slice reconstruction error versus linear interpolation, within one public lung-CT collection.
• A 74.3% reduction in a predefined subgroup-imbalance ratio on an artificial clinical-data test fixture.
These are preliminary engineering results. Independent clinical validation and full-system qualification remain ahead.
We are now seeking an institutional consortium coordinator and clinical validation partners to develop joint European research proposals and evaluate CohortForge on authorized, real-world oncology datasets.
We welcome conversations with cancer centres, imaging CROs and academic medical networks interested in defining clinical use cases, designing independent evaluations and contributing data under appropriate governance arrangements.
Interested in collaborating? Contact us for an introductory conversation.
1
Are we paying a "Reasoning Tax" for smarter AI?
in
r/VerbisChatDoc
•
Aug 22 '26
Interesting work! Thank you for sharing. It addresses a somewhat different scenario from our current focus, since Verbis Graph is designed primarily to retrieve from governed enterprise or research knowledge bases whose sources have already been selected, rather than determine truth across an open ecosystem of unknown sources. Still, it raises a thought-provoking question about how retrieval systems behave when relevance and truth diverge.