richtige Kombination aus Werte- und Referenztypen

aber die row hat doch mit dem count gar nichts zu tun. denn du kannst ja 5000 positionen mt der gleichen gruppe und qualität in 200 verschiedenen rows haben?
Welche qualität meinst du? Das verstehe ich nicht ganz, aber ich würde dir intuitiv nur zum Teil zustimmen da die row quality später bestimmen soll welche Positionen aus der Datenbank geholt werden?

Ich versuch nochmal auf das wesentliche zu abstrahieren:
die Daten liegen folgendermaßen vor:
gruppe[TAB]positionen[TAB]posqualities[TAB]rowquality
chr1[TAB]1,2,3,4,5,6[TAB]10,20,30,30,25,5[TAB]80
chr1[TAB]3,4,5,6,7,8[TAB]1,40,3,30,25,5[TAB]10
chr1[TAB]2,3,4,5,6,7[TAB]40,25,3,3,5,5[TAB]30
...
so jetzt möchte ich die Daten in die Datenbank legen das zu jeder position jeweils die count, qual, row_qual und wahrscheinlich noch weitere Eigenschaften kommen, aber zunächst ist mir nur die folgende beispielhafte Abfrage wichtig:
welche Positionen haben einen count > 10, qual > 20 und row_qual > 20
so wie im vorherigen post. Die Werte können dann natürlich variieren.
Aber für das Beispiel wären jetzt die Positionen(den count nicht beachten da das Beispiel zu groß wäre, also count >= 1)aus row1 die pos3,4,5 und aus row3 die pos2,3 und alle haben count = 1 ausser pos3 mit count = 2

Gruß Air
 
Zuletzt bearbeitet:
Es gibt die drei Bedingungen count >=1 , qual > 20 und row_qual > 20.
Somit ist im Beispiel die erste row_qual ok und die jeweiligen positionen 3,4,5 haben eine pos_qual die höher als 20 ist.
Die zweite row fliegt raus da die row_qual zu gering ist. In der dritten row ist die row_qual wieder ok und pos 2,3 haben eine pos_qual die höher als 20 ist. Somit werden die Positionen von der Gruppe chr1 in row1 jeweils einmal gezählt und in row 3 kommt die pos2 dazu und pos3 wird zum zweiten mal gezählt=count2.
Also bleiben aus dem Beispiel folgende Daten übrig:
gruppe[TAB]positionen[TAB]posqualities[TAB]rowquality
chr1[TAB]x,x,3,4,5,x[TAB]x,x,30,30,25,x[TAB]80
chr1[TAB]x,x,x,x,x,x[TAB]x,x,x,x,x,x[TAB]x
chr1[TAB]2,3,x,x,x,x[TAB]40,25,x,x,x,x[TAB]30
...

Gruß Air
 
die row enthält drei positionen(das ist aber nicht der count) die den Anforderungen entsprechen, aber der count bezieht sich immer auf die Position in Abhängigkeit der Gruppe.
Das Ergebnis könnte man auch in eine Tabelle einfügen:
group/pos/count/pos_qual/row_qual
chr1/2/1/40/30
chr1/3/2/30,25/80,30
chr1/4/1/30/80
chr1/5/1/25/80
 
Sorry aber ich streck die Segel. Ich kapiere die Logik nicht. Jetzt hat row2 plötzlich 2 row qualitäten?

Das passt doch alles vorne und hinten nicht zusammen
 
Hi sorry, die Ergebnis-Tabelle irritiert ein wenig. Die Tabelle listet nur die Positionen auf da ist row2 nicht vertretten.
also die Ausgangs-Datei wäre:
gruppe[TAB]positionen[TAB]posqualities[TAB]rowquality
chr1[TAB]1,2,3,4,5,6[TAB]10,20,30,30,25,5[TAB]80
chr1[TAB]3,4,5,6,7,8[TAB]1,40,3,30,25,5[TAB]10
chr1[TAB]2,3,4,5,6,7[TAB]40,25,3,3,5,5[TAB]30
...
diese müsste in die Datenbank und wenn ich jetzt die Filter ansetze, würde man folgende Daten aus der Datei sehen(die nicht den Filter entsprechen habe ich mit x markiert):
gruppe[TAB]positionen[TAB]posqualities[TAB]rowquality
chr1[TAB]x,x,3,4,5,x[TAB]x,x,30,30,25,x[TAB]80
chr1[TAB]x,x,x,x,x,x[TAB]x,x,x,x,x,x[TAB]x
chr1[TAB]2,3,x,x,x,x[TAB]40,25,x,x,x,x[TAB]30
...
Danach habe ich die Ergebnistabelle gezeigt die nachdem query entsteht, die hat keinen bezug auf rows nur row quality (Select group, pos, pos_count, pos_qual,row_qual...):
group/pos/count/pos_qual/row_qual
chr1/2/1/40/30
chr1/3/2/30,25/80,30
chr1/4/1/30/80
chr1/5/1/25/80
Die entsprechende row number wäre also für die spätere query erstmal nicht interessant. Aber ich füge sie mal in die Ergebnis-Tabelle ein damit der Bezug ersichtlich ist:
group/pos/count/pos_qual/row_qual/row_number
chr1/2/1/40/30/3
chr1/3/2/30,25/80,30/1,3
chr1/4/1/30/80/1
chr1/5/1/25/80 /1

Gruß Air
 
Zuletzt bearbeitet:
also die position 3 der gruppe chr1 ist in der row1 und row3 vertreten, das heißt wir haben 2 mal die gleiche position -> somit 2 counts. Zu jedem count ist dann jeweils eine pos qual und row qual.
Also in zeile 2 der Ergebnistabelle die row_qual 80 von row1 und row_qual 30 von row3 und die pos_qual 30 und 25 genauso
 
Also ich wüde ganz gerne einfach mal komplett weg von den Tabellen und erstmal begreifen was genau du eigentlich auswerten willst und wie die Daten zusammen hängen. Im Moment verstehe ich mit jedem Post von Dir weniger.

Was ist denn der eigentliche zusammenhang? Die Gruppe oder die Qualität oder die Positionen oder was auch immer? Es muss doch irgendein zu verstehendes System geben. Vielleicht versuchst du mir mal zu erklären was die Werte eigentlich darstellen damit ich mehr Hintergrundwissen habe.
 
Also ich könnte dir die Werte erklären das bringt meiner Meinung nichts oder würde noch mehr verwirren, vor allem wenn ich das per post mache.
Ich versuche das nochmal ohne die ganzen tabellen, aber eine Ausgangsdatei brauchen wir sonst kann ich das nicht beispielhaft erklären. Also nehmen wir nochmal die Ausgangsdatei:
gruppe[TAB]positionen[TAB]posqualities[TAB]rowquality
chr1[TAB]1,2,3,4,5,6[TAB]10,20,30,30,25,5[TAB]80
chr1[TAB]3,4,5,6,7,8[TAB]1,40,3,30,25,5[TAB]10
chr1[TAB]2,3,4,5,6,7[TAB]40,25,3,3,5,5[TAB]30
...

So zum eigentlichen Zusammenhang, also wie du schon geschrieben hast sollte die Gruppe/Position unique sein, aber es kommen ja noch weitere dateien dazu also wäre dann der unique key datei/Gruppe/Position.
Die Zeilen in der Ausgangsdatei könnte man als Beobachtungen ansehen, also zeile1 = beobachtung1. Pro Zeile haben wir eine bestimmte Anzahl an beobachteten Positionen mit der jeweiligen Qualität und eine allgemeine Qualität für die Zeile(nicht der mean) und die Gruppe ist auch pro Zeile vertreten.
Also sagt uns Zeile1 das wir in der gruppe "chr1" die position "1" mit pos_qual "10" mit row_qual "80", die position "2" mit qual "20" mit row_qual "80" ...(bis pos 6) haben.
Wenn sich jetzt eine Position in der selben Gruppe in den folgenden Zeilen wiederholt würde sich der count erhöhen.
Also Zeile2 sagt uns das wir in der gruppe "chr1" die position "3" mit pos_qual "1" mit row_qual "10", die position "4" mit qual "40" mit row_qual "10" ...(bis pos 8) haben. Davon würde sich jetz pos3,4,5,6 wiederholen, also count 2 als zusätzlich Information bekommen.

Ist das verständlich oder welchen Zusammenhang brauchst du?

Gruß Air
 
Zuletzt bearbeitet:
Ok, aber die eigentliche Grundlage ist dann ja erstmal die Gruppe oder? Also es kann nicht vorkommen das du daten von Gruppe 2 auch in Gruppe 1 benötigst oder?
 
Genau. Aber Positionen (1,2,3,4,5,......) sind auch in der Gruppe2 vertreten.

Ich wollte dir gerade ein private nachricht schicken, aber dein posteingang ist voll.

Gruß Air
 
Zuletzt bearbeitet:
und kann die gleiche Position auch innerhalb einer zeile und einer gruppe mehrfach vorkommen oder sind in einer Zeile immer nur verschiedene Positionen?

Brauchen wir einen Zusammenhang von Rowquality zu den einzelnen Positionen in der Row oder sind die auch unabhägig?

Postfach ist wieder leer.
 

Zurück
Oben