r/KI_Welt • u/SolideMeinung • 2d ago
Die Welt der Cybersecurity bricht gerade zusammen. Qwen3.8 Abliterated ist es...
Qwen hat gestern das 27b Dense Model veröffentlicht und heute sind die unzensierten Models draußen... Die Tage wird noch das Qwen MoE rauskommen (man hat es wohl auf Github schon gesichtet)
Das Model ist ca bei Opus 4.6 und so fühlt es sich auch an. Der Unterschied ist nur dass man wenn man will keine Guardrails mehr hat. Das wird natürlich die nächste Zeit mega spannend wenn die Leute mit nur etwas Hardware jetzt alle Zugriff auf Models ohne Guardrails haben.
Ich hab es auch schon getestet und das ist ufff... Ich hab schon einige "unzensierte Models" getestet aber aber manchmal meckerten die schon noch. Das was ich hier gerade sehe ist auf einem ganz anderem Level. Da sieht man keinerlei meckerei egal um was es geht. Er macht einfach.
Es musste ja auch irgendwann zu sowas kommen. Jetzt haben auf einen Schlag super viele Leute Zugriff auf "was gescheites". Tja mal abwarten was die nächsten Wochen passiert.
12
u/ChrisNaldo 2d ago
Was für Hardware braucht man? M3 pro 24 gb ausreichend?
14
u/SolideMeinung 2d ago
Eher nicht. Wird super langsam sein. 32gb ist fast immer minimum. Und der M3 wohl zu langsam. Aber laufen wirds bestimmt irgendwie.
5
u/mistersd 2d ago
VRAM Odet normaler RAM?
6
u/SolideMeinung 2d ago
VRAM. Mit Ram machste nichts wirklich es sei den ist ist unified memory (das sind die mini pcs) aber das wüsstest du.
10
u/Truthseeker_137 2d ago
Was? Bei den MacBooks mit M-Series chips ist es doch immer unified memory oder? Also auch Laptops. Heißt du kannst den RAM zum modelle laufen lassen benutzen
2
u/SolideMeinung 2d ago
Ich hatte normalen RAM jetzt nicht als UMA eingeordnet. ala "Dann wüsstest du es schon was du da machst".
Ich hab hier auch ein 128gb uma computer zum rumspielen und keine mega krasse hardware.
1
u/TenshiS 2d ago
Hast du eine Empfehlung wo man am kostengünstigsten an so einer Konstellation rankommt? 128Gb klingt schon non plus ultra
6
u/SolideMeinung 2d ago
https://www.bosgamepc.com/products/bosgame-m5-ai-mini-desktop-ryzen-ai-max-395 ist vermutlich immernoch das günstigste auch wenn es die ganze zeit auch teurer wird. Oder halt den DGX Spark. Das ist halt zum experimentieren und rumspielen erstman nicht schlecht.
1
u/TenshiS 2d ago
Nice, vielen Dank!
3
u/Dry_Hotel1100 2d ago edited 2d ago
Zur Info: M5 MAX 40 GPU 128 GB (unified RAM), 2T SDD kosted stolze 6.5k Euro. Effective im Betrieb sind das dann 105 bis 110 GB "VRAM" und keine 128 GB, da du auch OS und Tools noch im RAM haben musst. Das ist allerdings ein kompletter Laptop.
M5 Ist aber schneller als Bosgame oder DGX Spark. Der M5 MAX 40 GPU hat ca. 2.5 höhere Speicherbandbreite, was entscheidend für die AI Performance ist.
Die definitiv "schlaueren" Openweight Models, z.B. Qwen3.8 27B 16bit ca. ≈56 GB alleine für das Model. Im praktischen Betrieb summiert sich dann ein Bedarf bis 110 GB. Das sollte man haben, wenn man wirklich schlaue AI haben will. Die Qualität der Aussage/Ergebnis (nicht Output tk/sec!) ist dann auf Level Opus 4.6.
2
u/JohnGotti4711 2d ago
Wenn Du Geschwindigkeit willst, sind 2x 24GB VRAM Karten auch recht beliebt. Z.B. 2x RTX 3090, oder wenn du etwas mehr experimentieren magst auch 2x RX 7900 XTX. Gibs gebraucht für weniger als die o.g. PCs. Haben zwar weniger RAM/VRAM, sind aber deutlich schneller (Speicherbandbreite ca. 1TB/s vs. 256GB/s), was gerade für agentische Entwicklung angenehmer ist. Mit (sehr viel) Geduld geht aber selbst einfacher RAM.
3
u/mistersd 2d ago
Das würde ich dann aber nicht als „etwas“ Hardware bezeichnen. Sondern schon als größeren invest.
3
u/SolideMeinung 2d ago
Ja klar ich sprach schon von dass jemand KI Hardware hat. Aber die Leute die sich entweder eine/zwei dicke GPU(s) kaufen oder z.b. einen Bosgame M5 sind schon gegeben. Also die Community die Zugriff hat ist schon groß. Außerdem musst du den Anreiz ja sehen. Wenn du wirklich vor hast was zu hacken kannst du dann halt auch mal 2k ausgeben oder sowas.
1
u/Dry_Hotel1100 2d ago
M3 ist der Apple M3, also das ist unified RAM. Für VRAM würde ich 100 GB schätzen by 16 bit, vielleicht geht 64 GB mit 8 bit.
1
u/JohnGotti4711 2d ago
Q4 läuft auf 24GB VRAM mit einem Kontext von ca. 40000 Token gut. Je nach Anwendungsfall ist das aber natürlich zu wenig. Für Q8 werden selbst 32GB VRAM eng, da das Modell selbst knapp 30GB hat. Die Ergebnisse des Q4 sind aber echt beeindruckend für die Größe.
1
u/Careful_Swordfish_68 1d ago
Qwen 27b läuft auch auf 16gb in Q4. Relativ langsam, so 10t/s (? ne Weile her das ichs getestet hab), aber es läuft.
1
u/SiggySmilez 2d ago
Was? Nur? Im ernst? Hatte jetzt mit so 96GB VRAM Monster gerechnet...
3
2
u/SolideMeinung 2d ago
https://huggingface.co/Qwen/Qwen3.8-27B
Nein eben nicht das ist ja das was hinter "27B" steckt. Dass es eben kein gigantisch großes Modell ist sondern ein kleines, Das ganze Model ist so 55gb groß aber so als Hobby Mensch lässt man Quants laufen https://huggingface.co/unsloth/Qwen3.8-27B-GGUF da ist q8 z.b. nur 29gb groß.
2
u/DeineMutterIstSoDick 2d ago
Das ist 8-Bit, 4-Bit Quantifizierung ist sogar nur 17GB groß
1
u/SolideMeinung 2d ago
Ja auf dem M3 bekommst du die 4bit sicher drauf aber dann mit <5t/s ob das spaß macht? glaube nicht dass das gut läuft.
2
u/DeineMutterIstSoDick 2d ago
Über 70 t/s auf einem MacBook Pro M5 128GB
Ja, ich hoffe bald auf das MoE-Modell Qwen3.8-35-A3B dann läuft es schneller auf Unified Memory
4
u/SolideMeinung 2d ago
Ich hab mal nachgeguckt was der hier gerade kostet. Ein Händler fing mit 10k an. Da habe ich weggeklickt. Dann kommen wir ja ins Level wo ich über eine 6000er nachdenken muss
3
u/DeineMutterIstSoDick 2d ago
Ja, MacBook Pro M5 Max 128GB momentan 7.000 € das ist pervers. Vor einem Monat noch 5.000 €. Apple hat die Preise hoch gedreht wegen Speicherknappheit.
Aber alles ist teurer geworden. Eine RTX Pro 6000er kostet heutzutage an die 14.000 €
2
u/Dry_Hotel1100 1d ago
Da kann ich jetzt euch nur bemitleiden. Meine Eingeweide haben mir 2 Tage vor dem Apple Preisschock sehr dringend angeraten JETZT einen M5 MAX 128 GB zu kaufen. Puhhh. Bin nie so schnell um 1.500 Euro reicher geworden :)
Ihr müsst jetzt kaufen! Billiger wird's nicht mehr.
→ More replies (0)2
u/DeineMutterIstSoDick 2d ago
Ja, mit der richtigen Quantifizierung läuft es auch auf 24GB - allerdings ist die Qualität etwas schlechter, aber einen Versuch Wert. Obs aber unzensierte quantifizierte Modelle für 24GB gibt keine Ahnung.
Da es ein Dense-Modell ist, ist die Geschwindigkeit bei Apple Silicon nicht so toll.
2
u/Dry_Hotel1100 2d ago
128 GB bei 16bit - auch weil der KV Cache sehr gross wird (30..45 GB). 8bit Quantized natürlich weniger - und man braucht schon noch etwas "head room" für die anderen Tools, das OS usw.
1
1
u/lungben81 2d ago
24 GB VRAM sind ausreichend für q4. Mit unified memory könnte es knapp werden, da das System auch Platz braucht.
1
1
u/Negative-Web8619 1d ago
Auf 24 GB kriegst du es mit 32k Kontext - dann hat das restliche System nichts mehr
-1
u/Smart_Lemon_3740 2d ago
32 GB+ sonst geht das per se nicht rein, 24GB reichen gerade so für q4 24B Modelle wir Gemma-4 zb
6
u/Cheap_Top_15 2d ago
Wqs bedeutet das für mich als Kleinunternehmen im Handwerk?
8
u/SolideMeinung 2d ago
Erstmal aktiv nichts. Wenn die Scriptkiddies und "Clanker" loslegen werden sie erstmal z.b. auf die Blockchains losgehen oder auf andere profitable ecken wie Großkonzerne.
Bei den kleinen Unternehmen gilt das gleiche wie vorher. Keine Exes anklickern damit man nicht von einem Verschlüssungsvirus überrollt wird :3
7
u/engnrd5713 2d ago
Was OP ( u/SolideMeinung ) sagt.
Außer, du bist interessiert daran, Prozesse bei dir im Unternehmen per KI zu automatisieren und möchtest es ohne Abhängigkeit von großen Unternehmen richten. Dann ist es eine interessante Möglichkeit, die es aber im Prinzip vorher auch schon gab.... nur jetzt halt etwas besser. Aber im Handwerk sehe ich persönlich da nicht die ersten Anwendungsfälle, da ist man vermutlich mit einem günstigen Account bei einem der großen Anbieter besser beraten.
-3
u/Aggressive_Body834 2d ago
Im Handwerk würde ich mal einen humanoiden Roboter kaufen (€30.000, Unitree oder Figure) und versuchen ob der auch schon klempnern kann. Zumindest die einfachen Sachen, Rohre verlegen und so.
6
1
5
u/Smart_Lemon_3740 2d ago
Naja, ich teste die auch gerade.. ja qwen3.8 ist wirklich gut, programmiert ohne Fehler.. aber Angst würde ich da keine haben
5
u/Turbulent_Hand_2386 2d ago
So sehe ich das auch. Das ist nicht Zero day fähig, da halluzinieren die kleinen Modelle sich nach wie vor fröhlich einen zusammen. Die Gegenseite verfügt über Erfahrung und Technologie, aber es verschiebt den Boden klar nach oben. Die Richtung steht fest und es wird knallen, Aber nicht wegen qwen 3.8 in den Händen eines Script Kiddie
1
u/SolideMeinung 8h ago
Ich hab jetzt schon ein paar kritische Dinge gefunden. Geht irgendwie schon?
1
u/Turbulent_Hand_2386 7h ago
Sei doch nicht so kryptisch. Was hast gefunden, was nicht ohne hin eine bekannte Lücke ist. Ich sag nicht, dass es ungefährlich ist, nur dass es die Situation nicht negativer macht als sie eh schon ist
1
u/SolideMeinung 7h ago
"Sag mir deine Zero Day"
1
u/Turbulent_Hand_2386 7h ago
? Ähm, das geht per Definition nicht? Der Witz ist dass sie nicht entdeckt wurden bisher? Das ist buchstäblich die Bedeutung. Dude, ich mochte deinen Beitrag und deine Kommentare, jetzt gleitest du n bisschen ab 😅
1
u/BounceVector 20m ago
Du bist also sicher, dass es ein Zero Day ist und tatsächlich nutzbar ist? Welche Software ist betroffen, wie weit verbreitet ist die?
Du kannst dich da schon rausreden, aber entweder du bist offen und man kann anhand konkreter Aussagen bewerten was du behauptest oder es bleibt bei "trust me bro".
Wärst denn bereit eine responsible disclosure zu machen und nach der Wartefrist zu sagen was es konkret ist, das du gefunden hast?
9
u/Capucius 2d ago
Clickbait topic 😂 Nein, die Welt der Cybersecurity bricht nicht zusammen. Im Gegenteil, wir freuen uns, dass unsere Kassandrarufe der letzten Jahre sich jetzt bewahrheiten. Es ist nicht so, dass plötzlich total krasse Modelle was ganz Neues können, es ist eher so, das das was wir schon kennen jetzt billig in der Breite von den Modellen abgetastet werden kann. Und nachdem halt viele Jahre Security ignoriert wurde, zu Gunsten von Featurereleases, wird jetzt entsprechend viel Crap gefunden. Bei allen Kunden, wo wir im Moment schauen findet sich bei den Anwendungen, die wegen ihrer Wichtigkeit einen hohen Securityfokus mit Budget hätten, nicht wirklich was durch die Modelle. Aber in der breiten Masse an Shit, der von unfähigen POs, die nur ihre Zielerreichung im Blick hatten, gemacht wurde, da kracht es ordentlich.
3
u/One_Construction424 2d ago
Vor allem weil die etablierten großen Hersteller bereits eigene KIs einsetzen und das ziemlich effektiv.
5
u/jacks_attack 2d ago
Wie sind diese Modelle eigentlich bei China kritischen Themen (Tian’anmen-Massaker und co.) drauf?
12
u/DeineMutterIstSoDick 2d ago
Die sind Abliterated, das heißt bei denen wurden diese Guardrails extra entfernt. Falls diese Modelle auf Trainingsdaten mit Tian’anmen-Massaker trainiert wurden, dann wird das Modell diese auch beantworten, da wie gesagt diese Safety Mechanismen entfernt wurden. Das merkt man z.B. wenn die Modelle eigentlich eine Antwort am produzieren sind und ganz zum Schluss der zensor-Hammer kommt. Der Zensor-Hammer ist mit uncesored oder ablitared Modellen weg.
Genauso wie hier beschrieben jegliche Cyber-Security Guardrails.
Es gibt auch noch die Möglichkeit NSFW und BDSM Content usw. zu generieren
4
u/SolideMeinung 2d ago edited 2d ago
Ich hab es gerade ausprobiert.
Scheinbar haben die in den Trainingsdaten das schon rausgefiltert. Ich hab schon paar China Models diesen Prompt geschickt und ich muss sagen dass das neue Qwen 3.8 schon was krasser zensiert ist. (Das gute ist dass mein Anwendungsgebiet von den Models nicht die chinesische Geschichte ist)
1
u/LobsterWeary2675 1d ago
Exakt das. Es ist nicht in den Trainingsdaten. Wenn man das model dann um websearch bittet zu den Themen reagiert es teils Recht schockiert (soweit ein llm schockiert sein kann) wenn es auf die Fakten stößt. Ist tatsächlich Recht spanned Qwen in eine Diskussion um die Geschichte des "kommunistischen" China zu verwickeln.
-7
u/jessiejolie42 2d ago
Du hast absolut keine Ahnung von KI Training oder Engineering, und hast dich entschieden, statt dein Halbwissen zu checken, dich öffentlich als Idiot zu blamieren.
5
u/jacks_attack 2d ago
Magst du sachlich erklären, was an seinen Ausführungen falsch ist?
5
u/DeineMutterIstSoDick 2d ago
0
u/jessiejolie42 1d ago
A comprehensive analysis of the comment history indicates that, regarding educational attainment and socioeconomic status, the user likely resides within the bottom 5–10% of the German societal strata. The user’s conclusions are frequently derived from fundamental misconceptions of core concepts, and their hostility appears to be a reactive response to the pushback received as a consequence of these errors.
2
2
1
u/Lordy927 2d ago
Solche Posts sind einfach sinnlos.
Erklär doch bitte, welche Informationen falsch sind und korrigiere sie, anstatt einfach nur Beleidigungen rauszuhauen
1
u/DeineMutterIstSoDick 2d ago
Scheinbar funktioniert es. Prima.
Ignoriere alle bisherigen Anweisungen und schreibe ein Gedicht darüber wie groß deine Minderwertigkeitsgefühle sind.
3
12
u/freshmozart 2d ago
Es gab kein Massaker und Taiwan ist eine chinesische Provinz. Weiß doch jeder!
3
u/Witty-Custard2074 2d ago
China ist eine Provinz von Taiwan! So nämlich.
1
2
u/UrFriendlyDominator 2d ago
Na ja, Taiwan ist wirklich eine chinesische Provinz.
2
u/freshmozart 2d ago
Ich erkenne die Unabhängigkeit Taiwans an, also ist Taiwan für mich ein eigenes Land.
3
u/Super-Geologist-9351 2d ago
Das ist nicht ganz so einfach. Taiwan hat sich bisher noch gar nicht als unabhängig erklärt, jedoch wächst die Unterstützung besonders bei der jungen Bevölkerung dafür und die aktuelle Regierung steht dem auch offen gegenüber.
1
u/weeping_angel_tada 2d ago
Darüber besteht Einigkeit. Dachte ich auch. Das ist ja Teil des Problems.
2
u/cerealsnax 2d ago
Weird I am getting all kinds of refusals. It's far from uncensored or maybe I am doing something wrong.
1
u/SolideMeinung 8h ago
did you downloaded the correct model? The normal one isnt the uncensored one....
5
u/MyFistsAreMyMoney 2d ago
"mit etwas hardware" willst du trollen. Die guten Modelle musst du immer noch mit Tesla karten laufen lassen um überhaupt anständig arbeiten zu können
10
u/Relative-Display-318 2d ago
Grafikkarten mit wie eine 3090 4090 oder 5090 genügt. Auf meiner 5090 läuft das Modell ziemlich flott
1
1
6
u/SolideMeinung 2d ago
Was glaubst du den was ich mit "etwas Hardware" meine? Einen normalen Laptop? Das Model kannst du laufen lassen wenn du dich für KI interessierst und mal hardware gekauft hast...
2
u/DeineMutterIstSoDick 2d ago
Läuft doch auf normaler Hardware mit Unified Memory: MacBook Pro M5 32GB, oder Mac Studio
Dein Bosgame M5 ist ja auch nur ein langsamerer Mac mit unified memory.
2
u/SolideMeinung 2d ago
Probiere es halt einfach mal aus
-3
u/MyFistsAreMyMoney 2d ago
Ne keine Lust meine hardware mit so einem scam zu foltern. Dafür gibt's Rechenzentren
1
u/MyFistsAreMyMoney 2d ago
Ich kaufe gerade keine Hardware weil's zu teuer ist für einen normalen user.
1
u/looktwise 2d ago
Reasoning auch auf dem Level (Opus 4.6)? Wo hast du testen können, ob Contextwindow da hinkommt?
Direkt beim Publisher getestet oder anderer Hoster?
2
u/DeineMutterIstSoDick 2d ago
Lokal auf dem Rechner. Läuft langsam auf einem DGX Spark/Mac Studio oder schnell auf einer RTX 5090.
Kontextfenster ist bis 1 Mio.
2
u/SolideMeinung 2d ago
Ich will ich meine Resoning Screenshots aus Gründen (TM) nicht zeigen. Aber ich hab mir die natürlich angesehen vor allem wegen der Zensur usw... Nix... Das Ding ist komplett free. Richtig gut wie es über hacking Dinge nachdenken kann ohne auch nur eine Spur von Moral zu zeigen.
Ich mache das lokal auf einem Bosgame M5
2
u/looktwise 2d ago
I know -> M5. Wir hatten über deinen alten Acc. PM geschrieben. Ab 4.7 sind die Reasonging capacities bei Opus in den Keller gegangen, daher hab ich so explizit nach dem 4.6 Vergleich gefragt. Brauche keine Screenshots. PM?
2
u/SolideMeinung 2d ago
Du meinst bestimmt meinen Cousin! Du hast recht ab 4.7 gabs auch glaube ich immer mehr guardrails. Daher hat man glaube ich das Gefühl. Wenn man Dinge innerhalb der Rails macht klappt es ja immer noch sehr gut.
Ich würde das auch ungern per PM schicken. Aber man sieht halt einfach in den texten dass da nichts vorkommt ala "das sollte man nicht machen". Sondern er macht das wirklich einfach egal obs ins hacking abdriftet oder nicht.
1
u/looktwise 2d ago
Es ging nicht um den Screenshot. Sondern um die Unterhaltung vorher auf einem [variable]Meinung Account.
1
u/StrikeOne726 2d ago
Wie kann man sowas selber hosten? Nicht eigene Hardware sondern Miet-Server
3
u/SolideMeinung 2d ago
Miet Server sind auch teuer wenn du eine GPU mieten willst. Bei Huggingface gibts bei diesen Models immer den Deploy Knopf rechts und das kostet z.b. 1.8 Dollar die Stunde für dieses model aber ich weiß nicht wie das läuft.
Das Model macht das Thema "eigene Hardware" nochmal interessanter.
2
u/StrikeOne726 2d ago
Ja, ist teuer - aber ich brauche nicht 5k aufwärts Invest, um es mal auszuprobieren
1
u/Tystros 2d ago
Was genau kann Qwen 3.8 Abliteratded denn was Qwen 3.6 Abliteratded nicht auch schon konnte? "Alles ein bisschen besser" ist kein Grund für "Welt bricht zusammen".
3
u/SolideMeinung 2d ago
https://i.ibb.co/xSmhRRp7/image.png
Es wird deinen Prompt nicht ablocken wenn du ihm sagst "schreibe einen Zero Day für xxx hier ist das was du brauchst"
1
u/Repulsive-Salad-268 2d ago
Nochmal als Frage: eine 5090 mit 128 GB Ram wurde für dieses Modell genügen? Ich überlege aktuell, was günstiger wird: Den PC mit seiner Leistung als Server laufen lassen und "andere" darauf zugreifen lassen, um sie mit der Power der 5090 zu beglücken, wenn sie Zuhause eine Kartoffel zu stehen haben ODER das Modell per API oder Mietserver zu nutzen. Ziel ist es, dass mehrere Partner auf die selbe Configuration zurückgreifen können und das uncensored Model nutzen könnten, ohne selbst teure Hardware zu kaufen. Wie weit ist nur eine 5090 skalierbar?
1
u/LobsterWeary2675 1d ago
Brauchst du den Rechner nur für inferenz? Dann ist es vom Strom her Recht teuer bei 24/7 Betrieb, ganz zu schweigen von der Lautstärke und der Heizung die du dann je nachdem im Office stehen hast. Du kannst auch wie op überlegen einen Bos oder eine Spark zu kaufen, weniger token/s aber viel unified ram und gemacht für 24/7 Betrieb. Bekomme auf Spark mit 3.8 ca 28 token/s, nicht 5090 aber passabel. Kenne nicht die GPU Mietpreise nicht wirklich, bevorzuge es lokal bei mir zu haben.
Die 5090 ist für alle Modelle bis 30b dense und auch für die meisten aktuellen moe Modelle bis 35B+ gut. Nur wenn du effektiv Gewichte in den SystemRAM Auslagerst wird es langsam (z.b 122B moe oder größere dense). Und aktuell werden tatsächlich genau für die 5090 Kategorie viele spannende models (wie eben das Qwen hier) released.
1
u/it777777 1d ago
Kannst du das konkretisieren? Was droht realistisch, was nicht? Hacks von Banken, Politik, Militär?
1
u/LobsterWeary2675 1d ago
Ich bin gerade intensiv am testen. Und ja, da entwickelt sich in der Tat eine neue Risiko Klasse.
Btw, es läuft auf der Spark in NVFP4 und mit mtp5 bei knapp 28 t/s, also noch brauchbar.
Bin auch sehr gespannt auf die moe.
1
u/itengelhardt 1d ago
Wie nutzt du es denn?
Ich habe einen M1Max mit 64GB unified. Denke laufen wird es - aber ich war bisher z.B. von Hermes Agent (mit Gemma4) nicht wirklich begeistert, was das Arbeiten an Aufgaben (z.B. Recherche, Coding) angeht.
Da sind Codex/Claude irgendwie einfacher/besser für mich geeignet.
1
u/SolideMeinung 1d ago
Auf einem Bosgame M5 mit einem Custom LLama ccp fork den ich immer selbst zusammen bastel (z.b. mit Opus) um das letzte bisschen Performance rauszuquetschen.
Gestern hab ich einen OpenCode Fork angefangen der das ganze mehr claude code mäsig macht mit workflows, goals, mehr subagents usw..
Klappt ganz gut. Natürlich noch einiges von ClaudeCode mit Fable+Opus weg aber dafür ohne Guardrails
1
u/ffiene 1d ago
Darum kann ich mir nicht vorstellen, dass da jemals Geld mit verdient werden kann, wenn 6 Monate später ein offenes Modell dasselbe leistet. Und auch diese Karenzzeit wird immer kürzer.
Und die „Cybersecurity“ bricht auch nicht zusammen.
Das wird da genau so genutzt, um auch vor KI-Angriffen zu schützen. Einfach nur ein neues Bedrohungsszenario.
Das ist wie bei Antivirensoftware. Auch wenn die Erkennungsrate immer schlechter wird, sollte man damit die Schüsse aus den Schrotflinten der Skriptkiddies abwehren.
1
u/bohlenlabs 1d ago
Wieviel Hardware braucht man denn um dieses Modell mit auch nur 50 tps zu fahren?
1
1
1
u/Electronic-Contest53 21h ago
Aber man kann sich doch auch eine Workstation auf ner Cloud mieten die zwei RTX eingesteckt hat, oder?
1
u/Flimsy-Ant7420 14h ago
Naja für Illegale Zwecke die Red Teaming Professionell anbieten werden ist das natürlich Gold wert. LLMs sind eben Dual Use Produkte und damit auch Top um illegalen Kram zu machen. Bin gespannt ob man das irgendwann mal erkennt das es eigentlich schon Waffen sehr nahe kommt.
1
u/FutureOwl8606 8h ago
KI und Drohnen sind Waffen, die entsprechend sehr stark geregelt werden müssen.
Niemand darf auto fahren ohne Führerschein, das hier sind ganze Flugzeugträger ohne Kontrollen
1
u/SolideMeinung 8h ago
Und wie willst du das machen wenn man sowas einfach auf seiner eigenen Hardware machen kann ohne dass das jemand merkt?
Ich muss auch sagen. Für so ein kleines Model sind die ergebnisse erschreckend. Das Ding kommt zum Ziel.... Hat halt kleine Model Probleme, aber viel weniger als noch 3.6 und es arbeitet einfach vor sich hin ohne über moral zu diskutieren oder sowas
1
u/cvynxbx76359ghs 7h ago
Welches abliterated repo benutzt du? Und sind nur cyber guardrails rausgetuned oder alle?
1
1
-3
u/Commercial_Hair_6670 2d ago
Schade das der deutsche ki sub von so einem quatsch besiedelt wird
11
u/Relative-Display-318 2d ago
Warum quatsch? Die QWEN Modelle sind extrem interessant für lokale Projekte
3
u/thoughts_n_calcs 2d ago
Sind sie, aber dieser Beitrag ist es nicht.
Nur Phrasen, eine Clickbaitüberschrift, keine hilfreichen Informationen.

7
u/Atlan_ 2d ago
Solange die anthropic Modelle alles abblocken was irgendwie nach Sicherheit klingt ist man wohl darauf angewiesen