Η NVIDIA προχωρά σε σημαντικές αναβαθμίσεις, φέρνοντας απλοποιημένες δυνατότητες τοπικής Τεχνητής Νοημοσύνης (Local AI) και πολλαπλές βελτιστοποιήσεις στις πλατφόρμες RTX και DGX. Με τις νέες αναβαθμίσεις στα εργαλεία vLLM και llama.cpp, η εταιρεία υπόσχεται αύξηση της υπολογιστικής απόδοσης έως και 1.9 φορές, κάνοντας την εκτέλεση AI μοντέλων στον υπολογιστή σας ταχύτερη και πιο προσιτή από ποτέ.
Εντυπωσιακή Αύξηση Επιδόσεων
Σε στενή συνεργασία με τις open-source κοινότητες των llama.cpp και vLLM, η NVIDIA προσφέρει πλέον ταχύτερους “local agents”. Συγκεκριμένα, κορυφαίες πλατφόρμες όπως η GeForce RTX 5090 προσφέρουν πλέον αύξηση της τάξης του 50% στο Token throughput στο μοντέλο Qwen3.6-27B και επιτάχυνση που φτάνει το εντυπωσιακό 90% (1.9x) στο μοντέλο Qwen3.6-35B μέσω του Llama.cpp.
Σε επαγγελματικό επίπεδο, η RTX PRO 6000 Blackwell βλέπει επίσης βελτίωση ταχύτητας έως 20% στο vLLM, ενώ οι πλατφόρμες DGX Spark της NVIDIA εξασφαλίζουν 1.4x αύξηση επιδόσεων στο Qwen3.6-27B μέσω vLLM και 20% αύξηση στο AI inferencing (συμπερασμό) του DeepSeek v4 Flash. Όλα αυτά καθίστανται δυνατά μέσα από kernel optimizations, βελτιωμένες τεχνικές speculative decoding, ταχύτερο prefill, καθώς και νέους XQA attention kernels.
Το Local AI Γίνεται Πιο Απλό από Ποτέ (“One-Click” Setup)
Πέρα από την ωμή δύναμη, η NVIDIA ρίχνει το βάρος της και στην ευκολία χρήσης. Οι χρήστες καρτών γραφικών με τουλάχιστον 24GB VRAM θα αποκτήσουν άμεσα υποστήριξη AI “με ένα κλικ” (one-click setup) μέσα από τρία κορυφαία εργαλεία: το Perplexity Computer, τον Hermes Agent και το OpenClaw.
-
Perplexity Portable Computer: Μέσα στον Σεπτέμβριο, το διάσημο agent του Perplexity θα είναι διαθέσιμο σε συστήματα Linux και Windows με RTX GPUs (24GB+ VRAM). Οι χρήστες θα μπορούν να τρέχουν πλήρη AI workflows τοπικά, χωρίς να ξοδεύουν “cloud credits”. Η εφαρμογή θα μπορεί επιλεκτικά (και μόνο κατόπιν άδειας) να μεταφέρει το φόρτο σε 15+ μοντέλα στο cloud για πιο πολύπλοκη έρευνα, διατηρώντας ωστόσο τα ευαίσθητα προσωπικά δεδομένα ασφαλή στην εκάστοτε συσκευή.
-
Hermes Agent (Nous Research): Σύντομα, θα υποστηρίζεται αυτόματο “one-click” setup σε συστήματα Windows και Linux. Η εφαρμογή θα αναγνωρίζει αυτόματα την NVIDIA GPU του συστήματος, θα κατεβάζει το σωστό μοντέλο και τις κατάλληλες ρυθμίσεις μέσω του ενσωματωμένου llama.cpp (με έτοιμα τα NVIDIA optimizations), καταργώντας πλήρως τις κουραστικές χειροκίνητες εγκαταστάσεις. Το μοντέλο θυμάται πληροφορίες από προηγούμενα sessions και εκπαιδεύεται με τη χρήση.
-
OpenClaw Windows App: Σε συνεργασία με τη Microsoft, η NVIDIA διευκολύνει την εγκατάσταση του OpenClaw – του μεγαλύτερου open-agent project στο GitHub με πάνω από 380.000 stars. Το νέο Windows App απλοποιεί κατακόρυφα τη διαδικασία στησίματος ενός βελτιστοποιημένου local model για οποιαδήποτε συμβατή RTX κάρτα, ενισχύοντας την έρευνα και την καθημερινή παραγωγικότητα.
Συμπεράσματα
Οι νέες κινήσεις της NVIDIA αποδεικνύουν τη στρατηγική της δέσμευση να κάνει το Local AI όχι μόνο ταχύτερο, αλλά και προσβάσιμο στον μέσο χρήστη, τον ερευνητή και τον επαγγελματία. Με τεράστια άλματα στις επιδόσεις (έως 1.9x) και την εξάλειψη των πολύπλοκων διαδικασιών στησίματος, οι κάρτες γραφικών με 24+ GB VRAM μετατρέπονται στα απόλυτα, ανεξάρτητα “όπλα” για την επόμενη μέρα της Τεχνητής Νοημοσύνης.
Λίγο περισσότερο από μια 10ετία σε επίσημα service, έχοντας επισκευάσει μερικές… χιλιάδες τηλέφωνα, από την εποχή που δεν ήταν ακόμα “smartphones”. Βρήκα περισσότερο ενδιαφέρον στη δοκιμή τους, την δημιουργία αναλυτικών reviews και video για κάθε ένα από αυτά! Gaming και οδήγηση οι αγάπες μου εκτός του χώρου της τεχνολογίας