↓ Salta al contenuto principale

IA e Agenti di Codice IA

Clef-flash contro Jev: il modello decisionale aperto di Cloudflare su un MacBook da 16 GB

·2445 parole·12 minuti· loading · loading
Tre giorni dopo l’annuncio di Cloudflare, Clef-flash ha affrontato lo stesso benchmark da 80 prompt di Jev, Laya, Von e Kev. 90% di accuratezza sull’argomento, una temperatura di confidenza che lo porta al livello di Jev sulla calibrazione, e un problema che nessuna temperatura può risolvere su un portatile.

ai-running-coach, cinque giorni dopo: una chat, un armadietto per l'attrezzatura, una mappa GPS e una serie di video

·3260 parole·16 minuti· loading · loading
Una chat con il coach dentro la dashboard, una mappa GPS su ogni seduta, un modello delle calorie che controlla i numeri di Garmin, un vero armadietto per l’attrezzatura con ispezioni fotografiche, le dinamiche di corsa, un secondo contributo esterno, e “Il Sentiero”, una serie di video disegnata in JavaScript che puoi guardare direttamente qui.

system-one-router: lasciare che un modello "System One" scelga l'LLM giusto per ogni prompt

·4435 parole·21 minuti· loading · loading
Il mio primo router di modelli lasciava a un LLM il compito di leggere un file di prompt e scegliere un agente. Questo fa quattro domande tipizzate a un modello decisionale “System One”, calcola il punteggio dei modelli con semplice aritmetica, e pubblica un benchmark per dimostrare che funziona (e per mostrare dove non funziona).