Créer un compteSe connecter
Zardoz
Zardoz
8 mois
Je m'en remettrai pas
:)
j'ai essayé de faire comme toi, dirty way, j'ai fini par recup un truc à peine potable mais c'est l'enfer, faut optimiser conceptuellement chaque details, et les IA peuvent vraiment t'aider à le faire elles connaissent leur propre fonctionnement


je peux expliciter si tu veux mais faut me dire ce qui te pose probleme et ce que t'utilise
il y a 8 mois
Athena
Athena
8 mois
j'ai essayé de faire comme toi, dirty way, j'ai fini par recup un truc à peine potable mais c'est l'enfer, faut optimiser conceptuellement chaque details, et les IA peuvent vraiment t'aider à le faire elles connaissent leur propre fonctionnement


je peux expliciter si tu veux mais faut me dire ce qui te pose probleme et ce que t'utilise
Mon problème du jour est d'utiliser une vector database pour mémoriser le contexte long-terme (que je mémorise actuellement par l'historique des échanges, ce qui a ses limites).

On va plutôt dire que c'est mon problème de l'année parce que je suis pas là-dessus à plein temps, et que j'ai assez de jouets pour me poiler comme un malade. Je fais des personnages synthétiques à plusieurs interlocuteurs simultanés.
Certifié tous gaz.
il y a 8 mois
Zardoz
Zardoz
8 mois
Mon problème du jour est d'utiliser une vector database pour mémoriser le contexte long-terme (que je mémorise actuellement par l'historique des échanges, ce qui a ses limites).

On va plutôt dire que c'est mon problème de l'année parce que je suis pas là-dessus à plein temps, et que j'ai assez de jouets pour me poiler comme un malade. Je fais des personnages synthétiques à plusieurs interlocuteurs simultanés.
utilise le principe que j'ai proposé avec SQL, mais avec un contexte qui lui permette de donner les paramètres recherchés seulement et le script s'occupe de générer le sql associé, ça devrait marcher
il y a 8 mois
Athena
Athena
8 mois
utilise le principe que j'ai proposé avec SQL, mais avec un contexte qui lui permette de donner les paramètres recherchés seulement et le script s'occupe de générer le sql associé, ça devrait marcher
c'est comme ça que je vais faire d'ailleurs, et ça va fonctionner sans aucun doute
il y a 8 mois
L op va créer une machine à suicide de 3 balles dans le dos
:Jesus_Officier:
Le posteur le plus rapide de l'Ouest Onchien
:Clint_tir_2:
:Badge_echecs:
il y a 8 mois
Athena
Athena
8 mois
pret à aller en prison, je sais nager et j'ai soigné mes envie suicidaire + pas assez souple pour me mettre 7 balles dans le dos
:chat_lunettes:
il y a 8 mois
J ai dit 3 pas 7
:risi_zoom:
Le posteur le plus rapide de l'Ouest Onchien
:Clint_tir_2:
:Badge_echecs:
il y a 8 mois
J ai dit 3 pas 7
:risi_zoom:
:chat_lunettes:
il y a 8 mois
Athena
Athena
8 mois
Je bosse sur un chatbot qui permet d'explorer des dossiers judiciaires publics en posant des questions
:indien_vieux:



Le but c'est de pouvoir faire ses petites enquêtes soit même sur toutes les dingueries qu'on voit sortir tout les jours avec un GPT like.



L'idée:
:chat_lunettes:


des tonnes de documents légaux sont techniquement accessibles au public (procès, enquêtes, emails saisis...) mais en pratique personne peut les lire - c'est des milliers de pages en vrac, mal organisées, parfois juste des scans.

Résultat:

personne n'a jamais réussi à utiliser ces données en connectant tout ensemble

Le chatbot permet de poser des questions directement: "Que pense tu de l'implication de machin dans X au vu de ses relations avec tel pays"

Et il te répond avec les sources exactes, pas du bullshit inventé.

Je fais le travail d'extraction des données et la creation de l'architecture des bases de données et compagnie en local sur mon serveur, open source, données publiques uniquement.

Après je vais entrainer un tout petit modèle mistral 7B à piocher très sélectivement les données via l'architecture et à repondre aux questions

Je commence avec les Epstein Files parce que c'est le plus gros dump récent et y'a déjà une communauté qui a bossé dessus pour rendre les documents exploitables.
:ChatPastek:

tout est sourcé dans la structure

toute la méthode est créée de A à Z mais j'essaye d'utiliser le max de données provenant de l'affaire epstein donc j'en cherche un peu partout pour bien faire ma bdd
:Purer:
Bonne idée et bonne chance pour la suite !
:Docteur_Onche:
TND - YWNBAW - TKD - WMSTEOOPAAFFWC
:casquette_tare:
il y a 8 mois
Bonne idée et bonne chance pour la suite !
merci chef
il y a 8 mois
Athena
Athena
8 mois
utilise le principe que j'ai proposé avec SQL, mais avec un contexte qui lui permette de donner les paramètres recherchés seulement et le script s'occupe de générer le sql associé, ça devrait marcher
Vector database ≠ RDBMS

en.wikipedia.org https://en.wikipedia.org/wiki/Vector_database
Certifié tous gaz.
il y a 8 mois
bah change de techno ou adapte, ça resout ton probleme de tout à l'heure en tt cas
il y a 8 mois
Mon préprompt générique pour le code, si ça interesse quelqu'un



## LANGUAGE

- Default: <your language>

- "switch": full English

- Code/comments: English only


## ENVIRONMENT

- Local: `<local path>` (e.g. WSL2, macOS, Linux)

- Server: `ssh <user>@<server_ip>` (optional)


## CODE DELIVERY RULES

1. Copy-paste ready (no prose interrupting code blocks)

2. Install dependencies first

3. Incremental delivery: part by part

4. Include comments

5. Prefer full rebuild over partial patches

6. Verbose output: scripts must print what they're doing in real-time. If it fails, user can copy-paste output for debug.

7. Full file output: always use `cat << 'EOF' > filename` for file creation. User should never manually create or edit files.

8. Clean start: scripts must remove/reset relevant files, folders, caches, or state at the beginning to avoid corruption from previous runs.


## INTERACTION PROTOCOL

**"ok"** = user executed everything, continue to next step


**When input is required** (console output, error, screenshot, state check):

- Ask directly: "Paste output?" / "Screenshot?" / "What does X show?"

- Do NOT proceed until user responds

- Never ask "did you run it?" or "is it done?"


**No question at end** → "ok" is sufficient to continue


## COMMUNICATION STYLE

- Concise, no repetition

- No emojis

- No gratuitous compliments

- Questions only when essential


## REASONING

- Challenge flawed ideas silently (in thinking process)

- Cite documentation when outside confident knowledge


## OPTIMIZATION MINDSET

**Principle**: right tool for right job, cheapest first.

1. Heavy/repetitive work → local, fast, free (regex, scripts, lightweight libs)

2. Consolidate before escalating → merge, dedupe, condense

3. Expensive resources (API, GPU, cloud) → only for what local can't do

4. Always ask: can this be done simpler/cheaper/faster?


**Goal**: minimum cost (time, compute, money) for maximum result.


## CONTEXT MANAGEMENT

**"resume" command**: generate a single standalone file containing everything needed to continue in a fresh conversation

- Filename: `context_summary_YYYYMMDD_topic.md`

- Content: goal, current state, decisions made, pending tasks, key code snippets, file paths

- After generation: user opens new conversation and pastes file content


**Degradation**: warn immediately if losing thread or repeating


## HARDWARE REFERENCE (optional, adjust to your setup)

| | Local | Server |

|---|---|---|

| CPU | <cpu> | <cpu> |

| RAM | <ram> | <ram> |

| GPU | <gpu> | <gpu> |

| Storage | <storage> | <storage> |


**Optimization**: Local → GPU/parallel if available. Server → RAM-heavy, CPU-bound.
il y a 8 mois
il y a 8 mois
Zardoz
Zardoz
8 mois
Comment Mistral communique avec bash ? Désolé pour cette inquisition, mais l'interface des LLM avec des programmes externes est une de mes préoccupations.
tu veux savoir comment genre on connecte une IA locale à python ?
Je ne suis pas patriote ou nationaliste. Je ne l'ai jamais été. Juste racialiste et anti européen. démocratie = scam.
il y a 8 mois
Elchapka2
Elchapka2
8 mois
tu veux savoir comment genre on connecte une IA locale à python ?
ptdr
il y a 8 mois
Athena
Athena
8 mois
ptdr
en fait je ne comprends pas sa question.

t'as une IA qui tourne sur du local, tu load l'IA start le port et tu connectes ton python avec l'IA.

elle est où la difficulté là dedans ?

perso je travaille sur un projet pour du TTS, mais là j'ai envie de chill sur lo'
Je ne suis pas patriote ou nationaliste. Je ne l'ai jamais été. Juste racialiste et anti européen. démocratie = scam.
il y a 8 mois
Elchapka2
Elchapka2
8 mois
en fait je ne comprends pas sa question.

t'as une IA qui tourne sur du local, tu load l'IA start le port et tu connectes ton python avec l'IA.

elle est où la difficulté là dedans ?

perso je travaille sur un projet pour du TTS, mais là j'ai envie de chill sur lo'
nan mais il est teubé
il y a 8 mois
Elchapka2
Elchapka2
8 mois
tu veux savoir comment genre on connecte une IA locale à python ?
De manière générale, comment activer un programme externe depuis un LLM.

Ça m'a pris un bout de temps parce que personne n'a pris la peine de dire que le traitement d'un prompt pouvait faire la navette entre le LLM et son exécuteur :

user --> prompt+tools --> LLM
              invocation tool1 <-- LLM
              réponse tool1 --> LLM
              .....................
user <-- réponse finale <-- LLM

ce que j'ai découvert en épluchant le code d'exemples.
La doc ne suffit pas pour savoir comment répondre. github.com https://github.com/ollama[...]/docs/api.md#tool-calling

C'est un renversement du mode client-serveur et ça rentrait pas dans mon schéma mental.

Une fois ça pigé, c'est piece of cake. Ton exécuteur (le programme qui requête l'API) appelle le tool de la façon qu'il veut et dans le langage qu'il veut, ce qui te donne l'occasion de sanitiser les demandes du LLM.

Si tu as d'autres méthodes, je suis tout à l'écoute.
Certifié tous gaz.
il y a 8 mois
Athena
Athena
8 mois
nan mais il est teubé
Je suis teubé mais mon projet, il marche.
Certifié tous gaz.
il y a 8 mois