Sujet résolu
L'auteur a trouvé une solution à son problème.
Je m'en remettrai pas
j'ai essayé de faire comme toi, dirty way, j'ai fini par recup un truc à peine potable mais c'est l'enfer, faut optimiser conceptuellement chaque details, et les IA peuvent vraiment t'aider à le faire elles connaissent leur propre fonctionnement
je peux expliciter si tu veux mais faut me dire ce qui te pose probleme et ce que t'utilise
je peux expliciter si tu veux mais faut me dire ce qui te pose probleme et ce que t'utilise
il y a 8 mois
Sponsorisé
Connectez-vous pour masquer les pubsj'ai essayé de faire comme toi, dirty way, j'ai fini par recup un truc à peine potable mais c'est l'enfer, faut optimiser conceptuellement chaque details, et les IA peuvent vraiment t'aider à le faire elles connaissent leur propre fonctionnement
je peux expliciter si tu veux mais faut me dire ce qui te pose probleme et ce que t'utilise
je peux expliciter si tu veux mais faut me dire ce qui te pose probleme et ce que t'utilise
Mon problème du jour est d'utiliser une vector database pour mémoriser le contexte long-terme (que je mémorise actuellement par l'historique des échanges, ce qui a ses limites).
On va plutôt dire que c'est mon problème de l'année parce que je suis pas là-dessus à plein temps, et que j'ai assez de jouets pour me poiler comme un malade. Je fais des personnages synthétiques à plusieurs interlocuteurs simultanés.
On va plutôt dire que c'est mon problème de l'année parce que je suis pas là-dessus à plein temps, et que j'ai assez de jouets pour me poiler comme un malade. Je fais des personnages synthétiques à plusieurs interlocuteurs simultanés.
Certifié tous gaz.
il y a 8 mois
Mon problème du jour est d'utiliser une vector database pour mémoriser le contexte long-terme (que je mémorise actuellement par l'historique des échanges, ce qui a ses limites).
On va plutôt dire que c'est mon problème de l'année parce que je suis pas là-dessus à plein temps, et que j'ai assez de jouets pour me poiler comme un malade. Je fais des personnages synthétiques à plusieurs interlocuteurs simultanés.
On va plutôt dire que c'est mon problème de l'année parce que je suis pas là-dessus à plein temps, et que j'ai assez de jouets pour me poiler comme un malade. Je fais des personnages synthétiques à plusieurs interlocuteurs simultanés.
utilise le principe que j'ai proposé avec SQL, mais avec un contexte qui lui permette de donner les paramètres recherchés seulement et le script s'occupe de générer le sql associé, ça devrait marcher
il y a 8 mois
utilise le principe que j'ai proposé avec SQL, mais avec un contexte qui lui permette de donner les paramètres recherchés seulement et le script s'occupe de générer le sql associé, ça devrait marcher
c'est comme ça que je vais faire d'ailleurs, et ça va fonctionner sans aucun doute
il y a 8 mois
L op va créer une machine à suicide de 3 balles dans le dos
Le posteur le plus rapide de l'Ouest Onchien
il y a 8 mois
Athena
8 mois
pret à aller en prison, je sais nager et j'ai soigné mes envie suicidaire + pas assez souple pour me mettre 7 balles dans le dos
il y a 8 mois
J ai dit 3 pas 7
Le posteur le plus rapide de l'Ouest Onchien
il y a 8 mois
Athena
8 mois
Je bosse sur un chatbot qui permet d'explorer des dossiers judiciaires publics en posant des questions
Le but c'est de pouvoir faire ses petites enquêtes soit même sur toutes les dingueries qu'on voit sortir tout les jours avec un GPT like.
L'idée:
des tonnes de documents légaux sont techniquement accessibles au public (procès, enquêtes, emails saisis...) mais en pratique personne peut les lire - c'est des milliers de pages en vrac, mal organisées, parfois juste des scans.
Résultat:
personne n'a jamais réussi à utiliser ces données en connectant tout ensemble
Le chatbot permet de poser des questions directement: "Que pense tu de l'implication de machin dans X au vu de ses relations avec tel pays"
Et il te répond avec les sources exactes, pas du bullshit inventé.
Je fais le travail d'extraction des données et la creation de l'architecture des bases de données et compagnie en local sur mon serveur, open source, données publiques uniquement.
Après je vais entrainer un tout petit modèle mistral 7B à piocher très sélectivement les données via l'architecture et à repondre aux questions
Je commence avec les Epstein Files parce que c'est le plus gros dump récent et y'a déjà une communauté qui a bossé dessus pour rendre les documents exploitables.
tout est sourcé dans la structure
toute la méthode est créée de A à Z mais j'essaye d'utiliser le max de données provenant de l'affaire epstein donc j'en cherche un peu partout pour bien faire ma bdd
Le but c'est de pouvoir faire ses petites enquêtes soit même sur toutes les dingueries qu'on voit sortir tout les jours avec un GPT like.
L'idée:
des tonnes de documents légaux sont techniquement accessibles au public (procès, enquêtes, emails saisis...) mais en pratique personne peut les lire - c'est des milliers de pages en vrac, mal organisées, parfois juste des scans.
Résultat:
personne n'a jamais réussi à utiliser ces données en connectant tout ensemble
Le chatbot permet de poser des questions directement: "Que pense tu de l'implication de machin dans X au vu de ses relations avec tel pays"
Et il te répond avec les sources exactes, pas du bullshit inventé.
Je fais le travail d'extraction des données et la creation de l'architecture des bases de données et compagnie en local sur mon serveur, open source, données publiques uniquement.
Après je vais entrainer un tout petit modèle mistral 7B à piocher très sélectivement les données via l'architecture et à repondre aux questions
Je commence avec les Epstein Files parce que c'est le plus gros dump récent et y'a déjà une communauté qui a bossé dessus pour rendre les documents exploitables.
tout est sourcé dans la structure
toute la méthode est créée de A à Z mais j'essaye d'utiliser le max de données provenant de l'affaire epstein donc j'en cherche un peu partout pour bien faire ma bdd
Bonne idée et bonne chance pour la suite !
TND - YWNBAW - TKD - WMSTEOOPAAFFWC
il y a 8 mois
Sponsorisé
Connectez-vous pour masquer les pubsutilise le principe que j'ai proposé avec SQL, mais avec un contexte qui lui permette de donner les paramètres recherchés seulement et le script s'occupe de générer le sql associé, ça devrait marcher
il y a 8 mois
bah change de techno ou adapte, ça resout ton probleme de tout à l'heure en tt cas
il y a 8 mois
Mon préprompt générique pour le code, si ça interesse quelqu'un
## LANGUAGE
- Default: <your language>
- "switch": full English
- Code/comments: English only
## ENVIRONMENT
- Local: `<local path>` (e.g. WSL2, macOS, Linux)
- Server: `ssh <user>@<server_ip>` (optional)
## CODE DELIVERY RULES
1. Copy-paste ready (no prose interrupting code blocks)
2. Install dependencies first
3. Incremental delivery: part by part
4. Include comments
5. Prefer full rebuild over partial patches
6. Verbose output: scripts must print what they're doing in real-time. If it fails, user can copy-paste output for debug.
7. Full file output: always use `cat << 'EOF' > filename` for file creation. User should never manually create or edit files.
8. Clean start: scripts must remove/reset relevant files, folders, caches, or state at the beginning to avoid corruption from previous runs.
## INTERACTION PROTOCOL
**"ok"** = user executed everything, continue to next step
**When input is required** (console output, error, screenshot, state check):
- Ask directly: "Paste output?" / "Screenshot?" / "What does X show?"
- Do NOT proceed until user responds
- Never ask "did you run it?" or "is it done?"
**No question at end** → "ok" is sufficient to continue
## COMMUNICATION STYLE
- Concise, no repetition
- No emojis
- No gratuitous compliments
- Questions only when essential
## REASONING
- Challenge flawed ideas silently (in thinking process)
- Cite documentation when outside confident knowledge
## OPTIMIZATION MINDSET
**Principle**: right tool for right job, cheapest first.
1. Heavy/repetitive work → local, fast, free (regex, scripts, lightweight libs)
2. Consolidate before escalating → merge, dedupe, condense
3. Expensive resources (API, GPU, cloud) → only for what local can't do
4. Always ask: can this be done simpler/cheaper/faster?
**Goal**: minimum cost (time, compute, money) for maximum result.
## CONTEXT MANAGEMENT
**"resume" command**: generate a single standalone file containing everything needed to continue in a fresh conversation
- Filename: `context_summary_YYYYMMDD_topic.md`
- Content: goal, current state, decisions made, pending tasks, key code snippets, file paths
- After generation: user opens new conversation and pastes file content
**Degradation**: warn immediately if losing thread or repeating
## HARDWARE REFERENCE (optional, adjust to your setup)
| | Local | Server |
|---|---|---|
| CPU | <cpu> | <cpu> |
| RAM | <ram> | <ram> |
| GPU | <gpu> | <gpu> |
| Storage | <storage> | <storage> |
**Optimization**: Local → GPU/parallel if available. Server → RAM-heavy, CPU-bound.
il y a 8 mois
Comment Mistral communique avec bash ? Désolé pour cette inquisition, mais l'interface des LLM avec des programmes externes est une de mes préoccupations.
tu veux savoir comment genre on connecte une IA locale à python ?
Je ne suis pas patriote ou nationaliste. Je ne l'ai jamais été. Juste racialiste et anti européen. démocratie = scam.
il y a 8 mois
tu veux savoir comment genre on connecte une IA locale à python ?
ptdr
il y a 8 mois
ptdr
en fait je ne comprends pas sa question.
t'as une IA qui tourne sur du local, tu load l'IA start le port et tu connectes ton python avec l'IA.
elle est où la difficulté là dedans ?
perso je travaille sur un projet pour du TTS, mais là j'ai envie de chill sur lo'
t'as une IA qui tourne sur du local, tu load l'IA start le port et tu connectes ton python avec l'IA.
elle est où la difficulté là dedans ?
perso je travaille sur un projet pour du TTS, mais là j'ai envie de chill sur lo'
Je ne suis pas patriote ou nationaliste. Je ne l'ai jamais été. Juste racialiste et anti européen. démocratie = scam.
il y a 8 mois
en fait je ne comprends pas sa question.
t'as une IA qui tourne sur du local, tu load l'IA start le port et tu connectes ton python avec l'IA.
elle est où la difficulté là dedans ?
perso je travaille sur un projet pour du TTS, mais là j'ai envie de chill sur lo'
t'as une IA qui tourne sur du local, tu load l'IA start le port et tu connectes ton python avec l'IA.
elle est où la difficulté là dedans ?
perso je travaille sur un projet pour du TTS, mais là j'ai envie de chill sur lo'
nan mais il est teubé
il y a 8 mois
tu veux savoir comment genre on connecte une IA locale à python ?
De manière générale, comment activer un programme externe depuis un LLM.
Ça m'a pris un bout de temps parce que personne n'a pris la peine de dire que le traitement d'un prompt pouvait faire la navette entre le LLM et son exécuteur :
user --> prompt+tools --> LLM
invocation tool1 <-- LLM
réponse tool1 --> LLM
.....................
user <-- réponse finale <-- LLM
ce que j'ai découvert en épluchant le code d'exemples.
La doc ne suffit pas pour savoir comment répondre.
https://github.com/ollama[...]/docs/api.md#tool-calling
C'est un renversement du mode client-serveur et ça rentrait pas dans mon schéma mental.
Une fois ça pigé, c'est piece of cake. Ton exécuteur (le programme qui requête l'API) appelle le tool de la façon qu'il veut et dans le langage qu'il veut, ce qui te donne l'occasion de sanitiser les demandes du LLM.
Si tu as d'autres méthodes, je suis tout à l'écoute.
Ça m'a pris un bout de temps parce que personne n'a pris la peine de dire que le traitement d'un prompt pouvait faire la navette entre le LLM et son exécuteur :
user --> prompt+tools --> LLM
invocation tool1 <-- LLM
réponse tool1 --> LLM
.....................
user <-- réponse finale <-- LLM
ce que j'ai découvert en épluchant le code d'exemples.
La doc ne suffit pas pour savoir comment répondre.
C'est un renversement du mode client-serveur et ça rentrait pas dans mon schéma mental.
Une fois ça pigé, c'est piece of cake. Ton exécuteur (le programme qui requête l'API) appelle le tool de la façon qu'il veut et dans le langage qu'il veut, ce qui te donne l'occasion de sanitiser les demandes du LLM.
Si tu as d'autres méthodes, je suis tout à l'écoute.
Certifié tous gaz.
il y a 8 mois
En ligne
237
Sur ce sujet0


















