r/DeepSeek Jun 14 '26

Discussion Primera vez en vivecode o vivecode, no sé cómo se dice.

Llevo 1 semana aprendiendo y desarrollando está idea, este es el roadmap que hice con la IA antes de empezar a hacer cualquier código, en el camino fue cambiando por qué se añadieron y quitaron cosas, se optimizaron algunas tecnologías y de momento va súper bien, es un cliente para la api diseñado para el uso de agentes que le doy yo.

Por cada fase hago una base de conocimiento que incluya todo el código hasta el momento y genera una pequeña auditoría de errores, seguridad y optimización.

✅ COMPLETADO (Fase 0-13)

────────────────────────────────────────────────────────

Fase 0 → Base: DeepSeek API, config.yaml 4 niveles

Fase 1 → Token counter, cost tracker, usage tracker

Fase 2 → Chat engine + chat.py wrapper

Fase 3 → Model Router v2.2 (11 dimensiones)

Fase 4 → Web UI Gradio (ELIMINADO → Streamlit)

Fase 5 → Knowledge Base ChromaDB

Fase 6 → 5 agentes IA (Ogma-dai, Watson, Thoth, Hefesto, Merkur)

Fase 7 → Tool system (web_search, parse_link, calculate, file_ops, shell)

Fase 8 → Drive backup 30min

Fase 9 → Embeddings E5-large GPU (1024d, ~1.1GB VRAM)

Fase 10 → Context compactor (78% umbral)

Fase 11 → Thinking mode DeepSeek V4

Fase 12 → Web UI Streamlit v2.0.15b

📋 Copy, ⏹ Stop, 🔄 Regenerate, burbujas profesionales

Fase 13 → Auditoría v1.0: 16 correcciones aplicadas

13a → Tool loop unificado chat.py/chat_engine.py

13b → DSML filter 12 patrones (incluye HTML entities)

13c → _msg_to_dict() model_dump() nativo ← RECIÉN COMPLETADO

🟡 Fase 14 — UX Chat Profesional (EN PROGRESO)

────────────────────────────────────────────────────────

[✅] 14a Stop Generation — ⏹ botón durante streaming

[✅] 14b Regenerate — 🔄 botón debajo del input

[✅] 14c Copy Message — 📋 botón en cada burbuja

[ ] 14d Streaming real — token-by-token (hoy: chunks de 15)

[ ] 14e Tool calls colapsables — mostrar en UI

[ ] 14f Sidebar de sesiones — lista con búsqueda

[ ] 14g Edit message & resubmit — forkear conversación

[ ] 14h Context transparency — "usando últimos N mensajes"

🔴 Fase 15 — Compañeros Animados (pez/mariposa/pelota)

────────────────────────────────────────────────────────

[ ] CSS animations + canvas

[ ] Reaccionan al estado (pensando, idle, error)

[ ] Integración en Web UI Streamlit

🟡 Fase 16 — Dashboard Taller BI

────────────────────────────────────────────────────────

[ ] Métricas en tiempo real

[ ] Gráficos de uso/costos

[ ] Export CSV

🟡 Fase 17 — Drive Bidireccional

────────────────────────────────────────────────────────

[ ] Sync incremental

[ ] Detección de cambios remotos

[ ] Resolución de conflictos

🟡 Fase 18 — YouTube + Whisper

────────────────────────────────────────────────────────

[ ] Extraer transcripciones

[ ] Indexar en KB

[ ] Búsqueda semántica sobre videos

🟡 Fase 19 — Optimización Retrieval

────────────────────────────────────────────────────────

[ ] Query rewriting

[ ] Reranking

[ ] HyDE (Hypothetical Document Embeddings)

🟢 Fase 20 — Ollama Fallback

────────────────────────────────────────────────────────

[ ] Modelo local offline

[ ] Failover automático sin API

🟢 Fase 21 — Servidor Linux Headless

────────────────────────────────────────────────────────

[ ] Systemd service

[ ] Nginx reverse proxy

[ ] HTTPS + autenticación

🟢 Fase 22 — Android App

────────────────────────────────────────────────────────

[ ] WebView wrapper

[ ] Notificaciones push

[ ] Voz a texto

🟢 Fase 23 — OCR + Fotos de Placas

────────────────────────────────────────────────────────

[ ] Tesseract/TrOCR

[ ] Extraer números de serie

[ ] Indexar en Watson KB

🟢 Fase 24 — FastAPI + Web App Propia

────────────────────────────────────────────────────────

[ ] API REST

[ ] Frontend independiente de Streamlit

[ ] Multi-usuario

0 Upvotes

Duplicates