3 puntos por GN⁺ 2024-05-31 | 1 comentarios | Compartir por WhatsApp
  • delve se presentó como una interfaz de ChatGPT pensada para profundizar en un tema, y la página actual está al nivel de una breve introducción
  • En la pantalla pública aparece la frase “delve into —” junto con temas de ejemplo como Faster language models, High-speed rail y Lentils
  • No se proporciona información clave del producto como descripción de funciones, forma de uso, creación de cuenta, precios o modelos compatibles
  • Con el texto disponible, es difícil confirmar cómo se integra con ChatGPT o cómo funciona realmente la interfaz
  • Por ahora, lo único verificable es el nombre del producto y los temas de ejemplo, así que se necesita más información para evaluar si vale la pena usarlo

Lo que se puede confirmar en la página pública

  • El nombre del producto es delve
  • En pantalla aparece la frase “delve into —
  • Hay 3 temas de exploración de ejemplo
    • Faster language models
    • High-speed rail
    • Lentils

Información que todavía no se puede confirmar

  • El contenido no incluye una lista de funciones ni un proceso de uso
  • En el texto mostrado no se puede confirmar la creación de cuenta, el precio, los modelos compatibles, el manejo de datos ni la forma de integración con ChatGPT

1 comentarios

 
GN⁺ 2024-05-31
Opiniones de Hacker News
  • Muy bueno. Me cuesta precisar exactamente qué es, pero parece algo más importante que un simple gimmick.
    También me gustó que al hacer clic en un tema ya explorado no se vuelva a abrir; sería aún mejor si te llevara de vuelta al panel donde ese tema ya está abierto. Es un intento interesante desde la perspectiva de que habría que dedicarle un poco más de esfuerzo a la UX de los LLM.

    • La UI es buena y tiene fuerza para hacer que uno siga profundizando. Pero, a mi modo de ver, el problema es que esta herramienta lleva al usuario hacia áreas en las que los LLM no son buenos.
      Los LLM son útiles cuando se encargan de cosas que una persona podría hacer pero no quiere hacer. Por ejemplo, un amigo usa ChatGPT para crear una política antidiscriminación bastante estándar; otro para generar descripciones de villanos; y también son famosos para generar código repetitivo. Pero usarlos para descubrir hechos nuevos y concretos es casi un desastre. Buscando pernos falsificados, alucinó un caso llamado “sword net” que supuestamente apuntaba a sujetadores falsificados en 2018, y la frase “Secure the Foundation, Eliminate the Fake”; no había fundamento para eso en Google, Brave ni DuckDuckBing. Al final, el sistema confundió las falsificaciones en general con un problema más específico, los sujetadores falsificados, y si estas distinciones finas son inevitables, entonces los LLM no son muy útiles para este tipo de exploración.
    • Si intento explicar la sensación de que “parece más importante que un simple gimmick”, diría que las conversaciones humanas pueden tener varias líneas de conversación, y después de unos 10 minutos el tema puede cambiar por completo hasta el punto de que sea difícil recuperar el tema original.
      No es exactamente igual que un chat donde se ve el historial de prompts, pero la conversación sigue siendo bastante lineal. Esta UI permite ramificar el pensamiento y evita ese problema de antemano.
    • Sinceramente, no lo tengo claro. Me pregunto en qué se diferencia de ChatGPT.
  • Dando un paso atrás, la UX/UI de los LLM en general todavía está muy inmadura. La mejor forma de interactuar con estas herramientas aún está en una etapa temprana, así que hacen falta más experimentos como este para descubrir qué funciona y qué no.

    • Totalmente de acuerdo. Siento que todavía ni siquiera hemos arañado la superficie.
      En el proyecto en el que estoy trabajando ahora hacemos experimentos obvios pero necesarios, como eliminar la molesta sintaxis Markdown que todos los LLM muestran por un instante, o suavizar la forma en que se renderizan los caracteres para que coincida con la tasa de refresco de la pantalla. https://llm-ui.com/
    • La interfaz de chat básica es muchísimo mejor que el horrible panel lateral de Copilot o los intentos de interfaces al estilo Google, excesivamente pulidas con diseño quasi-material.
      Puede haber margen de mejora en casos especiales como lo multimodal o la investigación profunda, pero si hablamos solo de chat de texto puro, creo que es difícil mejorar la interfaz más simple.
    • Ojalá la interacción humano-computadora avance lo suficiente como para que algún día la interfaz sea el último recurso.
    • La extensión de Chrome HLAI también está experimentando con esta idea.
  • Si “delve” era un chiste interno, lo entendí. Yo también tengo un Custom GPT llamado AutoExpert (Chat), al que varios reviewers llamaron “el Rabbit Hole GPT perfecto” por la forma en que va aprendiendo el tema.
    Ahora también pueden acceder los usuarios del nivel gratuito, así que quizá les guste. [0]: https://chatgpt.com/g/g-LQHhJCXhW-autoexpert-chat

    • Me gusta esto. Me gusta que sea fácil profundizar más. Aunque los usuarios gratuitos tienen límites bastante estrictos de uso de Custom GPT, así que quizá no puedan ir tan profundo como quisieran.
      Le pregunté sobre teoría de cuerdas, mecánica cuántica, platos clásicos de pasta romana y vinos italianos, y también le mandé una foto de cicuta; creo que encontré mi nuevo GPT favorito. También le pedí una crítica de una foto reciente que tomé, y eso también fue excelente y bastante impresionante.
    • Me gusta el enfoque general, pero me pregunto si de verdad está bien “aprender” con una herramienta que alucina tanto.
      La mayoría de las veces estará en lo correcto, pero si tengo mala suerte podría memorizar sin darme cuenta algo alucinado y luego, al decirlo frente a un experto real, hacer que me mire raro.
    • Esto es realmente útil. Es interesante la forma en que induce roles de expertos, expertos alternativos e incluso perspectivas opuestas.
      Siento que lo que se puede hacer con LLM apenas está empezando.
    • Me pregunto cuál es el chiste.
  • Me gusta. Está bueno que el sitio vaya directo a la acción, pero podría mejorar mucho con un walkthrough.
    Si el sitio se presentara dentro del prompt inicial, sería más fácil entender su propósito desde el principio. Por ejemplo, en la primera pantalla podría haber un prompt sugerido como [Explain what "delve into" is], y la respuesta podría decir: “Es una herramienta para explorar un tema en profundidad, como un rabbit hole en el que algo interesante lleva a otra cosa interesante. Algunos ejemplos son...”. Luego podría guiar paso a paso las funciones, como: “Haz clic en la opción X para iniciar un nuevo hilo, elige un prompt sugerido o crea el tuyo, y sigue los hilos relacionados para profundizar más”.

    • No está tan claro como parece que una guía inicial de ese tipo vaya a tener un efecto neto positivo. La gente está dividida con respecto a estas sugerencias guiadas.
      Muchas personas dicen que un walkthrough muy amable obviamente es útil, y muchas otras dicen que es molesto. He recopilado mucho feedback de diseñadores UX senior, PMs y usuarios en varios sitios y apps, y a menudo se contradicen sobre mejoras y buenas prácticas. Claro que quienes expresan su opinión suelen ser quienes quieren hacerlo, y las voces de quienes se molestarían se escuchan menos. Para mí, este proyecto es fácil de entender e intuitivo, así que no veo necesario agregar otro walkthrough.
  • Me encanta. ¿Qué tal si permitieran que el usuario seleccione cualquier parte del texto y la use de la misma forma en que funcionan ahora los enlaces?
    Por ejemplo, parece que los nombres de personas no se convierten en enlaces, y me gusta que en Wikipedia sea fácil buscar personas mencionadas en el cuerpo del texto. En vez de llenar la página con miles de enlaces, sería práctico poder seleccionar un nombre en el texto y presionar un botón o usar el menú contextual para crear un prompt basado en la selección. Para un caso de uso personalizado como este, me parece aceptable que el usuario tenga que hacer unos clics más.

    • Pregunté sobre las computadoras Atari de 8 bits y me dijo que tenían un CPU MOS 6502, pero esa parte no se convirtió en enlace. Justo ahí quería entrar al siguiente rabbit hole.
  • Es una buena idea. Parece inspirada también en las notas de Andy Matuschak, y a mí también me gusta ese enfoque.
    [0] https://notes.andymatuschak.org/zB74H9CuWrosEuqve7jZyCo?stac...

    • ¿Existe algún SaaS tipo Notion, o algún plugin de Obsidian, que permita escribir notas así?
  • Es excelente, y es algo que desde hace tiempo quería que existiera. Por ahora los mosaicos tienen una estructura lineal.
    Por ejemplo, si el mosaico A enlaza a los mosaicos B y C, al hacer clic en B o en C se abre un nuevo mosaico justo al lado de A, y solo se ve B o C a la vez. Me pregunto cómo sería un layout de árbol donde B y C se ramifiquen desde A y puedan verse al mismo tiempo.

    • En este punto creo que habría que ampliar el alcance un nivel: en lugar de buscar solo implementaciones de UI de árbol para LLM, conviene mirar el campo más maduro de las jerarquías de texto generales.
      Seguramente ya hay muchas UIs para visualizar repositorios de documentos tipo wikilink, como plugins de Obsidian, extensiones de navegador y plugins de Vim/Emacs. Personalmente, tengo algunos principios que algún día me gustaría impulsar al mundo mediante un libro: usar índices en lugar de claves; que un conjunto normalmente tenga solo N elementos, menos de 10; que cada elemento se referencie con un índice local como 3, o con la ruta completa desde la raíz concatenando los índices de sus ancestros, como 053. Este es un ejemplo de un enfoque “analítico”, en contraste con un enfoque provisional de “síntesis” que simplemente visualiza una estructura de wikilinks que existe por accidente. Prefiero usar una estructura diseñada de antemano, porque permite la visualización automática. Por ejemplo, reutilizar las mismas 3 o 4 plantillas de directorios de 12 factores en todos los proyectos de SWE; y esto también se puede aplicar directamente a proyectos de investigación realizados con muchas consultas automáticas a LLM.
    • De acuerdo. La UI ya es excelente, pero sería genial que tuviera una estructura en árbol.
    • ¿Algo como un diagrama de telaraña?
  • Me gusta mucho. Se siente como navegar tranquilamente por enlaces de Wikipedia, con la diferencia clave de que en cada nuevo paso se mantiene el contexto anterior.
    Para mí es algo nuevo y útil.

    • Me recuerda a aquellas sesiones de rabbit hole en las que me perdía en https://wiki.c2.com/. Para mí sería perfecto si se combinara el chat con una interfaz tipo ventana de rabbit hole con contexto.
  • Wow, está realmente genial. Rara vez me impresionan las cosas en Show HN, y como no quiero que mi apatía estorbe a quien subió su trabajo, casi no comento; pero de vez en cuando aparece algo así de genial.
    También me encanta que no haya rastreo aparte de Cloudflare Insights. Una vieja máxima de la industria dice que cuanto más “sugerencias” hace la gente sobre una idea, más le gusta esa idea, y es totalmente cierto. Proyecto muy bien hecho. Me pregunto si hay planes de monetización o de hacerlo open source.

  • Las conversaciones ramificadas son excelentes por muchas razones. Hace tiempo publiqué una demo de un prototipo: https://x.com/ajdegol/status/1788689011302682657
    Jake Collins también anunció que publicaría como open source un plugin de Obsidian con muchas funciones: https://x.com/JacobColling/status/1795462258258002255

    • Creo que esta es la dirección correcta. Si imaginas usar esto también al programar, podrías arrastrar funciones generadas y conectarlas visualmente.
      Cada función sería su propio nodo, y al ajustar entradas y salidas con drag and drop, la IA entendería mágicamente los requisitos.
    • Yo también estoy creando una app muy parecida en cuanto a ramificación. Aún no tiene la visualización de la derecha, pero planeo soportar tanto algo similar como un grafo tipo Git.
      1: https://msty.app