eXpineTe escribió:Con opus5.5 estoy haciendo en minutos el trabajo de dias.
Con agentes? Yo de momento me han dado solo acceso a un formulario web, y le pido cosillas pequeñas, y las pruebo yo. Con agentes ya puedes hacer que se supervise el mismo, haga los tests, etc ... pero me daría mucho miedo, ya que en cualquier momento te nerfean el modelo para ahorrar en la inferencia, y algo que funcionaba de maravilla igual empieza a fallar ...
Luego a parte no se harás tu, pero en mi curro probar algunas cosas implica hardware muy caro, y hay que ir con pies de plomo, no se puede hacer prueba y error, cada pequeño fallo puede joder una electrónica, o peor aun, algo de potencia.
Se hacen pruebas con software in the loop, y hardware in the loop, pero aun así luego hay cosas diferentes cuando llegas al equipo final.
saMuraixxxxxxx escribió:La verdad es que por no saber no se ni que modelo elegir
![fiesta [fies]](/images/smilies/nuevos2/fiesta.gif)
La cosa es que es algo dinámico. Por una lado sacan modelos cada poco, así que el modelo que es el mejor hoy, mañana puede ser superado por una de la competencia, y puede que mas barato.
Y aunque no cambies tu de modelo, ellos te lo pueden haber cambiado, como demuestran en este paper unos investigadores, que GPT4 de lanzamiento era mucho mejor que 6 meses después, que lo nerfearon tanto que en algunas cosas era peor que GPT 3.5
https://arxiv.org/abs/2307.09009Mi consejo es que vayas sin prisa, que busques formas de verificar el trabajo de la IA, a ser posible sin usar IA, pero mínimo que un modelo supervise lo ha hecho otro modelo por si las moscas.
Y no necesitas necesariamente el mejor modelo, para tareas sencillas te puede valer un modelo economico.
Y también ten en cuenta el tema de privacidad, si tienes información sensible, para algunas cosas te puede interesar tener algun modelo en local en un servidor de la empresa.
Por cierto, que eso que pones no son modelos en si, son plataformas que cada una de ella provee varios modelos.