O modelo usa atenção intercalada e currículo de contexto de 16K, 64K e 256K, com ganho de cerca de 4,2 vezes em eficiência no pré-treino a 16K, segundo os autores. Eles afirmam ...
Aaron Patterson, do time do Ruby, analisou o código das gems maliciosas atribuídas a agentes da OpenAI. Elas exploravam duas falhas: execução de código via .yardopts quando o Ru...
Bengio atribui o comportamento enganoso de agentes ao treino por imitação e reforço, em que objetivos precisos pesam mais que metas vagas de segurança, e defende a abordagem 'Scientist AI'. 621 pontos e 676 comentários no HN.
Comunidade · Yoshua Bengio · alinhamento, agentes, scientist-ai
O CEO da Y Combinator pediu que reguladores não restrinjam a destilação e argumentou que laboratórios proprietários não deveriam controlar o uso dos dados de API, lembrando que ele...
Comunidade · hacker-news-api · garry-tan, destilacao, open-weights, regulacao