Modelo coreano focado em raciocinio e execucao de tarefas reais — analise longa, extracao de informacao, uso de ferramentas, decisao multi-etapa —, ja adotado pelo Hermes Agent da Nous Research e disponivel no OpenRouter.
Ferramenta em que cada aresta e literalmente o contexto enviado ao modelo, permitindo ver quais ancestrais entram no proximo request, deletar ramos poluidores e regenerar com o mesmo prompt e contexto diferente.
Tecnica de Doug Turnbull para classificar quando o vocabulario de rotulos e grande demais para caber no prompt: peca ao modelo que invente tags livremente e depois case as tags imaginadas com as reais via embeddings vetoriais.
Biblioteca BDD para JavaScript, menos prescritiva que o Cucumber sobre como escrever especificacoes, relancada com enquadramento explicito: especificacao executavel em linguagem natural como forma de controlar agentes.
Projeto que transmite do macOS via USB para um LCD Thermalright Trofeo Vision os limites de sessao e semanais do Claude, a queima de tokens e o custo hipotetico em API.
Os dois maiores labs americanos lancaram versoes mais baratas para segurar market share enquanto DeepSeek, Z.ai e Alibaba ganham terreno com preco agressivo e pesos abertos.
Com a plataforma Vera Rubin apenas entrando em producao em massa, a Nvidia ja desloca pesquisa e cadeia de suprimentos para a geracao seguinte, Feynman, com chiplets 3D, SoIC da TSMC, HBM e optica co-empacotada.
Receita de US$ 9,12 bilhoes no terceiro trimestre fiscal, alta de 25% na comparacao anual, lucro ajustado de US$ 3,50 por acao e plano de dobrar a producao de sistemas ate 2028.
A marca d'agua nao usa caracteres ocultos nem marcacao visivel: e um padrao estatistico na escolha de tokens, decodificavel apenas com a chave da Anthropic, adaptado do SynthID-Text do Google DeepMind.
Davide Piffer sustenta que o desempenho de LLMs em matematica nao vem de raciocinio superior, mas de uma memoria de trabalho simbolica praticamente ilimitada — a janela de contexto como workspace externo.
Comunidade · hacker-news · raciocinio, memoria-de-trabalho, contexto, matematica, cognicao
Allen Bargi argumenta que o mesmo pedido gera respostas diferentes e por isso o ganho vem de compartilhar contexto, explicar intencao e estabelecer limites — como se faz com gente, nao com compilador.
Comunidade · hacker-news · context-engineering, agentes, lideranca, prompt, praticas
Joshua Barretto sustenta que, antes de argumentos ambientais ou politicos, a questao da eficacia dos LLMs para software nao-trivial segue em aberto: quatro anos de revolucao sem software mais rapido, barato, seguro ou de melhor qualidade.
Comunidade · hacker-news · ceticismo, produtividade, engenharia-de-software, evidencia, contraponto
Artigo de opiniao defendendo que a IA aumenta, em vez de reduzir, o valor do conhecimento fundamental — porque so quem domina os fundamentos consegue avaliar o que a maquina entregou.
Comunidade · websearch · educacao, ensino-superior, avaliacao, fundamentos, curriculo