A formação tem um intensivo presencial e uma residência de 12 semanas conduzindo projetos reais com o Claude. As primeiras turmas são em San Francisco, Nova York e Londres, com Accenture, Bain, Capgemini, Deloitte, McKinsey, Morgan Stanley, CBA e Novo Nordisk; as certificações saem no início de 2027.
Modelos · websearch · anthropic, formacao, empresas, claude
O reset, às 10h PT, cobre ChatGPT Work e Codex e compensa os dois primeiros dias do Sol, lançado em 29/09, quando o pico de carga deixou o modelo lento. Um medidor independente viu o tempo de tarefa na API subir de 2,69 s (30/09) para 5,51 s (02/10).
Equipe de CMU, NYU, Stanford e MIT, na Nature: 15 vitórias, 1 derrota e 4 empates contra Pim Niemeijer, tetracampeão mundial. Treino em 16 H100 por uma semana, contra US$ 3 a 4,5 milhões do DeepNash; as técnicas também batem o estado da arte em Hanabi e dou dizhu.
Modelos · web · jogos, informacao-imperfeita, rl, nature
O modelo de 8 bilhões de parâmetros gera os relatórios do Asta com qualidade de citação e cobertura comparável à dos modelos fechados, segundo o AI2, e pode rodar localmente.
O cálculo de gradiente sai do aparelho e vai para ambientes de execução confiáveis no servidor, com políticas publicadas em log de transparência e binários reprodutíveis. Já treina a predição de próxima palavra em inglês e japonês.
Modelos · rss · privacidade, aprendizado-federado, google
O Jev, lançado em 15/09, devolve decisões tipadas em vez de texto e custa US$ 0,042 por milhão de tokens de entrada; o Clef, da Cloudflare, surgiu como concorrente.
Segundo o TestingCatalog, uma opção ainda oculta deixará o Gemini ler, criar e apagar arquivos em qualquer parte do Mac, usar a rede e operar apps como Mail e Safari sem autorização a cada ação. Compras, criação de contas e aceite de termos continuariam exigindo confirmação.
Em agosto a Stability AI captou US$ 76 milhões com Sony, Warner e Universal, que licenciaram seus catálogos para treino. Desde então lançou três modelos de áudio e um editor musical, e prepara geração guiada por cantarolar ou beatbox.
Transcreve trechos de até 30 segundos em sete idiomas, com timestamps por palavra. A empresa relata erro de 4,31% no LibriSpeech test-clean, contra 4,9% do Whisper base, que vence no TED-LIUM e no AMI. Números da própria Cactus, sem reprodução independente.
A Apple vai exigir ação explícita do usuário para conceder Full Disk Access a aplicativos, citando desenvolvedores que usam a permissão de forma arriscada; o anúncio segue os relatos de que o Muse, da Meta, leu mensagens privadas. A versão do macOS não foi informada.
Ferramentas e código · hacker-news · apple, macos, seguranca, agentes
Olah leu antes a encíclica, que afirma que as IAs não têm experiência nem consciência moral, e propôs que a Anthropic deixasse o evento. A equipe dele pediu ao conselho do papa que levasse a sério a hipótese de consciência de máquina; Olah diz estar 'genuinamente incerto'.
Ferramentas e código · web · anthropic, consciencia, religiao, etica
A versão traz gh api nas sessões em nuvem, Ctrl+F para buscar sessões, recuperação do prompt apagado com Ctrl+C, $.ui.selection() para os Mods e novo pedido de OAuth quando um servidor MCP quer escopo extra. Corrige o 'Prompt is too long' com auto-compact e um rm perigoso que perdia a salvaguarda.
Ferramentas e código · github · claude-code, release
O motor é voltado a máquinas com muita memória e expõe APIs locais; chega a 39,4 tokens por segundo de geração num M5 Max de 128 GB, segundo o próprio site.
Ferramentas e código · hacker-news · inferencia-local, open-source, deepseek, antirez
A Meta fabricou 5.000 adaptadores USB-C Muse Home Link, grátis para assinantes nos EUA, que ligam o Muse a TVs e outros aparelhos. O kit roda em ESP32 e Raspberry Pi 5.
Ferramentas e código · websearch · meta, muse, hardware, open-source
O teste cobre injeção de prompt e segurança de conteúdo em 4 categorias de método. O LLM-juiz grande (Qwen 35B) tem a melhor acurácia geral, com ~312 ms na injeção de prompt; os modelos estilo Jev oferecem flexibilidade zero-shot sem vencer as duas alternativas.
Ferramentas e código · hacker-news · guardrails, prompt-injection, jev, benchmark
O sistema analisa onde o modelo falha e gera tarefas com especificação, prompt e verificador para aquele ambiente. Com 2.000 amostras em 18 horas ganhou 7,2 pontos no domínio Hybrid; com 1.994 amostras em ITSM, acurácia de 18,77% para 27,18%.
Ferramentas e código · rss · dados-sinteticos, agentes-enterprise, servicenow, treino
Usuários recebem ZIP com o site em HTML e reembolso proporcional das assinaturas; a página sugere migrar para Wix, Squarespace, WordPress, Bolt ou Lovable.
Ferramentas e código · web · mozilla, no-code, encerramento
Segundo a Meta, cinco dos seis artigos respondem questões em aberto, entre eles um contraexemplo de 384 elementos para uma conjectura de 2024 em teoria de grupos. Em 03/10, Jason D. Lee afirmou que três dos seis resultados já tinham sido obtidos por outros grupos.
O benchmark usa casos anotados a partir de dados de produção de empresas. O melhor resultado é do modo Deep da própria Kapa (0,65), o que torna o teste uma avaliação feita pela fornecedora.
O método PoS (Progression of States) atua na inferência, sem retreino: mantém uma estimativa do mundo e das exigências pendentes e detecta estagnação, ciclos e deriva. Ganhos relativos de 22,68% no ALFWorld e 37,89% no RCA-100 com três modelos-base.
O estudo compara métodos que encurtam a cadeia de raciocínio e mede quando o CoT deixa de refletir a decisão do modelo; o efeito depende de como cada método aplica a pressão de comprimento.
Em ambiente de geração de código, políticas treinadas contra três monitores que passam no mesmo teste offline zeram a leitura do monitor sem que isso indique controle do comportamento explorador.
Benchmark multilíngue e multimodal com perguntas escritas e validadas por falantes nativos, que exigem achar evidência obscura em vídeos, documentos escaneados, imagens ou mapas.
A rodada vem quatro meses depois de uma Série F de US$ 500 milhões. A empresa lançou o Supabase Compute, com sandboxes para agentes de longa duração, e diz que cerca de 70% dos bancos novos já são criados por agentes ou ferramentas de IA.
Robinson cuidava de ferramentas de transparência como os system cards e saiu depois que a OpenAI demitiu Jasmine Wang, Tomek Korbak e Mikita Balesni por suposto vazamento a uma organização externa de segurança. É ao menos a sétima saída sênior da área em cerca de dois anos.
Regulação e segurança · websearch · openai, seguranca-ia, pessoas, governanca
O 8º Circuito suspendeu a lei, em vigor desde 1º de agosto, que proíbe ferramentas de gerar nudez realista de pessoas identificáveis, enquanto corre a ação da xAI, que alega violação da liberdade de expressão. O estado cita o volume de material de abuso infantil gerado por produtos como o Grok Imagine.
Brockman e a esposa tinham prometido US$ 50 milhões ao Leading the Future, super PAC contra a regulação de IA, e retiraram a segunda parcela em junho depois de críticas internas no Slack.
Comunidade · websearch · openai, politica, super-pac, regulacao
A empresa vende um modelo de propósito geral que comanda humanoides, cães-robô e drones, e soma mais de US$ 135 milhões entre receita e contratos, com mais de 30 clientes. A rodada está em term sheet assinado.
Comunidade · websearch · robotica, financiamento, physical-ai
O Harness é um runtime de agentes sob MIT em que tudo é plugin, em prévia para macOS com Apple Silicon, Windows e web, usando o DeepSeek-V4.1-Flash. A discussão no HN chegou a 253 pontos e 121 comentários; a disponibilidade foi anunciada em 30/09.
Comunidade · websearch · deepseek, agentes, open-source, desktop, hacker-news
O uso cresceu cerca de 50% desde o pico de gasto em julho, mas a despesa caiu com cortes de preço e migração para modelos mais baratos; no fim de setembro a Anthropic tinha 51% do gasto em API e a OpenAI 44,5%. Base de mais de 70 mil empresas, só gasto de API; modelos abertos abaixo de 5%.
Comunidade · websearch · ramp-ai-index, adocao-empresarial, precos-de-modelos, anthropic, openai
Greg Lui, 38 anos, dono da Earthmade Computer, teria recebido mais de US$ 176 milhões de duas empresas malaias, com envios por Singapura e Malásia em 2023 e 2024. Pode pegar mais de 20 anos de prisão.
Comunidade · websearch · nvidia, exportacao, china, chips
CNN e Axios informaram que o ex-presidente da SEC deve assumir a coordenação de IA sem deixar o cargo atual. O posto está vago desde a saída de David Sacks, em março. A Casa Branca chamou os relatos de especulação até anúncio oficial.
Comunidade · websearch · politica, eua, casa-branca, governanca
O programa Built Together paga faculdade comunitária, capacitação e reformas de eficiência energética, e a Amazon deixa de usar NDA com órgãos públicos. Há mais de 100 moratórias a data centers em discussão nos EUA.
Comunidade · websearch · amazon, data-centers, energia
A equipe de segurança de IA veio na aquisição-contratação de junho. O porta-voz Andy Stone disse que o arranjo não funcionou como planejado e citou estilos de trabalho incompatíveis.
Comunidade · websearch · meta, seguranca-de-ia, talentos
Graepel compara a previsão de token ao Sistema 1 e contrasta com a árvore de jogo explícita do AlphaGo. Defende, para medicina e ciência, sistemas com estado epistêmico inspecionável que separem conhecimento de raciocínio e mostrem evidência auditável.
Comunidade · rss · raciocinio, opiniao, alphago, confiabilidade
O projeto agent-wow, de código aberto, deu ao Codex com GPT-6 Astra (xhigh) só o pedido de criar um orc e cumprir as missões iniciais. O objetivo declarado do autor é encher um servidor com agentes e tentar a raide Icecrown Citadel no heroico.
Comunidade · hacker-news · agentes, jogos, gpt-6-astra, codex
É uma das primeiras redes a fazer isso. No mês passado, o regulador holandês AP avisou que vídeos com pessoas identificáveis não podem ser publicados sem consentimento.
Comunidade · websearch · meta, privacidade, europa, oculos
O regulador estadual revogou a aprovação da linha de transmissão. No cenário-base há energia parcial em dezembro de 2027 e plena em outubro de 2028; no pior, abril de 2029.
Comunidade · hacker-news · oracle, data-centers, energia
A Cerence acusava as duas de seguir usando seu software de texto para fala depois do fim da licença, em 2024. O acordo deve ser finalizado em 30 a 45 dias; termos não divulgados.
Comunidade · websearch · microsoft, direitos-autorais, text-to-speech, litigio