PT
Contato
Menu

Sistemas

Colony

Agentes pessoais que continuam trabalhando em todas as conversas. Dê a eles projetos, ferramentas e memória. Eles podem escrever código, usar seu Mac, criar pequenos aplicativos e retornar ao trabalho agendado em um computador que você controla.

Pré-visualização técnica mediante solicitação.

Colony//Trabalhe em conversas

01/Atribuir

Um projeto para trabalhar Descreva um resultado, continue uma tarefa ou defina um cronograma

02/Trabalho

Os agentes usam suas ferramentas Arquivos, códigos e aplicativos conectados, com o acesso que você concede

03/Manter

Útil novamente na próxima vez Memória de projeto, habilidades reutilizáveis e aplicativos com dados armazenados

O que ele faz

  • Dê a ele um trabalho contínuo

    Atribua uma meta, defina um lembrete ou agende uma tarefa recorrente. Analise o progresso e pause o trabalho no mesmo espaço de trabalho.

  • Trabalhe em suas ferramentas

    Leia e altere arquivos, execute comandos, pesquise na web e opere aplicativos Mac com o acesso que você concede.

  • Lembrar e reutilizar

    Mantenha o conhecimento do projeto e as preferências pessoais em todas as conversas. Transforme o trabalho concluído em habilidades que você pode revisar.

  • Crie o que você precisa

    Crie um rastreador, painel ou aplicativo pequeno a partir de um resumo, com dados armazenados e atualizações programadas.

Em Colony, um agente mantém sua identidade, ferramentas e memória à medida que o trabalho passa de uma conversa para outra. Dê a ele um projeto e os arquivos necessários; volte mais tarde com uma correção ou uma nova tarefa. O trabalho anterior ainda está lá.

A Colony suporta projetos de engenharia e tarefas pessoais: lembretes, assistência informática e pequenos aplicativos que mantêm as informações úteis atualizadas. Você administra o ambiente e escolhe os modelos que ele usa.

Atribua trabalho e, em seguida, mantenha a conversa em andamento

Uma solicitação pode se tornar uma meta contínua com um resultado claro pelo qual trabalhar. Tarefas separadas são executadas em suas próprias conversas, portanto, um experimento lento não atrapalha todos os outros trabalhos. Para um trabalho recorrente, defina um intervalo; para um lembrete, defina um horário. O trabalho agendado pode continuar após você fechar o navegador, enquanto o Colony e suas conexões necessárias permanecem em execução no computador host.

Escolha como os resultados chegam até você. Os relatórios de rotina podem acompanhar a tarefa, aparecer na conversa ou ser interrompidos quando você pede para ser informado. Em uma conversa de voz ao vivo, um relatório de interrupção pode ser falado. Caso contrário, ele aparece por meio da interface aberta ou de um canal configurado; avisos não entregues permanecem disponíveis quando você retorna. Você pode inspecionar, pausar ou interromper o trabalho.

O espaço de trabalho do navegador reúne conversas, arquivos, agentes, aplicativos e atividades. A voz pode usar um modelo de fala no navegador ou nos terminais de áudio que você configura. As integrações de mensagens precisam de sua própria configuração; a conexão Zulip atual suporta conversas e entrega proativa de resultados em segundo plano.

Use o computador e as ferramentas que você já tem

Os agentes podem inspecionar um repositório, editar arquivos, executar comandos, pesquisar na web e chamar ferramentas conectadas. As habilidades adicionam instruções reutilizáveis e as conexões MCP adicionam acesso a serviços externos.

Em um Mac, o Colony pode ler janelas de aplicativos por meio da árvore de acessibilidade, selecionar controles, digitar, usar a área de transferência e capturar a tela. Essas ações exigem as permissões correspondentes do macOS. Atualmente, o controle de desktop é específico para o macOS; uma instalação Linux ainda tem seus arquivos, terminal, web e ferramentas conectadas.

Crie vários agentes quando o trabalho se beneficiar de funções distintas. Eles podem compartilhar um espaço de trabalho e trocar mensagens sob suas permissões. Um fluxo de trabalho finito atribui etapas dependentes aos agentes nomeados e transmite os artefatos resultantes adiante. Para um experimento, isso pode significar preparar as entradas, executar um trabalho, revisar suas saídas e escrever o relatório.

Crie um aplicativo para uma necessidade recorrente

Colony/De uma tarefa a um trabalho salvo

Um aplicativo funcional, salvo para a próxima tarefa.

  1. 01 / Construir

    Trabalhe em um projeto real.

    Um agente usa os arquivos do projeto e as ferramentas permitidas para produzir um aplicativo. Nesta sessão gravada, Colony construiu uma calculadora científica e registrou seis arquivos com 450 linhas inseridas.

    Confirmação de aplicativo gravadae790c966 arquivos · 450 linhas inseridas
    • ui/index.htmlInterface
    • ui/styles.cssEstilos
    • ui/app.jsLógica e gráfico
    • data/latest.jsonDados do aplicativo
    • manifest.jsonDefinição
    • .gitignoreExclusões

    Um aplicativo salvo que a próxima conversa pode usar.

    Confirmação gravada e790c96. O projeto salvo contém a interface, a lógica, os dados e a definição do aplicativo.
  2. 02 / Verificar

    Inspecione o que realmente foi salvo.

    Reabrimos o aplicativo e verificamos sqrt (9), que retornou 3. A imagem é o próprio aplicativo salvo, portanto, o resultado pode ser inspecionado junto com o registro da sessão.

    Aplicativo reaberto//Captura real

    A calculadora científica salva, verificada com sqrt (9), retornando 3

    sqrt(9)3

    Captura real do aplicativo. Uma verificação aritmética demonstra esse artefato salvo, não a exatidão exaustiva.
  3. 03 / Continuar

    Faça a próxima solicitação em algum lugar para começar.

    Os arquivos do aplicativo, os dados e o histórico de alterações permanecem no espaço de trabalho. Uma conversa posterior pode inspecionar ou alterar o mesmo projeto. A memória do agente e as habilidades reutilizáveis apoiam esse trabalho contínuo.

    Projeto retidoe790c966 arquivos · 450 linhas inseridas
    • ui/index.htmlInterface
    • ui/styles.cssEstilos
    • ui/app.jsLógica e gráfico
    • data/latest.jsonDados do aplicativo
    • manifest.jsonDefinição
    • .gitignoreExclusões
    Próxima solicitaçãoOs mesmos arquivos, dados e histórico
    Os mesmos arquivos, dados do aplicativo e histórico de versões permanecem disponíveis para trabalhos posteriores.

Com base na sessão gravada da calculadora e no aplicativo reaberto. Este exemplo não mede a confiabilidade geral da codificação.

Peça à Colony que crie um pequeno aplicativo a partir de um resumo: um rastreador de experimentos, uma lista de leitura, um painel, uma lista de verificação ou um lembrete. O aplicativo tem sua própria página, dados armazenados e uma conversa para alterações. As atualizações agendadas podem atualizar seus dados e relatórios quando uma entrada deixa de funcionar.

A criação de aplicativos e a manutenção programada usam permissões de ferramentas diferentes. Uma tarefa de manutenção pode atualizar os dados do aplicativo e ler suas fontes; ela não pode executar comandos arbitrários do shell nem reescrever a interface do aplicativo. A versão prévia atual fornece esses aplicativos da instalação da Colony. A hospedagem pública para clientes independentes ainda está planejada.

Colony · Sessão gravada e artefato salvo

CONFIRMAÇÃO DE APLICATIVO GRAVADA

Uma calculadora científica,
salva em seis arquivos.

O aplicativo, seus dados e seu histórico de alterações permanecem disponíveis para a próxima solicitação.

Comprometa-se
e790c96
Alteração registrada
6 arquivos · 450 linhas inseridas

APLICATIVO SALVO

  • ui/index.htmlInterface
  • ui/styles.cssEstilos
  • ui/app.jsCalculadora e gráfico
  • data/latest.jsonDados do aplicativo
  • manifest.jsonDefinição de aplicativo
  • .gitignoreExclusões de arquivos

Verificado no aplicativo reaberto sqrt(9)3

Inspecione a sessão original e as capturas do aplicativo

01/Sessão de construção gravada

Trecho de uma sessão gravada de criação de aplicativos da Colony mostrando a confirmação do arquivo e seu relatório da calculadora científica.

02/Aplicativo salvo

O aplicativo de calculadora realmente salvo, reaberto e verificado com sqrt (9), retornando 3.
Um aplicativo que permanece após a conversa. Um registro do projeto de calculadora salvo. As capturas originais da sessão e do aplicativo estão disponíveis acima; o aplicativo reaberto foi verificado com sqrt (9) = 3. Uma captura de interface anterior, recortada para o funcionamento do aplicativo. Este exemplo não mede a confiabilidade geral da codificação.

Memória que você pode inspecionar

Cada agente mantém suas próprias notas, junto com as notas compartilhadas com os membros de um projeto. Esses são arquivos Markdown com informações de autor e hora. Os agentes podem pesquisá-los, lê-los, anexá-los e corrigi-los com ferramentas comuns. As memórias compartilhadas permanecem com o projeto; as anotações do próprio agente o acompanham em seus espaços de trabalho.

À medida que as notas crescem, os passes de consolidação limitados as mesclam em um resumo em evolução. Os arquivos de origem são arquivados para o operador antes da reescrita. A consolidação usa o modelo configurado, portanto, a manutenção da memória tem seu próprio custo de inferência, juntamente com o trabalho de primeiro plano do agente.

O histórico da sessão é separado dessas notas. A pesquisa lê a transcrição armazenada em vez de apenas as mensagens atualmente carregadas para inferência. A compactação pode encurtar a próxima solicitação de modelo, enquanto o trabalho anterior permanece disponível para recuperação.

Mantenha as evidências, controle o contexto

Grandes registros de construção e saídas de experimentos são caros de enviar em cada chamada de modelo subsequente. O Colony armazena um resultado de ferramenta de grandes dimensões como um artefato completo e endereçado ao conteúdo e fornece ao modelo uma prévia, além de instruções para recuperar a peça relevante.

EstágioComportamento atual
Salve o resultadoAs saídas acima de 8,000 bytes são gravadas em um artefato de propriedade da sessão identificado por um hash SHA-256.
Primeira visualização do modeloAté 4,000 bytes de conteúdo principal, além do ID de saída, tamanho e instruções de recuperação.
Inspecione ainda maisPesquise linhas correspondentes ou solicite intervalos de bytes limitados. Os resultados incluem localizações de linhas ou bytes.
Retenha a fonteA saída completa permanece disponível durante a vida útil da sessão. Saídas idênticas compartilham um artefato.

Os limites descrevem a implementação atual, não uma economia medida de token. A recuperação adiciona chamadas de ferramentas e algumas tarefas precisam de toda a saída. Se o salvamento do artefato falhar, Colony retornará o resultado completo em linha.

As instruções estáveis e as definições de ferramentas do agente também permanecem em uma ordem consistente em um turno, para que os fornecedores compatíveis possam reutilizar seu prefixo de prompt. Os registros de uso incluem tokens em cache rápidos, completos e relatados pelo provedor. A economia real depende do endpoint, da carga de trabalho e da quantidade de evidências que o agente precisa revisar.

O inspetor de contexto mostra os blocos de instruções enviados no último turno, incluindo seus tamanhos e hashes. Comparar esses hashes com o turno anterior ajuda a identificar qual parte de um prompt foi alterada quando um cache deixou de ser reutilizado.

Leve um trabalho útil para a próxima tarefa

Após a conclusão de uma tarefa em segundo plano, Colony pode redigir uma habilidade a partir do procedimento registrado . Você revisa a proposta antes que ela se torne uma habilidade instalada. A tarefa e o modelo de origem são gravados com ele, portanto, um procedimento reutilizável tem um histórico que você pode inspecionar.

A Colony observa operações bem-sucedidas em primeiro plano repetidas nas mesmas entradas. Quando um padrão se repete, ele pode atribuir uma tarefa curta para criar um script reutilizável, instalar uma habilidade ou registrar um procedimento na memória do espaço de trabalho. A ferramenta resultante pode ser inspecionada e usada em trabalhos posteriores.

Esses mecanismos alteram arquivos e procedimentos, não os pesos dos modelos. Tanto a elaboração de habilidades quanto a consolidação da memória consomem chamadas de modelo. O trabalho é limitado; tarefas em segundo plano não podem gerar recursivamente mais tarefas de repetição .

Nosso interesse de pesquisa é quanta experiência útil um agente pode levar para sua próxima tarefa. Scripts, procedimentos e memórias inspecionáveis nos fornecem objetos concretos para testar: quais são reutilizados, quais ficam obsoletos e se melhoram a conclusão com o mesmo modelo e orçamento computacional.

Analise o que o agente realmente fez

As conversas retêm mensagens, chamadas de ferramentas e resultados. A conclusão de metas usa um juiz modelo separado que analisa os critérios em relação aos registros de execução e aos artefatos do espaço de trabalho. Os resumos escritos pelo agente são marcados como reivindicações não verificadas. A falta dos arquivos necessários impede a conclusão, mesmo que o juiz dê um veredicto positivo.

O juiz ainda pode cometer erros. Os testes e outras verificações de aceitação independentes continuam fazendo parte da revisão de trabalhos importantes. Durante uma conversa ao vivo, Colony pode pedir uma decisão humana e esperar pela resposta. O trabalho em segundo plano pode deixar uma solicitação de decisão para revisão. As permissões determinam quais ferramentas e espaços de trabalho cada agente pode acessar. Não publicamos um benchmark comparativo de sucesso de tarefas.

Colony de corrida

Um serviço local inclui a API e a interface do navegador. Ele é executado na CPU; o servidor modelo configurado e os processos da ferramenta têm seus próprios requisitos de recursos. Os trabalhadores de sessão ociosos param até que mais entradas cheguem, enquanto seu estado salvo permanece no disco.

Conecte um modelo hospedado existente ou um servidor local operado separadamente. Para uma implantação isolada, o modelo, as ferramentas e suas dependências devem estar disponíveis nesse ambiente. As compilações instaladas verificam as versões automaticamente, a menos que as atualizações sejam desativadas; uma instalação isolada precisa de seu próprio processo de atualização.

Prévia técnica

Estamos abrindo prévias técnicas para pessoas que constroem com agentes persistentes e pesquisadores que estudam memória, uso de ferramentas e tarefas estendidas. Traga um trabalho contínuo que você daria a um agente, as ferramentas de que ele precisa e uma forma de verificar seu trabalho. Queremos medir o que é transferido para a próxima tarefa, quanto contexto ela custa e onde a intervenção humana ainda é necessária.

Especificações

  • InterfacesEspaço de trabalho do navegador, voz, linha de comando, interface de terminal e API.
  • PlataformasmacOS no Apple Silicon; Linux em x86_64 e ARM64.
  • ModelosConecte um servidor modelo que você executa ou um endpoint hospedado. A compilação atual não inclui um modelo.
  • EstadoArquivos locais: fluxos de sessão, registros de metas, artefatos do espaço de trabalho e memória Markdown com escopo definido.
  • FerramentasArquivos, terminal, web, ferramentas de desktop Mac, habilidades instaladas e conexões MCP sob permissões configuradas.
  • DisponibilidadeO trabalho em segundo plano é executado enquanto o computador host e as conexões necessárias do modelo e da ferramenta permanecem disponíveis.
  • AcessoConstrução de desenvolvimento privado. Entre em contato com o laboratório para obter uma prévia técnica.

Outros sistemas

Também aqui: re1