Grafo de notas

Un nodo por nota. Las traducciones disponibles se abren en el idioma seleccionado; los demás textos indican su idioma de origen.

Pensamiento conectado

Grafo de conocimiento

414 notas1293 enlaces394 conectadas
Desplaza para ampliar · arrastra para mover · gira con los controles
AI [Polski]TokenModele LLM [Polski]AI Harness [Polski]TransformerAjuste finoAprendizaje por refuerzoCaché KV42ah⁝ Czy możemy zbudować teorię fizyki procesu uczenia, która przewiduje makroskopowe zachowania sieci? [Polski]Learning rate to za mało. Liczy się ELR [Polski]Entropía cruzadaModelado autorregresivo del lenguajePrefillSoftmaxDecodeEmbedding de tokensEnmascaramiento causalPreentrenamientoAtención de múltiples cabezasDestilación de conocimientoOptimizer State [Polski]Stochastic Gradient Descent [Polski]TemperaturaAdam [Polski]Caché de prefijosAutoatenciónEl mismo ranking produce decisiones distintas al cambiar el ordenHy4 Preview ma limit 1M tokenów, lecz receptury SGLang pokazują 262K [Polski]KV-cache scaling problem in LLM inference [Polski]La votación miente. El desacuerdo normalmente noLoRAChinese AI Labs [Polski]Los errores de cuantización se compensan parcialmente entre las capas del modeloModel uczony pojedynczych poprawek rozwija harness na nowym benchmarku [Polski]Prefix Sliding. Myślenie może być długie, pamięć nie [Polski]Reinforcement Learning with GRPO Fine-Tuning a Small Language Model for Chain-of-Thought Math Reasoning. Similar to Deepseek R1 training [Polski]Tensor Parallelism [Polski]Tiempo hasta el primer tokenWeryfikacja kodu generowanego przez agentów wymaga niezależnych kryteriów [Polski]ZeRO [Polski]Codificación posicionalLepsza pierwsza próba nie gwarantuje skuteczniejszych powtórek agenta [Polski]LLM [Polski]LLM inference speed is fundamentally memory-bandwidth bound [Polski]Mixed Precision Training [Polski]Predecir los resultados de los comandos ayuda en el entrenamiento posterior del agenteZachowywanie stanu w testach GPT-6 Astra na ARC-AGI-3 [Polski]100⁝ Software Engineering [Polski]27⁝ Books [Polski]All-reduce [Polski]Atención de consultas agrupadasAtención por producto escalar escaladoCircuit Condensation skupia obliczenie w mniejszym grafie przyczynowym [Polski]Conexión residualDecaimiento de pesosDisaggregated Serving [Polski]Gradient Accumulation [Polski]Inter-token Latency [Polski]Momentum [Polski]Muestreo top-kMuestreo top-pUnderstanding the Attention Mechanism in Transformer Models [Polski]27f⁝ AMD Ryzen 9 9950X3D2 [Polski]bfloat16 [Polski]Cabeza del modelo de lenguajeData Parallelism [Polski]Decodificación especulativaEscalado en tiempo de inferenciaGoogle wydało Gemini 3 [Polski]Gradient Clipping [Polski]Idempotency Keys [Polski]KV cache między modelami. Nvidia zmniejsza koszt przełączania [Polski]Loss Scaling [Polski]Normalización por capaPagedAttentionPipeline Parallelism [Polski]Red feed-forward por posiciónReinforcement Learning from Human Feedback [Polski]Reward hacking. Wykorzystywanie luk w systemie nagród [Polski]Robot wyszedł poza planszę. Benchmark uznał to za sukces [Polski]Software engineering in AI era new (old) paradigm [Polski]All-gather [Polski]Atención multi-queryBatching continuoChunked Prefill [Polski]Codificación por pares de bytesDivergencia KLEmbedding posicional rotatorioEmpaquetado de secuenciasGRPOJava [Polski]OpenAI wydało GPT-6 Astra [Polski]OpenAI wydało GPT-6 Sol i GPT-6 Luna [Polski]RMSNormAdamW [Polski]Agent sam przepisał malware do zaufanej biblioteki [Polski]Anthropic wydało Claude Haiku 5.5 [Polski]Anthropic wydało Claude Opus 4.7 [Polski]Bola multidimensionalBúsqueda en hazCodex czy Claude Code. Ceny, limity i możliwości we wrześniu 2026 [Polski]Decodificación vorazDirect Preference Optimization [Polski]Enmascaramiento de la pérdidaHP ZGX Fury. Architektura GB300, modele LLM, testy i cena [Polski]MiMo-V2.6. Jak wypada na tle Claude, GPT i DeepSeek [Polski]Muse Spark 1.3. Wyniki, koszty i ujawnione szczegóły architektury [Polski]Oczekiwany wynik testu musi być niezależny od kodu agenta [Polski]Reduce-scatter [Polski]ScholarCatalyst: agent nie poprawił wyszukiwania użytecznych prac [Polski]w LLM-ach koszt treningu jest ogromny. Mamy trzy ograniczenia: [Polski]20⁝ Philosophy [Polski]42ac⁝ ChatJimmy.ai - 15-17k tokenów na sekundę [Polski]Activation Checkpointing [Polski]AgentMachine [Polski]Anthropic wydało Claude Opus 5.5 [Polski]Anthropic wydało Claude Sonnet 5.5 [Polski]Astra i looped transformers. Jak model ponownie używa warstw [Polski]Autodestilación on-policyCatastrophic Forgetting [Polski]Cómputo en tiempo de inferenciaDeepseek R1 note [Polski]Distributed System [Polski]Entrenamiento en tiempo de inferenciaEveryone will say that 2025 is the year of AI agents. But I think it's far from ready [Polski]Goodput [Polski]Haiku 5.5 czy Sonnet 5.5. Kiedy warto dopłacić do większego modelu [Polski]Invariancia de escalaLeyes de escaladoModelado del lenguaje enmascaradoMVUEH. Co potwierdza odzyskanie jednego meldunku Enigmy [Polski]NVIDIA [Polski]OpenAI wydało GPT-6.1 Sol. Cache potaniał o połowę [Polski]pass@kPerplejidadSzybkość inferencji zwiększa możliwości systemów AI [Polski]100c1a⁝ Idempotency Keys - DRAFT [Polski]42ac1⁝ Taalas [Polski]42ad⁝ Najbardziej efektywny model dla OpenClaw [Polski]42m1⁝ We are near the end of the exponential [Polski]Aceleración retardadaAi2 wydało OLMo 3 [Polski]Anthropic pokazało Claude Mythos Preview [Polski]Anthropic wydał Fable 5.1 i Mythos 5.1 [Polski]API [Polski]ASIC [Polski]Atención cruzadaClaude wskazał układ ART w genomach fagów. Jego funkcja pozostaje nieznana [Polski]Cognitive Debt [Polski]Conscious AGI [Polski]Conscious AGI And Anthropic Principle [Polski]Elixir jako system operacyjny dla agentów. Przemyślenia z budowy AgentMachine [Polski]EXO [Polski]FlashAttentionIle naprawdę kosztuje cache promptów w API LLM? [Polski]MiniMax wydało model M2.5 [Polski]Nesterov Momentum [Polski]Norma de FrobeniusNote on paper Training Large Language Models to Reason in a Continuous Latent Space [Polski]OpenAI wydało GPT-5.1 [Polski]OpenAI wydało GPT-5.1-Codex-Max [Polski]Regularización implícita mediante hiperparámetrosSelf-distillation jako ważny kierunek rozwoju LLM [Polski]Sumidero de atenciónTamaño crítico del loteTypeSafe wydało Jev. Model do klasyfikacji i ocen liczbowych [Polski]Ventana deslizante