Notizengraph

Ein Knoten pro Notiz. Verfügbare Übersetzungen öffnen sich in der gewählten Sprache; andere Texte zeigen ihre Originalsprache.

Vernetztes Denken

Wissensgraph

414 Notizen1293 Links394 verbunden
Scrollen zum Zoomen · ziehen zum Verschieben · mit den Steuerelementen drehen
AI [Polski]TokenModele LLM [Polski]AI Harness [Polski]TransformerFine-TuningReinforcement LearningKV-Cache42ah⁝ Czy możemy zbudować teorię fizyki procesu uczenia, która przewiduje makroskopowe zachowania sieci? [Polski]Learning rate to za mało. Liczy się ELR [Polski]Autoregressive SprachmodellierungKreuzentropiePrefillSoftmaxDecodeKausale MaskierungPre-TrainingToken-EmbeddingMulti-Head AttentionOptimizer State [Polski]Stochastic Gradient Descent [Polski]TemperaturWissensdestillationAdam [Polski]Prefix CachingAbstimmungen lügen. Abweichungen meist nichtGleiche Rankingqualität, andere Entscheidungen nach einer Änderung der ReihenfolgeHy4 Preview ma limit 1M tokenów, lecz receptury SGLang pokazują 262K [Polski]KV-cache scaling problem in LLM inference [Polski]LoRASelf-AttentionChinese AI Labs [Polski]Model uczony pojedynczych poprawek rozwija harness na nowym benchmarku [Polski]Prefix Sliding. Myślenie może być długie, pamięć nie [Polski]Quantisierungsfehler gleichen sich zwischen den Modellschichten teilweise ausReinforcement Learning with GRPO Fine-Tuning a Small Language Model for Chain-of-Thought Math Reasoning. Similar to Deepseek R1 training [Polski]Tensor Parallelism [Polski]Weryfikacja kodu generowanego przez agentów wymaga niezależnych kryteriów [Polski]Zeit bis zum ersten TokenZeRO [Polski]Das Vorhersagen von Befehlsausgaben hilft beim späteren Training des AgentenLepsza pierwsza próba nie gwarantuje skuteczniejszych powtórek agenta [Polski]LLM [Polski]LLM inference speed is fundamentally memory-bandwidth bound [Polski]Mixed Precision Training [Polski]PositionskodierungZachowywanie stanu w testach GPT-6 Astra na ARC-AGI-3 [Polski]100⁝ Software Engineering [Polski]27⁝ Books [Polski]All-reduce [Polski]Circuit Condensation skupia obliczenie w mniejszym grafie przyczynowym [Polski]Disaggregated Serving [Polski]Gradient Accumulation [Polski]Grouped-Query AttentionInter-token Latency [Polski]Momentum [Polski]ResidualverbindungScaled Dot-Product AttentionTop-k-SamplingTop-p-SamplingUnderstanding the Attention Mechanism in Transformer Models [Polski]Weight Decay27f⁝ AMD Ryzen 9 9950X3D2 [Polski]bfloat16 [Polski]Data Parallelism [Polski]Google wydało Gemini 3 [Polski]Gradient Clipping [Polski]Idempotency Keys [Polski]KV cache między modelami. Nvidia zmniejsza koszt przełączania [Polski]Layer-NormalisierungLM HeadLoss Scaling [Polski]PagedAttentionPipeline Parallelism [Polski]Positionsweises Feed-Forward-NetzReinforcement Learning from Human Feedback [Polski]Reward hacking. Wykorzystywanie luk w systemie nagród [Polski]Robot wyszedł poza planszę. Benchmark uznał to za sukces [Polski]Software engineering in AI era new (old) paradigm [Polski]Speculative DecodingTest-Time ScalingAll-gather [Polski]Byte Pair EncodingChunked Prefill [Polski]Continuous BatchingGRPOJava [Polski]KL-DivergenzMulti-Query AttentionOpenAI wydało GPT-6 Astra [Polski]OpenAI wydało GPT-6 Sol i GPT-6 Luna [Polski]RMSNormRotary Position EmbeddingSequence PackingAdamW [Polski]Agent sam przepisał malware do zaufanej biblioteki [Polski]Anthropic wydało Claude Haiku 5.5 [Polski]Anthropic wydało Claude Opus 4.7 [Polski]Beam SearchCodex czy Claude Code. Ceny, limity i możliwości we wrześniu 2026 [Polski]Direct Preference Optimization [Polski]Greedy DecodingHP ZGX Fury. Architektura GB300, modele LLM, testy i cena [Polski]HyperballLoss MaskingMiMo-V2.6. Jak wypada na tle Claude, GPT i DeepSeek [Polski]Muse Spark 1.3. Wyniki, koszty i ujawnione szczegóły architektury [Polski]Oczekiwany wynik testu musi być niezależny od kodu agenta [Polski]Reduce-scatter [Polski]ScholarCatalyst: agent nie poprawił wyszukiwania użytecznych prac [Polski]w LLM-ach koszt treningu jest ogromny. Mamy trzy ograniczenia: [Polski]20⁝ Philosophy [Polski]42ac⁝ ChatJimmy.ai - 15-17k tokenów na sekundę [Polski]Activation Checkpointing [Polski]AgentMachine [Polski]Anthropic wydało Claude Opus 5.5 [Polski]Anthropic wydało Claude Sonnet 5.5 [Polski]Astra i looped transformers. Jak model ponownie używa warstw [Polski]Catastrophic Forgetting [Polski]Deepseek R1 note [Polski]Distributed System [Polski]Everyone will say that 2025 is the year of AI agents. But I think it's far from ready [Polski]Goodput [Polski]Haiku 5.5 czy Sonnet 5.5. Kiedy warto dopłacić do większego modelu [Polski]Maskierte SprachmodellierungMVUEH. Co potwierdza odzyskanie jednego meldunku Enigmy [Polski]NVIDIA [Polski]On-Policy-SelbstdestillationOpenAI wydało GPT-6.1 Sol. Cache potaniał o połowę [Polski]pass@kPerplexitätSkaleninvarianzSkalierungsgesetzeSzybkość inferencji zwiększa możliwości systemów AI [Polski]Test-Time ComputeTest-Time Training100c1a⁝ Idempotency Keys - DRAFT [Polski]42ac1⁝ Taalas [Polski]42ad⁝ Najbardziej efektywny model dla OpenClaw [Polski]42m1⁝ We are near the end of the exponential [Polski]Ai2 wydało OLMo 3 [Polski]Anthropic pokazało Claude Mythos Preview [Polski]Anthropic wydał Fable 5.1 i Mythos 5.1 [Polski]API [Polski]ASIC [Polski]Attention SinkClaude wskazał układ ART w genomach fagów. Jego funkcja pozostaje nieznana [Polski]Cognitive Debt [Polski]Conscious AGI [Polski]Conscious AGI And Anthropic Principle [Polski]Cross-AttentionElixir jako system operacyjny dla agentów. Przemyślenia z budowy AgentMachine [Polski]EXO [Polski]FlashAttentionFrobeniusnormGleitendes FensterIle naprawdę kosztuje cache promptów w API LLM? [Polski]Implizite Regularisierung durch HyperparameterKritische BatchgrößeMiniMax wydało model M2.5 [Polski]Nesterov Momentum [Polski]Note on paper Training Large Language Models to Reason in a Continuous Latent Space [Polski]OpenAI wydało GPT-5.1 [Polski]OpenAI wydało GPT-5.1-Codex-Max [Polski]Self-distillation jako ważny kierunek rozwoju LLM [Polski]TypeSafe wydało Jev. Model do klasyfikacji i ocen liczbowych [Polski]Verzögerte Beschleunigung