標籤

共 403 個標籤,其中 88 個橫跨多篇論文。點一下即可篩選。

只出現在單篇論文的標籤(315)
3D Stacking1Activation1Adaptive Computation1Agent Skills1Agentic AI1AGI1AI Scientist1Allen AI1Apple1ARC-AGI1Attention1Attention Mask1Attention Mechanism1Autoregressive1Bias1ByteDance1Chain-of-Thought1Chinchilla1Chinese NLP1CISPO1Claude Code1CLI1Code Agent1Code Synthesis1Common Crawl1Compression1Computer System Validation1Context Extension1Continued Pre-training1CoT1Cross-Entropy1Cross-Tokenizer1Cryptographic Protocol1CUDA Kernel1DAPO1Data1Data Augmentation1Data Collection1Data Curation1Data Mixing1Data Parallelism1Data-Centric AI1Database1Datacenter AI1Decoding1DeepSeek1Delegated Work1Delegation1Delta Rule1DeltaNet1Democratic Discourse1Diffusion1Diffusion LLM1Diffusion Model1Diffusion Transformer1Disaggregation1Distributionally Robust Optimization1Document Editing1Document VQA1Domain Reweighting1DPPO1Ed255191Emergent Behavior1Few-Shot Learning1Financial Agent1Financial LLM1Financial Security1Fisher-Rao1Flash Memory1FrogNano1Gating1Generalization1GPT-31GPT-51Gradient Noise Scale1GUI Agent1Hallucination1Hardware1Harness1Harness Engineering1Harness Optimization1HBF1HBM1HDPO1Hedgehog1Hybrid Architecture1Hybrid Attention1Hybrid Model1Hypergraph1ICLR20231ICML20241IETF1Image Captioning1In-Context Learning1Information Bottleneck1Information Extraction1Information Theory1Inverse RL1Karcher Mean1Kimi1KL Divergence1Knowledge Integration1Large Vocabulary1Large-Batch Training1Latent Reasoning1Layout Detection1Lightning Attention1Linear RNN1LLaMA1LLM Agents1LLM Alignment1LLM Inference1LLM Routing1LLM Training1LLM推理1LLM規劃1Load Balancing1Long CoT1Long-Context1Long-Horizon Evaluation1LoopLM1Low-Cost Training1Mamba-21Mamba21MCTS1Memory Efficiency1Memory Wall1MergeKit1Meta-cognition1Meta-Cognition1Meta-Optimization1microVM1Mind Virus1Mixed-Task Agentic RL1Mixture-of-Experts1MLP1Model Ensemble1Model Routing1Monte Carlo Graph Search1MTP1Multi-Agent System1Multi-Capability1Multi-Head Attention1Multi-objective Optimization1Multi-token Prediction1Multilingual1Neural Computer1NeurIPS1NLP1OLMo1Olympiad1OmniDocBench1On-device1On-policy1On-Policy1On-Policy Distillation1On-Policy Learning1Open Recipe1Optimization1Optimization Dynamics1Optimizer1Parallelism1Parameter Efficiency1Pareto Frontier1Peer-Preservation1Performance-Cost1Policy Distillation1Position Interpolation1Position Paper1Preference Optimization1Pretraining Data1Probing1Process Reward1Processing-Near-Memory1Production1Prompt Engineering1Prompting1Protocol1Protocols1Provenance1Pruning1Quantization1Qwen2.51Qwen2.5-VL1Qwen31Qwen3.51RAG1Reasoning Model1Repeated Data1Replay1Representation Learning1Reward Design1Reward Hacking Defense1Riemannian Geometry1Ring Attention1RoPE1Routing1RTX 50901Rubric Reward1RULER1Safety1Schmidhuber1Security1Self-Distillation1Self-Improvement1Self-Instruct1Sequence Modeling1SGD1SIGMOD1Skill2Env1Skills1SLERP1Software Architecture1Software Engineering1Sparse1Sparse Attention1Sparse Autoencoder1Sparse Update1SQL1State Space Duality1Summarization1Survey1System Design1T51TCO1Test-time Scaling1Test-Time Training1Text-to-Image1Tülu1UDF1Universal Transformer1Video Model1Vision Transformer1Vision-Language1Visual Perception1VQA1Wan2.11Web Agent1Web Scraping1WSD Scheduler1Xiaohongshu1世界知識1中文評測1中期訓練1事實性1互動式環境1代理式推理1代理式搜尋1分散式檔案系統1初始化1判決預測1剪枝1加速1動態剪枝1台灣法律1合成任務1合成環境1向量量化1圖搜尋1基礎模型1基礎設施1多代理系統1安全性1容器1小型模型1小模型1工具使用1工具創建1思維鏈監控1成本效益1技術報告1指令遵循1推測式解碼1推測解碼1推理對齊1推理模型1推論加速1擴散模型1數據增強1數據生成1數據集生成1架構設計1模型再造1沙箱1法律 NLP1混合注意力1潛在推理1災難性遺忘1知行落差1知識整合1稀疏模型1程式碼代理1程式碼智能體1端側部署1策略發現1紅隊測試1終端代理1結構化剪枝1繁體中文1自動駕駛1自我進化1規劃1訓練策略1評測1詞彙擴充1資料合成1資料多樣性1資料生成1資料選擇1資訊理論1近鄰搜尋1零樣本1預訓練動態1高效訓練1黑盒模型1