Grilled Cheese

ExploreLog inSign up
Terms of UsePrivacy PolicyCommunity StandardsHelpGet the app

Grilled Cheese is a product of Village Compute

Version devBuilt at: 2026-10-10 01:38:52 EDT

Explore

PostsPeople
LatestRanked
@igrgavilan.bsky.socialOct 5, 2026, 7:30 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (y VI): destilado" ignaciogavilan.com/como-hacemos... #Distillation #Destilado #LRM #LargeReasoningModels #ReasoningModels #ModelosRazonadores #Entrenamiento #IA #AI

@igrgavilan.bsky.socialOct 5, 2026, 7:58 AM

Blue Chip]: "Cómo hacemos que un modelo razone (y VI): destilado" ignaciogavilan.com/como-hacemos... #Distillation #Destilado #LRM #LargereasoningModels #ReasoningModels #ModelosRazonadores #Entrenamiento #IA #AI

@igrgavilan.bsky.socialOct 4, 2026, 7:21 PM

La semana en [Blue Chip]. Jueves 1: "Cómo hacemos que un modelo razone (V): aprendizaje por refuerzo con feedback humano (RLHF)" ignaciogavilan.com/como-hacemos... #RLHF #ReinforcementLearning #ReasoningModels #ModelosRazonadores #LRM #LargeReasoningModels #LLM #LargeLanguageModels #IA #AI

@igrgavilan.bsky.socialOct 4, 2026, 7:19 PM

La semana en [Blue Chip]. Lunes 28-Sep: "Cómo hacemos que un modelo razone (IV): aprendizaje por refuerzo basado en recompensas verificables (RLVR)" ignaciogavilan.com/como-hacemos... #RLVR #GRPO #ReinforcementLearning #AprendizajePorRefuerzo #ModelosRazonadores #ReasoningModels #IA #AI #LLM

@igrgavilan.bsky.socialOct 1, 2026, 9:26 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (V): aprendizaje por refuerzo con feedback humano (RLHF)" ignaciogavilan.com/como-hacemos... #RLHF #ReinforcementLearning #ReasoningModels #ModelosRazonadores #LRM #LargeReasoningModels #LLM #LargeLanguageModels #IA #AI

@igrgavilan.bsky.socialOct 1, 2026, 9:02 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (V): aprendizaje por refuerzo con feedback humano (RLHF)" ignaciogavilan.com/como-hacemos... #RLHF #ReinforcementLearning #ReasoningModels #ModelosRazonadores #LRM #LargeReasoningModels #LLM #LargeLanguageModels #IA #AI

@igrgavilan.bsky.socialSep 28, 2026, 8:31 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (IV): aprendizaje por refuerzo basado en recompensas verificables (RLVR)" ignaciogavilan.com/como-hacemos... #RLVR #GRPO #ReinforcementLearning #AprendizajePorRefuerzo #ModelosRazonadores #ReasoningModels #IA #AI #LLM

@igrgavilan.bsky.socialSep 28, 2026, 7:58 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (IV): aprendizaje por refuerzo basado en recompensas verificables (RLVR)" ignaciogavilan.com/como-hacemos... #RLVR #GRPO #ReinforcementLearning #AprendizajePorRefuerzo #ModelosRazonadores #ReasoningModels #IA #AI #LLM

@igrgavilan.bsky.socialSep 23, 2026, 7:19 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (III): auto-refinamiento" ignaciogavilan.com/como-hacemos... #ReasoningModels #ModelosRazonadores #SelfRefinement #Autorefinamiento #LLM #LargeLanguageModels #GenerativeAI #GenAI #AI

@igrgavilan.bsky.socialSep 21, 2026, 9:33 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (II): técnicas de prompting" ignaciogavilan.com/como-hacemos... #ReasoningModels #ModelosRazonadores #LLMs #LargeLanguageModels #AI #CoT #ChainOfThought #SelfConsistency #Thinking #Reasoning

@igrgavilan.bsky.socialSep 20, 2026, 8:08 PM

La semana en [Blue Chip]. Miércoles 16: "Cómo hacemos que un modelo razone (I): tres grandes estrategias" ignaciogavilan.com/como-hacemos... #AI #ArtificialIntelligence #LLM #ReasoningModels #ModelosRazonadores #AgenticAI

@igrgavilan.bsky.socialSep 16, 2026, 8:16 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (I): tres grandes estrategias" ignaciogavilan.com/como-hacemos... #AI #ArtificialIntelligence #LLM #ReasoningModels #ModelosRazonadores #AgenticAI

@igrgavilan.bsky.socialSep 16, 2026, 7:39 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (I): tres grandes estrategias" ignaciogavilan.com/como-hacemos... #AI #ArtificialIntelligence #LLM #ReasoningModels #ModelosRazonadores #AgenticAI

@igrgavilan.bsky.socialSep 13, 2026, 7:46 PM

La semana en [Blue Chip]. Miércoles 9: "Algunas limitaciones en los modelos razonadores… de momento" ignaciogavilan.com/algunas-limi... #LLM #LRM #ReasoningModels #LargeReasoningModels #ModelosRazonadores #IA #IA #GenerativeAI

@igrgavilan.bsky.socialSep 9, 2026, 8:05 PM

Hoy en [Blue Chip]: "Algunas limitaciones en los modelos razonadores… de momento" ignaciogavilan.com/algunas-limi... #LLM #LRM #ReasoningModels #LargeReasoningModels #ModelosRazonadores #IA #IA #GenerativeAI

@igrgavilan.bsky.socialSep 9, 2026, 9:53 AM

[Blue Chip]: "Algunas limitaciones en los modelos razonadores... de momento" ignaciogavilan.com/algunas-limi... #LLM #LRM #ReasoningModels #LargeReasoningModels #ModelosRazonadores #IA #IA #GenerativeAI

@igrgavilan.bsky.socialSep 3, 2026, 7:43 AM

Reading "The Illusion of Thinking: Understanding the Strengths and Limitations of Reasoning Models via the Lens of Problem Complexity" (arxiv.org/abs/2506.06941) #LRM #LargeReasoningModels #LLM #LargeLanguageModels #ModelosRazonadores #IA #AI #ArtificialIntelligence #InteligenciaArtificial