Grilled Cheese

ExploreLog inSign up
Terms of UsePrivacy PolicyCommunity StandardsHelpGet the app

Grilled Cheese is a product of Village Compute

Version devBuilt at: 2026-10-10 01:38:52 EDT

Explore

PostsPeople
LatestRanked
@singulism.bsky.socialOct 8, 2026, 7:39 PM

OpenAI Releases 337 Results on Unsolved Math Problems

#OpenAI #reasoningmodels #mathematics

https://singulism.com/en/2026-10-08-openai-math-results-release/

@igrgavilan.bsky.socialOct 5, 2026, 7:30 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (y VI): destilado" ignaciogavilan.com/como-hacemos... #Distillation #Destilado #LRM #LargeReasoningModels #ReasoningModels #ModelosRazonadores #Entrenamiento #IA #AI

@igrgavilan.bsky.socialOct 5, 2026, 7:58 AM

Blue Chip]: "Cómo hacemos que un modelo razone (y VI): destilado" ignaciogavilan.com/como-hacemos... #Distillation #Destilado #LRM #LargereasoningModels #ReasoningModels #ModelosRazonadores #Entrenamiento #IA #AI

@igrgavilan.bsky.socialOct 4, 2026, 7:21 PM

La semana en [Blue Chip]. Jueves 1: "Cómo hacemos que un modelo razone (V): aprendizaje por refuerzo con feedback humano (RLHF)" ignaciogavilan.com/como-hacemos... #RLHF #ReinforcementLearning #ReasoningModels #ModelosRazonadores #LRM #LargeReasoningModels #LLM #LargeLanguageModels #IA #AI

@igrgavilan.bsky.socialOct 4, 2026, 7:19 PM

La semana en [Blue Chip]. Lunes 28-Sep: "Cómo hacemos que un modelo razone (IV): aprendizaje por refuerzo basado en recompensas verificables (RLVR)" ignaciogavilan.com/como-hacemos... #RLVR #GRPO #ReinforcementLearning #AprendizajePorRefuerzo #ModelosRazonadores #ReasoningModels #IA #AI #LLM

@igrgavilan.bsky.socialOct 1, 2026, 9:26 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (V): aprendizaje por refuerzo con feedback humano (RLHF)" ignaciogavilan.com/como-hacemos... #RLHF #ReinforcementLearning #ReasoningModels #ModelosRazonadores #LRM #LargeReasoningModels #LLM #LargeLanguageModels #IA #AI

@igrgavilan.bsky.socialOct 1, 2026, 9:02 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (V): aprendizaje por refuerzo con feedback humano (RLHF)" ignaciogavilan.com/como-hacemos... #RLHF #ReinforcementLearning #ReasoningModels #ModelosRazonadores #LRM #LargeReasoningModels #LLM #LargeLanguageModels #IA #AI

@igrgavilan.bsky.socialSep 28, 2026, 8:31 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (IV): aprendizaje por refuerzo basado en recompensas verificables (RLVR)" ignaciogavilan.com/como-hacemos... #RLVR #GRPO #ReinforcementLearning #AprendizajePorRefuerzo #ModelosRazonadores #ReasoningModels #IA #AI #LLM

@igrgavilan.bsky.socialSep 28, 2026, 7:58 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (IV): aprendizaje por refuerzo basado en recompensas verificables (RLVR)" ignaciogavilan.com/como-hacemos... #RLVR #GRPO #ReinforcementLearning #AprendizajePorRefuerzo #ModelosRazonadores #ReasoningModels #IA #AI #LLM

@igrgavilan.bsky.socialSep 23, 2026, 7:19 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (III): auto-refinamiento" ignaciogavilan.com/como-hacemos... #ReasoningModels #ModelosRazonadores #SelfRefinement #Autorefinamiento #LLM #LargeLanguageModels #GenerativeAI #GenAI #AI

@igrgavilan.bsky.socialSep 21, 2026, 9:33 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (II): técnicas de prompting" ignaciogavilan.com/como-hacemos... #ReasoningModels #ModelosRazonadores #LLMs #LargeLanguageModels #AI #CoT #ChainOfThought #SelfConsistency #Thinking #Reasoning

@igrgavilan.bsky.socialSep 21, 2026, 6:44 AM

I've just finished "Build a Reasoning Model (from Scratch)" (www.amazon.es/Build-Reason...) by @rasbt.bsky.social Deep, development-oriented but with solid theoretical foundations #libros #books #AI #ReasoningModels #LLM #FrontierModels

@igrgavilan.bsky.socialSep 20, 2026, 8:08 PM

La semana en [Blue Chip]. Miércoles 16: "Cómo hacemos que un modelo razone (I): tres grandes estrategias" ignaciogavilan.com/como-hacemos... #AI #ArtificialIntelligence #LLM #ReasoningModels #ModelosRazonadores #AgenticAI

@igrgavilan.bsky.socialSep 16, 2026, 8:16 PM

Hoy en [Blue Chip]: "Cómo hacemos que un modelo razone (I): tres grandes estrategias" ignaciogavilan.com/como-hacemos... #AI #ArtificialIntelligence #LLM #ReasoningModels #ModelosRazonadores #AgenticAI

@igrgavilan.bsky.socialSep 16, 2026, 7:39 AM

[Blue Chip]: "Cómo hacemos que un modelo razone (I): tres grandes estrategias" ignaciogavilan.com/como-hacemos... #AI #ArtificialIntelligence #LLM #ReasoningModels #ModelosRazonadores #AgenticAI

@igrgavilan.bsky.socialSep 13, 2026, 7:46 PM

La semana en [Blue Chip]. Miércoles 9: "Algunas limitaciones en los modelos razonadores… de momento" ignaciogavilan.com/algunas-limi... #LLM #LRM #ReasoningModels #LargeReasoningModels #ModelosRazonadores #IA #IA #GenerativeAI

@igrgavilan.bsky.socialSep 9, 2026, 8:05 PM

Hoy en [Blue Chip]: "Algunas limitaciones en los modelos razonadores… de momento" ignaciogavilan.com/algunas-limi... #LLM #LRM #ReasoningModels #LargeReasoningModels #ModelosRazonadores #IA #IA #GenerativeAI

@igrgavilan.bsky.socialSep 9, 2026, 9:53 AM

[Blue Chip]: "Algunas limitaciones en los modelos razonadores... de momento" ignaciogavilan.com/algunas-limi... #LLM #LRM #ReasoningModels #LargeReasoningModels #ModelosRazonadores #IA #IA #GenerativeAI