Octopus v4: Graph of language models
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Wei, Li, Zhiyuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Octopus v2: On-device language model for super agent
por: Chen, Wei, et al.
Publicado: (2024)
por: Chen, Wei, et al.
Publicado: (2024)
Octopus: On-device language model for function calling of software APIs
por: Chen, Wei, et al.
Publicado: (2024)
por: Chen, Wei, et al.
Publicado: (2024)
Octopus v3: Technical Report for On-device Sub-billion Multimodal AI Agent
por: Chen, Wei, et al.
Publicado: (2024)
por: Chen, Wei, et al.
Publicado: (2024)
Developmental trajectories of decision making and affective dynamics in large language models
por: Wang, Zhihao, et al.
Publicado: (2025)
por: Wang, Zhihao, et al.
Publicado: (2025)
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)
por: Guo, Yue, et al.
Publicado: (2022)
Symbol tuning improves in-context learning in language models
por: Wei, Jerry, et al.
Publicado: (2023)
por: Wei, Jerry, et al.
Publicado: (2023)
On the steerability of large language models toward data-driven personas
por: Li, Junyi, et al.
Publicado: (2023)
por: Li, Junyi, et al.
Publicado: (2023)
Dynamic data sampler for cross-language transfer learning in large language models
por: Li, Yudong, et al.
Publicado: (2024)
por: Li, Yudong, et al.
Publicado: (2024)
Large language models have learned to use language
por: Lupyan, Gary
Publicado: (2025)
por: Lupyan, Gary
Publicado: (2025)
Tiny language models
por: Gross, Ronit D., et al.
Publicado: (2025)
por: Gross, Ronit D., et al.
Publicado: (2025)
Occam's Razor and Bender and Koller's Octopus
por: Guerzhoy, Michael
Publicado: (2024)
por: Guerzhoy, Michael
Publicado: (2024)
Context informs pragmatic interpretation in vision-language models
por: Tan, Alvin Wei Ming, et al.
Publicado: (2025)
por: Tan, Alvin Wei Ming, et al.
Publicado: (2025)
Can we teach language models to gloss endangered languages?
por: Ginn, Michael, et al.
Publicado: (2024)
por: Ginn, Michael, et al.
Publicado: (2024)
Do large language models resemble humans in language use?
por: Cai, Zhenguang G., et al.
Publicado: (2023)
por: Cai, Zhenguang G., et al.
Publicado: (2023)
Studies with impossible languages falsify LMs as models of human language
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
por: Bowers, Jeffrey S., et al.
Publicado: (2025)
Simple synthetic data reduces sycophancy in large language models
por: Wei, Jerry, et al.
Publicado: (2023)
por: Wei, Jerry, et al.
Publicado: (2023)
Measuring short-form factuality in large language models
por: Wei, Jason, et al.
Publicado: (2024)
por: Wei, Jason, et al.
Publicado: (2024)
Efficient argument classification with compact language models and ChatGPT-4 refinements
por: Pietron, Marcin, et al.
Publicado: (2024)
por: Pietron, Marcin, et al.
Publicado: (2024)
Why do language models perform worse for morphologically complex languages?
por: Arnett, Catherine, et al.
Publicado: (2024)
por: Arnett, Catherine, et al.
Publicado: (2024)
Prompting language influences diagnostic reasoning and accuracy of large language models
por: Bazoge, Adrien, et al.
Publicado: (2026)
por: Bazoge, Adrien, et al.
Publicado: (2026)
Squid: Long Context as a New Modality for Energy-Efficient On-Device Language Models
por: Chen, Wei, et al.
Publicado: (2024)
por: Chen, Wei, et al.
Publicado: (2024)
Large language models are not about natural language
por: Bolhuis, Johan J., et al.
Publicado: (2025)
por: Bolhuis, Johan J., et al.
Publicado: (2025)
Dissociating language and thought in large language models
por: Mahowald, Kyle, et al.
Publicado: (2023)
por: Mahowald, Kyle, et al.
Publicado: (2023)
InkubaLM: A small language model for low-resource African languages
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
por: Tonja, Atnafu Lambebo, et al.
Publicado: (2024)
Multilingual large language models leak human stereotypes across language boundaries
por: Cao, Yang Trista, et al.
Publicado: (2023)
por: Cao, Yang Trista, et al.
Publicado: (2023)
Effective vocabulary expanding of multilingual language models for extremely low-resource languages
por: Zheng, Jianyu
Publicado: (2026)
por: Zheng, Jianyu
Publicado: (2026)
Large language models in healthcare and medical domain: A review
por: Nazi, Zabir Al, et al.
Publicado: (2023)
por: Nazi, Zabir Al, et al.
Publicado: (2023)
Anthropocentric bias in language model evaluation
por: Millière, Raphaël, et al.
Publicado: (2024)
por: Millière, Raphaël, et al.
Publicado: (2024)
Open foundation models for Azerbaijani language
por: Isbarov, Jafar, et al.
Publicado: (2024)
por: Isbarov, Jafar, et al.
Publicado: (2024)
Demystifying optimized prompts in language models
por: Melamed, Rimon, et al.
Publicado: (2025)
por: Melamed, Rimon, et al.
Publicado: (2025)
Visualizing token importance for black-box language models
por: Rauba, Paulius, et al.
Publicado: (2025)
por: Rauba, Paulius, et al.
Publicado: (2025)
vLLM Hook v0: A Plug-in for Programming Model Internals on vLLM
por: Ko, Ching-Yun, et al.
Publicado: (2026)
por: Ko, Ching-Yun, et al.
Publicado: (2026)
Octo-planner: On-device Language Model for Planner-Action Agents
por: Chen, Wei, et al.
Publicado: (2024)
por: Chen, Wei, et al.
Publicado: (2024)
Why transformers are obviously good models of language
por: Hill, Felix
Publicado: (2024)
por: Hill, Felix
Publicado: (2024)
Oddballness: universal anomaly detection with language models
por: Graliński, Filip, et al.
Publicado: (2024)
por: Graliński, Filip, et al.
Publicado: (2024)
How much do language models memorize?
por: Morris, John X., et al.
Publicado: (2025)
por: Morris, John X., et al.
Publicado: (2025)
Universal computation is intrinsic to language model decoding
por: Lewandowski, Alex, et al.
Publicado: (2026)
por: Lewandowski, Alex, et al.
Publicado: (2026)
Automata-based constraints for language model decoding
por: Koo, Terry, et al.
Publicado: (2024)
por: Koo, Terry, et al.
Publicado: (2024)
Hyacinth6B: A large language model for Traditional Chinese
por: Song, Chih-Wei, et al.
Publicado: (2024)
por: Song, Chih-Wei, et al.
Publicado: (2024)
Humans overrely on overconfident language models, across languages
por: Rathi, Neil, et al.
Publicado: (2025)
por: Rathi, Neil, et al.
Publicado: (2025)
Ejemplares similares
-
Octopus v2: On-device language model for super agent
por: Chen, Wei, et al.
Publicado: (2024) -
Octopus: On-device language model for function calling of software APIs
por: Chen, Wei, et al.
Publicado: (2024) -
Octopus v3: Technical Report for On-device Sub-billion Multimodal AI Agent
por: Chen, Wei, et al.
Publicado: (2024) -
Developmental trajectories of decision making and affective dynamics in large language models
por: Wang, Zhihao, et al.
Publicado: (2025) -
Retrieval augmentation of large language models for lay language generation
por: Guo, Yue, et al.
Publicado: (2022)