成为VIP会员查看完整内容
VIP会员码认证
首页
主题
会员
服务
注册
·
登录
指令微调
关注
1
综合
百科
VIP
热门
动态
论文
精华
From Tokens to Regions: CUDA-Sensitive Instruction Tuning for GPU Kernel Generation
Arxiv
0+阅读 · 6月15日
Agentic Reinforcement Learning for Search Misaligns Instruction-Tuning
Arxiv
0+阅读 · 6月13日
Lost in the Flow with Code Talkers: Unveiling the Instruction-Tuning Tax of Large Language Models in Code Tasks
Arxiv
0+阅读 · 6月7日
Lius: Translation Model Based Instructional Lingustic Using Continual Instruction Tuning In Kupang Malay
Arxiv
0+阅读 · 6月10日
What Really Matters for Table LLMs? A Meta-Evaluation of Model and Data Effects
Arxiv
0+阅读 · 6月9日
Localizing Anchoring Pathways in Language Models
Arxiv
0+阅读 · 6月11日
Tool Calling is Linearly Readable and Steerable in Language Models
Arxiv
0+阅读 · 5月25日
A Controlled Study of Decoding-Time Truthfulness Methods on Instruction-Tuned LLMs
Arxiv
0+阅读 · 6月11日
Alignment midtraining for animals
Arxiv
0+阅读 · 4月22日
Evian: Towards Explainable Visual Instruction-tuning Data Auditing
Arxiv
0+阅读 · 4月22日
LuxIT: A Luxembourgish Instruction Tuning Dataset from Monolingual Seed Data
Arxiv
0+阅读 · 3月30日
Data Selection for Multi-turn Dialogue Instruction Tuning
Arxiv
0+阅读 · 4月19日
Misconception Acquisition Dynamics in Large Language Models
Arxiv
0+阅读 · 4月1日
Neuro-RIT: Neuron-Guided Instruction Tuning for Robust Retrieval-Augmented Language Model
Arxiv
0+阅读 · 4月2日
One Token Away from Collapse: The Fragility of Instruction-Tuned Helpfulness
Arxiv
0+阅读 · 4月14日
参考链接
提示
微信扫码
咨询专知VIP会员与技术项目合作
(加微信请备注: "专知")
微信扫码咨询专知VIP会员
Top