Megagon实验室的研究人员提出了一种创新框架Insight-RAG,从而更好地捕捉任务特定的细微信息,整合 … Continue reading “颠覆传统RAG,创新大模型检索增强—Insight-RAG”
![]()
Megagon实验室的研究人员提出了一种创新框架Insight-RAG,从而更好地捕捉任务特定的细微信息,整合 … Continue reading “颠覆传统RAG,创新大模型检索增强—Insight-RAG”
![]()
最近,北京大学陈宝权教授带领团队在三维形状生成和三维数据对齐方面取得新的突破。 近年来,智能三维形状生成(3D … Continue reading “北大团队引领3D生成与对齐革新:OctGPT打破扩散模型垄断”
![]()
只靠模型尺寸变大已经不行了?大语言模型(LLM)推理需要强化学习(RL)来「加 buff」。 著名 AI 研究 … Continue reading “Sebastian Raschka长文:DeepSeek-R1、o3背后,RL推理训练正悄悄突破上限”
![]()
Hyper-RAG利用超图同时捕捉原始数据中的低阶和高阶关联信息,最大限度地减少知识结构化带来的信息丢失,从而 … Continue reading “让DeepSeek更可靠!清华提出Hyper-RAG,用超图提升知识建模精准度”
![]()
经验时代标志着人工智能发展的一个关键转折点。在现有的坚实基础上,智能体将超越人类生成数据的局限性,越来越多地从 … Continue reading “智能体版《苦涩的教训》,图灵奖得主Sutton、谷歌RL大佬Silver新作:超人智能靠经验”
![]()
华为利用纯昇腾集群训练出的盘古Ultra,在数学竞赛、编程等推理任务当中,和R1打得有来有回。 密集模型的推理 … Continue reading “英伟达含量为零!华为密集模型性能比肩DeepSeek-R1,纯昇腾集群训练”
![]()
在这个竞技场上,我们发现前段时间排到第二名的模型 —— 拥有 17B 参数的 HiDream-I1 和 GPT … Continue reading “「开源版GPT-4o」来了!这个17B国产模型生图效果比肩4o,还可商用”
![]()
清华大学联合上海 AI Lab 提出生成式过程奖励模型 ——GenPRM,将生成式思维链推理(CoT)与代码验 … Continue reading “过程奖励模型也可以测试时扩展?清华、上海AI Lab 23K数据让1.5B小模型逆袭GPT-4o”
![]()
近日,EAGLE 团队的新作《EAGLE-3: Scaling up Inference Accelerati … Continue reading “大模型推理无损加速6.5倍!EAGLE-3碾压一切、延续Scaling Law能力”
![]()
来自中国科学技术大学MIRA实验室的王杰教授团队提出了提出了一个创新的框架——知识图谱驱动的监督微调(KG-S … Continue reading “中科大ICLR2025:特定领域仅用5%训练数据,知识准确率提升14%”
![]()