微软 DKI 团队、香港中文大学(深圳)贺品嘉教授团队与清华大学裴丹教授共同提出了当前首个公开的、用于评估 L … Continue reading “连Claude 3.5都败下阵来,大语言模型能否定位软件服务的故障根因?”
![]()
微软 DKI 团队、香港中文大学(深圳)贺品嘉教授团队与清华大学裴丹教授共同提出了当前首个公开的、用于评估 L … Continue reading “连Claude 3.5都败下阵来,大语言模型能否定位软件服务的故障根因?”
![]()
近年来,大型语言模型(LLM)迅速兴起,带动了生产率的大幅提高。编程助手的蓬勃发展,数百万个多行代码块通过按键 … Continue reading “为什么人工智能生成的代码不够好?如何变得更好?”
![]()
研究发现,LLM在创作梗图时表现出惊人的幽默感与创造力,甚至超越了人类创作者!AI创作的梗图评分更高,但最具灵 … Continue reading “AI比人类更会玩梗!模因图灵测试已被攻破,研究发现LLM表情包更搞笑”
![]()
本文将归纳对比LLM定制开发常用的六种基本策略,包括提示工程、解码策略、RAG、代理、微调和RLHF。 &nb … Continue reading “六种LLM定制开发基本策略:提示工程、解码策略、RAG、代理、微调和RLHF”
![]()
DeepSeek的R1模型在不需要人类反馈的情况下就能进行更深思熟虑的推理,已颠覆了大语言模型(LLM)领域。 … Continue reading “DeepSeek级AI?训练自己的推理模型仅需七个步骤”
![]()
复旦新研究揭示了AI系统自我复制的突破性进展,表明当前的LLM已具备在没有人类干预的情况下自我克隆的能力。这不 … Continue reading “AI已学会自我复制!复旦新研究:开源LLM克隆成功率最高90%”
![]()
图数据库的剪枝可以通过移除不相关数据来优化LLM中的知识表示,从而实现更快、更集中的知识检索。本文探讨了剪枝知 … Continue reading “图数据库的剪枝在大型语言模型中的知识表示”
![]()
如今,AI工具已变得司空见惯,你可能每天都在使用它们。保护你的个人和商业机密数据的关键途径之一,就是在自己的基 … Continue reading “如何使用Ollama在个人计算机上运行开源LLM”
![]()
本文介绍了为什么批处理范式已过时,它如何阻碍AI应用,以及为什么AI的未来需要一种实时事件流平台。   … Continue reading “别再将LLM当成数据库了”
![]()
随着大型语言模型(LLMs)在AI应用领域持续发展,其计算成本也呈现显著上升趋势。数据分析表明,GPT-4的运 … Continue reading “TurboAttention:基于多项式近似和渐进式量化的高效注意力机制优化方案,降低LLM计算成本70%”
![]()