首页
学习
活动
专区
圈层
工具
发布
首页标签大模型部署

#大模型部署

大模型本地部署神器的瘦身进阶原理,就这两招?

蛋先生DX

腾讯 | 前端研发 (已认证)

温馨提示:另有配套视频版,附带图解演示,观感不同,欢迎到各大视频平台搜索同名标题或【蛋先生说识】

600

AI应用安全防护落地指南:企业需要重点评估哪些能力

AI风控技术笔记

生成式AI应用已经从问答和内容生成,扩展到办公协作、客服、营销、搜索、知识库、数据分析和Agent执行。业务能力越强,安全边界越重要。一个AI应用如果能读取文档...

1200

让 AI 审 AI:三场实测抓到需求做反、同源盲区与六类失效模式

斯晨的AI笔记

我建议别。过去这两周我用自研的对抗性审查流程做了三场「让 AI 审 AI」的实测,结果很有说服力:

900

当AI学会“猜词”:我用大模型做了一面情绪镜子

闪学it点com

两个月前,我试着让大语言模型(LLM)做一件很小的事——从一段文字中,推测作者最可能的三种情绪,并给出概率。不是分析情感极性(积极/消极),而是更细腻的标签,比...

200

大模型微调完全指南:从原理到实践,解锁领域专属AI

97java-xyz

大型语言模型(LLM)在预训练阶段从海量文本中学习了丰富的语言知识和世界知识,但它们本质上是一个“通才”——能回答通用问题,但在特定领域(如医疗、法律、金融)往...

1900

AI Infra 系列 · 第三章 存储层(下):训练慢别改学习率,先看 DataLoader

dongdonglog

调优不当的输入管道可能浪费 50% 的 GPU 时间,而算法优化通常只给几个百分点

1410

算法备案总被驳回?8 个高频驳回点一次说透(附提交前自查清单)

AI算法大模型备案当当

算法备案不是简单的 "填表交材料",而是对算法安全主体责任的系统验收。2026 年监管口径明显收紧,主要体现在三个方面:

2200

当AI开始替用户做决策,一个河南内容网站把自己做成了”信源”

信舆

本文以产品经理视角,拆解垂直产业资讯平台「信舆融媒」的产品设计。它做的事情不性感:不追热点、不做 App、不做推荐算法。但它在 5 个月里沉淀了 2,265 篇...

2400

LLaMA架构深度解析:从开源大模型设计到高效推理的工程实现全流程

百行代码

csig | 服务端开发 (已认证)

2023年Meta发布LLaMA系列模型,标志着开源大模型时代的到来。LLaMA-1证明了使用公开数据训练可以接近GPT-3级别的性能;LLaMA-2引入了GQ...

7910

大模型落地实战:基于腾讯云向量数据库与LangChain构建企业级RAG系统

科技酱

在大模型应用落地的浪潮中,如何让通用大模型安全、准确地理解并使用企业私有数据,已成为技术团队的核心命题。检索增强生成(RAG)凭借其无需微调、知识实时更新、数据...

8010

AI Infra 系列 · 第三章 存储层(上):GPU 饿着不是算法问题,是账单问题

dongdonglog

一个 72 卡的 NVIDIA NVL72 机柜,如果每张 GPU 需要 200 MB/s 的训练数据才不闲着,整个机柜需要 14 到 20 GB/s 的聚合存...

6720

国内直连 Claude Code:从零配置到稳定运行(2026 避坑版)

用户12711710

适用:中国大陆开发者,想用 Anthropic 官方 CLI(Claude Code)稳定接入 Claude,又不想折腾代理。目标:5 分钟跑通,提前避开高频坑...

8210

员工正在把公司机密“喂”给AI?——企业AI安全合规实战手册

悟空码字

随着生成式AI、大语言模型等技术的快速普及,企业员工在日常工作中使用AI工具的场景日益增多。然而,随之而来的数据泄露、模型幻觉、合规风险等问题也日益突出。例如,...

7120

为什么大模型不设计成带有记忆的?详解外置记忆最优架构方案

咕泡科技

人类聊天可以跨越数天、数月串联语境,记住对方的习惯、偏好、过往交流细节。但百亿、千亿参数的顶级大模型,裸调 API 永远 “即时失忆”。

6610

AI拟人化合规新规落地,企业如何完成安全自评估闭环?

AI算法大模型备案当当

随着《人工智能拟人化互动服务安全管理办法》正式实施,国内AI拟人化服务监管进入标准化、常态化、全生命周期治理阶段。

5910
领券