首页
学习
活动
专区
圈层
工具
发布
首页标签大模型部署

#大模型部署

当AI开始替用户做决策,一个河南内容网站把自己做成了”信源”

信舆

本文以产品经理视角,拆解垂直产业资讯平台「信舆融媒」的产品设计。它做的事情不性感:不追热点、不做 App、不做推荐算法。但它在 5 个月里沉淀了 2,265 篇...

100

LLaMA架构深度解析:从开源大模型设计到高效推理的工程实现全流程

百行代码

csig | 服务端开发 (已认证)

2023年Meta发布LLaMA系列模型,标志着开源大模型时代的到来。LLaMA-1证明了使用公开数据训练可以接近GPT-3级别的性能;LLaMA-2引入了GQ...

1200

大模型落地实战:基于腾讯云向量数据库与LangChain构建企业级RAG系统

科技酱

在大模型应用落地的浪潮中,如何让通用大模型安全、准确地理解并使用企业私有数据,已成为技术团队的核心命题。检索增强生成(RAG)凭借其无需微调、知识实时更新、数据...

1500

AI Infra 系列 · 第三章 存储层(上):GPU 饿着不是算法问题,是账单问题

dongdonglog

一个 72 卡的 NVIDIA NVL72 机柜,如果每张 GPU 需要 200 MB/s 的训练数据才不闲着,整个机柜需要 14 到 20 GB/s 的聚合存...

1500

国内直连 Claude Code:从零配置到稳定运行(2026 避坑版)

用户12711710

适用:中国大陆开发者,想用 Anthropic 官方 CLI(Claude Code)稳定接入 Claude,又不想折腾代理。目标:5 分钟跑通,提前避开高频坑...

1800

员工正在把公司机密“喂”给AI?——企业AI安全合规实战手册

悟空码字

随着生成式AI、大语言模型等技术的快速普及,企业员工在日常工作中使用AI工具的场景日益增多。然而,随之而来的数据泄露、模型幻觉、合规风险等问题也日益突出。例如,...

2810

为什么大模型不设计成带有记忆的?详解外置记忆最优架构方案

咕泡科技

人类聊天可以跨越数天、数月串联语境,记住对方的习惯、偏好、过往交流细节。但百亿、千亿参数的顶级大模型,裸调 API 永远 “即时失忆”。

2400

AI拟人化合规新规落地,企业如何完成安全自评估闭环?

AI算法大模型备案当当

随着《人工智能拟人化互动服务安全管理办法》正式实施,国内AI拟人化服务监管进入标准化、常态化、全生命周期治理阶段。

1900

把 AI 搬进你的机房:一台 3×A5000 工作站,Workbuddy跑通文生图、文生视频与大模型

George代码游侠

不用上云、不写一行部署代码、不养一个 GPU 运维团队。 插电,开机,配一行地址——你的 AI 能力就在线了。

6410

从规则驱动到自主决策:基于 AI Agent 的下一代智能自动化架构与落地实践

AI指路人

脚本自动化(Scripting / Batch):基于硬编码与固定触发器(如 Shell、Python 脚本、Cron Job),处理确定性高、逻辑单一的任务。

6711

使用multica打造专属的AgentTeam

不做虫子

multica是一个智能平台,可以创建agent智能体,并且可以将多个agent组成一个小队,用来处理专门的场景。

5910

在PowerShell里用curl调AI接口为什么总报错?90%的人不知道这个别名

奋进者说

你照着教程在 PowerShell 敲 curl http://127.0.0.1:11434/api/tags -d '...',回车,报错"找不到参数 d"...

7200

16G内存硬上14B模型会怎样?我帮你试了,附内存-模型选型终结表

奋进者说

你听人说"14B 效果最好",想都没想就 ollama pull,结果一对话——鼠标拖都拖不动,系统卡到假死,只能强杀进程。你以为电脑坏了,其实根因一句话:运行...

6500

从单智能体到多智能体:LangChain/LangGraph/AutoGen/CrewAI大模型架构原理20.2

未闻花名

先说一个痛点,做过大模型开发的朋友们应该都有同感,最开始入门大模型应用开发,我们基本都是直接调用官方原生API。简单聊个天、回答个基础问题没问题,但真要落地到实...

20310
领券