首页
学习
活动
专区
圈层
工具
发布
首页标签大模型部署

#大模型部署

算法备案 20 个高频知识点:从判断到填表

AI算法大模型备案当当

不确定要不要办、不确定备哪一类、不确定某一栏怎么填、不确定手上这串数字是什么。每一个不确定都可能导致两种代价:多做了不需要做的事,或者做错了方向导致返工。

000

从序列模型到大语言模型:一次关于“注意力”的范式革命

飞猫警长

序列数据的本质特征是顺序性——词语的顺序承载意义,时间步的先后决定因果。RNN的设计直觉非常直接:维护一个隐藏状态 htht​,在每个时间步读取当前输入 xtx...

1100

大语言模型驱动钓鱼攻击对原生邮件过滤体系的挑战与防御路径

芦笛

中国互联网络信息中心 | 工程师 (已认证)

生成式人工智能降低了网络钓鱼攻击的技术门槛与实施成本,AI 生成钓鱼邮件在文本流畅度、目标定制化程度上已经逼近专业人工攻击者产出的恶意内容,企业云邮件平台内置的...

2900

Claude Haiku 5.5:单价只有 Sonnet 5.5 的 1/20,能力逼近 Kimi K3、超过同价的 GPT-6 Luna

用户4447475

它的单价只有 Sonnet 5.5 的二十分之一。提示词在 100k 以内,输入 $0.10、输出 $0.50(每百万 token)。

4600

EmbeddingGemma 2:740M 多模态嵌入怎么跑离线 RAG

用户8534050

EmbeddingGemma 2 是 Google DeepMind 于 2026 年 10 月 6 日发布的开放权重嵌入模型,Apache 2.0 许可,总参...

3810

端侧大模型部署踩坑实录:Qwen + OpenVINO 在 AI PC 上跑通本地推理

华东子

半年前我开始琢磨一件事:手上的推理需求里,有相当一部分根本不需要联网。合同条款比对、内部纪要整理、批量日志初筛——这些活儿有两个共同点:素材敏感,且重复率高。

5500

11 月 1 日三标同实施:安全评估、合规体系与风险管理,三份标准怎么配合

AI算法大模型备案当当

三份同日实施,不是排期上的巧合。把它们放在一起看,会发现它们各自填补的是一套体系里不同层的位置:

3600

给 Agent 选模型:先别问哪个聪明,问哪个你敢用

API老黑

这个问题其实很难回答,因为它往往问错了方向。大多数人把"选模型"当成选一个更聪明的聊天机器人——谁分数高选谁。但 Agent 不是聊天,选模型的标准完全不同。

3700

Mistral新王炸Le Chonk,被Claude和GPT甩出两条街

邵奈一

昨天,Mistral 冷不丁甩出了一只“肥猫”——Le Chonk(Mistral Large 4),1 万亿参数、49B 激活,号称“中国以外最强开源权重”。...

3700

AI 内容溯源与检测合规实操:从水印原理到接入清单

A88

如果你在做 UGC 平台、内容审核、出海产品,或者任何会对外发布 AI 生成内容的系统,这一两个月的变化和你直接相关。

5910

类Jev项目Kev从入门到实战(7):如何选型:决策树与 checklist

用户12796739

先确认任务形状:输出是「从 N 个选项里选一个」「是非判断」「打等级」三种之一?是,才继续。

5010

有没有比较好用的网页工作台?2026 年 9 月从零接入与配置指南

用户12788090

结论:如果你的需求是「一个入口直达 ChatGPT、Gemini、Claude.ai 等网页端,且境内网络直连、不用自己解决访问问题」,网页工作台这类产品可以满...

11910
领券