腾讯 | 前端研发 (已认证)
温馨提示:另有配套视频版,附带图解演示,观感不同,欢迎到各大视频平台搜索同名标题或【蛋先生说识】
生成式AI应用已经从问答和内容生成,扩展到办公协作、客服、营销、搜索、知识库、数据分析和Agent执行。业务能力越强,安全边界越重要。一个AI应用如果能读取文档...
我建议别。过去这两周我用自研的对抗性审查流程做了三场「让 AI 审 AI」的实测,结果很有说服力:
两个月前,我试着让大语言模型(LLM)做一件很小的事——从一段文字中,推测作者最可能的三种情绪,并给出概率。不是分析情感极性(积极/消极),而是更细腻的标签,比...
大型语言模型(LLM)在预训练阶段从海量文本中学习了丰富的语言知识和世界知识,但它们本质上是一个“通才”——能回答通用问题,但在特定领域(如医疗、法律、金融)往...
调优不当的输入管道可能浪费 50% 的 GPU 时间,而算法优化通常只给几个百分点
算法备案不是简单的 "填表交材料",而是对算法安全主体责任的系统验收。2026 年监管口径明显收紧,主要体现在三个方面:
本文以产品经理视角,拆解垂直产业资讯平台「信舆融媒」的产品设计。它做的事情不性感:不追热点、不做 App、不做推荐算法。但它在 5 个月里沉淀了 2,265 篇...
csig | 服务端开发 (已认证)
2023年Meta发布LLaMA系列模型,标志着开源大模型时代的到来。LLaMA-1证明了使用公开数据训练可以接近GPT-3级别的性能;LLaMA-2引入了GQ...
在大模型应用落地的浪潮中,如何让通用大模型安全、准确地理解并使用企业私有数据,已成为技术团队的核心命题。检索增强生成(RAG)凭借其无需微调、知识实时更新、数据...
一个 72 卡的 NVIDIA NVL72 机柜,如果每张 GPU 需要 200 MB/s 的训练数据才不闲着,整个机柜需要 14 到 20 GB/s 的聚合存...
适用:中国大陆开发者,想用 Anthropic 官方 CLI(Claude Code)稳定接入 Claude,又不想折腾代理。目标:5 分钟跑通,提前避开高频坑...
随着生成式AI、大语言模型等技术的快速普及,企业员工在日常工作中使用AI工具的场景日益增多。然而,随之而来的数据泄露、模型幻觉、合规风险等问题也日益突出。例如,...
人类聊天可以跨越数天、数月串联语境,记住对方的习惯、偏好、过往交流细节。但百亿、千亿参数的顶级大模型,裸调 API 永远 “即时失忆”。
随着《人工智能拟人化互动服务安全管理办法》正式实施,国内AI拟人化服务监管进入标准化、常态化、全生命周期治理阶段。