18202649300(张老师)
编排平台核心:低代码编排平台把 Agent 开发从写代码变成拖节点。四大平台定位:Dify:LLMOps 一站式,BaaS+API-first,适合对外对话应用
Agentic RAG核心:LLM 从"被喂数据的答题者"变为"检索决策者"。范式演进:Naive RAG(2023,单
红队攻防核心:越狱(Jailbreak)攻防是不对称战争——攻击者只需一个成功手法,防御者要堵住所有缺口。攻击演进:手工 Prompt(DAN) 自动化批量变体
开源与闭源模型生态2026 变局:开源从"追赶者"变"围剿者"。Hugging Face 春季报告:中国开源模型下载占比
垂直领域大模型格局:2026 上半年国内行业专属大模型超 1200 个,金融/制造/政务/医疗 AI 渗透率破 40%。McKinsey:垂直 AI 平均 RO
AI原生应用架构定义:AI 是产品核心逻辑而非附加功能。无 AI 则产品无意义(Cursor vs "带 AI 补全的编辑器")。与传统架构
内容溯源与水印背景:深度伪造检测军备竞赛已输——行业转向"证明什么是真的":创作时刻附加防篡改元数据 + 隐形水印,未签名内容默认视为未验证
思考型推理模型核心概念:Test-Time Scaling——不在训练期堆算力,而在推理期"多想"。o1/R1 范式:模型回答前生成不可见的
Embedding模型演进三代演进Word2Vec/GloVe:词级静态向量,无法处理多义词 ❌ELMo/BERT:上下文动态向量,但检索要两两拼接太慢 ❌SB
结构化输出与工具调用问题:纯 Prompt 求 JSON,成功率 85-95%——日 10 万次调用意味着 5000-15000 次失败(Markdown 包裹
视频生成模型技术路线已收敛(2026):GANDiffusionDiT。主流(Sora 2、Veo 3.1、可灵 3.0、Seedance 2.0)全部是 潜空
长上下文 vs RAG背景:2026 年主流前沿模型(GPT-5.5、Claude Opus 4.7、Gemini 3.1 Pro、DeepSeek V4)上下