私有化部署与安全
数据主权与合规审计是金融、制造、政企等核心行业引入 AI 的底线要求。本专栏系统探讨开源大模型(如 DeepSeek、Qwen、Llama)本地化部署、GPU 算力成本优化、企业内网权限隔离、敏感数据脱敏与防护沙箱,为企业在完全物理隔离或专有云环境中搭建自主可控的 AI 基础设施提供安全合规的落地支撑。
积墨 AI 智能体开发平台
快速搭建具备商业价值的 AI 智能体,支持复杂工作流编排、50+ 主流模型接入与私有化部署。
- tutorial
OpenMAIC背后的教育大模型CogEvol:断网本地部署新方案
深度解析登顶GitHub趋势榜的教育开源项目OpenMAIC,揭示其背后CogEvol教育垂域模型的技术演进、本地部署方案及对教育AI生态的深远意义。
阅读全文 - tutorial
用一段说话声,完整复刻一首歌:AI翻唱技术实战指南
深入解析 Singing Voice Conversion 技术链路,从人声分离、声纹转换到混音输出,手把手教你用 Demucs + Seed-VC 在本地完成一次真实的 AI 翻...
阅读全文 - insight
开完一小时会还要重听录音补纪要:这个本地工具帮你
Meetily是一款开源本地会议工具,支持实时转写、带时间戳回溯、会后自动生成摘要待办,全程本地处理保障数据安全。
阅读全文 - insight
AI Agent安全的新挑战:提示词注入攻击防护实践
随着AI Agent从对话助手演进为具备行动能力的智能体,提示词注入攻击已成为不可忽视的系统性安全威胁。本文深入分析该攻击的技术原理、风险分类及纵深防护方案。
阅读全文 - insight
2万星标的Mac大模型服务器:让Apple Silicon化身本地AI工作站
oMLX开源项目让Apple Silicon Mac秒变本地大模型服务器,三步启动告别云端依赖,KV缓存设计专为AI编程长对话优化。
阅读全文 - tutorial
Speech-to-Speech:用开源模型搭建低延迟实时语音智能体
深入解析Hugging Face开源的speech-to-speech框架,剖析四级级联架构原理、插话打断机制与性能调优策略,助力开发者快速构建生产级语音智能体。
阅读全文 - insight
阿里Qwen3.8-27B疯了:笔记本就能跑,能力却直逼Opus4.6
阿里开源的27B参数大模型性能直逼顶级闭源模型,经量化压缩后仅需8GB显存即可运行,标志着本地AI应用的关键突破。
阅读全文 - tutorial
DeepSeek与Pi Agent本地部署深度优化实战
将DeepSeek上下文扩展至328K、默认开启推理模式与自动工具调用,本地部署实现每秒60 tokens推理速度,日均成本仅1.9元。
阅读全文 - tutorial
DSH Desktop:让AI Agent真正走进个人电脑
无需配置环境、无需编写代码,只需双击图标即可在本地运行强大的AI助手。DSH Desktop基于DeepSeek开源框架,为个人用户提供了零门槛的本地AI Agent体验。
阅读全文 - tutorial
5分钟快速部署DeepSeek Harness:让AI工具真正派上用场
DeepSeek Harness以「一切皆插件」为核心理念,通过简洁的安装流程和灵活的插件生态,让AI工具告别闲置,真正融入日常工作。
阅读全文 - insight
消费级硬件跑满血大模型:开源系统FreeToken打破部署壁垒
UC Berkeley、MIT等机构联合开源FreeToken系统,实现单卡RTX 5090运行284B参数MoE大模型,首Token延迟降低42-58%。
阅读全文 - tutorial
FunASR语音识别本地部署实战:34分钟录音压测复盘与生产环境避坑指南
深入实测FunASR本地部署性能表现,解析413错误处理方案、RTF性能边界、说话人分离实现路径,以及上线前必须关注的关键配置与避坑要点。
阅读全文 - tutorial
仅需17GB显存:如何在消费级设备上本地运行Qwen3.8-27B大模型
通过Unsloth 4-bit GGUF量化技术,27B参数大模型可压缩至17GB显存需求,让消费级显卡和Mac设备也能本地运行强大AI能力。
阅读全文 - insight
MOSS-Transcribe-Diarize:本地离线语音转文字终极方案
MOSS-Transcribe-Diarize整合包实现一键本地部署,精准区分说话人并标注时间戳,完美适配会议录音场景。中文识别准确率高,资源占用低,支持多种导出格式。
阅读全文 - solution
开源 AI 会议助手 Meetily:让会议记录从此无忧
一款获得超过 22K Stars 的开源 AI 会议助手,支持全本地运行、实时转录和智能总结,彻底解决会议记录痛点与数据隐私担忧。
阅读全文 - insight
本地AI新纪元:17GB显存即可运行的顶级27B多模态模型
阿里开源Qwen3.8-27B原生多模态大模型,仅需17GB内存即可本地运行,性能超越前代且支持商用,消费级硬件即可部署。
阅读全文 - tutorial
Qwen3.8-27B首日支持:OpenVINO让新一代大模型即刻跑上Intel AI PC
阿里巴巴千问团队发布的Qwen3.8-27B原生多模态大模型,结合OpenVINO工具链实现轻量化本地部署,让复杂的多模态推理任务在普通AI PC上即可高效运行。
阅读全文 - tutorial
MinerU本地部署完全指南:Docker方式快速搭建文档解析服务
详细介绍MinerU的Docker本地部署方法,涵盖GPU版本和CPU版本的完整部署步骤,帮助快速搭建高效的文档解析服务。
阅读全文 - insight
DeepSeek V4 Flash 开源:消费级硬件也能跑前沿大模型
DeepSeek V4 Flash 正式开源,配合 KTransformers 实现原生无损支持,让前沿大模型在消费级硬件上流畅运行,部署门槛大幅降低。
阅读全文 - tutorial
当大模型迈入万亿参数时代:普通电脑的AI部署指南
Qwen3.8-Max和Kimi K3等旗舰模型参数已突破TB级别,普通电脑难以承载。本文深入分析MoE架构下的真实硬件门槛,并给出个人电脑适配模型的选择标准与实践建议。
阅读全文 - tutorial
AI伦理审查新规落地:30天倒计时与四类高风险系统,企业合规自查指南
《人工智能科技伦理审查与服务管理办法》正式实施,将伦理审查从行业倡议转为法定流程。本文解析三类高风险AI系统及企业亟需自查的四个合规盲区。
阅读全文 - tutorial
Agent审计:从海量噪音中捞出真风险
深度解析Coding Agent安全审计的核心方法论,探讨如何通过构建完整行为事实底座与精准上下文判定,从海量日志中识别真正的高危风险事件。
阅读全文 - report
AI驱动的智能渗透验证:重新定义网络安全测试新范式
传统安全检测已无法应对AI时代的新型安全风险。本文探讨基于大模型驱动的智能渗透验证技术,如何通过多Agent协同架构实现从“漏洞点”到“攻击链”的完整还原。
阅读全文 - tutorial
前沿模型筑墙:AI开发者如何应对开源收紧与合规新局
OpenAI等巨头通过Frontier Model Forum将对抗蒸馏列为违规行为,标志着前沿AI从开放共享转向围墙花园。开发者需重构模型策略,从单点依赖转向多源架构与智能体系统...
阅读全文 - tutorial
在 OpenCode 中接入本地模型:Ollama 部署与配置完全指南
详解如何在 OpenCode 中接入本地 Ollama 模型,从安装部署到配置调优,助你15分钟完成本地 AI 编码助手搭建。
阅读全文 - insight
Gemma 4 26B QAT 本地部署实战:32GB 显卡也能跑出旗舰级性能
本文详细记录了在消费级双卡32GB显存环境下,成功部署Gemma 4 26B QAT量化模型的全过程,实测首字时延仅433ms、生成速度达156 tokens/s,开创了本地大模型...
阅读全文 - insight
英伟达开源SkillSpector:一款让Agent Skill安全无处遁形的扫描利器
英伟达开源的SkillSpector能够对Agent Skill进行全方位安全扫描,在4万多个样本中发现每4个Skill就有1个存在漏洞,带可执行脚本的漏洞概率更高。
阅读全文 - tutorial
Gemma 4 QAT模型正式发布:让大语言模型在手机和消费级GPU上流畅运行
Google DeepMind推出量化感知训练优化的Gemma 4 QAT模型,将E2B模型内存占用降至1GB,让大语言模型真正实现本地化部署。
阅读全文 - report
【报告】养马专题:Hermes Agent品牌研究报告:会自我进化的开源AI智能体
报告深入解析 Hermes Agent 的开源框架、闭环学习与持久记忆能力,指出其本地部署与自我进化特性在开发者与隐私敏感场景中具有强吸引力,并梳理了其快速增长的开源社区影响力
阅读全文 - insight
长亮科技金融智能体引爆2026中国国际金融展!
长亮科技在2026中国国际金融展发布面向经营分析、营销与风控等多场景的金融智能体平台,通过Workspace-as-a-Service架构与通用大脑+规则塑化模式,实现可视化、可审...
阅读全文 - report
26.1%的AI编程技能存在漏洞:NVIDIA开源SkillSpector能扫出什么?
NVIDIA研究发现超过四分之一的AI技能包存在已知安全漏洞,开源工具SkillSpector通过三层检测架构为AI编程安全保驾护航。
阅读全文 - insight
2部全国首部AI合规标准启动编制,公开征集起草单位、起草人
全国首部两项 AI 合规标准启动编制,涵盖生成式 AI 产品与 AIGC 内容合规管理,旨在建立全生命周期合规框架以应对智能体越权与情感诱导等风险
阅读全文 - insight
蠡开安全芯片护航智能体AI发展
基于国产抗量子安全芯片的多智能体可信通信方案,解决身份与能力核验、过程追溯等关键问题,为联网智能体协作提供端到端的加密与可信验证保障,推动行业安全能力升级
阅读全文 - insight
英伟达发布RTX Spark:个人电脑的全新时代来临
英伟达在GTC台北大会上发布RTX Spark消费级AI芯片,首次实现统一内存架构与CUDA生态的结合,让百亿级大模型在个人电脑上流畅运行成为可能。
阅读全文 - release-note
OpenClaw 2026.3.11 版本重磅更新:安全修复+Ollama本地部署+iOS焕新
OpenClaw发布最新版本,带来7项安全修复与14+新功能,涵盖WebSocket高危漏洞修复、Ollama本地部署、iOS/macOS界面全面升级等重磅更新。
阅读全文 - tutorial
Windows系统OpenClaw本地部署完全指南
本文详细介绍如何在Windows系统上快速部署OpenClaw,从环境准备到AI模型配置,再到飞书机器人接入,全程实操指导。
阅读全文 - insight
当零信任遇见 AI Agent:企业安全边界的新一轮下沉
随着 AI Agent 逐步进入企业核心业务系统,Google 提出将零信任边界从应用层下沉至动作层,为 AI 时代的企业安全架构指明新方向。
阅读全文 - insight
达实智能召开生态伙伴大会,“AI+平台”实现快速迭代
达实智能展示AI Agent 2.0两月内的快速迭代成果,AIoT平台通过模型与智能体引擎支撑多场景应用,能耗诊断与全局寻优等模块获得客户高度采纳
阅读全文 - insight
据称推进微信 AI Agent,14 亿用户入口待合规
腾讯正在内部测试微信AI Agent原型,若能进入小程序与支付等工作流,将把14亿用户入口转化为可付费的智能体服务,计划在2026年6月启动合规流程以推动正式落地
阅读全文 - insight
据称推进微信 AI Agent,14 亿用户入口待合规/SpaceX IPO 拟募 750 亿美元,每股 135 美元/阿里发布 Qwen3.7-Plus,1M 上下文和多模态
消息称腾讯正在测试微信 AI Agent 原型,计划在完成合规流程后向 14 亿用户分发,若能将 Agent 深度接入小程序与支付,可能形成新的可收费行为并显著影响用户生态
阅读全文 - tutorial
自主智能体AI系统安全部署指南:五国联袂发布权威框架
澳大利亚、美国、加拿大、新西兰、英国五国网络安全机构联合发布《审慎部署智能体AI服务》指南,为基于大语言模型的自主智能体AI系统提供全面的安全风险分析与最佳实践指导。
阅读全文 - tutorial
当AI Agent越来越能干,你敢放心放手吗?
随着AI Agent能力边界不断扩展,一个悖论正在浮现:它们越强大,人类越不敢放权。ANOLISA v0.3版本通过四层安全防护体系、Token消耗可视化以及工作区快照功能,为这一...
阅读全文 - insight
黄仁勋与高通同日宣布2026 为 “智能体 AI 元年”!AI 正从 “聊天” 走向 “执行任务”,算力战场全面切换
英伟达与高通在GTC与COMPUTEX上几乎同时将2026年定为智能体AI元年,指出AI应用重心正从生成内容转向执行任务,推动推理算力、长链规划与多智能体协同成为新一轮算力竞争核心
阅读全文 - insight
OpenClaw.NET:AI工作流程机器人的网关架构深度解析
OpenClaw.NET是基于.NET 9的自托管AI Agent网关,采用模块化分层设计与NativeAOT,围绕Webhook体系、内存审批门与工具执行运行时构建生产级网关,提...
阅读全文 - tutorial
英特尔AI PC专区:专治本地模型跑不动、智能体做不出、新模型不会用
针对端侧AI开发中的模型运行慢、智能体构建难、新模型不会用三大痛点,提供一站式实战工具箱
阅读全文 - insight
AI Open Day兰州龙虾大会圆满举办,共绘西北数字经济新蓝图
AI Open Day 兰州龙虾大会聚焦OpenClaw智能体的落地与安全实践,多家企业展示全链路防护与场景化应用,为西北地区搭建技术生态与产业化通道,推动本地数字经济与AI能力下...
阅读全文 - tutorial
Claude Code云端部署与HTTP流式调用实战指南
深度解析如何将 Claude Code 从本地 CLI 工具转变为云端 HTTP 流式服务,涵盖离线部署、FastAPI 服务封装、沙箱隔离与用户文件版本化存储等关键技术。
阅读全文 - solution
华为联合行业机构重磅发布OpenClaw安全解决方案技术白皮书,构筑AI Agent智能安全防护体系
华为联合国家级安全实验室与高校发布OpenClaw安全白皮书,提出网络、Agent、主机三层围栏架构并给出部署规范与全生命周期运维建议,为AI Agent安全治理与合规落地提供系统...
阅读全文 - insight
盘古信息IMS V6 8.0重磅发布:以薪火AI数智平台点燃离散制造数智化引擎
盘古信息发布IMS V6 8.0薪火AI数智平台,将AI能力注入生产、质量与设备管理等全流程,依托智能体矩阵与本地私有化推理引擎推动离散制造的数智化转型与业务能力跃升
阅读全文 - insight
研华MIC系列边缘AI平台依托OpenClaw与英伟达Nemotron,加速智能体AI落地
研华推出MIC系列边缘AI平台,集成OpenClaw与英伟达Nemotron,支持Jetson模块与安全运行时,实现模型推理到任务执行的边缘级智能体部署与自动化决策
阅读全文 - insight
联想 × 此芯 Agentic SoC P1 全球首发AI主机,高算力+超便携,树立 Agentic Compute 行业新标杆
联想与此芯联合发布基于Agentic SoC P1的高性能智能体终端,P7与mini支持本地大模型部署、190 TOPS算力与低功耗,标志端侧智能体计算新时代的来临
阅读全文 - tutorial
Hermes Agent + Ollama 本地安装指南
深入解析 Hermes Agent 三大核心特性:自动学习技能、三层记忆结构与多平台支持,手把手教你如何在本地部署这个会学习的 AI 助手。
阅读全文 - insight
零一万物与AMD联合发布Cube01:李开复博士与苏姿丰博士同台共话多智能体时代的智算基础设施
在AMD AI开发者日2026上,零一万物与AMD联合发布Cube01,结合锐龙AI Max处理器与万智智能体平台,提出软硬一体化、多智能体协同的企业级私有化智算方案,旨在推动AI...
阅读全文 - insight
从《智能体新规》看AI智能体的风险防范与合规治理(上)
基于《智能体规范应用与创新发展实施意见》,文章系统梳理智能体的内生风险、供应链与应用衍生风险,提出企业在数据治理、权限管理、模型边界与可控机制上构建合规框架的实务建议,帮助组织降低...
阅读全文 - insight
健康有益科博会重磅发布 Health AI 健康智能体开放平台
健康有益在科博会上发布Health AI开放平台,基于Health Hope大模型与多模态能力,面向政府、企业与开发者开放API/SDK与私有化部署,推动健康场景的智能体应用落地
阅读全文 - insight
博云发布 BoAgent 智能体平台 以安全可信 Agentic AI 重构企业数字生产力
博云推出 BoAgent 平台,提供感知-思考-规划-执行-记忆全闭环能力,支持私有化部署与国产算力,面向政企级场景推动智能体在业务自动化与数字化转型中的落地
阅读全文 - tutorial
本地4B开源模型实现端侧GUI操作:告别Token焦虑,数据全程本地处理
开源端侧模型Mano-P可在Mac本地运行,纯视觉驱动操控任何应用界面,4B版本量化后仅占4.3GB内存,解决GUI自动化的高Token消耗和隐私泄露痛点。
阅读全文 - insight
英伟达发布首个量子AI开源模型;腾讯云开源Agent底座Cube Sandbox
汇总5月6日两大开源进展:英伟达发布量子AI开源模型,腾讯云开源Cube Sandbox作为生产级Agent底座,提升Agent部署的安全与可控性,推动企业级落地。
阅读全文 - release-note
Ollama 0.19 底层引擎大换血:苹果 M5 芯片如何实现本地大模型性能翻倍
Ollama 0.19 版本悄然将底层引擎从 llama.cpp 切换至苹果 MLX 框架,借助统一内存架构和 M5 芯片 GPU 神经加速器,实现本地大模型运行性能 57%-93...
阅读全文 - tutorial
当真人短剧遇到AI短剧,精品化如何实现?
本文分析微短剧市场中AI剧与真人剧的差异,探讨精品化与IP化道路,提出技术与内容结合的优化路径
阅读全文
