Qwen3:通义千问新一代开源大模型,思考与非思考一键切换
Qwen3 是阿里开源的全新大模型家族,原生支持混合推理——模型自己决定要不要深度思考,旗舰 MoE 版本在代码与数学任务上直接对标 DeepSeek-R1,覆盖从端侧到云端的全尺寸。
精选值得关注的 AI 开源项目与创意应用,每篇深度安利一个项目
Qwen3 是阿里开源的全新大模型家族,原生支持混合推理——模型自己决定要不要深度思考,旗舰 MoE 版本在代码与数学任务上直接对标 DeepSeek-R1,覆盖从端侧到云端的全尺寸。
Rebuff 是专为防御提示词注入而生的开源框架,通过启发式检测、向量相似度比对与外部 LLM 判定三层防线识别恶意指令,给所有把外部文本喂给大模型的应用加上一道保险。
PyRIT 是微软开源的 AI 红队自动化工具包,用一套可编排的攻击算子持续探测 LLM 的提示词注入、越狱与有害内容边界,把"攻击自己的模型"变成标准化的安全测试流程。
E2B 是专为 AI 智能体设计的代码解释沙箱,毫秒级启动一个隔离的云端环境让 Agent 安全地写代码、跑命令、开浏览器,内置文件系统与超时控制,Cursor 等产品的安全代码执行底座。
OpenManus 是社区复刻 Manus 的通用 AI 智能体,把规划、工具调用、浏览器操作、文件处理整合进一个极简 Python 框架,无需邀请码即可自己跑一个"数字员工",Agent 开源生态的爆款。
DeepSpeed 是微软开源的分布式深度学习优化库,ZeRO 显存优化让千亿级模型训练成为可能,同时提供推理、微调、稀疏加速全家桶,大模型训练框架的常青树。
TensorRT-LLM 是 NVIDIA 官方的大模型推理引擎,在 TensorRT 之上为 LLM 深度定制,把 FP8 量化、KV Cache、PagedAttention 等优化做到极致,是英伟达 GPU 上把吞吐榨干的首选。
WhisperX 在 OpenAI Whisper 之上加上了词级时间对齐、说话人分离与批量加速,把一段模糊的原始转录变成带时间戳、分角色、可直接上字幕的标准字幕文件,音视频内容生产者的效率神器。
ktransformers 是主打异构推理的开源框架,把稀疏大模型的计算智能分配到 CPU 与 GPU,用一台万元级家用主机就能流畅跑起 671B 的 DeepSeek,本地部署大模型的成本杀手。
FlashAttention 是 IO 感知的精确注意力算法,通过分块计算把访存开销降低一个数量级,让训练序列从 1K 突破到 128K,几乎每一代新大模型的训练与推理都离不开它。
第 11-20 篇,共 121 篇