
大模型在医学领域的应用
大模型在医学领域具有广阔前景,涵盖诊断、治疗方案设计、药物研发等场景。文章从临床辅助、科研分析及医学教育三个维度探讨了大模型的应用价值,并介绍了 BioBERT、GatorTron、BioMedLM 及 ClinicalGPT 等代表性模型及其特点与训练数据。
博客作者
锋芒毕露
371
已发布文章
12K
博客获赞
688K
博客浏览
第 17 页

大模型在医学领域具有广阔前景,涵盖诊断、治疗方案设计、药物研发等场景。文章从临床辅助、科研分析及医学教育三个维度探讨了大模型的应用价值,并介绍了 BioBERT、GatorTron、BioMedLM 及 ClinicalGPT 等代表性模型及其特点与训练数据。

Python 爬虫通过模拟浏览器请求获取网页数据。涵盖 HTTP 协议基础、Requests 库使用、正则与 XPath 解析、BeautifulSoup 及 Scrapy 框架架构。内容包含 GET/POST 请求示例、代理设置、多线程处理及分布式爬虫原理,适合初学者系统学习网络数据采集技术。

Windows 环境下 Python 环境的配置流程及 pip 包管理工具的安装方法。内容包括如何检查 Python 和 pip 版本、配置系统环境变量 Path、通过 ensurepip 或 get-pip.py 脚本安装 pip。此外,文章还列举了 pip 的常用命令如安装、卸载、升级及依赖导出,并补充了国内镜像源配置、权限错误处理以及虚拟环境的使用等最…

详细分析了 Python 兼职的市场现状与主流平台,涵盖猪八戒、时间财富网等渠道的特点与注意事项。文章构建了爬虫、办公自动化及数据分析三大核心技能体系,提供了基于 requests 和 pandas 的实战代码示例。同时强调了法律合规性、交易风险控制及需求沟通技巧,为技术从业者提供了从入门接单到长期发展的完整指导方案。

Git 引入安全更新后,当仓库目录所有者与当前用户不匹配时会报错。解析了 CVE-2022-24765 漏洞背景,提供了 Linux、Windows 及 Docker 环境下修改目录所有权和配置安全目录例外的具体命令,分析了不同方案的风险,并给出了 CI/CD 环境下的最佳实践建议,帮助开发者快速修复致命错误并保障开发安全。

介绍使用 Python 结合 Selenium 自动化操作浏览器,实现大麦网演出门票的自动抢票流程。主要涉及免登录 Cookie 保存、页面元素检测、购票按钮点击及订单确认等核心功能。通过面向对象编程封装 Concert 类,利用 pickle 持久化用户状态,减少重复登录步骤。代码包含环境配置、模块导入、登录逻辑、抢票循环及下单操作。需注意此类脚本仅用于技…

2024 年中国大模型行业应用案例白皮书覆盖头部云厂商、创业企业及运营商,涉及金融、能源、医疗等十大行业。内容包含大模型学习路线图,涵盖系统设计、提示词工程、平台开发、知识库构建、微调及多模态应用。配套资源包括视频教程、技术文档、电子书及面试题合集,旨在帮助开发者掌握全栈工程能力与垂直领域模型训练技能。

记录了从中小厂到大厂的跳槽面试经历,涵盖 Java 基础、Android 系统原理、网络通信、操作系统及设计模式等核心考点。内容包含简历投递策略、心态调整建议以及常见面试题的解题思路,旨在帮助开发者系统复习技术栈,提升面试通过率。文章详细解析了 HashMap 原理、Activity 生命周期、Handler 机制、HTTP 协议及常用设计模式,并提供了算法…

当前互联网行业裁员现象背后的宏观因素,指出反垄断与中小企业发展对岗位容量的影响。针对行业焦虑,强调了技术更新与学习能力的重要性,并详细梳理了 Android 及 Java 方向的技术成长路线,涵盖架构设计、性能优化及源码阅读等核心技能,为开发者提供客观的职业规划参考。

对比了 Jetpack Compose 和 Flutter 两大移动 UI 框架。从语言基础看,Compose 基于 Kotlin 服务于 Android 原生,Flutter 基于 Dart 实现跨平台。架构上两者均采用声明式 UI,但状态管理和导航方案有所不同。开发体验方面,Flutter 的热重载与 Compose 的实时预览各具优势。性能上,Comp…

分享了 ChatGLM-6B 大模型微调的实战经验,对比了 Freeze、P-Tuning 和 LoRA 三种参数高效微调方法在信息抽取任务上的表现。实验结果显示 P-Tuning V2 效果最佳,LoRA 在显存效率上具有优势,且微调过程未出现明显的灾难性遗忘。文章还汇总了可用的中文开源大模型、指令数据集及相关项目,为开发者提供技术参考和资源指引。

系统介绍了大模型的基础概念、发展历程、技术特点及核心原理。内容涵盖 Transformer 架构、自注意力机制、预训练与微调流程、RAG 与 Agent 应用实践。详细阐述了大模型在自然语言处理、计算机视觉等领域的场景,分析了算力、安全、幻觉等挑战。提供了从基础理解到 API 开发、私有化部署及进阶优化的完整学习路线,旨在帮助读者全面掌握大模型技术体系。

LLaMA-Factory 是一款基于 Python 的低代码大模型微调框架,支持多种主流模型与高效微调算法。它提供 Web UI 和命令行接口,涵盖预训练、指令微调及强化学习等任务。通过集成 LoRA、QLoRA 等技术,显著降低显存消耗并提升训练效率。详细介绍其安装配置、参数设置、训练流程及推理部署方法,帮助用户快速上手大模型定制开发。

2024 年人工智能 PC 行业的核心发展趋势及消费者洞察。重点探讨了本地算力集成、端侧大模型部署、操作系统深度整合以及隐私安全保护等关键议题。随着 NPU 技术的普及和生成式 AI 的落地,PC 正从传统计算设备向智能终端转变。文章还评估了消费者对 AI 功能的接受度及付费意愿,为行业参与者提供决策参考。

大语言模型(LLM)基于神经网络构建,通过数字输入输出实现语言生成。文章从基础加法和乘法出发,解释神经元、权重、前向传播及梯度下降训练过程。核心内容包括嵌入向量、子词分词器、自注意力机制、Softmax 函数、残差连接与层归一化等组件。最终阐述 GPT 架构与 Transformer 编码器 - 解码器结构,展示如何利用矩阵运算和位置编码处理序列数据,无需高…

大模型应用开发的核心技术,涵盖提示工程设计、模型微调全流程及插件应用。内容包含提示词的角色设定、上下文构建、思维链推理及少样本学习策略;详细阐述了微调的数据准备、API 调用、监控及使用步骤,并结合法律分析、代码审查等案例说明应用场景;此外还补充了 RAG 架构对比及安全伦理考量,旨在帮助开发者掌握构建高质量智能应用的关键方法。

如何将 6DRepNet 头部姿态评估模型转换为 ONNX 格式,并通过 ONNX Runtime 在 Python 环境中进行推理。内容涵盖模型加载、图像预处理(OpenCV)、推理执行以及利用 AutoGen 将模型封装为工具函数集成到大语言模型 Agent 中。通过实际代码示例,展示了从读取图片到获取 Yaw、Pitch、Roll 角度的完整流程,帮助…

从零开始微调大模型的完整流程。基于阿里魔搭社区环境和 LLaMA-Factory 框架,使用 Yi-1.5-6B 开源模型进行实操。内容涵盖环境准备、依赖安装、模型下载、配置文件详解、训练执行及推理测试。重点解析了 LoRA 微调的核心参数含义,如量化位、学习率、批次大小等,并补充了显存不足、训练不收敛等常见问题的解决方案。通过,读者可掌握微调的基本方法,实…

本路线图涵盖从基础理论到工程落地的完整 AI 大模型学习路径。内容包括 Transformer 架构原理、主流开源模型(Llama、Qwen 等)分析、微调技术(SFT、LoRA、RLHF)、推理加速框架及多模态应用开发。旨在帮助开发者建立扎实的深度学习基础,掌握大模型预训练、对齐与部署的核心技能,并结合行业思考探讨技术壁垒与职业发展方向。

DeepSeek-R1 展示了仅通过强化学习(RL)即可激发大模型产生长思维链(Long CoT)和反思能力,无需监督微调(SFT)作为前置条件。文章对比了 DeepSeek-R1-Zero 与正式版 R1 的训练流程。R1-Zero 验证了基于规则的奖励模型配合 Base 模型进行 RL 的有效性。正式版 R1 则采用冷启动数据 SFT 初始化,结合多阶段…