
2019 人工智能发展报告发布,涵盖 13 个子领域与人才分析
2019 中国人工智能产业年会发布《2019 人工智能发展报告》,由清华大学与中国人工智能学会联合发布。报告涵盖机器学习、计算机视觉等 13 个 AI 子领域,重点分析了深度学习技术脉络及全球人才分布。依托 AMiner 平台数据,提供专家画像与合作情况统计,为产业发展与国家战略决策提供参考。
博客作者
日系少女
342
已发布文章
13K
博客获赞
669K
博客浏览
第 16 页

2019 中国人工智能产业年会发布《2019 人工智能发展报告》,由清华大学与中国人工智能学会联合发布。报告涵盖机器学习、计算机视觉等 13 个 AI 子领域,重点分析了深度学习技术脉络及全球人才分布。依托 AMiner 平台数据,提供专家画像与合作情况统计,为产业发展与国家战略决策提供参考。

OpenAI 发布 Shap·E 模型实现 3D 资产快速生成,Prompt Diffusion 为扩散模型增加上下文学习能力,ChartSpark 实现文本到图表可视化,Pick-a-Pic 构建用户偏好数据集。企业方面,OpenAI 亏损 5.4 亿美元,new Bing 全面开放,微软计划推出专用云 ChatGPT,Runway 融资估值达 15 亿美…

Jupyter Notebook 是一个支持多种科学计算语言的多功能平台,能够整合代码、输出、文档及多媒体资源。它通过 Cell 概念实现交互式编程,允许开发者运行局部代码块并即时查看结果,显著提升实验效率。Jupyter 广泛应用于教育领域,如顶尖大学的计算机课程,以及在工业界处理中小型程序。其云端化趋势使得无需本地安装即可在浏览器中重现机器学习与统计模型…

本周大模型研究涵盖多模态 RAG 系统配置优化、推理时对齐算法 Speculative Rejection、智源 OmniGen 扩散模型架构、Salesforce BLIP-3-Video 视频理解模型、CMU Pangea 多语言多模态模型、斯坦福上下文扩展定律、RAG 推理加速 Block-Attention、AgentStore 可扩展 Agent…

网络安全行业受新基建推动及国家战略影响,未来需求持续增长。薪资高于预期,人才缺口大。转行需注重实战能力,区分安全与运维、渗透测试的区别。自学难度大,建议选择专业机构或系统学习路线,掌握核心知识体系以应对行业挑战。

梳理了网络安全入门的常见问题及学习路线,涵盖基础阶段(法律、Linux、网络、语言)、渗透阶段(SQL 注入、XSS 等漏洞原理与防御)、安全管理(等级保护、应急响应)、逆向免杀及编程进阶。推荐掌握 Burp、Nmap 等工具,阅读《白帽子讲 Web 安全》等书籍。强调系统学习比碎片化收集资料更高效,建议坚持实战练习并获取授权进行渗透测试。

国家信息安全水平考试(NISP)由中国信息安全测评中心实施,分为一级、二级、三级证书。NISP 一级侧重信息安全意识普及,适合在校学生;二级侧重专业技术与 CISP 衔接,适合有一定经验的从业者;三级为高端专项。证书具有提高安全意识、增加就业机会、高校学分置换、CISP 免试换领等价值,是进入网络安全领域的有效凭证。

Python 3.9的安装过程,包括从官网下载、安装步骤、环境变量配置以及如何在命令行中运行Python。同时涵盖了使用PyCharm作为开发工具的安装与配置,并介绍了pip工具的使用方法,包括安装第三方库如Selenium及配置ChromeDriver以支持浏览器自动化操作。

Python 数据可视化包含确定问题选择图形、转换数据应用函数、参数设置三个核心步骤。常用库有 Matplotlib、Seaborn、Bokeh 等。Matplotlib 提供底层绘图能力,需配置 Figure、Subplot 及样式参数。Pandas 封装了基于 Matplotlib 的高级接口,简化 Series 和 DataFrame 的绘图流程。数据…

WPScan 漏洞扫描工具的安装配置、API Token 获取、常用命令选项及实战技巧。内容涵盖 WordPress 安全背景、工具原理、枚举策略、暴力破解方法及进阶配置。文章提供了具体的命令行示例,包括用户枚举、插件检测、主题扫描及输出格式设置。同时补充了常见问题排查、WAF 绕过策略及法律合规声明,旨在为安全研究人员提供全面的技术参考。

国外主流的网络安全与黑客技术论坛及新闻资源。涵盖 GreySec、Hack Forums、0x00sec 等讨论社区,以及 Threatpost、The Hacker News 等资讯平台。内容涉及漏洞分析、恶意软件研究、逆向工程及行业情报。旨在为安全研究人员提供信息获取渠道,同时强调合法合规使用的重要性。

探讨了 AI 技术对劳动力市场的影响,分析了 1639 种职业的替代风险,指出年龄与替代率的相关性。介绍了程序员开展副业的精益方法,包括核心资源识别、时间片管理及资产构建。阐述了一人企业方法论,帮助个体从螺丝钉成长为超级个体。讨论了 AI 产品经理的稀缺性及团队组建策略,分析了创新者窘境在 AIGC 领域的适用性。最后详细解读了大模型高效训练的 10 条黄金…

记录了从零预训练 1B 参数中文大语言模型 Steel-LLM 的全过程。涵盖数据收集清洗、训练框架优化、模型结构改进(Soft MoE、SENet)、分布式训练策略及微调评估。重点分享了工程实践中的显存优化、算子融合技巧、数据恢复机制及硬件受限下的解决方案。最终模型在 C-Eval 和 CMMLU 基准测试中取得了优于同类早期模型的成绩,为资源受限场景下的…

AI 大模型行业正处于快速发展期,涵盖基础设施、模型及应用三层产业链。行业现状、挑战及国内外公司布局,探讨了智能客服、代码辅助等应用场景。同时提供了从系统设计、提示词工程到微调开发的七阶段学习路径,涵盖 LangChain、RAG 技术及多模态应用,旨在帮助开发者掌握大模型全栈技能并应对实际项目需求。

使用 Text Generation WebUI 对大语言模型进行 LoRA 微调的完整流程。内容包括 LoRA 原理、环境搭建、Alpaca 格式数据集准备、训练参数配置及推理验证步骤。文章提供了具体的代码示例和常见故障排查方案,旨在帮助开发者以低成本实现大模型的垂直领域定制。

GPT-4o 是 OpenAI 发布的最新全能型 AI 模型,命名中的 o 代表 Omni。其核心突破在于实现了文本、音频和图像的统一处理,响应速度达到毫秒级,接近人类对话水平。文章详细解析了 GPT-4o 的技术架构、性能指标及在实时翻译、客户服务、教育辅导等领域的实际应用。同时探讨了免费开放策略对行业的影响,以及面临的算力成本和安全伦理挑战,为开发者提供…

大语言模型的基础原理、提示工程技术、应用开发方法及高级场景。涵盖 Transformer 架构、Tokenization、零样本与少样本提示、思维链推理、API 调用与 LangChain 框架、检索增强生成(RAG)、模型微调(LoRA)及自主 Agent 系统。文章还讨论了模型安全与伦理问题,并展望了多模态与 AIOS 生态的未来趋势,旨在帮助开发者掌握…

大模型(LLM)在企业中的应用涵盖九大核心场景,包括替代自建 ML 模型、整合分散数据、构建聊天界面、增强搜索体验、实现客户自助服务、定制化沟通、加速应用开发、生成代码整合后端系统。文章详细阐述了各场景的技术实现路径,如 RAG 架构、Agent 代理模式及函数调用机制,并指出了幻觉、数据安全、成本延迟等关键挑战,为企业提供了从评估到落地的实施建议。

详细阐述从零构建并训练 BERT 架构大模型的完整流程。内容涵盖使用 Hugging Face tokenizers 库定制 WordPiece 分词器,配置 BertLMHeadModel 模型结构,利用文本语料进行预训练,以及完成后的推理测试。通过完整代码示例展示从环境准备、分词器保存、模型加载到训练参数设置的全过程,深入解析分词步骤、模型配置及训练策略…

Prompt 提示工程的基础原理与实践方法。首先阐述了 Prompt 工程的概念,即通过精细调整 AI 输入以获得符合需求的输出。接着分析了 Prompt 的主要类型,包括问题式、陈述式、指令式及情感传入式,并探讨了 Prompt 工程师的职责与所需技能。文章重点讲解了零样本、少样本、思维链、模板式等核心提示技术,并提供了具体示例。此外,还总结了进阶技巧如明…