标签聚合

提示词工程

提示词工程 领域的最新 AI 动态与独家辣评,共 43

ProductHunt

Taku AI:一键借用最佳AI配置

  • Taku AI允许用户借鉴他人调优好的AI设置
  • 把成熟的提示词与工作流变成可复用模板
  • 降低普通用户用好AI的门槛
16 天前访问原文链接
HackerNews

Claude 正式公开系统提示词机制

  • Claude 平台在发布说明中新增「System Prompts」专题,正式文档化系统提示词用法
  • 系统提示词用于设定模型角色、边界与行为规范,是控制 Claude 输出的关键入口
  • 开发者可通过结构化提示词提升输出稳定性,减少幻觉与越界(基于标题摘要推断)
17 天前访问原文链接
HackerNews

怀疑法庭用 AI,当事人注入提示词搏胜诉

  • 一名当事人怀疑法庭使用 AI 处理文件,便在提交材料中植入隐藏提示词
  • 试图借此影响案件结果,把提示词注入从安全研究带入真实诉讼
  • 再度暴露 AI 进入司法流程后缺乏透明度的隐患
19 天前访问原文链接
HackerNews

官方指南:榨干 Claude Code 会话价值

  • Anthropic 发布官方博客,系统讲解如何最大化 Claude Code 会话价值
  • 涵盖上下文组织、任务拆解与工作流编排等实操技巧
  • 标志着 AI 编程工具的使用方法论正被产品官方体系化
19 天前访问原文链接
HackerNews

ThoughtDAG:可视化编辑 LLM 对话上下文

  • ThoughtDAG 是面向 LLM 对话的可编辑上下文图谱,用节点图管理对话脉络
  • 支持对上下文进行增删改与重组,解决长对话记忆混乱、难以复用的问题
  • 以可视化方式呈现 agent 的推理路径,便于调试与回溯
19 天前访问原文链接
HackerNews

同一提示词喂 11 个模型,结果差异惊人

  • Netlify 用同一提示词分别测试 11 个大模型,输出结果差异显著
  • 揭示不同模型在代码生成、推理、风格上的鲜明差异
  • 提示开发者选型需结合实际任务而非单一基准分
20 天前访问原文链接
ProductHunt

Prompt Bridge:让AI上下文随处可携

  • Prompt Bridge提供跨平台AI上下文管理方案
  • 帮助用户在不同AI工具间迁移和管理提示词上下文
  • 解决多AI工具使用中上下文断裂的痛点
27 天前访问原文链接
HackerNews

Zero-Mem:LLM Agent 零令牌内存操作新范式

  • 论文提出 Zero-Mem 方法,实现 LLM Agent 无需消耗 token 即可进行内存读写操作
  • 通过外部内存模块绕过上下文窗口限制,显著降低 Agent 推理成本
  • 实验表明该方法在长程任务中可减少 40% 以上的 token 消耗
29 天前访问原文链接
HackerNews

揭秘Dario and Amanda提示词:Claude的隐藏人格开关

  • 文章深入分析了在 Claude 模型中引发特殊行为的Dario and Amanda系统提示词
  • 该提示词被发现可以触发 Claude 的特定人格模式,展现出不同于默认状态的回答风格
  • 研究引发了对 AI 模型内部人格机制和提示词注入安全性的讨论
1 个月前访问原文链接
HackerNews

别再让LLM给自己打置信度分数了

  • 文章论证LLM输出的'置信度分数'本质上不可靠,缺乏统计学基础
  • LLM没有内省能力,其自我评估容易产生系统性偏差
  • 建议使用外部验证框架或多次采样交叉比对来替代自评分
1 个月前访问原文链接
HackerNews

Claude 5 时代:上下文工程新规发布

  • Anthropic 发布 Claude 5 系列模型的上下文工程最佳实践指南
  • 新规涵盖 prompt 设计、上下文窗口管理、多轮对话策略等核心方向
  • 强调结构化上下文注入可大幅提升长文档推理和代码生成质量
1 个月前访问原文链接
HackerNews

Anthropic发布Claude Cookbook官方示例集

  • Anthropic正式上线Claude Cookbook,提供涵盖提示工程、工具调用、RAG等场景的官方代码示例
  • Cookbook覆盖多种编程语言和框架,帮助开发者快速上手Claude API的高级功能
  • 包含多模态处理、长文本分析、Agent编排等前沿用例的最佳实践
1 个月前访问原文链接
ProductHunt

AGINE Academy:用游戏学Claude的叙事驱动教程

  • AGINE Academy是一款通过故事驱动游戏学习Claude使用的教育产品
  • 玩家在游戏中通过完成任务逐步掌握Claude的提示词技巧和API使用
  • 将枯燥的AI学习转化为沉浸式游戏体验
1 个月前访问原文链接
HackerNews

Fable 5 与 GPT-5.6 对决 NP-Hard 问题:/goal 命令有何奇效

  • 实测对比 Fable 5 和 GPT-5.6 在 NP-Hard 问题求解上的表现
  • 重点测试 /goal 命令对模型推理能力的提升效果
  • 结果显示特定提示策略能显著改善复杂问题求解质量
1 个月前访问原文链接
HackerNews

GPT-5.6 凭一条提示词攻克 30 年凸优化难题

  • GPT-5.6 通过精心设计的提示词解决了凸优化领域长达 30 年的开放问题
  • Reddit r/math 社区热议这一突破,该帖获 569 高票
  • 延续了 OpenAI 此前用 AI 辅助数学定理证明的探索方向
1 个月前访问原文链接
HackerNews

Gwern提出「守护天使」概念:LLM个性化助力生产力与安全

  • 知名研究者Gwern发布长文,提出用个性化LLM作为「守护天使」,实时辅助用户提升工作效率并防范安全风险
  • 系统可根据用户的长期行为模式进行深度个性化适配,在需要时主动介入
  • 文章探讨了LLM在个人安全、信息过滤、决策辅助等方面的具体应用场景
1 个月前访问原文链接
HackerNews

如何阻止Claude说出「承重墙」废话:开发者实战指南

  • Claude在代码生成中频繁出现「load-bearing」等AI惯用废话模式,影响代码可读性
  • 开发者通过自定义系统提示词和上下文工程,成功将Claude的输出噪音降低至接近零
  • 该方法适用于所有LLM代码助手,可提升AI辅助编程的工程实用价值
1 个月前访问原文链接
HackerNews

Lucid:可视化 AI 思考过程的 Web 工具

  • 开发者构建了一款 Web 工具 Lucid,可实时查看和编辑 AI 模型的内部推理过程
  • 用户可以在 AI 输出最终答案前干预其思考方向
  • 提供了一种全新的 AI 交互范式
1 个月前访问原文链接
HackerNews

开源工具 Subtext:可视化 LLM 推理思维过程

  • Subtext 是一个开源项目,可实时可视化 LLM 的推理链
  • 帮助开发者理解模型在生成答案时的中间思考步骤
  • 支持多种主流模型的思维链可视化
1 个月前访问原文链接
HackerNews

并非所有任务都需要 token:确定性 AI 的价值被严重低估

  • 文章指出很多场景下确定性规则比 LLM 推理更高效且成本更低
  • 过度依赖 LLM 会导致不必要的 token 消耗和不可预测的输出
  • 提出混合架构:LLM 处理模糊任务,确定性逻辑处理结构化任务
1 个月前访问原文链接
HackerNews

RAG 上下文裁剪新思路:只保留答案真正需要的部分

  • Kapa.ai 团队提出新的 RAG 上下文裁剪策略,精确剪除无关信息
  • 方法基于答案回溯分析,仅保留对最终回答有贡献的文档片段
  • 相比传统方法可减少 50% 以上的 token 消耗
1 个月前访问原文链接
HackerNews

「短绳法」:一种击败Fable的AI编程新策略

  • 开发者提出「短绳法」AI编程策略,通过精细控制AI代码生成范围来提升质量
  • 该方法在与Anthropic的Fable基准测试对比中表现出色,展示了人机协作新范式
  • 核心思想是让AI每次只处理小块代码,而非放任其生成大量可能出错的内容
2 个月前访问原文链接
HackerNews

GLM-5.2代码审查效果取决于提示词质量

  • 实测表明GLM-5.2的代码审查能力高度依赖提示词工程
  • 精心设计的prompt可显著提升代码审查准确率和问题发现率
  • 默认提示词下表现一般,需要针对具体场景调优
2 个月前访问原文链接
HackerNews

HN 热议:你用什么工具做 AI 辅助代码审查?

  • HN 社区热烈讨论 AI 代码审查工具的选择与实践
  • 涉及 CodeRabbit、Cursor、GitHub Copilot Review 等主流方案
  • 开发者分享 AI review 的优缺点及最佳实践
2 个月前访问原文链接
HackerNews

AI时代需要更多工程纪律,而非更少

  • 作者认为AI辅助编程不应降低工程标准
  • 反而需要更严格的测试、代码审查和架构设计
  • 否则AI生成代码将导致技术债务指数级增长
2 个月前访问原文链接
ProductHunt

Deep Work Plan:给Agent一份好计划,比大模型更重要

  • 强调上下文和任务规划对AI Agent的重要性超过模型能力
  • 提供结构化的Agent任务规划和执行框架
  • 适用于复杂多步骤工作流的编排
2 个月前访问原文链接
HackerNews

AI即代码:不可能靠Prompt让它变聪明

  • The Register评论:AI本质是确定性的代码执行
  • 无论多精妙的prompt都无法超越模型固有能力上限
  • 批评过度神化prompt engineering的行业风气
  • HN热度140分,引发对AI能力边界的理性讨论
2 个月前访问原文链接
HackerNews

如何减少 AI 生成前端代码的「粗糙感」

  • 作者分享用 AI 写前端时减少代码杂乱的实战技巧
  • 强调 prompt 工程+人工审查的必要性
  • HN 评分 198,高共鸣度
2 个月前访问原文链接
HackerNews

别让LLM说话,直接探测它的隐藏状态

  • 提出通过探测LLM隐藏层状态来替代自然语言交互
  • 隐藏状态探针可直接读取模型"想法",无需依赖生成输出
  • 为AI可解释性和安全性研究开辟新路径
2 个月前访问原文链接
ProductHunt

Minimi:为 Claude 打造的「环境记忆」工具

  • 为 Claude 提供持久化上下文记忆能力
  • 自动记录对话关键节点,跨会话保持上下文
  • 解决「每次都要重新解释」的痛点
2 个月前访问原文链接
ProductHunt

Agent Browser Shield:阻止提示注入 + 削减 Token 成本

  • 专为 AI 浏览器 Agent 设计的安全防护工具
  • 实时检测并阻止 prompt injection 攻击
  • 同时通过智能缓存削减 Token 消耗
2 个月前访问原文链接
HackerNews

HN热议:你的AI开发技术栈和工作流是什么?

  • Hacker News用户分享各自AI辅助开发工具链和完整工作流
  • 讨论覆盖编码助手、架构设计、代码审查到部署全流程
  • 社区实践呈现Cursor+Copilot+Claude三位一体新标配
  • 独立开发者分享一人借助AI完成全栈开发的最佳实践
2 个月前访问原文链接
HackerNews

Lowfat:一个帮你省91.8% LLM Token的CLI过滤工具

  • Lowfat 是一款可插拔的 CLI 过滤工具,能在大幅减少 LLM 输入 token 的同时保留关键信息
  • 实测节省了 91.8% 的 token 消耗,直接降低 API 调用成本
  • 开源可定制,适用于日常命令行工作流
3 个月前访问原文链接
HackerNews

Mnemo:本地优先的LLM通用记忆层(Rust+SQLite实现)

  • 开源项目Mnemo为任意LLM提供本地记忆层,基于Rust+SQLite+petgraph图数据库
  • 支持本地优先架构,无需云端存储敏感对话数据
3 个月前访问原文链接
ProductHunt

Second Brain for AI: 为Claude/ChatGPT/Cursor提供持久记忆

  • 免费工具, 为Claude、ChatGPT、Cursor提供持久记忆
  • 基于Cloudflare构建, 零成本边缘部署
  • 解决AI对话上下文丢失的核心痛点
3 个月前访问原文链接
ProductHunt

PromptLayer:AI请求全链路追踪与成本管理平台

  • PromptLayer提供AI请求的统一时间线视图
  • 追踪每次LLM调用的workflow、延迟和费用
  • 帮助团队优化prompt质量和API预算
3 个月前访问原文链接
HackerNews

LLM代码异味大全:大模型时代的反模式图谱

  • 系统总结LLM应用中常见的"代码异味"和反模式
  • 包括prompt注入、幻觉处理不当、成本失控等
  • 提供实用的检测方法和修复建议
3 个月前访问原文链接
HackerNews

Claude Code深度配置指南:官方文档没告诉你的隐藏选项

  • 逆向分析Claude Code源码发现大量隐藏配置项
  • 涵盖prompt定制、工具链优化、权限控制等进阶用法
  • 帮助开发者榨干Claude Code全部潜力
3 个月前访问原文链接
HackerNews

研究显示提示词礼貌程度影响LLM准确率

  • 学术论文系统研究prompt中的礼貌用语对LLM输出的影响
  • 发现请和谢谢等措辞确实会改变模型回答质量
  • 不同模型对礼貌的敏感度差异显著
  • 对提示词工程实践有重要参考价值
3 个月前访问原文链接
TheVerge_AI

黑客正在学习利用聊天机器人“人格”发起攻击

  • 新型攻击方式针对聊天机器人的“个性设定”进行操纵
  • 通过角色扮演和情感引导绕过 AI 安全护栏
  • 暴露了当前 AI 安全机制的人性化漏洞
3 个月前访问原文链接
HackerNews

CPPL:电路提示编程语言

  • 论文提出 Circuit Prompt Programming Language (CPPL)
  • 用电路逻辑的形式化语言编写 LLM 提示词
  • 旨在解决复杂推理任务中提示词不可靠的问题
3 个月前访问原文链接
HackerNews

用 AI 写更慢但更好的代码

  • Nolan Lawson 实测用 AI 辅助编程的体验
  • 发现放慢速度使用 AI 反而能写出更高质量的代码
  • AI 在架构设计、代码审查方面帮助更大,而非快速生成
3 个月前访问原文链接
Hacker News

AI生成的"文字墙"正在污染人际对话

  • 探讨人们将AI生成的冗长文本直接倾倒入聊天和社交对话中的现象
  • 这种行为降低沟通效率,破坏人际交流的真实性与温度
  • 呼吁在使用AI辅助表达时保持人类判断和适度原则
3 个月前访问原文链接