AI Practices AI实践

5d ago 5天前

Multi-agent social intelligence with Strands Agents and Amazon Bedrock 使用 Strands Agents 和 Amazon Bedrock 实现多智能体社交智能

Thrad.ai utilizes a multi-agent system combining Strands Agents and Amazon Bedrock AgentCore to automate social intelligence and lead generation at sc... Thrad.ai利用多智能体系统自动化跨平台社交信号追踪,解决手动线索研究扩展性差的问题。 架构包含四个专用智能体:趋势研究、搜索专家、分析和邮件生成,通过Amazon Bedrock AgentCore编排。 采用Swarm和Graph两种编排模式进行基准测试,对比延迟、成本和邮件质量。 使用加权...

Hot 热度
65
Quality 质量
70
Impact 影响力
60
Agent Agent LLM 大模型
5d ago 5天前

Lessons From the Leaderboard: What 5,000+ Kagglers Taught Us About Improving AI Reasoning 来自排行榜的教训:5000多名Kaggle选手关于提升AI推理能力的启示

The NVIDIA Nemotron Model Reasoning Challenge demonstrated that improving AI reasoning relies heavily on engineering workflows rather than just model ... NVIDIA Nemotron Model Reasoning Challenge 汇聚5000+参与者,通过统一开源模型与基础设施,验证了工作流工程对提升AI推理能力的关键作用。 顶级方案的核心在于将推理视为完整工程流程,重点优化可验证的思维链数据、压缩推理痕迹以适配Token预算,以及分离通用知...

Hot 热度
72
Quality 质量
78
Impact 影响力
75
LLM 大模型 Open Source 开源 Fine-tuning 微调 Evaluation 评测 Benchmark 基准测试
5d ago 5天前

Accelerating software delivery with agentic QA automation using Amazon Nova Act – Part 2 使用 Amazon Nova Act 加速软件交付的代理式 QA 自动化 - 第 2 部分

QA Studio extends agentic QA automation from individual test cases to organized, parallelized regression test suites using Amazon Nova Act. Test suite... 介绍QA Studio的批量回归测试能力,支持将用例组织为套件并并行执行以缩短测试时间。 利用AWS Fargate容器任务独立运行每个用例,实现测试套件的高并发处理。 提供QA Studio CLI工具,使AI驱动的质量保证能够无缝集成到CI/CD流水线中。 支持OAuth 2.0无交互认证及环境...

Hot 热度
65
Quality 质量
70
Impact 影响力
60
Agent Agent LLM 大模型 Deployment 部署
5d ago 5天前

Scaling UX testing with Amazon Nova Act: A new approach to user flow analysis 使用 Amazon Nova Act 扩展 UX 测试:用户流分析的新方法

Amazon Nova Act introduces a multimodal foundation model capable of understanding and interacting with web interfaces via visual input, enabling human... 亚马逊推出Nova Act多模态基础模型,通过视觉理解与交互能力解决传统UX测试难以扩展的问题。 该方案利用Claude 4.5 Sonnet从非结构化文档自动生成测试场景,并结合Nova Act进行智能导航测试。 整体架构基于AWS服务(Bedrock, Lambda, ECS/Fargate),...

Hot 热度
65
Quality 质量
70
Impact 影响力
60
Closed Source 闭源 Multimodal 多模态 Product Launch 产品发布
5d ago 5天前

Scaling medical content review at Flo Health with Amazon Bedrock – Part 2 使用 Amazon Bedrock 扩展 Flo Health 的医疗内容审查 - 第二部分

Flo Health transformed a proof-of-concept into a production-grade medical content review system using Amazon Bedrock, reducing review time by 60% and ... Flo Health基于Amazon Bedrock构建了生产级医疗内容审查系统,将审查时间减少60%,内容吞吐量提升三倍,且未增加医疗团队规模。 采用三层验证机制:内部指南合规性检查、外部可信医学来源验证、以及专家在简化界面中的最终审核,有效降低幻觉风险。 引入“AI法官”(AI Judges)架...

Hot 热度
65
Quality 质量
75
Impact 影响力
70
Healthcare AI 医疗AI LLM 大模型 Deployment 部署
5d ago 5天前

ScienceSoft’s HIPAA-compliant AI voice scheduler built on AWS ScienceSoft基于AWS构建的HIPAA合规AI语音调度器

ScienceSoft developed a HIPAA-compliant AI voice scheduler using Amazon Nova Sonic for natural conversation and Amazon Bedrock Guardrails for safety a... ScienceSoft利用Amazon Nova Sonic和Bedrock Guardrails构建了符合HIPAA标准的AI语音调度系统,解决医疗预约痛点。 传统人工调度存在耗时长、扩展性差及成本高问题,AI方案可显著提升效率并降低运营负担。 架构基于AWS VPC,集成Chime SDK、Li...

Hot 热度
65
Quality 质量
70
Impact 影响力
60
Conversational AI 对话系统 Speech 语音 Healthcare AI 医疗AI Security 安全 Deployment 部署
5d ago 5天前

How to Run an Autoresearch Workflow with RL Agent Skills and NVIDIA NeMo 如何使用RL Agent技能和NVIDIA NeMo运行自动研究工作流程

Autonomous coding agents like Codex with GPT 5.5 can fully automate reinforcement learning research workflows, including environment setup, experiment... 展示了利用Codex (GPT 5.5) 结合NVIDIA NeMo RL和NeMo Gym实现端到端自动化强化学习研究工作的完整流程。 引入三种专用Agent技能(Brev-etiquette、Session-memory、Autoresearch)以解决长周期实验中的状态持久性、环境规范及可复现...

Hot 热度
65
Quality 质量
70
Impact 影响力
68
Agent Agent GPU GPU Research 科学研究 Training 训练
5d ago 5天前

Post-Train NVIDIA Cosmos 3 in One Day Using Agent Skills 一天内使用Agent技能对NVIDIA Cosmos 3进行后训练

NVIDIA Cosmos 3 Nano achieves a dramatic accuracy increase from 54.41% to 93.35% on the Woven Traffic Safety dataset using automated post-training. Th... NVIDIA Cosmos 3 Nano结合TAO Agent Skills与LoRA技术,实现了视频问答任务的自动化后训练,准确率从54.41%提升至93.35%。 采用混合Transformer(MoT)架构,分离推理与生成路径,并通过AutoML自动搜索超参数,将多日工程工作压缩至一天内完成。...

Hot 热度
65
Quality 质量
70
Impact 影响力
72
Multimodal 多模态 Fine-tuning 微调 Agent Agent Video Generation 视频生成 Training 训练
5d ago 5天前

DSLs Enable Reliable Use of LLMs 领域特定语言使LLM的可靠使用成为可能

Domain-Specific Languages (DSLs) provide necessary constraints that guide Large Language Models (LLMs) to generate precise, intended code, reducing am... 提出利用领域特定语言(DSL)作为LLM生成代码的“强约束框架”,以解决自然语言意图与具体实现之间的偏差问题。 强调设计是通过实现过程逐步发现的,LLM在初期充当探索抽象和词汇的“头脑风暴伙伴”,后期则作为DSL的自然语言接口。 指出DSL通过限制表达空间显著提高了LLM生成的可靠性,且易于通过少量...

Hot 热度
65
Quality 质量
75
Impact 影响力
70
LLM 大模型 Code Generation 代码生成 Programming 编程
6d ago 6天前

OpenAI GPT-5.6 Sol, Terra, and Luna are now generally available on Amazon Bedrock OpenAI GPT-5.6 Sol、Terra 和 Luna 现已在 Amazon Bedrock 上全面可用

OpenAI's GPT-5.6 model family (Sol, Terra, Luna) is now generally available on Amazon Bedrock, introducing a new tiered naming convention based on cap... OpenAI GPT-5.6系列模型(Sol、Terra、Luna)已在Amazon Bedrock正式全面可用,采用新一代推理引擎以支持高并发与低延迟场景。 GPT-5.6 Sol作为旗舰推理模型,在编码代理指数、网络安全基准及长流程工作流评估中创下新纪录,且成本显著低于前代。 引入分层命名体系,...

Hot 热度
75
Quality 质量
65
Impact 影响力
70
GPT GPT LLM 大模型 Product Launch 产品发布 Deployment 部署 Inference 推理
6d ago 6天前

NVIDIA Ising Decoding Cuts Color Code Logical Error Rates by Over 300X NVIDIA Ising解码将颜色码逻辑错误率降低超过300倍

NVIDIA's Ising Decoder ColorCode 1 Fast achieves a 347.7x improvement in logical error rate (LER) and 7.3x faster runtime compared to the state-of-the... NVIDIA发布Ising Decoder ColorCode 1 Fast,在物理错误率0.3%、距离d=31时,逻辑错误率(LER)比Chromobius降低347.7倍,运行速度快7.3倍。 该方案利用3D卷积神经网络(CNN)作为预解码器处理三角色码的局部错误综合征,实现了可扩展、低延迟且高...

Hot 热度
75
Quality 质量
80
Impact 影响力
85
Research 科学研究 GPU GPU Chip 芯片
6d ago 6天前

When your brain works differently, AI isn’t a luxury—it’s accessibility 当你的大脑运作方式不同时,AI不是奢侈品——它是无障碍工具

AI serves as a critical accessibility tool for neurodivergent professionals, specifically compensating for executive function gaps associated with AuD... 文章提出AI不仅是生产力工具,更是神经多样性人群(如AuDHD)的关键无障碍辅助手段,用于补偿执行功能缺陷。 作者构建了基于Amazon Quick桌面应用和Bedrock推理引擎的自动化工作流,通过MCP服务器连接Outlook、日历和Asana。 系统核心在于“自我维护”机制,将邮件分类、优先级...

Hot 热度
60
Quality 质量
65
Impact 影响力
55
LLM 大模型 Conversational AI 对话系统 Productivity Productivity